{"as_of":"2026-08-10T09:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:73b64926cecc09b69ae15ea3bf5f60da1797ac8f676e5d18184497840dd2e770","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:50:29.507664Z","state":"measured"},{"denominator":77,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":77,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T19:27:35.889180Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"cited_work":{"arxiv_id":"2505.23387","doi":"10.48550/arxiv.2505.23387","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23387","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Afterburner: Reinforcement learning facilitates self-improving code efficiency optimization","venue":"ArXiv.org","work_id":"b81128dc-02bc-4c4e-af89-0bb8b68a4a84","year":2025},"citing_paper":{"arxiv_id":"2509.08827","last_updated":"2025-10-09T17:08:52Z","snapshot_observed_at":"2026-08-06T15:38:05.011922Z","submitted_at":"2025-09-10T17:59:43Z","title":"A Survey of Reinforcement Learning for Large Reasoning Models","version":3},"reference_index":119,"source":"arxiv_source","source_observed_at":"2026-05-18T00:02:24.352947Z"},"links":{"cited_paper":"/paper/2505.23387","citing_paper":"/paper/2509.08827"},"observation_digest":"sha256:28e866f424bc8d1be8cf42a17f597c92ab2b61fc0f40b0b2b33199768ce75c57","observation_id":"d24ad08c-0077-4fc8-bcb5-6bd98235db2a","resolution":{"observed_at":"2026-05-18T00:02:25.299885Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23387","snapshot_observed_at":"2026-08-02T19:27:35.889180Z","title":"Du, M., Tuan, L","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.02510","last_updated":"2026-07-06T09:08:30Z","snapshot_observed_at":"2026-08-09T04:48:05.325558Z","submitted_at":"2026-03-03T01:41:07Z","title":"ParEVO: Synthesizing Code for Irregular Data: High-Performance Parallelism through Agentic Evolution","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T19:27:35.889180Z"},"links":{"cited_paper":"/paper/2505.23387","citing_paper":"/paper/2603.02510"},"observation_digest":"sha256:7b87ca321f563cf413ff672f61a82ecb79a97db5ac23339193f2c740a5d580dc","observation_id":"63ce1b29-3b42-47d7-9ac3-da77138d62bc","resolution":{"observed_at":"2026-08-02T19:27:35.889180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"cited_work":{"arxiv_id":"2505.23387","doi":"10.48550/arxiv.2505.23387","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23387","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Afterburner: Reinforcement learning facilitates self-improving code efficiency optimization","venue":"ArXiv.org","work_id":"b81128dc-02bc-4c4e-af89-0bb8b68a4a84","year":2025},"citing_paper":{"arxiv_id":"2604.02352","last_updated":"2026-03-03T12:36:15Z","snapshot_observed_at":"2026-08-08T03:59:10.266884Z","submitted_at":"2026-03-03T12:36:15Z","title":"An Initial Exploration of Contrastive Prompt Tuning to Generate Energy-Efficient Code","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-15T16:37:16.968173Z"},"links":{"cited_paper":"/paper/2505.23387","citing_paper":"/paper/2604.02352"},"observation_digest":"sha256:12a3f588f2458e3915798e079e0da14cc7683d78593b7cdfc2b69aaf5991cbf1","observation_id":"8091cb00-e0a4-413e-8745-630dca012d56","resolution":{"observed_at":"2026-05-15T16:40:10.533028Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"cited_work":{"arxiv_id":"2505.23387","doi":"10.48550/arxiv.2505.23387","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23387","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Afterburner: Reinforcement learning facilitates self-improving code efficiency optimization","venue":"ArXiv.org","work_id":"b81128dc-02bc-4c4e-af89-0bb8b68a4a84","year":2025},"citing_paper":{"arxiv_id":"2604.04562","last_updated":"2026-04-06T09:45:21Z","snapshot_observed_at":"2026-08-02T06:33:26.544006Z","submitted_at":"2026-04-06T09:45:21Z","title":"Paper Espresso: From Paper Overload to Research Insight","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T19:37:25.753942Z"},"links":{"cited_paper":"/paper/2505.23387","citing_paper":"/paper/2604.04562"},"observation_digest":"sha256:5202b4566892838310411ab320ec5bab07887224d55b32456b267c40d388607b","observation_id":"0ab1904a-5441-4146-b456-9d111cebdfb7","resolution":{"observed_at":"2026-05-10T22:45:47.882211Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"cited_work":{"arxiv_id":"2505.23387","doi":"10.48550/arxiv.2505.23387","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23387","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Afterburner: Reinforcement learning facilitates self-improving code efficiency optimization","venue":"ArXiv.org","work_id":"b81128dc-02bc-4c4e-af89-0bb8b68a4a84","year":2025},"citing_paper":{"arxiv_id":"2605.17978","last_updated":"2026-05-18T07:33:15Z","snapshot_observed_at":"2026-07-06T23:28:55.079333Z","submitted_at":"2026-05-18T07:33:15Z","title":"AutoVecCoder: Teaching LLMs to Generate Explicitly Vectorized Code","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-05-20T11:41:58.923091Z"},"links":{"cited_paper":"/paper/2505.23387","citing_paper":"/paper/2605.17978"},"observation_digest":"sha256:9d60b38ef4726df893ba55ea561137a05f7a52c73bee69e33afc9f3ff0c15628","observation_id":"f1c30b62-e7be-45ca-865c-b5e7fc4d2ce5","resolution":{"observed_at":"2026-05-20T11:43:14.954223Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"cited_work":{"arxiv_id":"2505.23387","doi":"10.48550/arxiv.2505.23387","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23387","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Afterburner: Reinforcement learning facilitates self-improving code efficiency optimization","venue":"ArXiv.org","work_id":"b81128dc-02bc-4c4e-af89-0bb8b68a4a84","year":2025},"citing_paper":{"arxiv_id":"2605.28751","last_updated":"2026-05-27T17:09:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-27T17:09:30Z","title":"Extrapolative Weight Averaging Reveals Correctness-Efficiency Frontiers in Code RL","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-29T14:41:13.191919Z"},"links":{"cited_paper":"/paper/2505.23387","citing_paper":"/paper/2605.28751"},"observation_digest":"sha256:fde66ac536d6fed244d6056a91c4b5cf343713f5c516d4d0bf1a427200f180c9","observation_id":"cf593b53-fee9-4d4c-8b60-9aa8ef710dc3","resolution":{"observed_at":"2026-06-29T14:43:30.585461Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"cited_work":{"arxiv_id":"2505.23387","doi":"10.48550/arxiv.2505.23387","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23387","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Afterburner: Reinforcement learning facilitates self-improving code efficiency optimization","venue":"ArXiv.org","work_id":"b81128dc-02bc-4c4e-af89-0bb8b68a4a84","year":2025},"citing_paper":{"arxiv_id":"2606.06821","last_updated":"2026-06-05T01:49:20Z","snapshot_observed_at":"2026-08-06T19:29:50.731277Z","submitted_at":"2026-06-05T01:49:20Z","title":"Chiseling Out Efficiency: Structured Skeleton Supervision for Efficient Code Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-27T21:43:14.839335Z"},"links":{"cited_paper":"/paper/2505.23387","citing_paper":"/paper/2606.06821"},"observation_digest":"sha256:afcb773dbd85c90424b811769b006a521abfa2fae4831bfef43d48578b1d71d6","observation_id":"929a6b79-6e5d-4392-9ea1-d87fc9f941b7","resolution":{"observed_at":"2026-07-02T18:57:17.261414Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"cited_work":{"arxiv_id":"2505.23387","doi":"10.48550/arxiv.2505.23387","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23387","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Afterburner: Reinforcement learning facilitates self-improving code efficiency optimization","venue":"ArXiv.org","work_id":"b81128dc-02bc-4c4e-af89-0bb8b68a4a84","year":2025},"citing_paper":{"arxiv_id":"2606.06826","last_updated":"2026-06-05T02:01:38Z","snapshot_observed_at":"2026-08-07T19:01:41.755123Z","submitted_at":"2026-06-05T02:01:38Z","title":"SkelDPO: A Skeleton-Guided Direct Preference Optimization Framework for Efficient Code Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-27T21:41:02.035059Z"},"links":{"cited_paper":"/paper/2505.23387","citing_paper":"/paper/2606.06826"},"observation_digest":"sha256:73cf71ad1b081a1cfce27cbd2afc4ef30da84917652fd6b8b8e1592508660d92","observation_id":"340d2a8d-ac0f-4077-82c6-24e66db3da73","resolution":{"observed_at":"2026-07-02T19:07:17.720297Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"cited_work":{"arxiv_id":"2505.23387","doi":"10.48550/arxiv.2505.23387","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23387","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Afterburner: Reinforcement learning facilitates self-improving code efficiency optimization","venue":"ArXiv.org","work_id":"b81128dc-02bc-4c4e-af89-0bb8b68a4a84","year":2025},"citing_paper":{"arxiv_id":"2606.11052","last_updated":"2026-06-09T16:17:19Z","snapshot_observed_at":"2026-08-05T14:17:36.486236Z","submitted_at":"2026-06-09T16:17:19Z","title":"Attention Amnesia in Hybrid LLMs: When CoT Fine-Tuning Breaks Long-Range Recall, and How to Fix It","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-27T13:08:57.218711Z"},"links":{"cited_paper":"/paper/2505.23387","citing_paper":"/paper/2606.11052"},"observation_digest":"sha256:fee4d93334721a76326973cce1517dc8c917359e3659a095b52dc4646933eab7","observation_id":"4ab10d0a-cf07-46ae-bac0-8c78fb288242","resolution":{"observed_at":"2026-06-27T13:10:55.920584Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"cited_work":{"arxiv_id":"2505.23387","doi":"10.48550/arxiv.2505.23387","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23387","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Afterburner: Reinforcement learning facilitates self-improving code efficiency optimization","venue":"ArXiv.org","work_id":"b81128dc-02bc-4c4e-af89-0bb8b68a4a84","year":2025},"citing_paper":{"arxiv_id":"2606.17682","last_updated":"2026-06-16T08:48:58Z","snapshot_observed_at":"2026-08-01T05:53:08.805029Z","submitted_at":"2026-06-16T08:48:58Z","title":"From Trainee to Trainer: LLM-Designed Training Environment for RL with Multi-Agent Reasoning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-27T00:59:50.038405Z"},"links":{"cited_paper":"/paper/2505.23387","citing_paper":"/paper/2606.17682"},"observation_digest":"sha256:a804f5fcd6b00b375981468fb6963adb15be0a3548e5aa315e55b555565c6bb6","observation_id":"f75767b9-bece-4bef-92df-e6872303254f","resolution":{"observed_at":"2026-06-27T01:00:19.847467Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.23387/citation-record","integrity":"/paper/2505.23387/integrity","json":"/paper/2505.23387/citation-record.json","paper":"/paper/2505.23387"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T12:50:23.483646Z","title":"Gpt-4 technical report.arXiv preprint arXiv:2303.08774, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:23.483646Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:d89a3178cff7c09980384d4d0f6b76e4010fe0c64162690a1df54a3370010485","observation_id":"19bb2ec8-78db-4d56-8cfd-77d0d0bda6c0","resolution":{"observed_at":"2026-08-07T12:50:23.483646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.03988","last_updated":"2023-02-24T09:53:40Z","snapshot_observed_at":"2026-08-06T09:28:54.008213Z","submitted_at":"2023-01-09T10:52:35Z","title":"SantaCoder: don't reach for the stars!","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.03988","snapshot_observed_at":"2026-08-07T12:50:23.535332Z","title":"Santacoder: don’t reach for the stars!arXiv preprint arXiv:2301.03988, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:23.535332Z"},"links":{"cited_paper":"/paper/2301.03988","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:5203097cff31681d47bbd1e192f2d8aea95b2b79b3273e451f3357eeef5194c1","observation_id":"468da172-88cd-4971-b37d-8c5a53c6bfc9","resolution":{"observed_at":"2026-08-07T12:50:23.535332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:34.551793Z","title":"An orchestrated survey of methodologies for automated software test case generation.Journal of systems and software, 86(8):1978–2001, 2013","venue":null,"work_id":"9b08af1d-611f-42a2-bdff-a5f07abe5279","year":1978},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:23.612845Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:f39d2906c5cf67a7af3ad824ea031dbd3baa42da300b09b76af897a337df2d16","observation_id":"0f266989-003f-473f-bf97-4dbd7d2645d2","resolution":{"observed_at":"2026-08-07T12:50:34.630886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:34.390744Z","title":"Introducing claude 3.5 sonnet, 6 2024","venue":null,"work_id":"00e14fa5-526a-4d92-b3fe-3e1fe793ef06","year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:23.694238Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:a716306a799e87d7bc5cfc45282260ee2469bd0902b5807fb240cdf6f2789d5a","observation_id":"9eb01a86-3448-44a7-9bbb-77b90512f6c9","resolution":{"observed_at":"2026-08-07T12:50:34.460316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:34.237859Z","title":"Claude 3.7 sonnet and claude code, 2 2025","venue":null,"work_id":"fbcdd781-6f2a-4134-8a92-80d6452d742a","year":2025},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:23.775023Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:c4009ba847da0a48ec4e65028e9794853f5bbe60e6dad4f476d24d976af1a3d4","observation_id":"f4771a24-b08c-4463-a240-b05cf17fb19d","resolution":{"observed_at":"2026-08-07T12:50:34.313485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-07T12:50:23.855659Z","title":"Program synthesis with large language models.arXiv preprint arXiv:2108.07732, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:23.855659Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:1481515fd1df15d9c54aaaf6a905b8d61f96bef31cc4c9b389a35cce0a58d416","observation_id":"03503e04-0ef7-4ff0-b052-418442383f6f","resolution":{"observed_at":"2026-08-07T12:50:23.855659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:24.037931Z","title":"Code alpaca: An instruction-following llama model for code generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:24.037931Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:10bb52234487fdbe48b550311b8b7665097534995d6041036c7851d675a62c13","observation_id":"9fcb4b02-dc24-4bf0-a9d1-56a22cd1799d","resolution":{"observed_at":"2026-08-07T12:50:24.037931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:34.061162Z","title":null,"venue":null,"work_id":"ac5f8179-ff0d-4b1f-9c40-a8fa15988685","year":2021},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:24.120147Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:b44beac4ea8077b07bb981ede2b772d1852541715ebdf563d2bac0e3a086dbe6","observation_id":"73ac9bfd-78db-4414-a0c4-8a553ef074e6","resolution":{"observed_at":"2026-08-07T12:50:34.158212Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-07T12:50:24.180001Z","title":"Evaluating large language models trained on code.arXiv preprint arXiv:2107.03374, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:24.180001Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:c80291cd14ad3f62418687b4dca3918b1ccd953980f4c67458db4f44cdab4807","observation_id":"9c38a33c-8575-4f14-9e31-570569b308fc","resolution":{"observed_at":"2026-08-07T12:50:24.180001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:33.841018Z","title":"An introduction to algorithms and the big o notation.Introduction to Programming with Fortran: With Coverage of Fortran 90, 95, 2003, 2008 and 77, pages 359–364, 2015","venue":null,"work_id":"3e019314-e0f4-4cd5-b91f-f969bbf8f933","year":2003},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:24.233906Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:b397a5615caa09709fc6837369500026633b6c12ba54ff9fe7108c3b252aefad","observation_id":"ebecbb5f-4933-4c80-a794-f472fc657670","resolution":{"observed_at":"2026-08-07T12:50:33.953988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:33.669895Z","title":"Mhpp: Exploring the capabilities and limitations of language models beyond basic code generation, 2024","venue":null,"work_id":"edd39976-c386-47aa-b69f-e023dd14ad19","year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:24.356750Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:ea700d940c693f0c56620e978cffa85bf40b19f5b2f24cc58f112d670d78f286","observation_id":"f0523b29-292a-4f91-9e29-160329a78769","resolution":{"observed_at":"2026-08-07T12:50:33.772239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:33.479046Z","title":"Docker.lınea].[Junio de 2017]","venue":null,"work_id":"7df5cd69-8804-4923-a3f4-78b17164644b","year":2017},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:24.485638Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:a88a142106673e76e3f49ca91b8252f8e43b0bf0d2ec986c166a01604e631a43","observation_id":"b258fdba-ecdd-4cda-acbc-bd4bf3c12972","resolution":{"observed_at":"2026-08-07T12:50:33.580132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01391","last_updated":"2024-02-05T13:28:23Z","snapshot_observed_at":"2026-07-06T17:24:16.787573Z","submitted_at":"2024-02-02T13:14:31Z","title":"StepCoder: Improve Code Generation with Reinforcement Learning from Compiler Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01391","snapshot_observed_at":"2026-08-07T12:50:24.562628Z","title":"Stepcoder: Improve code generation with reinforcement learning from compiler feedback.arXiv preprint arXiv:2402.01391, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:24.562628Z"},"links":{"cited_paper":"/paper/2402.01391","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:c85be937e0cb97e395e99ce97f8686dba78bbfec29b0f75bf46ff01f0952a5dc","observation_id":"457bd8db-44ed-4218-8753-a5053c9b1667","resolution":{"observed_at":"2026-08-07T12:50:24.562628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:33.329271Z","title":"Mercury: A code efficiency benchmark for code large language models.Advances in Neural Information Processing Systems, 37, 2024","venue":null,"work_id":"1834a74b-86cb-4953-b01f-0ae6ac8c0abd","year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:24.645596Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:b303ecbb7f4431fdeb4fe6fe96616aca13b3fdbfd207831cf75fec51838b08f1","observation_id":"0ac43d93-2f3e-493a-a312-8bf844b68a09","resolution":{"observed_at":"2026-08-07T12:50:33.390117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:24.724108Z","title":"Chapman and Hall/CRC, 1994","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:24.724108Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:7efb2604f4931fa24a5e80ca0688d00e4059d73395c6c6e01da96ad3125da843","observation_id":"45663742-0ae8-4af7-800d-af78d13af267","resolution":{"observed_at":"2026-08-07T12:50:24.724108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02089","last_updated":"2025-02-18T11:39:46Z","snapshot_observed_at":"2026-07-06T19:26:38.002071Z","submitted_at":"2024-10-02T23:25:17Z","title":"RLEF: Grounding Code LLMs in Execution Feedback with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02089","snapshot_observed_at":"2026-08-07T12:50:24.815311Z","title":"Rlef: Grounding code llms in execution feedback with reinforcement learning.arXiv preprint arXiv:2410.02089, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:24.815311Z"},"links":{"cited_paper":"/paper/2410.02089","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:02092aaa98d9f510f3310bbdf478d61c5b52182f7d51aa505cff094f22e693f5","observation_id":"5badb4da-5bed-4308-8c0b-fd622e9b4717","resolution":{"observed_at":"2026-08-07T12:50:24.815311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T12:50:24.899820Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:24.899820Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:2dd8a3d501fb763f511d8b712023d46f2b178c58ff9065e3671565b20acc8ad9","observation_id":"722ebdaf-510b-4de9-a384-35e57fd0cebb","resolution":{"observed_at":"2026-08-07T12:50:24.899820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:33.123607Z","title":"Measuring coding challenge competence with apps.NeurIPS, 2021","venue":null,"work_id":"a424a87b-6644-47d9-8818-c225646c3839","year":2021},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:24.978032Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:39c8a134324122d3eb0da63527d7fd3f927dda58fce6fd5937d9cd0683c4c435","observation_id":"f36078d5-eae7-49a9-b5e7-19be210922b6","resolution":{"observed_at":"2026-08-07T12:50:33.219909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:32.917537Z","title":"Codecot: Tackling code syntax errors in cot reasoning for code generation, 2024","venue":null,"work_id":"891432f2-b32c-4ba5-b95d-7338257cae9e","year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:25.021399Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:25dfb4d5251bf37ee0290ccf165021172b5884b77b6d76a2dfe7ffd915894608","observation_id":"08b14e2d-1020-4ba0-b9b3-75ecd3c05244","resolution":{"observed_at":"2026-08-07T12:50:33.019551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:32.626178Z","title":"Effilearner: Enhancing efficiency of generated code via self-optimization.Advances in Neural Information Processing Systems, 37:84482–84522, 2024","venue":null,"work_id":"4f24541a-ff68-4a38-8453-56f834866ee5","year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:25.112854Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:e31a33b23a58464a2f400426507868aba278580ec2172b5ed3cac1210ccd97b7","observation_id":"b478f50e-0d9c-4771-b248-cec0d4d2b89b","resolution":{"observed_at":"2026-08-07T12:50:32.790748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:32.454465Z","title":"Effibench: Benchmarking the efficiency of automatically generated code.Advances in Neural Information Processing Systems, 37:11506–11544, 2024","venue":null,"work_id":"e800c58c-28c5-43a0-b9d4-4fe453c2b6a3","year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:25.160863Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:2841e11d218543f16ea879fc6ec2f236eaca921d8f3a0be2fd475157e604b8fc","observation_id":"446d9409-f8a4-4237-aab9-80fbe517bf5f","resolution":{"observed_at":"2026-08-07T12:50:32.549057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10209","last_updated":"2025-06-16T09:27:30Z","snapshot_observed_at":"2026-08-09T14:04:43.600226Z","submitted_at":"2024-10-14T07:05:51Z","title":"EffiCoder: Enhancing Code Generation in Large Language Models through Efficiency-Aware Fine-tuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10209","snapshot_observed_at":"2026-08-07T12:50:25.227030Z","title":"Effi-code: Unleashing code efficiency in language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:25.227030Z"},"links":{"cited_paper":"/paper/2410.10209","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:ee419b33f83ac615d52c90d8b2fb50efd5a1861724b0e6362c9595d6a65f8f0e","observation_id":"8d701659-174a-4c4d-afeb-08c29b63f765","resolution":{"observed_at":"2026-08-07T12:50:25.227030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:32.159460Z","title":"Bias testing and mitigation in llm-based code generation.ACM Transactions on Software Engineering and Methodology, 2024","venue":null,"work_id":"123eea58-00d6-4054-a452-62a4af0f1142","year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:25.294749Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:e97fe34765133dd14fc8c7b4f5ba0a83b2ff16aa89f970561a162ab6a0b56504","observation_id":"92b7a3da-f89a-4ff5-aa5d-51097c8b5401","resolution":{"observed_at":"2026-08-07T12:50:32.310975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.09464","last_updated":"2025-03-28T03:00:37Z","snapshot_observed_at":"2026-08-09T09:34:30.708163Z","submitted_at":"2024-09-14T15:17:34Z","title":"Measuring the Influence of Incorrect Code on Test Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.09464","snapshot_observed_at":"2026-08-07T12:50:25.350738Z","title":"Rethinking the influence of source code on test case generation.arXiv preprint arXiv:2409.09464, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:25.350738Z"},"links":{"cited_paper":"/paper/2409.09464","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:15f7ac31bb85cd80539a041155fe3880214d703423d93d07d38f0032cdca509c","observation_id":"e47b6424-dece-40b9-be72-358d58537a21","resolution":{"observed_at":"2026-08-07T12:50:25.350738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:25.414753Z","title":"Zhang, Michael Luck, Qingwen Bu, Yuhao Qing, and Heming Cui","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:25.414753Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:9c8a7fe858c80bfd9bfa48f65c08366eea7df26c196d16acbcf866fbc0785eb9","observation_id":"28372f51-1e5a-44a1-a159-8e2af24c6d33","resolution":{"observed_at":"2026-08-07T12:50:25.414753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04905","last_updated":"2025-03-20T03:28:56Z","snapshot_observed_at":"2026-08-08T14:21:42.036023Z","submitted_at":"2024-11-07T17:47:25Z","title":"OpenCoder: The Open Cookbook for Top-Tier Code Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04905","snapshot_observed_at":"2026-08-07T12:50:25.476308Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:25.476308Z"},"links":{"cited_paper":"/paper/2411.04905","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:7934649ad66dbf1e13e4d80e90727546eb37df513b28e8e70f4c372d794688ce","observation_id":"6e9830e7-59f7-4d76-b684-647962f480f7","resolution":{"observed_at":"2026-08-07T12:50:25.476308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-07T12:50:25.619468Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:25.619468Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:41b1caae87217f89a4034e68d413eaf91871cb408317a6c52994d28345b52239","observation_id":"85dcd90d-1106-43d6-be37-fce6f7f671e7","resolution":{"observed_at":"2026-08-07T12:50:25.619468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:31.793240Z","title":"Ashraful Islam, Mohammed Eunus Ali, and Md Rizwan Parvez","venue":null,"work_id":"e325606e-a516-4f65-983d-e7f28ea60e55","year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:25.703099Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:bb469a25ab9a4d4fe3da0eb899631803a78396859586445ca6b0d2361291fa18","observation_id":"494b4c79-dec5-4857-a27c-146e6ac0731c","resolution":{"observed_at":"2026-08-07T12:50:31.958871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-08-10T03:07:35.408836Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-08-07T12:50:25.816411Z","title":"Livecodebench: Holistic and contamination free evaluation of large language models for code.arXiv preprint arXiv:2403.07974, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:25.816411Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:30ac31ed56ce48c84b459e9813c48c7a4e226b911bb499fd316fe2e80021f374","observation_id":"bdd1d97f-5a85-4f00-bf56-e344fc4e7c4c","resolution":{"observed_at":"2026-08-07T12:50:25.816411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00515","last_updated":"2024-11-10T22:02:27Z","snapshot_observed_at":"2026-07-29T20:40:25.374189Z","submitted_at":"2024-06-01T17:48:15Z","title":"A Survey on Large Language Models for Code Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00515","snapshot_observed_at":"2026-08-07T12:50:25.949940Z","title":"A survey on large language models for code generation.arXiv preprint arXiv:2406.00515, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:25.949940Z"},"links":{"cited_paper":"/paper/2406.00515","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:042ad7ee728d68aab93cd3a5a7eba6ab4c7c487532306efaec31760a535dcae6","observation_id":"a57ee1a0-903a-49fb-8d93-adc1c0903f55","resolution":{"observed_at":"2026-08-07T12:50:25.949940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:26.056841Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:26.056841Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:ce21ba9ee6cb07feb84a527e5793eec989fb98be21ff73cf034d74e8717440ce","observation_id":"5f6a845a-08fe-4409-936e-3cd8fcac0ce8","resolution":{"observed_at":"2026-08-07T12:50:26.056841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:31.521422Z","title":"Coderl: Mastering code generation through pretrained models and deep reinforcement learning","venue":null,"work_id":"0dcd8884-3c34-48d5-9262-93cd21b6662b","year":2022},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:26.174145Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:d9111b5c542adce21789c21779b75564b9d3db86ed7e7d8c0a3d4bc30bfce1cf","observation_id":"1149084b-f88c-4659-ab68-623086d0a859","resolution":{"observed_at":"2026-08-07T12:50:31.646333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:26.277047Z","title":"Competition-level code generation with alphacode.Science, 378(6624):1092–1097, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:26.277047Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:d28298b5b631cfbafc3f662d82a999b713e3574159fd47a641ce4313337a8a6e","observation_id":"d1335fe5-2825-46e4-9764-ee4e5a722cf1","resolution":{"observed_at":"2026-08-07T12:50:26.277047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T12:50:26.377727Z","title":"Deepseek-v3 technical report.arXiv preprint arXiv:2412.19437, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:26.377727Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:f3f36108c0b2466afed9ecee54dbef49da538f86f1c63ba6f074a1bb5bbf76a4","observation_id":"2fbd8b7c-5ee1-4003-a086-1a9d9256e68c","resolution":{"observed_at":"2026-08-07T12:50:26.377727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:26.394353Z","title":"Is your code generated by chatGPT really correct? rigorous evaluation of large language models for code generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:26.394353Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:5687f10cb72ad336e0f65d813cb2e5f9b407549691a0bb93286c5495619aea34","observation_id":"1dcf8880-cb30-428f-a2c4-c71d6bf5fce9","resolution":{"observed_at":"2026-08-07T12:50:26.394353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06450","last_updated":"2024-08-12T18:59:13Z","snapshot_observed_at":"2026-08-07T08:27:28.863794Z","submitted_at":"2024-08-12T18:59:13Z","title":"Evaluating Language Models for Efficient Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06450","snapshot_observed_at":"2026-08-07T12:50:26.404596Z","title":"Evaluating language models for efficient code generation.arXiv preprint arXiv:2408.06450, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:26.404596Z"},"links":{"cited_paper":"/paper/2408.06450","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:70f7254b4d2348a764c7516ab16dba2c952b945946fbaa3b8cd4be69bd1d7964","observation_id":"901b1cf3-73e3-462e-8e60-18cfe99e9c15","resolution":{"observed_at":"2026-08-07T12:50:26.404596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:31.186576Z","title":"Refining chatgpt-generated code: Characterizing and mitigating code quality issues.ACM Transactions on Software Engineering and Methodology, 33(5):1–26, 2024","venue":null,"work_id":"1fdf1324-b05f-4523-9fb8-ff1363cdcc10","year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:26.564217Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:eae03f626ee2569349783d43482ee0adbbfc06e3a6f1479372c720905fb90b14","observation_id":"3d2f7533-58d2-4b83-b9c0-79448fbafd5d","resolution":{"observed_at":"2026-08-07T12:50:31.355615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19173","last_updated":"2024-02-29T13:53:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-29T13:53:35Z","title":"StarCoder 2 and The Stack v2: The Next Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19173","snapshot_observed_at":"2026-08-07T12:50:26.687342Z","title":"Starcoder 2 and the stack v2: The next generation.arXiv preprint arXiv:2402.19173, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:26.687342Z"},"links":{"cited_paper":"/paper/2402.19173","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:f227dea66405b4938f8504f1dbcf432e4ee2a84a22e2c2e162f65ec1405fcfe6","observation_id":"b645b98e-207d-455b-a7fa-b67c1182f7a9","resolution":{"observed_at":"2026-08-07T12:50:26.687342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08568","last_updated":"2025-05-27T07:40:36Z","snapshot_observed_at":"2026-08-04T15:08:40.203853Z","submitted_at":"2023-06-14T15:18:48Z","title":"WizardCoder: Empowering Code Large Language Models with Evol-Instruct","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08568","snapshot_observed_at":"2026-08-07T12:50:26.792726Z","title":"Wizardcoder: Empowering code large language models with evol-instruct.arXiv preprint arXiv:2306.08568, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:26.792726Z"},"links":{"cited_paper":"/paper/2306.08568","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:adbee47edba54c57511648f04ee0166f0ede4c58ce47faec9c1c1b7cd5f16398","observation_id":"eb8d02a6-cfb5-4e96-b0ad-45eb984f4414","resolution":{"observed_at":"2026-08-07T12:50:26.792726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:30.937603Z","title":"The llama 4 herd: The beginning of a new era of natively multimodal ai innovation","venue":null,"work_id":"e5077b0b-714b-4b82-8049-12bea3bd82b2","year":2025},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:26.908398Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:ca6081771889b93ceccd6226b52c477a612ef7c0997e77623fa99f04d21a47e3","observation_id":"f35a0c77-24bc-44db-b4fa-10f686a0fd94","resolution":{"observed_at":"2026-08-07T12:50:31.081251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07124","last_updated":"2024-02-18T09:46:06Z","snapshot_observed_at":"2026-08-08T14:13:40.407110Z","submitted_at":"2023-08-14T13:53:54Z","title":"OctoPack: Instruction Tuning Code Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07124","snapshot_observed_at":"2026-08-07T12:50:27.026954Z","title":"Octopack: Instruction tuning code large language models.arXiv preprint arXiv:2308.07124, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:27.026954Z"},"links":{"cited_paper":"/paper/2308.07124","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:7e9311c1991279b5246f615c08d5317096e1043714f500b733ede82c863e6b24","observation_id":"93a71e4a-fe8b-4a52-82b8-9f69abb06b3c","resolution":{"observed_at":"2026-08-07T12:50:27.026954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.13474","last_updated":"2023-02-27T21:26:48Z","snapshot_observed_at":"2026-07-06T12:52:16.992962Z","submitted_at":"2022-03-25T06:55:15Z","title":"CodeGen: An Open Large Language Model for Code with Multi-Turn Program Synthesis","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.13474","snapshot_observed_at":"2026-08-07T12:50:27.094115Z","title":"Codegen: An open large language model for code with multi-turn program synthesis.arXiv preprint arXiv:2203.13474, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:27.094115Z"},"links":{"cited_paper":"/paper/2203.13474","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:2f253d7bd2dc76b7554a660f86e57c15fd933dacdcced4f545854c64d93fa52c","observation_id":"b028048c-f4f5-4732-91dd-22fbbe098333","resolution":{"observed_at":"2026-08-07T12:50:27.094115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:30.682186Z","title":"Introducing openai o3 and o4-mini, 4 2025","venue":null,"work_id":"1c2f250d-ea90-4d57-80a1-2a3568ff4207","year":2025},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:27.149254Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:cee0056d508e15246a32957f2fa562e08d7377f8bbbf953c6b93aae9e9016729","observation_id":"064be610-7300-4050-b626-fd9dd388fd70","resolution":{"observed_at":"2026-08-07T12:50:30.800178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:30.509486Z","title":"Zhang, Heming Cui, Siu-Ming Yiu, Dong Huang, See-Kiong Ng, and Luu Anh Tuan","venue":null,"work_id":"cadeb126-25b5-426f-8c5c-f54d2ec3aa9b","year":2025},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:27.204810Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:a9102f8c42b64a1d11f2d7ed50411200e79ac36bc8f55b4c10bd16fff4e82294","observation_id":"45870295-1a6a-4563-b2c4-6584df34f3b8","resolution":{"observed_at":"2026-08-07T12:50:30.584280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06647","last_updated":"2025-02-19T04:16:24Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-10T04:19:20Z","title":"How Efficient is LLM-Generated Code? A Rigorous & High-Standard Benchmark","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06647","snapshot_observed_at":"2026-08-07T12:50:27.276056Z","title":"How efficient is llm-generated code? a rigorous & high-standard benchmark.arXiv preprint arXiv:2406.06647, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:27.276056Z"},"links":{"cited_paper":"/paper/2406.06647","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:c53396d8a3441efc4ac931fa48499ffa31a6f6e1a2706b3c28a8598525b673fc","observation_id":"d768de9e-9a5d-4dd6-91bd-2962dc171164","resolution":{"observed_at":"2026-08-07T12:50:27.276056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:27.345353Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:27.345353Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:491079931b1dc5ed7e753402e181df363780a9cacde43d2123a3f54cc4cf64e6","observation_id":"43e114bd-4d8f-457f-9ca7-bfe336ed532c","resolution":{"observed_at":"2026-08-07T12:50:27.345353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T12:50:27.475345Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models.arXiv preprint arXiv:2402.03300, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:27.475345Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:b12694fabf92c79c822203f558eb8593ca972bd229fc12fd0332283d93ede47b","observation_id":"77eeb386-b4ad-4930-96a9-263eb0ef08b3","resolution":{"observed_at":"2026-08-07T12:50:27.475345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19256","last_updated":"2024-10-02T04:01:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-28T06:20:03Z","title":"HybridFlow: A Flexible and Efficient RLHF Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19256","snapshot_observed_at":"2026-08-07T12:50:27.598252Z","title":"Hybridflow: A flexible and efficient rlhf framework.arXiv preprint arXiv: 2409.19256, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:27.598252Z"},"links":{"cited_paper":"/paper/2409.19256","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:990b6c4b97a736a59e2bd7268da638220a4d32b9a1ea92e1cddb21477fbb9fbc","observation_id":"1957a6dd-8bff-4a8e-809e-b216b82fbce4","resolution":{"observed_at":"2026-08-07T12:50:27.598252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04566","last_updated":"2024-12-04T08:36:13Z","snapshot_observed_at":"2026-07-06T17:56:27.818353Z","submitted_at":"2024-04-06T09:27:04Z","title":"Efficient and Green Large Language Models for Software Engineering: Literature Review, Vision, and the Road Ahead","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04566","snapshot_observed_at":"2026-08-07T12:50:27.702240Z","title":"Efficient and green large language models for software engineering: Literature review, vision, and the road ahead.arXiv preprint arXiv:2404.04566, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:27.702240Z"},"links":{"cited_paper":"/paper/2404.04566","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:fa334bde7252d44b7f2725e943a561180bf3de6e4891933bbc70795e57813381","observation_id":"564cc66c-78cb-4f7c-9a6d-36d52c42892d","resolution":{"observed_at":"2026-08-07T12:50:27.702240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.07867","last_updated":"2024-04-26T16:41:55Z","snapshot_observed_at":"2026-08-09T00:08:03.125473Z","submitted_at":"2023-02-15T18:59:21Z","title":"Learning Performance-Improving Code Edits","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.07867","snapshot_observed_at":"2026-08-07T12:50:27.836357Z","title":"Learning performance-improving code edits.arXiv preprint arXiv:2302.07867, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:27.836357Z"},"links":{"cited_paper":"/paper/2302.07867","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:de0a7612b9b7e2bfab15c85a20d00d9e97c5baa8e290b6de355a87309b9965fa","observation_id":"ae1fa2d6-8fdb-48d9-8e30-51fbb49bd72a","resolution":{"observed_at":"2026-08-07T12:50:27.836357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20527","last_updated":"2024-10-27T17:34:07Z","snapshot_observed_at":"2026-08-04T02:07:56.156600Z","submitted_at":"2024-10-27T17:34:07Z","title":"CodeRosetta: Pushing the Boundaries of Unsupervised Code Translation for Parallel Programming","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20527","snapshot_observed_at":"2026-08-07T12:50:27.939356Z","title":"Coderosetta: Pushing the boundaries of unsupervised code translation for parallel programming.arXiv preprint arXiv:2410.20527, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:27.939356Z"},"links":{"cited_paper":"/paper/2410.20527","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:193451667f5b8f670ee0e0344654d0c59bcacc68225792cb88108d03d08634dc","observation_id":"e1bb270e-7f0f-4abc-a70d-79a771fb7f03","resolution":{"observed_at":"2026-08-07T12:50:27.939356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T12:50:27.997213Z","title":"Llama: Open and efficient foundation language models.arXiv preprint arXiv:2302.13971, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:27.997213Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:2fc78b83970f85c81e03d419bb976164ed58cddabeeea593c14fddcdfbeac1a1","observation_id":"acf1e616-757f-40d2-8eac-a58cebcbb587","resolution":{"observed_at":"2026-08-07T12:50:27.997213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14044","last_updated":"2024-10-09T22:20:40Z","snapshot_observed_at":"2026-08-10T05:13:51.307547Z","submitted_at":"2024-07-19T05:47:40Z","title":"ECCO: Can We Improve Model-Generated Code Efficiency Without Sacrificing Functional Correctness?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14044","snapshot_observed_at":"2026-08-07T12:50:28.085835Z","title":"Ecco: Can we improve model-generated code efficiency without sacrificing functional correctness?arXiv preprint arXiv:2407.14044, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:28.085835Z"},"links":{"cited_paper":"/paper/2407.14044","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:f9cb23eba411bcabeb3e4072ba12838591f96b26d8e848d942a83d1e3c97057a","observation_id":"c1ec2e52-8874-46a8-a3f7-314142942e33","resolution":{"observed_at":"2026-08-07T12:50:28.085835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20367","last_updated":"2025-08-07T08:34:03Z","snapshot_observed_at":"2026-08-08T03:11:31.159173Z","submitted_at":"2024-12-29T06:15:41Z","title":"Enhancing Code LLMs with Reinforcement Learning in Code Generation: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20367","snapshot_observed_at":"2026-08-07T12:50:28.141142Z","title":"Enhancing code llms with reinforcement learning in code generation.arXiv preprint arXiv:2412.20367, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:28.141142Z"},"links":{"cited_paper":"/paper/2412.20367","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:9641ee803d53c0996512c91917724bccfb8a970a1952e11a079e124e201a2bf1","observation_id":"11b8eb8f-4ef8-49a9-9824-7dd480fb5620","resolution":{"observed_at":"2026-08-07T12:50:28.141142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.01652","last_updated":"2022-02-08T20:26:45Z","snapshot_observed_at":"2026-08-10T07:52:08.606999Z","submitted_at":"2021-09-03T17:55:52Z","title":"Finetuned Language Models Are Zero-Shot Learners","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.01652","snapshot_observed_at":"2026-08-07T12:50:28.229504Z","title":"Finetuned language models are zero-shot learners.arXiv preprint arXiv:2109.01652, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:28.229504Z"},"links":{"cited_paper":"/paper/2109.01652","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:6948afe6f4d226196654860486098d176d1792d95c66cb280f2bb8a91d94f28e","observation_id":"ad6dd3da-fa85-4285-8449-befd7caddbd3","resolution":{"observed_at":"2026-08-07T12:50:28.229504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:30.334355Z","title":"Magicoder: Empow- ering code generation with OSS-instruct","venue":null,"work_id":"87f42d65-13a2-4f1e-97b4-b997c119f193","year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:28.315645Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:dda9d9a7ad5babcd84e2ebf0c539a6cd4a85085474a511f1569b68b5386cf9d5","observation_id":"6158f97a-520d-47e9-a578-c453f4f2ba4d","resolution":{"observed_at":"2026-08-07T12:50:30.396424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00724","last_updated":"2025-03-03T07:53:32Z","snapshot_observed_at":"2026-08-09T23:53:42.648697Z","submitted_at":"2024-08-01T17:16:04Z","title":"Inference Scaling Laws: An Empirical Analysis of Compute-Optimal Inference for Problem-Solving with Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00724","snapshot_observed_at":"2026-08-07T12:50:28.424341Z","title":"Inference scaling laws: An empirical analysis of compute-optimal inference for problem-solving with language models.arXiv preprint arXiv:2408.00724, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:28.424341Z"},"links":{"cited_paper":"/paper/2408.00724","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:cf8175323cb6f19b525f2a230a424175643c7f8638f909a0a1569902e6351605","observation_id":"2eb1c552-0b1d-46b8-8c6d-933607e2e3e2","resolution":{"observed_at":"2026-08-07T12:50:28.424341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.12244","last_updated":"2025-05-27T06:49:09Z","snapshot_observed_at":"2026-08-10T07:58:15.209421Z","submitted_at":"2023-04-24T16:31:06Z","title":"WizardLM: Empowering large pre-trained language models to follow complex instructions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.12244","snapshot_observed_at":"2026-08-07T12:50:28.568252Z","title":"Wizardlm: Empowering large language models to follow complex instructions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:28.568252Z"},"links":{"cited_paper":"/paper/2304.12244","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:c5d7c8db6630746153e4afe453a3a24ab49ab4fb929f8a21ddbae98aa27be9d9","observation_id":"dba9e3d8-c622-4c48-900b-ffb25c58fa41","resolution":{"observed_at":"2026-08-07T12:50:28.568252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T12:50:28.668207Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:28.668207Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:101c36a06d09c35e9e3d7ee07d68ed647d94c5d9f7a4b04cca5066ec23b7bede","observation_id":"8ae38b73-4d33-4c53-aa58-bd40f5be8991","resolution":{"observed_at":"2026-08-07T12:50:28.668207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18489","last_updated":"2025-02-17T07:01:18Z","snapshot_observed_at":"2026-08-07T18:13:31.005755Z","submitted_at":"2025-02-17T07:01:18Z","title":"LLM4EFFI: Leveraging Large Language Models to Enhance Code Efficiency and Correctness","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18489","snapshot_observed_at":"2026-08-07T12:50:28.777021Z","title":"Llm4effi: Leveraging large language models to enhance code efficiency and correctness","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:28.777021Z"},"links":{"cited_paper":"/paper/2502.18489","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:b75d95d1d7d8282326d684713f6eabfaba954ea45da2297581f88148d2ee32d1","observation_id":"b7813645-9f34-4a7b-b5ea-f2014113db0f","resolution":{"observed_at":"2026-08-07T12:50:28.777021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:28.872627Z","title":"Focused-dpo: Enhancing code generation through focused preference optimization on error-prone points.arXiv preprint arXiv:2502.11475, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:28.872627Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:9c83bbde385d560600fe2cadc80310bee334be8f73973fd4469696f5317fd2fe","observation_id":"1479b453-fd6a-4059-9697-2fae65a8813c","resolution":{"observed_at":"2026-08-07T12:50:28.872627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:28.952622Z","title":"A systematic literature review on large language models for automated program repair","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:28.952622Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:e6f90d5f6a51ea16072774f77e9ebc020139d009a9d6ee2cbece735fc58d4e39","observation_id":"1a1d3a14-8e2a-4b1e-bc73-9b1a235d957f","resolution":{"observed_at":"2026-08-07T12:50:28.952622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:29.052783Z","title":"Codegeex: A pre-trained model for code generation with multilingual benchmarking on humaneval-x","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:29.052783Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:437397b11436549aa6a0fd3b4e258ab96efde544a072a4545999ec826b572b35","observation_id":"53c2939c-7ca9-4d28-967d-42f849ce694c","resolution":{"observed_at":"2026-08-07T12:50:29.052783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:29.173199Z","title":"Llamafactory: Unified efficient fine-tuning of 100+ language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:29.173199Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:e2d7cbc88d7746a1ee873387d36e53c0869d3ebb8dcddb737c953f65a545913c","observation_id":"9e139f44-2a97-4edf-a4a0-a2c171e0a289","resolution":{"observed_at":"2026-08-07T12:50:29.173199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:30.210169Z","title":"Debug like a human: A large language model debugger via verifying runtime execution step-by-step, 2024","venue":null,"work_id":"f7222822-3a33-45cb-9f5a-69703467acb1","year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:29.282465Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:43ddeb9960b1550dddefd3ca2c325d7f4c179d710152625de510f77836f64ccc","observation_id":"6737dbb1-562f-43f3-b232-1010bf84302a","resolution":{"observed_at":"2026-08-07T12:50:30.261687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15877","last_updated":"2025-04-01T08:36:44Z","snapshot_observed_at":"2026-07-31T19:00:59.311189Z","submitted_at":"2024-06-22T15:52:04Z","title":"BigCodeBench: Benchmarking Code Generation with Diverse Function Calls and Complex Instructions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15877","snapshot_observed_at":"2026-08-07T12:50:29.403751Z","title":"Bigcodebench: Bench- marking code generation with diverse function calls and complex instructions.arXiv preprint arXiv:2406.15877, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:29.403751Z"},"links":{"cited_paper":"/paper/2406.15877","citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:4dc349c33b9dee0d37c3f39648f19147220a83b23955076dbfe6819fa7c9f896","observation_id":"53fa0cad-94a7-426b-8f78-94bf78001534","resolution":{"observed_at":"2026-08-07T12:50:29.403751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:30.055899Z","title":"<thinking> thing_content </thinking> <solution> solution_content </solution>","venue":null,"work_id":"f08d30dd-a1ac-4d7f-81bb-07091c8219d9","year":1985},"citing_paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:29.507664Z"},"links":{"citing_paper":"/paper/2505.23387"},"observation_digest":"sha256:9ed47c7beb346833cb00b22463b34769ad8a3e078f772ec375e0ae72e6f1ebad","observation_id":"3d7a45dd-2500-4667-b35e-b9e700dca317","resolution":{"observed_at":"2026-08-07T12:50:30.109450Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.23387","last_updated":"2025-06-03T09:55:22Z","latest_version":3,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-07T12:44:29.008842Z","submitted_at":"2025-05-29T12:14:29Z","title":"Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":46,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 10 inbound Pith citation observations for arXiv:2505.23387."}