{"as_of":"2026-08-19T16:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:613c8a634490109b1b960a7d5613971093989d3ade9fe1eec877f0a963743b9e","coverage":[{"denominator":101,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T11:01:28.173937Z","state":"measured"},{"denominator":105,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":105,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:39:57.465250Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-19T12:22:17.217268Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02827","snapshot_observed_at":"2026-08-07T12:39:57.465250Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24098","last_updated":"2025-05-30T01:00:34Z","snapshot_observed_at":"2026-08-14T15:23:26.882834Z","submitted_at":"2025-05-30T01:00:34Z","title":"HardTests: Synthesizing High-Quality Test Cases for LLM Coding","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:57.465250Z"},"links":{"cited_paper":"/paper/2502.02827","citing_paper":"/paper/2505.24098"},"observation_digest":"sha256:62088d2b3a4faa5f114c887db217393befa6f5b65a489ea0c90a93a1f61adb31","observation_id":"aa34b9b4-ffad-4aa3-83ca-aa3829bb7f6f","resolution":{"observed_at":"2026-08-07T12:39:57.465250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.02827","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.02827","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Coffe: A code efficiency benchmark for code generation","venue":null,"work_id":"bc14d79c-9350-488f-a844-364c7bd17229","year":2025},"citing_paper":{"arxiv_id":"2506.01249","last_updated":"2026-05-05T18:10:55Z","snapshot_observed_at":"2026-08-16T08:04:57.775830Z","submitted_at":"2025-06-02T01:57:21Z","title":"SysLLMatic: Large Language Models are Software System Optimizers","version":3},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-19T12:17:34.743290Z"},"links":{"cited_paper":"/paper/2502.02827","citing_paper":"/paper/2506.01249"},"observation_digest":"sha256:f06ffd3928fd38b1bf9766e290c2c412cf320b015cc9eda6bde1f9111e49bbb5","observation_id":"803e126c-3653-467b-bf88-4e12d2e5e7fa","resolution":{"observed_at":"2026-05-19T12:22:17.219309Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02827","snapshot_observed_at":"2026-08-06T15:43:39.090108Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.15224","last_updated":"2025-07-21T03:55:41Z","snapshot_observed_at":"2026-08-13T21:34:52.654850Z","submitted_at":"2025-07-21T03:55:41Z","title":"SimdBench: Benchmarking Large Language Models for SIMD-Intrinsic Code Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T15:43:39.090108Z"},"links":{"cited_paper":"/paper/2502.02827","citing_paper":"/paper/2507.15224"},"observation_digest":"sha256:096421555c2fda0321408360f50679fddd3da1b9f4ff01a8b214c73d4f133ddd","observation_id":"2d7b2803-3b92-4247-a6d5-4b876b2ff61f","resolution":{"observed_at":"2026-08-06T15:43:39.090108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02827","snapshot_observed_at":"2026-08-05T20:04:42.799703Z","title":"Coffe: A code efficiency benchmark for code generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.11307","last_updated":"2026-05-23T15:47:53Z","snapshot_observed_at":"2026-08-09T21:03:10.754863Z","submitted_at":"2025-08-15T08:22:01Z","title":"Approximating the universal thermal climate index using sparse regression with orthogonal polynomials","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T20:04:42.799703Z"},"links":{"cited_paper":"/paper/2502.02827","citing_paper":"/paper/2508.11307"},"observation_digest":"sha256:9fedf3b2bf31522469096b6293ca44f837cdbaa1d56a30830ebd1c52bd17f5f7","observation_id":"9600db74-d376-4cf2-b7c4-38c2cce36eb4","resolution":{"observed_at":"2026-08-05T20:04:42.799703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.02827","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.02827","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Coffe: A code efficiency benchmark for code generation","venue":null,"work_id":"bc14d79c-9350-488f-a844-364c7bd17229","year":2025},"citing_paper":{"arxiv_id":"2605.05267","last_updated":"2026-05-06T09:38:31Z","snapshot_observed_at":"2026-08-04T17:41:12.164736Z","submitted_at":"2026-05-06T09:38:31Z","title":"Bridging Generation and Training: A Systematic Review of Quality Issues in LLMs for Code","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-05-08T17:37:51.790000Z"},"links":{"cited_paper":"/paper/2502.02827","citing_paper":"/paper/2605.05267"},"observation_digest":"sha256:3e61b35f0aa7d4f24ccb51078648a7abdd892f351ad136f35168c139e02e5633","observation_id":"cb1aaeb0-0d75-417b-8e2d-a269497b3c15","resolution":{"observed_at":"2026-05-11T17:26:04.815262Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.02827/citation-record","integrity":"/paper/2502.02827/integrity","json":"/paper/2502.02827/citation-record.json","paper":"/paper/2502.02827"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-08-17T03:25:04.404839Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-09T11:01:27.546055Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.546055Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:4ad07c6d27477fa7846def73ecb89a27e15086c651dc0b36bff6a70f4c5b5b95","observation_id":"2861173f-471c-47f3-8f0c-ae494a372200","resolution":{"observed_at":"2026-08-09T11:01:27.546055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.03988","last_updated":"2023-02-24T09:53:40Z","snapshot_observed_at":"2026-08-16T16:03:40.539365Z","submitted_at":"2023-01-09T10:52:35Z","title":"SantaCoder: don't reach for the stars!","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.03988","snapshot_observed_at":"2026-08-09T11:01:27.555183Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.555183Z"},"links":{"cited_paper":"/paper/2301.03988","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:23a4ca3961894d83de29580097d6a78a680466d2a96a9e1c57da2eb6fffa5d0f","observation_id":"62b8ba0d-a905-45b9-a522-05812ecd27b5","resolution":{"observed_at":"2026-08-09T11:01:27.555183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:27.561285Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.561285Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:8c38bf7a47bab9c266139cc7d3786afd243c48bc724e270433ee63924dc419ed","observation_id":"2e14cc25-07a2-4d5f-b4be-c4c87ad867c3","resolution":{"observed_at":"2026-08-09T11:01:27.561285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:27.565960Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.565960Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:4b729dbf2251db4d785a50e9a16bd16a83442123c96fb7ec4bfb384541168b85","observation_id":"576a0a70-1cfa-4d4e-b99d-631ff457c814","resolution":{"observed_at":"2026-08-09T11:01:27.565960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-15T17:40:38.050939Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-09T11:01:27.571440Z","title":"Nye, Maarten Bosma, Henryk Michalewski, David Dohan, Ellen Jiang, Carrie J","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.571440Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:483448069219788cc7ee86f1c8696217bcd30d594c5869836f477e4608ba59ab","observation_id":"02589864-ef5a-4f9b-aca8-abf79d94b5f5","resolution":{"observed_at":"2026-08-09T11:01:27.571440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:27.578803Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.578803Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:53ca13e366e3731f3a04a2c29e5efaeb43dbea65bab685b6f9c8d28951299ca8","observation_id":"97bd49c3-03cf-4327-898f-c9dff9251f2b","resolution":{"observed_at":"2026-08-09T11:01:27.578803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10622","last_updated":"2024-02-13T15:18:29Z","snapshot_observed_at":"2026-08-16T14:34:04.218930Z","submitted_at":"2023-12-17T06:38:11Z","title":"Unit Test Generation using Generative AI : A Comparative Performance Analysis of Autogeneration Tools","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10622","snapshot_observed_at":"2026-08-09T11:01:27.586030Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.586030Z"},"links":{"cited_paper":"/paper/2312.10622","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:c3611de95bac86769a279935ba718025dc49a782d16c84c38f694678b1cff06d","observation_id":"f7743c57-c178-44ff-9e86-3c1de53cf894","resolution":{"observed_at":"2026-08-09T11:01:27.586030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-09T11:01:27.598250Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.598250Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:e48eb5b98e0edac13ba39a6823a7a11f22d4fad114eb5bab2619c0849af072fc","observation_id":"d1841ed1-cc45-499f-93dd-18c0956940d5","resolution":{"observed_at":"2026-08-09T11:01:27.598250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05128","last_updated":"2023-10-05T09:12:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-11T10:43:43Z","title":"Teaching Large Language Models to Self-Debug","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05128","snapshot_observed_at":"2026-08-09T11:01:27.603903Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.603903Z"},"links":{"cited_paper":"/paper/2304.05128","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:4de0a65387bedd8263cd9e8c9a3b3262de95be0fcb54c34ffb8cbf081d4949cc","observation_id":"db902b5d-3c7f-41e0-8367-c96c489f084a","resolution":{"observed_at":"2026-08-09T11:01:27.603903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:27.609674Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.609674Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:283623202f21aeaa05b0c23fa6ae58398a7b7279aa6e797ca79cf42664054114","observation_id":"f2b86ad6-5fb8-402a-8135-cc885c82671b","resolution":{"observed_at":"2026-08-09T11:01:27.609674Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11416","last_updated":"2022-12-06T21:39:48Z","snapshot_observed_at":"2026-08-18T19:51:48.688199Z","submitted_at":"2022-10-20T16:58:32Z","title":"Scaling Instruction-Finetuned Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11416","snapshot_observed_at":"2026-08-09T11:01:27.615524Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.615524Z"},"links":{"cited_paper":"/paper/2210.11416","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:851cc4a32bf20d308e3ea356abe5929714a6875d814d09d1964e14be9d01d1f0","observation_id":"805dcc58-2f3e-4665-9a16-a9f186287ca4","resolution":{"observed_at":"2026-08-09T11:01:27.615524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:27.621454Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.621454Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:8b88fe125ce916be7fb30516abeb4f36c600a9f13488328a6b49e6978d777700","observation_id":"3d9eb3a9-e986-4202-9450-e1879be7a0a6","resolution":{"observed_at":"2026-08-09T11:01:27.621454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:27.626938Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.626938Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:c0562b1cc6e45dc24f9c4af63ce0f412b887df119cb6d77538f5721d1783335a","observation_id":"68ecdabb-2919-4ced-95da-7be39945e203","resolution":{"observed_at":"2026-08-09T11:01:27.626938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:27.632898Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.632898Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:61e9830c78f236603fba447474c0aa196ed4efbfb79102544c9d6b202f711a16","observation_id":"3f5ceeec-ced3-4e6f-a755-e672ca929054","resolution":{"observed_at":"2026-08-09T11:01:27.632898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04434","snapshot_observed_at":"2026-08-09T11:01:27.638350Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.638350Z"},"links":{"cited_paper":"/paper/2405.04434","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:fbc315f3dd66289593358df3414fe58fb3faa3a75260a1450cbce77dad90b2bd","observation_id":"2558f0b6-7fca-402f-a2b0-af24642dc7cf","resolution":{"observed_at":"2026-08-09T11:01:27.638350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:27.644414Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.644414Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:15fcbd5775fda6f79bbd45e6556f397d0127bdc42537d237d0ae07415e3dbff1","observation_id":"66e1ef42-f30e-40f7-9831-b52e7c8ad030","resolution":{"observed_at":"2026-08-09T11:01:27.644414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:27.649564Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.649564Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:05f4893deb147353eb82326a0e97d2b9329572b34caf5fcfdfcae99d10fc08fe","observation_id":"8d5870fe-6d1b-4be3-909f-cbdf60d58788","resolution":{"observed_at":"2026-08-09T11:01:27.649564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:27.654354Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.654354Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:5efd971183e09c7a4e616152f35d0bf185f9cda9fb2a42b5cb672624e5654b4d","observation_id":"66749a5b-ebfd-4c84-be86-e4bc6e4993ec","resolution":{"observed_at":"2026-08-09T11:01:27.654354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:27.659939Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.659939Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:63ace3704ebdd9f5c0a641044f993dff0aa8459b06643824e27c35609f581b15","observation_id":"451af2e4-55ed-40cc-be6c-643faf878719","resolution":{"observed_at":"2026-08-09T11:01:27.659939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:27.667595Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.667595Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:a9d667f3eb1045d5a75f939e257821b4c810b4c57ede15dce2278575b10d4a0f","observation_id":"3fcc2efe-067f-4ee1-b0a8-73fc0656a78b","resolution":{"observed_at":"2026-08-09T11:01:27.667595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:27.673026Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.673026Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:8d9abb8c7158f9c6567242d4babbca8c164d94d68b14e1f5dadf98326a193ac8","observation_id":"70af421b-7878-489f-999f-d69d30bb2380","resolution":{"observed_at":"2026-08-09T11:01:27.673026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:27.678301Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.678301Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:e7a2c915ddeb7749406e79223128615ea5b193fa338c72cbf4a2ba6d948f1430","observation_id":"ac7af819-edf7-4b44-9007-5801c455215d","resolution":{"observed_at":"2026-08-09T11:01:27.678301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:27.683720Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.683720Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:a1b7b30593c321a21ed831b2bb67c9dcb543368d2587a4c68c935a0b2b6a2108","observation_id":"64921342-b131-4912-a10b-56b369ee39c4","resolution":{"observed_at":"2026-08-09T11:01:27.683720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:27.688863Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.688863Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:65006458fad7655128a32c133e983606c7b56b5f069795db8ef9e548093f1230","observation_id":"50bd2c19-35df-4d29-8d1c-c76169b2db54","resolution":{"observed_at":"2026-08-09T11:01:27.688863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14196","last_updated":"2024-01-26T09:23:11Z","snapshot_observed_at":"2026-08-06T22:40:28.707813Z","submitted_at":"2024-01-25T14:17:53Z","title":"DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14196","snapshot_observed_at":"2026-08-09T11:01:27.694547Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.694547Z"},"links":{"cited_paper":"/paper/2401.14196","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:1b2d7459e7aad4554e85fce4853bf3cfdc8e0789a637bf50326f2f4fc3f66cb1","observation_id":"08d3dbfa-f5b5-45d0-ac99-7ff3dcb3d8bf","resolution":{"observed_at":"2026-08-09T11:01:27.694547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11927","last_updated":"2025-02-09T08:47:20Z","snapshot_observed_at":"2026-08-18T01:30:22.717429Z","submitted_at":"2024-06-17T10:45:22Z","title":"On the Impacts of Contexts on Repository-Level Code Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11927","snapshot_observed_at":"2026-08-09T11:01:27.700470Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.700470Z"},"links":{"cited_paper":"/paper/2406.11927","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:37772c0d977796e3b0cb5883f88eebb8285df31cd299f888fb9ed32acb253074","observation_id":"2d03be14-bfed-482f-bafd-8228b52c2f25","resolution":{"observed_at":"2026-08-09T11:01:27.700470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:27.705653Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.705653Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:66412a52988cfbe0a9b58636353a89ae17c74c4a9dbaab4937348beb85805481","observation_id":"38be2714-b51b-43ab-86e3-113ed3db2636","resolution":{"observed_at":"2026-08-09T11:01:27.705653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02003","last_updated":"2025-06-27T17:28:14Z","snapshot_observed_at":"2026-08-16T14:55:48.261868Z","submitted_at":"2023-10-02T16:55:19Z","title":"L2MAC: Large Language Model Automatic Computer for Extensive Code Generation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02003","snapshot_observed_at":"2026-08-09T11:01:27.709873Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.709873Z"},"links":{"cited_paper":"/paper/2310.02003","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:0f25315aaa167adf1ec95ccd1f460be3da5c405eec6644787610552f4cd707a6","observation_id":"0564e0db-060b-46dc-8c00-92506efebb9c","resolution":{"observed_at":"2026-08-09T11:01:27.709873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:27.715744Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.715744Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:b6374de29ab83263e34bf2e49441f553745171872dab1bf719eb4c4c1132b89e","observation_id":"3fb0fda2-d138-4593-aed3-0a1756173e01","resolution":{"observed_at":"2026-08-09T11:01:27.715744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03786","last_updated":"2024-12-10T00:45:24Z","snapshot_observed_at":"2026-08-19T15:28:37.468995Z","submitted_at":"2024-05-06T18:37:35Z","title":"TOGLL: Correct and Strong Test Oracle Generation with LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03786","snapshot_observed_at":"2026-08-09T11:01:27.720307Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.720307Z"},"links":{"cited_paper":"/paper/2405.03786","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:15f2f700e12927426603cfe0cd04ccfc36e6a40bd368ae06aa7cfe940e6cb4d1","observation_id":"629cf6be-89ad-463c-8a48-37c777e023de","resolution":{"observed_at":"2026-08-09T11:01:27.720307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13010","last_updated":"2024-05-24T11:47:24Z","snapshot_observed_at":"2026-08-14T19:02:11.924748Z","submitted_at":"2023-12-20T13:22:41Z","title":"AgentCoder: Multi-Agent-based Code Generation with Iterative Testing and Optimisation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.13010","snapshot_observed_at":"2026-08-09T11:01:27.725234Z","title":"Zhang, Michael Luck, and Heming Cui","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.725234Z"},"links":{"cited_paper":"/paper/2312.13010","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:a9f8a1a19a61e63a1bac6986165122003edb73fa11c00cb095a770023a73d7f9","observation_id":"0f2de358-2068-4143-b91a-4ea4267eac6e","resolution":{"observed_at":"2026-08-09T11:01:27.725234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02037","last_updated":"2025-05-10T15:11:34Z","snapshot_observed_at":"2026-08-16T14:21:55.683344Z","submitted_at":"2024-02-03T05:24:39Z","title":"EffiBench: Benchmarking the Efficiency of Automatically Generated Code","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02037","snapshot_observed_at":"2026-08-09T11:01:27.730591Z","title":"Zhang, Yuhao Qing, and Heming Cui","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.730591Z"},"links":{"cited_paper":"/paper/2402.02037","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:783facdf2a834c73daac599e8f088dc5d73b28240d23e474d44c00ca20e5324a","observation_id":"e890235c-b66d-41f0-a450-b2dee59f3b14","resolution":{"observed_at":"2026-08-09T11:01:27.730591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:27.739917Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.739917Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:7ae9f00a25f4fde3ee6bc575162683190e03bbbdf3866f7d11e341e6172624dd","observation_id":"826199b8-ea4c-4a8b-b6af-e91aeed82810","resolution":{"observed_at":"2026-08-09T11:01:27.739917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-13T19:43:49.936776Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-09T11:01:27.748900Z","title":"Jiang, Alexandre Sablayrolles, Antoine Roux, Arthur Mensch, Blanche Savary, Chris Bamford, Devendra Singh Chaplot, Diego de Las Casas, Emma Bou Hanna, Florian Bressand, et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.748900Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:60aaa467fb353c625c0341dd62735c6f1c497d866d9d1bc15ddbd2fe2f7738fe","observation_id":"6ef81ecb-335e-4822-be91-8c1a51ee4826","resolution":{"observed_at":"2026-08-09T11:01:27.748900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-08-18T08:11:45.716032Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-08-09T11:01:27.756916Z","title":"Jimenez, John Yang, Alexander Wettig, Shunyu Yao, Kexin Pei, Ofir Press, and Karthik Narasimhan","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.756916Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:98f082aa3933fe4bd022bfb8411b66a1ba69af735ec6645babbd106e5273439c","observation_id":"696279b5-6f90-40b9-8d33-8c5058421d69","resolution":{"observed_at":"2026-08-09T11:01:27.756916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:27.766139Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.766139Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:3a5e41b19e2ac715c757ddfe23662eb165a113d9f6a1cd3ac2d833956ab00d06","observation_id":"8e06412e-c5c0-44b2-b131-9755e24b4e84","resolution":{"observed_at":"2026-08-09T11:01:27.766139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:27.779819Z","title":"Saiful Bari, Xuan Long Do, Weishi Wang, Md","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.779819Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:ecb63bbba9907fb8aa61eac451b8eba624a368dabd1b7ec9d7e3fbc0a1f75406","observation_id":"6d2e6050-5b12-48d2-99b8-949d9c6ddbce","resolution":{"observed_at":"2026-08-09T11:01:27.779819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:27.792235Z","title":"Gall, and Philipp Leitner","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.792235Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:4f225abe69805fa4b162d2822cfbb2debb5a93a0c047f273d469d56bb8163bb7","observation_id":"9942c049-851d-487d-8c17-062b82c6b07a","resolution":{"observed_at":"2026-08-09T11:01:27.792235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:27.798571Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.798571Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:28bbe3ce4c5c15891154b49427361a3a495dc6e5880025ff82b2f69fe166a6bd","observation_id":"e22b1833-b9c2-48c5-aa2c-6162f575fc75","resolution":{"observed_at":"2026-08-09T11:01:27.798571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13340","last_updated":"2024-04-20T10:27:01Z","snapshot_observed_at":"2026-08-16T13:59:17.191969Z","submitted_at":"2024-04-20T10:27:01Z","title":"Large Language Models as Test Case Generators: Performance Evaluation and Enhancement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.13340","snapshot_observed_at":"2026-08-09T11:01:27.805110Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.805110Z"},"links":{"cited_paper":"/paper/2404.13340","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:ae2a14fadf59fa9d62ab8ccc254ac2f1cc7c062bd601f0372c9823fc95cb1e83","observation_id":"4ffa50f1-9a19-4f62-8455-b5d2995fb53f","resolution":{"observed_at":"2026-08-09T11:01:27.805110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06161","last_updated":"2023-12-13T14:44:10Z","snapshot_observed_at":"2026-07-06T15:25:35.930688Z","submitted_at":"2023-05-09T08:16:42Z","title":"StarCoder: may the source be with you!","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06161","snapshot_observed_at":"2026-08-09T11:01:27.810767Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.810767Z"},"links":{"cited_paper":"/paper/2305.06161","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:82d7a16037c82f8555fd9ac7ade7aab75f8adf3e65bc584eb9937e30b93e15a4","observation_id":"bc6e170d-be68-48e4-9e23-b6066857ca7a","resolution":{"observed_at":"2026-08-09T11:01:27.810767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:27.817718Z","title":"Mankowitz, Esme Sutherland Robson, Pushmeet Kohli, Nando de Freitas, Koray Kavukcuoglu, and Oriol Vinyals","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.817718Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:e4e38ffbb2badee20ae5a9fe07ac6d0e0e8afd2b333299859e9cb29811774e1d","observation_id":"d32eb340-d6ea-4d9b-8b55-5b544c8052a8","resolution":{"observed_at":"2026-08-09T11:01:27.817718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03837","last_updated":"2024-10-23T22:22:20Z","snapshot_observed_at":"2026-08-16T13:12:28.889892Z","submitted_at":"2024-10-04T18:05:22Z","title":"Learning Code Preference via Synthetic Evolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03837","snapshot_observed_at":"2026-08-09T11:01:27.824172Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.824172Z"},"links":{"cited_paper":"/paper/2410.03837","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:2266ad7d5ffdc99b80a607255f5a74531b6d0275d1f2e00e8250fb88ec5a2953","observation_id":"90356811-4075-44d3-b53f-9665a1ab5c37","resolution":{"observed_at":"2026-08-09T11:01:27.824172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:30.180440Z","title":null,"venue":null,"work_id":"6009289c-9df7-439a-8690-f6f35f1cafa0","year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.830959Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:83c6d4bef86226a983bba101217183ce5e89088c6966d2425b1e0bd3a16d5561","observation_id":"841cb8a7-bb20-4ad9-9b1d-0dc26b1bf766","resolution":{"observed_at":"2026-08-09T11:01:30.185541Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:30.164229Z","title":null,"venue":null,"work_id":"69cfc7bf-53b7-4d1c-ba7e-097efd3bb154","year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.838120Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:09cfb479f54f7f6c9cca0f7d897544ee2e42a67ab4071fdbf4c5e54ac87e075b","observation_id":"e9840d26-3e74-4595-9e40-47ceecd1d09e","resolution":{"observed_at":"2026-08-09T11:01:30.169427Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:30.145098Z","title":null,"venue":null,"work_id":"8e67ec65-ba63-41c2-9ee9-2b9f5d24f398","year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.843331Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:255b1bba059dbe0fa40e2a43c7a47435769ea50744f77dfb3183f263b8a5aa3f","observation_id":"b4383681-f35a-4161-891c-dc8f2ecf7b91","resolution":{"observed_at":"2026-08-09T11:01:30.151706Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06450","last_updated":"2024-08-12T18:59:13Z","snapshot_observed_at":"2026-08-16T13:26:54.745068Z","submitted_at":"2024-08-12T18:59:13Z","title":"Evaluating Language Models for Efficient Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06450","snapshot_observed_at":"2026-08-09T11:01:27.848936Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.848936Z"},"links":{"cited_paper":"/paper/2408.06450","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:18a92ac72d1cbecaf9d1be6f1e75af2cc6f4721f5ec6d9440c215ca27f56be55","observation_id":"6ef479bb-d7bd-4a3c-a3b4-d7d6147f8e8b","resolution":{"observed_at":"2026-08-09T11:01:27.848936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10304","last_updated":"2025-05-31T10:23:39Z","snapshot_observed_at":"2026-08-16T14:00:36.776293Z","submitted_at":"2024-04-16T06:20:06Z","title":"LLM-Powered Test Case Generation for Detecting Bugs in Plausible Programs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10304","snapshot_observed_at":"2026-08-09T11:01:27.854500Z","title":"Zhang, Yudong Han, Yun Ma, Ge Li, and Gang Huang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.854500Z"},"links":{"cited_paper":"/paper/2404.10304","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:8fdb731be7d7e02a3c2839792981ae6bbf0c45e19611de380a27e4b275a007d9","observation_id":"8c5ac90d-eae4-4aba-9efa-86cf27f62d49","resolution":{"observed_at":"2026-08-09T11:01:27.854500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:30.125430Z","title":null,"venue":null,"work_id":"1e8b4dcd-c533-44b8-b56b-1e0f516a235f","year":2021},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.860383Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:2378958c63ee255daa67520a37f585d142cd72f257444eb970e720687231f082","observation_id":"2d439915-888d-4d30-9f9c-8bf703d01172","resolution":{"observed_at":"2026-08-09T11:01:30.131310Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03091","last_updated":"2023-10-04T01:13:49Z","snapshot_observed_at":"2026-08-17T22:17:19.637825Z","submitted_at":"2023-06-05T17:59:41Z","title":"RepoBench: Benchmarking Repository-Level Code Auto-Completion Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03091","snapshot_observed_at":"2026-08-09T11:01:27.866380Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.866380Z"},"links":{"cited_paper":"/paper/2306.03091","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:3e9b788fd1182b5778fc7a1936326bf5d59d1c817c0135e35d4186a9b7085862","observation_id":"b5d96dd9-ea98-4459-a447-fbe6b1b296a8","resolution":{"observed_at":"2026-08-09T11:01:27.866380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19173","last_updated":"2024-02-29T13:53:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-29T13:53:35Z","title":"StarCoder 2 and The Stack v2: The Next Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19173","snapshot_observed_at":"2026-08-09T11:01:27.873127Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.873127Z"},"links":{"cited_paper":"/paper/2402.19173","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:7528b386224adbcabd567b4c94edd0b7419ba6e3c4b417c710c51f00977da5d8","observation_id":"c25ebc54-e05a-464e-b424-77a4e28db153","resolution":{"observed_at":"2026-08-09T11:01:27.873127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08568","last_updated":"2025-05-27T07:40:36Z","snapshot_observed_at":"2026-08-16T15:23:56.097387Z","submitted_at":"2023-06-14T15:18:48Z","title":"WizardCoder: Empowering Code Large Language Models with Evol-Instruct","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08568","snapshot_observed_at":"2026-08-09T11:01:27.878875Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.878875Z"},"links":{"cited_paper":"/paper/2306.08568","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:afba9fd9fa8d205c351ec8774352eea67e4469cc97ea75d5db9966f7f2a07627","observation_id":"9477b9e8-fd45-41c9-b61b-797c03b4649d","resolution":{"observed_at":"2026-08-09T11:01:27.878875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:30.107718Z","title":null,"venue":null,"work_id":"803209b2-f1cf-4c42-8f97-dabcf30a1206","year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.884266Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:bc69df2f229fb7d4ba17fb88601e526a0687c33d63a89853f1c6e1f2ebbe2b4d","observation_id":"316ff6a8-1b26-4f8e-866f-d9f99315d8f3","resolution":{"observed_at":"2026-08-09T11:01:30.113152Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:30.091605Z","title":null,"venue":null,"work_id":"21d03f1b-62ee-4fce-a4e1-d2d4530cf482","year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.889218Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:cca9d4bc161c7331cfd9a676407029e35614a88b269b42d0f6c677b95cfa761c","observation_id":"ce7cc4a0-a82a-4b90-bbb0-93020d9e0124","resolution":{"observed_at":"2026-08-09T11:01:30.096754Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:30.069797Z","title":null,"venue":null,"work_id":"51b31480-0afe-455f-9e54-d6ef48988653","year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.894222Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:9be72857403088dd5863c8730852e1d8403af72d50e0f31dc68dc98558c32c65","observation_id":"18ba5637-6507-479e-9361-badc9b2af453","resolution":{"observed_at":"2026-08-09T11:01:30.080623Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12952","last_updated":"2025-02-07T12:33:06Z","snapshot_observed_at":"2026-08-19T06:03:37.063210Z","submitted_at":"2024-06-18T14:54:37Z","title":"SWT-Bench: Testing and Validating Real-World Bug-Fixes with Code Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12952","snapshot_observed_at":"2026-08-09T11:01:27.898502Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.898502Z"},"links":{"cited_paper":"/paper/2406.12952","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:356787c03d6b97d50e5b37351e7e4f5fcdec4984fa2e1963f308c39f7a29c4f6","observation_id":"0ebc691d-d01c-46f6-bb7d-91bd5fee1899","resolution":{"observed_at":"2026-08-09T11:01:27.898502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:30.049950Z","title":"Wang, and Xi Victoria Lin","venue":null,"work_id":"e1f17fd7-de14-4bbc-81dc-1e04484b9a9f","year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.904668Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:88eac45948f05086103fdf18e438960341bca3c9ecd7a0ea22a608fb7cd34532","observation_id":"e5b6ebfe-1dc8-464b-8dbd-6f8312ef5b02","resolution":{"observed_at":"2026-08-09T11:01:30.055279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02309","last_updated":"2023-07-11T21:11:23Z","snapshot_observed_at":"2026-08-19T16:41:41.298016Z","submitted_at":"2023-05-03T17:55:25Z","title":"CodeGen2: Lessons for Training LLMs on Programming and Natural Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02309","snapshot_observed_at":"2026-08-09T11:01:27.910143Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.910143Z"},"links":{"cited_paper":"/paper/2305.02309","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:1ec5c92ae728172fc55b99c0ef82e95fee9e93c4b3aa0a15d541c4d0d5f31e56","observation_id":"31ba6f2e-7ea5-4953-bdea-244441ce724b","resolution":{"observed_at":"2026-08-09T11:01:27.910143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:27.916561Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.916561Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:a79b98b23472697da8af4bf4cb19f17a1ac80e111350e860d1d33dd5bb9cbac3","observation_id":"24894ea6-cc86-44d4-bbac-62095fc8e673","resolution":{"observed_at":"2026-08-09T11:01:27.916561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:29.997726Z","title":null,"venue":null,"work_id":"27e4459d-1343-4385-80fe-1fbf8308352c","year":2022},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.928243Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:5e825e93752cfd01e5b328aca4b6dae3a8b14d5aac0d14ae5469e0958414422c","observation_id":"1fdeb614-f4b3-4e05-9464-cc8f3baddcbc","resolution":{"observed_at":"2026-08-09T11:01:30.003550Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-09T11:01:27.933278Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.933278Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:44a604347c6f4a7129bad9133fcafb945950c818d5bf16ec7346a38ad07aabe9","observation_id":"3d39e27c-2bf7-4b1d-988d-787666d9fa73","resolution":{"observed_at":"2026-08-09T11:01:27.933278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:30.015619Z","title":"In The Eleventh International Conference on Learning Representations, ICLR 2023, Kigali, Rwanda, May 1-5, 2023","venue":null,"work_id":"8bd4a81d-42c0-4cfb-b0cf-791aee9657d5","year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.922552Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:e1be179919931f272d8898270a449e5efdf5bf51299fdbc29898571c53fd0f78","observation_id":"4997876d-6c1c-4aec-ba10-8e3cbedd9b0b","resolution":{"observed_at":"2026-08-09T11:01:30.021279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:29.961942Z","title":null,"venue":null,"work_id":"3e6a2a03-6b2a-4624-a190-08b9fa7ea7ed","year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.945291Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:ff536708778f3d83dbe0035b441dc9d0d69b7ac632e4af47ac58f743c50a8e38","observation_id":"b7f67494-1b00-4b4f-9328-e3f34d6d2e4d","resolution":{"observed_at":"2026-08-09T11:01:29.968127Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:29.942274Z","title":"Wainwright, Pamela Mishkin, Chong Zhang, et al","venue":null,"work_id":"b5f0e176-a19d-423a-9411-a3cdd78bef7c","year":2022},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.950581Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:bbcb7a2472002eab4586f6461e64054aa6a731ecca4d609de750f8fdd38894bf","observation_id":"60244f9c-2b78-4bd8-942a-4b9c11d6d2c7","resolution":{"observed_at":"2026-08-09T11:01:29.949390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:29.979935Z","title":null,"venue":null,"work_id":"b5910420-d3f4-401c-a147-f27287fbd8b6","year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.940374Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:01f2b2accfe18ea92a7d8735f32219a6eff355d4d36b931cf53ab2f9d2b71dee","observation_id":"5f1e09bd-f276-4b50-9c60-0c38c147c052","resolution":{"observed_at":"2026-08-09T11:01:29.985183Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:27.961023Z","title":"Rizwan Parvez, Wasi Uddin Ahmad, Saikat Chakraborty, Baishakhi Ray, and Kai-Wei Chang","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.961023Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:c3e6af08a1239bd708cf2990608b983299757bf1ddb038132d2ab891fdb0c582","observation_id":"c2100dc2-7426-4eb5-9d7f-20611a45224d","resolution":{"observed_at":"2026-08-09T11:01:27.961023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:29.921307Z","title":"Patterson and John L","venue":null,"work_id":"5f1a1a17-991b-457f-9e03-26e1368f42f6","year":2012},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.966060Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:7001b3e826e613b27bef4bb71faca939c90012de0bfb98594ab0f00832929441","observation_id":"f8e2b0be-acd5-465a-9c44-75596c7ceb0c","resolution":{"observed_at":"2026-08-09T11:01:29.927141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:27.956007Z","title":"Ouédraogo, Kader Kaboré, Haoye Tian, Yewei Song, Anil Koyuncu, Jacques Klein, David Lo, and Tegawendé F","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.956007Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:64d5528e1957dc740fa33825c849f4c538c9fee8dc0175dceddfa159cc52d6b1","observation_id":"1b2b1eb8-6585-479b-873b-4759ce87daf2","resolution":{"observed_at":"2026-08-09T11:01:27.956007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08500","last_updated":"2024-01-16T17:00:36Z","snapshot_observed_at":"2026-08-17T15:38:45.204670Z","submitted_at":"2024-01-16T17:00:36Z","title":"Code Generation with AlphaCodium: From Prompt Engineering to Flow Engineering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08500","snapshot_observed_at":"2026-08-09T11:01:27.976791Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.976791Z"},"links":{"cited_paper":"/paper/2401.08500","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:56360ac2ad2bfbcfbb4ad222663c31c80e7d02ea84a0e68ec54f1917e7f01813","observation_id":"57c2031e-7f91-4477-a4ae-b9e06ada4e0f","resolution":{"observed_at":"2026-08-09T11:01:27.976791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-08-18T03:59:39.242039Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-09T11:01:27.983143Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.983143Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:8bdf70252badc8c462beb111ea060fc7f5cdba90b04e7c55faaccf2c894a4a72","observation_id":"2f8f4d18-0282-48d9-8c9a-0d3fc7a3bb58","resolution":{"observed_at":"2026-08-09T11:01:27.983143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03578","last_updated":"2024-11-18T06:22:38Z","snapshot_observed_at":"2026-08-16T05:55:42.453545Z","submitted_at":"2024-11-18T06:22:38Z","title":"PerfCodeGen: Improving Performance of LLM Generated Code with Execution Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03578","snapshot_observed_at":"2026-08-09T11:01:27.970994Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.970994Z"},"links":{"cited_paper":"/paper/2412.03578","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:2af87fc82632bef7c88848f85eac09492c668e0846b07e27225d8e65bdd6ba60","observation_id":"e6a3fae2-d1cf-4053-8170-e36c31054c6c","resolution":{"observed_at":"2026-08-09T11:01:27.970994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:28.002731Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:28.002731Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:f73956c2bbf586232dd195841b29294b926eaf41f60864dc4bbbd51700969e50","observation_id":"0c06d152-e6db-44d3-be5a-0b1820049d9e","resolution":{"observed_at":"2026-08-09T11:01:28.002731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:29.884426Z","title":null,"venue":null,"work_id":"21f4f65d-5656-457b-85a1-1dfaf61027a5","year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:28.010541Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:3754a4d2dd146957637da7d3911b2f0491852d1334c921d90ab4e687e8448c81","observation_id":"1ce7d485-c639-46c3-a003-ea7135f190ed","resolution":{"observed_at":"2026-08-09T11:01:29.890410Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:29.903094Z","title":null,"venue":null,"work_id":"ec791d05-d9fa-44fb-8bb8-3747b2708636","year":null},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.988809Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:1b8d67b620b4d7ce0acdb2311702dd4dabfc7656125c30f424ca2fc02a743c38","observation_id":"ee7218ea-f8b1-4929-9b7e-26adf840ffd4","resolution":{"observed_at":"2026-08-09T11:01:29.909348Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07021","last_updated":"2024-06-11T07:26:13Z","snapshot_observed_at":"2026-08-19T12:28:42.461464Z","submitted_at":"2024-06-11T07:26:13Z","title":"A Tool for Test Case Scenarios Generation Using Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07021","snapshot_observed_at":"2026-08-09T11:01:27.994594Z","title":"CoRR abs/2406.07021 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.994594Z"},"links":{"cited_paper":"/paper/2406.07021","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:499a17a2c380ad58ff1b3890259ffde42cf80c1d6cd825ab7627b432440ab8ad","observation_id":"79c8c4e5-18ff-4361-9c93-a3a4e010a898","resolution":{"observed_at":"2026-08-09T11:01:27.994594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12317","last_updated":"2024-12-03T15:56:26Z","snapshot_observed_at":"2026-08-16T14:17:15.117084Z","submitted_at":"2024-02-19T17:37:28Z","title":"EVOR: Evolving Retrieval for Code Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12317","snapshot_observed_at":"2026-08-09T11:01:28.028734Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:28.028734Z"},"links":{"cited_paper":"/paper/2402.12317","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:0d13bb8d002ae0a45eec31f7a4a3b8efb0ffdd9557864ac9c962871001a082d2","observation_id":"fe01a149-1152-400e-8dea-0f63b6684d79","resolution":{"observed_at":"2026-08-09T11:01:28.028734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:28.036297Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:28.036297Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:d84065165ff54bc53064bfe9d76ce476c4ea4ca7f069617bd0664de83271f214","observation_id":"2db13087-fc95-4352-8226-13eb8c1b23aa","resolution":{"observed_at":"2026-08-09T11:01:28.036297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:29.863080Z","title":"Gardner, Yiming Yang, Milad Hashemi, Graham Neubig, Parthasarathy Ranganathan, Osbert Bastani, and Amir Yazdanbakhsh","venue":null,"work_id":"e0d6450d-21c4-4934-b15f-dfab7da41982","year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:28.017272Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:0810cff80fa13e503c4b483d884d95014e91f947930c6f340b844777e8ae99fc","observation_id":"5f22ea9d-f5d8-4c6c-9cc1-9fe84750a3a6","resolution":{"observed_at":"2026-08-09T11:01:29.870625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:29.841640Z","title":"Kinoshita, and Donald Lee","venue":null,"work_id":"7de0537c-8689-4a0d-be52-8065493cac15","year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:28.023502Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:6d87fabbbbd8cf53f79886b4e615cc8a5beb86b125533869d41e91a91c00649f","observation_id":"723bb15b-b5f8-47ed-9036-b079d38f1e2d","resolution":{"observed_at":"2026-08-09T11:01:29.847517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:28.053368Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:28.053368Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:4c0a998b8119bb15d456b7796b2a579c7d474023df63ba257ef32886d085783c","observation_id":"51eff561-1c2c-4b82-92d4-549eee775b1c","resolution":{"observed_at":"2026-08-09T11:01:28.053368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:28.062354Z","title":"Joty, and Steven C","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:28.062354Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:f02aea51185a09b52e03edb03ec49c4025739cdd7a7569f8ea899d60a27cc706","observation_id":"fb21d99c-ced5-49ba-a18c-a44970140e3d","resolution":{"observed_at":"2026-08-09T11:01:28.062354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04531","last_updated":"2025-02-01T08:28:28Z","snapshot_observed_at":"2026-08-16T13:45:20.623404Z","submitted_at":"2024-06-06T22:07:50Z","title":"TESTEVAL: Benchmarking Large Language Models for Test Case Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04531","snapshot_observed_at":"2026-08-09T11:01:28.042521Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:28.042521Z"},"links":{"cited_paper":"/paper/2406.04531","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:598b6c473fb6f7a7c9dc1d0821c7b08b7861f24d0763fc97130f683e59588010","observation_id":"a62b8d6b-1162-4109-ad1e-f8491b2341ad","resolution":{"observed_at":"2026-08-09T11:01:28.042521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01030","last_updated":"2024-06-07T01:53:07Z","snapshot_observed_at":"2026-08-16T14:22:20.166702Z","submitted_at":"2024-02-01T21:38:58Z","title":"Executable Code Actions Elicit Better LLM Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01030","snapshot_observed_at":"2026-08-09T11:01:28.047912Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:28.047912Z"},"links":{"cited_paper":"/paper/2402.01030","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:dec2896fa39289237a4bf3ab4d3986d6dd063467a95d724cafe407c486186943","observation_id":"40953331-f0e2-41ab-9fdc-93f95fd4d805","resolution":{"observed_at":"2026-08-09T11:01:28.047912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:29.772997Z","title":null,"venue":null,"work_id":"14cbe260-fb46-48e1-8e0b-7516b115dfd7","year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:28.086119Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:9772c55943bef162431034d05155950e93726f18f266ebe71c15fc8e504cbd92","observation_id":"cd8d16a3-f92b-48eb-9627-601f2b8e3891","resolution":{"observed_at":"2026-08-09T11:01:29.779420Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:29.754982Z","title":null,"venue":null,"work_id":"58cae079-8d9a-4450-8713-76ff20a518af","year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:28.093113Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:3444295e43e89e50669bf042529e09cc1fc0f220515e888f4e44e641aac3ba63","observation_id":"2ada420f-c3ed-4371-9f1c-317de3e21410","resolution":{"observed_at":"2026-08-09T11:01:29.760589Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:28.099706Z","title":"Jimenez, Alexander Wettig, Kilian Lieret, Shunyu Yao, Karthik Narasimhan, and Ofir Press","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:28.099706Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:bd08ee7a0e70e84b4fcae5ce8a33c4e9da7ca7bd44fca6334d4c8c8604901bd7","observation_id":"ecb57bff-dcba-4d6b-88d1-83d18ad348e5","resolution":{"observed_at":"2026-08-09T11:01:28.099706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:29.791783Z","title":"Chi, Tatsunori Hashimoto, Oriol Vinyals, Percy Liang, Jeff Dean, and William Fedus","venue":null,"work_id":"e6b5f732-ace7-40c5-84f1-1e13708487de","year":2022},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:28.074997Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:239ce738a8157b4a6d850ff3e92c6e12b3fa2c6cbd6149e095e0b3fdca30828a","observation_id":"c207b9ff-2b48-4563-a9aa-c9a6220747a6","resolution":{"observed_at":"2026-08-09T11:01:29.798130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02120","last_updated":"2024-06-07T02:50:56Z","snapshot_observed_at":"2026-08-16T22:22:41.448725Z","submitted_at":"2023-12-04T18:50:35Z","title":"Magicoder: Empowering Code Generation with OSS-Instruct","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02120","snapshot_observed_at":"2026-08-09T11:01:28.080365Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:28.080365Z"},"links":{"cited_paper":"/paper/2312.02120","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:2d65bd9698848a049967c4447bf38edd1d4c9eec64fe7be5169df69e426c4a11","observation_id":"3f99a981-3e91-45b9-82a0-8dbf99a69fb7","resolution":{"observed_at":"2026-08-09T11:01:28.080365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:28.136071Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:28.136071Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:5639d7be3a52f400a764a6b80ddaf17213b1b5415f0a7519de50fd8376d53585","observation_id":"c629af8d-24f5-493d-8d5b-6c24d8c2a2bd","resolution":{"observed_at":"2026-08-09T11:01:28.136071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05427","last_updated":"2024-07-25T16:54:41Z","snapshot_observed_at":"2026-08-19T01:23:53.899987Z","submitted_at":"2024-04-08T11:55:09Z","title":"AutoCodeRover: Autonomous Program Improvement","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05427","snapshot_observed_at":"2026-08-09T11:01:28.149694Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:28.149694Z"},"links":{"cited_paper":"/paper/2404.05427","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:c603ed5a338fb81d296de185f438bb40bcdba9289ad048f30feecf4f785e0e66","observation_id":"552dfd8c-f71b-4623-adae-564d7884f8fc","resolution":{"observed_at":"2026-08-09T11:01:28.149694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15793","last_updated":"2024-11-11T20:01:15Z","snapshot_observed_at":"2026-07-06T18:19:29.996982Z","submitted_at":"2024-05-06T17:41:33Z","title":"SWE-agent: Agent-Computer Interfaces Enable Automated Software Engineering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15793","snapshot_observed_at":"2026-08-09T11:01:28.105672Z","title":"CoRR abs/2405.15793 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:28.105672Z"},"links":{"cited_paper":"/paper/2405.15793","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:c53b7b9ddfa63b17e0c11bc14d57b3540bbaf5c97e77c6c3c987df68ef63fd88","observation_id":"43d2f080-b21e-4de6-ba29-4a55aed17c5a","resolution":{"observed_at":"2026-08-09T11:01:28.105672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:28.112679Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:28.112679Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:28bb7b7ad79825425dfc37a9dac193bfc0e0edd2a8423b06d5b4b8efea710b1f","observation_id":"c8762213-a808-4ce3-b741-a40b7903ec32","resolution":{"observed_at":"2026-08-09T11:01:28.112679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2009.49196","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:29.088317Z","title":null,"venue":null,"work_id":"d36138f5-da53-430b-afbb-300e5691b553","year":2009},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:28.118530Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:12ed8f4081afcc623742929035ac47d56c835068f620482849b02a6585cab38b","observation_id":"0c549d71-f1b8-41cb-99a8-6d5d3b3b18d9","resolution":{"observed_at":"2026-08-09T11:01:29.099074Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11931","last_updated":"2024-06-17T13:51:35Z","snapshot_observed_at":"2026-08-14T04:42:19.578053Z","submitted_at":"2024-06-17T13:51:35Z","title":"DeepSeek-Coder-V2: Breaking the Barrier of Closed-Source Models in Code Intelligence","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11931","snapshot_observed_at":"2026-08-09T11:01:28.173937Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:28.173937Z"},"links":{"cited_paper":"/paper/2406.11931","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:7027789feafc66ece897cbf0f7ec4f310132bb283fa5220f5743b92fb1fa3896","observation_id":"e4d5c3b3-4d90-4554-a80e-e458940802cb","resolution":{"observed_at":"2026-08-09T11:01:28.173937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:28.143453Z","title":"In Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing, EMNLP 2023, Singapore, December 6-10, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:28.143453Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:68104056f3e7fce40c2f95138ac0b876a9857376e6189d9dd6ecf29e8002a137","observation_id":"646b082e-bc17-4900-871a-776ff40c2714","resolution":{"observed_at":"2026-08-09T11:01:28.143453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17568","last_updated":"2024-07-10T03:52:58Z","snapshot_observed_at":"2026-08-18T04:45:35.100934Z","submitted_at":"2023-03-30T17:34:01Z","title":"CodeGeeX: A Pre-Trained Model for Code Generation with Multilingual Benchmarking on HumanEval-X","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17568","snapshot_observed_at":"2026-08-09T11:01:28.155586Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:28.155586Z"},"links":{"cited_paper":"/paper/2303.17568","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:d58cbba6f968df895f8d1c36b63c72aa685b58ce17aca0f2e05f8f079f751d74","observation_id":"38625d8a-dcc7-4d2c-859c-263623ed0152","resolution":{"observed_at":"2026-08-09T11:01:28.155586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04406","last_updated":"2024-06-06T02:51:17Z","snapshot_observed_at":"2026-08-13T11:34:11.989911Z","submitted_at":"2023-10-06T17:55:11Z","title":"Language Agent Tree Search Unifies Reasoning Acting and Planning in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04406","snapshot_observed_at":"2026-08-09T11:01:28.162800Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:28.162800Z"},"links":{"cited_paper":"/paper/2310.04406","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:3b00ab4039a9badac453c54af854709114db6657843d50472324cd483272868d","observation_id":"cef39351-900b-4a71-ba0f-470190061671","resolution":{"observed_at":"2026-08-09T11:01:28.162800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:29.709004Z","title":"Xu, Zhengbao Jiang, and Graham Neubig","venue":null,"work_id":"e32c7438-c4f8-4b40-b6de-2121258441fe","year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:28.168649Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:d340d559cc8e61b4c24b27cca81d0021627e55e505b4b2e236d53c5aba5c2f96","observation_id":"c19b806e-c5c1-4996-b3e5-5813ada8d505","resolution":{"observed_at":"2026-08-09T11:01:29.714608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:01:28.068709Z","title":"https://doi.org/10.18653/V1/2021.EMNLP-MAIN.685","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:28.068709Z"},"links":{"citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:90d10571aaf1977296d85743ea137d3831468877b8534773f55d39ebb6dcc32d","observation_id":"acd3711e-23ff-4f18-8f1f-428ad2eb72a9","resolution":{"observed_at":"2026-08-09T11:01:28.068709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03004","last_updated":"2023-11-06T07:16:58Z","snapshot_observed_at":"2026-08-16T15:50:32.561290Z","submitted_at":"2023-03-06T10:08:51Z","title":"xCodeEval: A Large Scale Multilingual Multitask Benchmark for Code Understanding, Generation, Translation and Retrieval","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03004","snapshot_observed_at":"2026-08-09T11:01:27.786095Z","title":"CoRR abs/2303.03004 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-09T11:01:27.786095Z"},"links":{"cited_paper":"/paper/2303.03004","citing_paper":"/paper/2502.02827"},"observation_digest":"sha256:b34e08171a478282d2fd1723e2f2053a017ef3e98a798e3036e5eaebb36d8ba6","observation_id":"83b506bb-45da-4628-9654-70099c0ad959","resolution":{"observed_at":"2026-08-09T11:01:27.786095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.02827","last_updated":"2025-02-05T02:08:51Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-16T01:02:06.579929Z","submitted_at":"2025-02-05T02:08:51Z","title":"COFFE: A Code Efficiency Benchmark for Code Generation"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":90,"verified_exact":0,"verified_fuzzy":8},"total_outbound_references":101},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 100 of 101 outbound references and 5 inbound Pith citation observations for arXiv:2502.02827."}