{"as_of":"2026-08-09T10:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d3db9f18dcde4ff81dae5c1dab8bdd93bdbca4e0e105ace1785fcb9b7562f379","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-25T20:09:37.551395Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.25530/citation-record","integrity":"/paper/2606.25530/integrity","json":"/paper/2606.25530/citation-record.json","paper":"/paper/2606.25530"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"SWE-perf: Can language models optimize code performance on real-world repos- itories? InSubmitted to The Fourteenth International Conference on Learning Representations,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:b88b97f26fad467ac5a251685e5baedf543fc046e2289ba64f51002d5c298063","observation_id":"0848b2fa-d65b-4965-97da-c9532e052142","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"Claude sonnet 4.6","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:ce2be77304b8513fc4e654a4f2837da193020704409f2f469ecda2e785878903","observation_id":"b19ef983-16ca-4f05-9b4c-eb01b6ae4f37","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:0c2a967878c42b3117b1f2a90363cfd41e93f983858b1240fd99b96c53d9ec40","observation_id":"b242db89-241e-4966-b494-db5bf5fea3c9","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"John Wiley & Sons, Ltd, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:0fb17a3d482a861a62442f87f7284f7f9efc44cd0fb4700da6bf0fce7f319d39","observation_id":"46d3ccde-352e-4dac-b8d7-ac2d425dfbbb","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"Mercury: a code efficiency benchmark for code large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:691b5e3f5222e232f85f16613d3f419de5065b605a37f97660ea4d0ad1d90ade","observation_id":"697bdaef-60c2-4e6e-a90c-cb44ba84bce5","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"Lyu.Search-Based LLMs for Code Optimization, page 578–590","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:89b1679b83d0b41e78a11ee6db177d9d1fe3b7742344b860ad4f07a10fc5b2b6","observation_id":"746751f9-a8b7-4b93-a726-e690bc2f55cd","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"Statistically rigorous java performance evaluation","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:a048e9c71c9a8231bc13ef3a0aa185f44c4dfabffd0e8746009697e283417e99","observation_id":"1a7beae1-fc5d-4a61-b657-06654699b5b0","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"Language models for code optimization: Survey, challenges and future directions, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:9c2c698a1babd2e59cdd074749e73f0c9e5c7e2c7f32379b4006fb84708701bc","observation_id":"a54b55cf-9b54-4b26-81ae-95fdc3a323f3","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"Gemini 3.1 flash","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:2cecf0d6bc29f060e901c8c6478d772de55f1074b218cf50cdd7ae77c9281403","observation_id":"7f1afbe2-dde3-4fae-aed9-e2ec63665401","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"Effibench: Bench- marking the efficiency of automatically generated code","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:617d8e700639ada539c4b0f1e68a914e9509b82b4eab03f2ec23f61ccda8c09d","observation_id":"fe06543f-7608-4e20-aa46-8b0e1c4392de","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"Monzurul Amin Ifath and Israat Haque","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:7f72f9cde305e1543c77decf543aa5772d0e8af5eab4a83f5736c15bfd26b46f","observation_id":"b401a4df-be9c-4b19-9d17-70bb1ef8524e","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":null,"venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:1fe3e1fc3b60fb5366b54ac719ceb08bf2023ce208f2327e66a6911a5b067820","observation_id":"f281f071-0bcc-49c4-a135-575fc04a14a7","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"A survey on large language models for code generation.ACM Trans","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:06b3ba9b540212d32f7c55bb074c16cb7f33cccee019b6d6e47c557d087f31ec","observation_id":"c14eb221-6c72-4b82-ab6f-fb0f093a7ef7","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"Jimenez, John Yang, Alexander Wettig, Shunyu Yao, Kexin Pei, Ofir Press, and Karthik Narasimhan","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:a695ce59f00083c9acb62cea2b36b9263c53594a73efded22a07b81e12abc16e","observation_id":"0a42aa90-e44b-4101-a916-7ebd8e52e3ab","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"Understanding and detecting real-world performance bugs","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:82202217fa5004fff468185eef6e8b135fd49fcfa51d523923afdc8d9194f993","observation_id":"d45fcaaa-1943-4fb9-aabd-a7c4a0ee45a6","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"Rigorous benchmarking in reasonable time","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:b2efdf45b21cc2f1488231e3b922c80c63701057dff5c0dfe65dd6f7e7018799","observation_id":"ba5090aa-c2f5-45b4-a0f3-c1e368e44a3a","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"Gall, and Philipp Leitner","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:4bfb541309134fa05ee29556f6feff122734850c879b80f5d282d0d968ca438e","observation_id":"d5d145f1-9818-4018-9085-149181e94e9b","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"Input sensitivity on the performance of configurable systems an empirical study.Journal of Systems and Software, 201:111671, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:0892b85425c47df1087b9d432745cc4f36a3a2c39c7cc61701e9fcf70add6d0a","observation_id":"64b77921-2c8e-4c68-a8d8-e4f1763765f3","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.10073","last_updated":"2021-02-19T18:12:44Z","snapshot_observed_at":"2026-07-06T10:42:58.934714Z","submitted_at":"2021-02-19T18:12:44Z","title":"Pyserini: An Easy-to-Use Python Toolkit to Support Replicable IR Research with Sparse and Dense Representations","version":1},"cited_work":{"arxiv_id":"2102.10073","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2102.10073","snapshot_observed_at":"2026-07-04T20:30:07.120934Z","title":"Jiachang Liu, Dinghan Shen, Yizhe Zhang, Bill Dolan, Lawrence Carin, and Weizhu Chen","venue":null,"work_id":"8bdde622-9d2c-4412-b9a4-44239d78692e","year":2021},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"cited_paper":"/paper/2102.10073","citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:c89318990745e5e7c88a2fe30e35733b0fa3aec9902bb33fe8ad8bcb16b0df9e","observation_id":"08e51002-92cd-4d61-ab34-b34192e224d9","resolution":{"observed_at":"2026-07-04T20:30:07.123394Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"Swe-fficiency: Can language models optimize real-world repositories on real workloads?, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:f2b407dc9f78deae43f344853ec9ee961c85dcf4d50fdd05e177f1183c038fdc","observation_id":"07b66a8e-ca2d-4007-aa4b-965e857bc9ce","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"MiniMax M27.https://www.minimax.io/news/minimax-m25, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:c9fea9895e18a8e6a5356e1f7f9351bd09b21432824c4705379b24a1f0dadb26","observation_id":"7966fdd9-f859-4f68-9d7e-239f674c7d3d","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"Kimi K2.5","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:11ba34b9d1be972c6bdd11c34be7ddf59d181471ae342146186febd97565fc15","observation_id":"0783defb-56b8-49a2-becc-b0218ef4669d","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"Analyzing the impact of workloads on modeling the performance of configurable software systems","venue":null,"work_id":null,"year":2085},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:969264ee22555518cd11544bff94f0dd3188cb2efcbdbddfc2f8e083baf3533d","observation_id":"dde4ef08-7ada-40de-8df4-4c6f1dcd9ac0","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:2433a3f97aeeabc012396c52c800c2a8e3509eee5651366eb6f25589d947fe7f","observation_id":"af9ede46-7647-4470-8be3-d903816fb74a","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"Discovering, reporting, and fixing performance bugs","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:d34317681e51eb53d6136a1beb2f7b7eb785cadf757813e657c725cd746d3e34","observation_id":"c1aaa681-e5a8-418e-92d0-be80dc40ade3","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"Introducing GPT-5.2","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:5ea6d7224b18a71a6e9c7788e5828c638eb6370f4d17ded15a5bccf96e4a19e0","observation_id":"9b3a2ace-7e7e-497e-abf9-c76017b85403","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"Lyu, Caiming Xiong, Silvio Savarese, and Doyen Sahoo","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:51665d817501771e317c28d8f6e793a7010ffe08e83830f4ef849045073999e3","observation_id":"04e3a7f0-ded9-409e-9c58-26d8e043fba8","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"Coffe: A code efficiency benchmark for code generation, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:39b6cd21c923329f7d2110d8833abf6331f79f23e998201d2974199635a37a15","observation_id":"4cb262f0-4fc3-4e7a-9085-260acda5e8fe","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:f5343c8aa3f069abce4da81e1405bf6315fa066b3eaaae97e1eeaf21ed8756c3","observation_id":"9f884374-be46-4515-aa40-b857cd428d71","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"tracemalloc — Trace memory allocations","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:0227e97a079cc42c431ac17cd414f7e1b1f1d06a2b5f752f3a40739d65124312","observation_id":"8bd6cd4a-348a-473a-8e43-cae31c78c5a0","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"Zhang, Heming Cui, Siu Ming Yiu, Dong HUANG, See-Kiong Ng, and Anh Tuan Luu","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:6fb9bde58606f80da46a6fa6dbb8b8e31207b54fdb5df6493a6877d66e487b51","observation_id":"25e9c537-7411-4a38-9b3f-46beeb615cff","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"How efficient is llm-generated code? a rigorous & high-standard benchmark, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:691c049281c22e671e51fa19bf7b5545dcb4a023bc42e83df2f2762f260326ca","observation_id":"75bd916e-a941-490b-bdb1-4db9285ab4ca","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"A large-scale empirical study on mobile performance: energy, run-time and memory.Empirical Softw","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:ff11dfe9aaed5812b3335f729f079d45d97fe6fffaaebad178872e683cc2ffbc","observation_id":"c565f4b7-0036-4ebf-a37a-4152966959ab","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"Saha, Matthew Lease, Sarfraz Khurshid, and Dewayne E","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:ab3db398868644c1eb78c2315ebc14dd7451b75be3c3289084f8394526301569","observation_id":"7a3513c0-bae1-4519-b038-236ea342bfdd","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"Gso: Challenging software optimization tasks for evaluating swe-agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:216212188d2565d747996cfe7e0225625391e60dec7270ec2caf7933da2a4330","observation_id":"e4a798c4-09f3-4702-8f62-8616f6c17d95","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"Learning performance-improving code edits, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:70d3cc33d78d1315c2c8afe8f867a635c51930d78591fdd2070f2391d7f85576","observation_id":"59f168cc-90c5-4c62-a95f-08c729f62b7d","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:07d49a1c755ae63de0749e447e13d270b1ec504a645ee6ce5c5041d5928c6e80","observation_id":"1c5a8b2e-ddb4-4e78-848c-0bfdfee8a7b6","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"Ecco: Can we improve model-generated code efficiency without sacrificing functional correctness?, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:b81c09cd499df2b69de2bf0432f844e146dc9028538ce21d429bdb7ac35a7848","observation_id":"032fb1b0-b2bb-4b0f-8604-61a9e414b562","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"Perfgen: Automated performance benchmark generation for big data analytics, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:d3f1673f4a9ff188eefce12d56ffeb26a45f30c75d6d96ea86d51d0eca657cf9","observation_id":"ee6a826f-2f8a-426b-a3c8-3e2016dbb16c","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"GLM-51.https://z.ai/blog/glm-5.1, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:db4f3a85bb40613083813c0da6bd8bc36db347eecaac62d6721d2fd135e7154a","observation_id":"e88ba221-aa15-40c7-b58b-d471a5965476","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:66b4fc80e7a9df25a891e8b89aa8d50833a8f19f1a231cae187904ac0264a4c5","observation_id":"cf513d70-7dec-4dea-b36a-d50e499237b6","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T20:09:37.551395Z","title":"\"\" PR #50778 - Benchmark Series.replace when using a large dict for to_replace. Parameters: - N: Series length - R: Number of values to replace","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-25T20:09:37.551395Z"},"links":{"citing_paper":"/paper/2606.25530"},"observation_digest":"sha256:46c54579c5f846d7333645dec5a1813cdac5f2b05c31845fa949c78ff6494a6a","observation_id":"ec033e3d-f27b-4dad-b549-e7f97e707923","resolution":{"observed_at":"2026-06-25T20:09:37.551395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.25530","last_updated":"2026-06-24T08:07:41Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-06T10:30:55.741121Z","submitted_at":"2026-06-24T08:07:41Z","title":"Evaluating LLMs on Real-World Software Performance Optimization"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":41,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2606.25530."}