{"as_of":"2026-08-17T00:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e042d92b5b6aa910394728834354c65514b60ec4b954b7ac1d43bfeb9f62de91","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:45:44.110888Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.23598/citation-record","integrity":"/paper/2505.23598/integrity","json":"/paper/2505.23598/citation-record.json","paper":"/paper/2505.23598"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2308.10620","last_updated":"2024-04-10T08:41:22Z","snapshot_observed_at":"2026-08-16T15:07:02.749105Z","submitted_at":"2023-08-21T10:37:49Z","title":"Large Language Models for Software Engineering: A Systematic Literature Review","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10620","snapshot_observed_at":"2026-08-07T12:45:40.068254Z","title":"Large language models for software engineering: A systematic literature review,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:40.068254Z"},"links":{"cited_paper":"/paper/2308.10620","citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:5c6b7794e28f4c0b3d098f5f42b7ba5373ca67351106538cc775418f2a609e4f","observation_id":"32113471-a8b7-4923-9850-9af0f4475126","resolution":{"observed_at":"2026-08-07T12:45:40.068254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14554","last_updated":"2024-12-27T10:17:12Z","snapshot_observed_at":"2026-08-12T22:10:28.716468Z","submitted_at":"2024-12-19T06:10:40Z","title":"The Current Challenges of Software Engineering in the Era of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14554","snapshot_observed_at":"2026-08-07T12:45:40.184121Z","title":"The current challenges of software engineering in the era of large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:40.184121Z"},"links":{"cited_paper":"/paper/2412.14554","citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:b7d23beabcd6bab5dbda42d3da6fc2fec17a7b149d1ba0b6888951be72c55812","observation_id":"4f742216-4b78-4527-a46f-d1860c26499b","resolution":{"observed_at":"2026-08-07T12:45:40.184121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14655","last_updated":"2025-04-20T15:28:16Z","snapshot_observed_at":"2026-08-16T11:41:37.083470Z","submitted_at":"2025-04-20T15:28:16Z","title":"LeetCodeDataset: A Temporal Dataset for Robust Evaluation and Efficient Training of Code LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14655","snapshot_observed_at":"2026-08-07T12:45:40.247629Z","title":"Leetcodedataset: A temporal dataset for robust evaluation and efficient training of code llms,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:40.247629Z"},"links":{"cited_paper":"/paper/2504.14655","citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:d02641ec90fa264594a8a2da43694981af770f01a3c198eac08d9271693f4601","observation_id":"c3ecf66b-b835-4348-9251-46c8cdb2961b","resolution":{"observed_at":"2026-08-07T12:45:40.247629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:47.997103Z","title":"Math word problem solving on math leaderboard,","venue":null,"work_id":"569b8e1f-fc27-4495-a4c9-4250b54c7d91","year":2025},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:40.367337Z"},"links":{"citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:22e1331f24b5b3b3c87c5720cb7989492e4387fac6e3541355dfe0bdf68b7b3b","observation_id":"3f95a9a8-de2b-49fc-860b-37194df0a11e","resolution":{"observed_at":"2026-08-07T12:45:48.092206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:40.473842Z","title":"A performance study of llm-generated code on leetcode,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:40.473842Z"},"links":{"citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:76d385ea55f1f3aa69fa3d088e2bef30b3fe7a384dc29c34003bbbcf1f1fdd40","observation_id":"3b1f3e53-1f7c-4506-944b-f059231ae39c","resolution":{"observed_at":"2026-08-07T12:45:40.473842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.01716","last_updated":"2021-12-03T05:01:47Z","snapshot_observed_at":"2026-08-16T17:37:21.471427Z","submitted_at":"2021-12-03T05:01:47Z","title":"Reduced, Reused and Recycled: The Life of a Dataset in Machine Learning Research","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.01716","snapshot_observed_at":"2026-08-07T12:45:40.600743Z","title":"Reduced, reused and recycled: The life of a dataset in machine learning research,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:40.600743Z"},"links":{"cited_paper":"/paper/2112.01716","citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:d322f4c59c3f3628ba8ab952d61b2c950c4e950940ec20c2c706973e920dc617","observation_id":"1745ef85-11e2-42cf-b5f8-97d61dd8a9e7","resolution":{"observed_at":"2026-08-07T12:45:40.600743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:47.796739Z","title":"Leetcode dataset,","venue":null,"work_id":"8211248c-bf5d-4cb6-a768-b828b18a6b5d","year":2025},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:40.722941Z"},"links":{"citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:bbe0cba62d1f21f5287286fb765d5e8090ecf2b971adaa47a93e923d7ff52cbf","observation_id":"4ab20e1e-e862-4cfd-9f89-edea607bd9d5","resolution":{"observed_at":"2026-08-07T12:45:47.885113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-07T12:45:40.821937Z","title":"Measuring mathematical problem solving with the math dataset,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:40.821937Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:01df1dbc1ba3c7174b0896f995993bc3580745fd4167f28c1940b4d8a8ad9a2b","observation_id":"ba28657e-6d91-4f2d-9d5f-655ba170c91b","resolution":{"observed_at":"2026-08-07T12:45:40.821937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10628","last_updated":"2023-10-16T17:51:29Z","snapshot_observed_at":"2026-08-16T14:51:40.042976Z","submitted_at":"2023-10-16T17:51:29Z","title":"Data Contamination Through the Lens of Time","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10628","snapshot_observed_at":"2026-08-07T12:45:40.967359Z","title":"Data contamination through the lens of time,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:40.967359Z"},"links":{"cited_paper":"/paper/2310.10628","citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:9d87058f941aac876c47428322a11be952c12df322a0c77e5ce60d327040a9b2","observation_id":"db0cddfe-a008-45a4-ae18-3d9528a862a4","resolution":{"observed_at":"2026-08-07T12:45:40.967359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.14337","last_updated":"2021-04-07T17:49:17Z","snapshot_observed_at":"2026-08-16T18:33:13.536437Z","submitted_at":"2021-04-07T17:49:17Z","title":"Dynabench: Rethinking Benchmarking in NLP","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.14337","snapshot_observed_at":"2026-08-07T12:45:41.067226Z","title":"Dynabench: Rethinking benchmarking in nlp,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:41.067226Z"},"links":{"cited_paper":"/paper/2104.14337","citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:f913f474f22ea54ecb2c5b53889fa2fd1a155ec30748277778c125d6977c4919","observation_id":"dc4387f9-e218-4af0-a674-4f10df6c376e","resolution":{"observed_at":"2026-08-07T12:45:41.067226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.09927","last_updated":"2024-12-08T19:15:26Z","snapshot_observed_at":"2026-08-16T18:04:25.566852Z","submitted_at":"2024-09-16T02:04:33Z","title":"Towards Data Contamination Detection for Modern Large Language Models: Limitations, Inconsistencies, and Oracle Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.09927","snapshot_observed_at":"2026-08-07T12:45:41.204856Z","title":"Towards data contamination detection for modern large language models: Limitations, inconsistencies, and oracle challenges,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:41.204856Z"},"links":{"cited_paper":"/paper/2409.09927","citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:863b5538135c29f8f12830a719c737281c6e1bc17a4ff7ea207113eb332fd69f","observation_id":"78c3158d-32db-4027-9bb4-19bb3fdb2eed","resolution":{"observed_at":"2026-08-07T12:45:41.204856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00699","last_updated":"2025-07-09T19:56:02Z","snapshot_observed_at":"2026-08-16T14:04:51.278555Z","submitted_at":"2024-03-31T14:32:02Z","title":"A Comprehensive Survey of Contamination Detection Methods in Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00699","snapshot_observed_at":"2026-08-07T12:45:41.334513Z","title":"A comprehensive survey of contamination detection methods in large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:41.334513Z"},"links":{"cited_paper":"/paper/2404.00699","citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:2f800e92aca4675fe184862bc46ca2f9e889fe9dbc5a1335a5c03c0741031ec5","observation_id":"d4b4295c-012c-4306-a64f-9614f6f4ede3","resolution":{"observed_at":"2026-08-07T12:45:41.334513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09754","last_updated":"2024-10-03T02:19:14Z","snapshot_observed_at":"2026-08-16T14:00:50.752382Z","submitted_at":"2024-04-15T12:55:08Z","title":"Resilience of Large Language Models for Noisy Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09754","snapshot_observed_at":"2026-08-07T12:45:41.427522Z","title":"Resilience of large language models for noisy instructions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:41.427522Z"},"links":{"cited_paper":"/paper/2404.09754","citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:daa8a6c31e4290fb69ef98a746a7e26df0f1e869f779dd3025a938a2d1e9cf09","observation_id":"2b258087-4b1d-4172-b964-beb4201d1fb9","resolution":{"observed_at":"2026-08-07T12:45:41.427522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:41.565070Z","title":"Measuring massive multitask language understanding,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:41.565070Z"},"links":{"citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:d88eb3b3787fe54acea121f0515ed728c87e65e81dce051599b21a2d85077971","observation_id":"14ec85f6-726c-4c66-92e6-cf86351984fe","resolution":{"observed_at":"2026-08-07T12:45:41.565070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:47.532029Z","title":"Impact of noise on llm-models performance in abstraction and reasoning corpus (arc) tasks with model temperature considerations,","venue":null,"work_id":"78e0992e-ea6b-4785-8c8f-7063962ba523","year":null},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:41.803492Z"},"links":{"citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:ee6bd256099d1a73b833fddec4c1da0140e73622dfd357a16acf5ca480cae4dd","observation_id":"7ff095dd-c6d6-4c15-9c27-6d4ea8b62f07","resolution":{"observed_at":"2026-08-07T12:45:47.643527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-07T12:45:42.040015Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:42.040015Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:f8c4d87797ed296d7b6658ab80f12063a68f84e04b9dee0529ab878de761371d","observation_id":"9310f242-bb3b-4610-b5d4-0dfc4510c825","resolution":{"observed_at":"2026-08-07T12:45:42.040015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.02846","last_updated":"2021-09-07T03:59:22Z","snapshot_observed_at":"2026-08-16T17:58:25.845387Z","submitted_at":"2021-09-07T03:59:22Z","title":"Datasets: A Community Library for Natural Language Processing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.02846","snapshot_observed_at":"2026-08-07T12:45:42.162519Z","title":"Datasets: A community library for natural language processing,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:42.162519Z"},"links":{"cited_paper":"/paper/2109.02846","citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:2ab8b9226a042c8b26ed6fc516764457df86da25f7b05271118825365b9394a0","observation_id":"ec7ef6f0-768c-4196-b2de-863cf6d6e03b","resolution":{"observed_at":"2026-08-07T12:45:42.162519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:47.278602Z","title":"Leetcode problemset,","venue":null,"work_id":"dcae1e7f-cb0e-4a7e-b559-9b0c751baba6","year":2025},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:42.206375Z"},"links":{"citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:4b3c62c9924733c16dd18fa20c7bbef4be7a68e980e9278a9c170262cb3828c1","observation_id":"0342647e-a376-43a7-b107-d8ebe46ad4b9","resolution":{"observed_at":"2026-08-07T12:45:47.370907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:47.114238Z","title":"Math augmented dataset,","venue":null,"work_id":"6ac37b07-d4cf-41e5-8306-ecd811a7767e","year":2021},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:42.330482Z"},"links":{"citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:22810a9865c08a02eabb0b71275a010cc16d00f5077654fc7793baecf23e847c","observation_id":"80b652f8-998e-4fca-b228-c76a1f4664fe","resolution":{"observed_at":"2026-08-07T12:45:47.191620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15440","last_updated":"2025-04-21T21:12:28Z","snapshot_observed_at":"2026-08-16T11:24:22.912859Z","submitted_at":"2025-04-21T21:12:28Z","title":"Demand for LLMs: Descriptive Evidence on Substitution, Market Expansion, and Multihoming","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15440","snapshot_observed_at":"2026-08-07T12:45:42.479403Z","title":"Demand for llms: Descriptive evidence on substitution, market expansion, and multihoming,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:42.479403Z"},"links":{"cited_paper":"/paper/2504.15440","citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:24d30ebc83d5a92bc82db7495086949fe579322f1f32ea021309cedc30ba25db","observation_id":"2e370611-a598-4830-90dc-6f6eeac107cf","resolution":{"observed_at":"2026-08-07T12:45:42.479403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:46.906063Z","title":"Openrouter: Unified api and playground for large lan- guage models,","venue":null,"work_id":"f6da8a11-87a0-4a7e-874b-41e8e8a67917","year":2025},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:42.626771Z"},"links":{"citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:3e6afc7dda20d2e88b010a5aca0aee2e69c1bb09ea578647cf0764af839db8e6","observation_id":"a89e5806-0e9d-4826-b762-d17d37bb3a16","resolution":{"observed_at":"2026-08-07T12:45:46.990726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:46.727078Z","title":"Claude 3 model card october ad- dendum,","venue":null,"work_id":"b0a9863f-9bd6-49fd-985b-a9cc1de46d07","year":2024},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:42.776857Z"},"links":{"citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:e00a6dcd47df323450c9aa76aa408bd75ae5b60e92e8191c3b0a19edf0fcfa84","observation_id":"0cf8612f-703d-4c01-a6a4-ca824f8a2d19","resolution":{"observed_at":"2026-08-07T12:45:46.814161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:46.491966Z","title":"Introducing deepseek-v3,","venue":null,"work_id":"47a583bc-c98a-4c50-8999-55ef4609f3fb","year":2024},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:42.920903Z"},"links":{"citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:92a6bf59f69005e8a3c00d3820107207a6bcc990537f7f01df19149dbd1b038f","observation_id":"32ba1988-750b-4b99-962c-356c99ce6e07","resolution":{"observed_at":"2026-08-07T12:45:46.577130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:46.272369Z","title":"Gemini 2.0 flash,","venue":null,"work_id":"937b2ae9-5aa7-4a50-a379-964cbc5e2345","year":2025},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:43.036742Z"},"links":{"citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:c039847ace92d9db5edc000b4553f90ff8fbfe07867bc5dd515a348726e794f5","observation_id":"26899376-76be-4aef-8469-b302ef4dfce0","resolution":{"observed_at":"2026-08-07T12:45:46.356669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:46.156328Z","title":"Llama 3.3 70b instruct,","venue":null,"work_id":"7f77a841-2920-461a-8bd3-4b0f3b3a18bd","year":2024},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:43.145514Z"},"links":{"citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:72d0576eacfc32fc2629521721e42ed004fe11ba3bdc166c1b2b34e84ce85a5a","observation_id":"2d0e6f62-328a-46b6-8b69-7dc52f4de629","resolution":{"observed_at":"2026-08-07T12:45:46.199596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:45.989477Z","title":"Gpt-4o-mini,","venue":null,"work_id":"129fdcc6-4fd8-4649-add5-2c8633de3900","year":2024},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:43.267076Z"},"links":{"citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:117cd0169f4b44b455a2cce05f966effd7e5c681291b9b261f504c49bd298d68","observation_id":"2b1fb22a-a6f0-45bf-9af2-07c425797197","resolution":{"observed_at":"2026-08-07T12:45:46.078530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02395","last_updated":"2024-07-04T08:59:31Z","snapshot_observed_at":"2026-08-16T13:37:41.431114Z","submitted_at":"2024-07-02T16:13:21Z","title":"Is Your AI-Generated Code Really Safe? Evaluating Large Language Models on Secure Code Generation with CodeSecEval","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02395","snapshot_observed_at":"2026-08-07T12:45:43.375530Z","title":"Is your ai-generated code really safe? evaluating large language models on secure code generation with codeseceval,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:43.375530Z"},"links":{"cited_paper":"/paper/2407.02395","citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:fed440e5f8b040e1127dcb45ea94521337eb8249ac8ea4325ce34288043b7b31","observation_id":"ec566a92-e435-4bc6-8eb7-23f91e20f791","resolution":{"observed_at":"2026-08-07T12:45:43.375530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:45.831740Z","title":"Keeping an eye on dangerous python modules,","venue":null,"work_id":"95ce21b7-3138-4753-b6ff-0526ce139e2c","year":2023},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:43.496835Z"},"links":{"citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:db8330ba9c5988830629d5476740181e0a98de4f768b36ebd76c3e093e14277b","observation_id":"5d0b8d27-9cf4-43d6-86a3-e1ebd65050b8","resolution":{"observed_at":"2026-08-07T12:45:45.894471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:43.638653Z","title":"A mathematical theory of communication,","venue":null,"work_id":null,"year":1948},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:43.638653Z"},"links":{"citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:c088536e797327e2d7de7cde5f4c7a8417d98cf7c03ebefeb096385f79a5f86a","observation_id":"eb6c9b61-7f27-429f-8261-7d9ad7f76aa0","resolution":{"observed_at":"2026-08-07T12:45:43.638653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:45.551638Z","title":"What are bob and alice saying? [mis]communication and intermediation between language and code,","venue":null,"work_id":"c2ada070-0cc5-4b27-8e3e-3c09f1d4d283","year":2021},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:43.766764Z"},"links":{"citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:134dc3e331538c30749e0ebe7722b496a858939750c5492246d514b09ccb6567","observation_id":"804d2c58-59c5-429a-b13a-b27f5a184709","resolution":{"observed_at":"2026-08-07T12:45:45.680712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:45.356950Z","title":"Zittrain, Intellectual Debt: With Great Power Comes Great Ignorance , ser","venue":null,"work_id":"7e643743-b642-443f-bdc1-4806106a06ed","year":2022},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:43.894121Z"},"links":{"citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:b02c4fd014da21d8fcb69ab286e88f1dab17238f1da86b83597a60b88fde1e5d","observation_id":"a4ec811e-cc65-4c54-adde-79bac3377ab1","resolution":{"observed_at":"2026-08-07T12:45:45.423296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3657.36439","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:44.419448Z","title":"The systems engineering approach in times of large language models,","venue":null,"work_id":"1126f35e-94d0-4cee-9b6b-321a298b61e0","year":2025},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:44.110888Z"},"links":{"citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:4a26c467229543f5f49fba52a161355a7cbc074568d1de8129b602c75c9ea616","observation_id":"fedb689d-251f-472a-87ad-c2897492e599","resolution":{"observed_at":"2026-08-07T12:45:44.494686Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-07T12:45:41.680009Z","title":"Available: https://arxiv.org/abs/2009.03300","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:41.680009Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:0050b88f5fa9cf31e2dda31054a9603961f83c6a889a015a02d66c6036bb6429","observation_id":"db350097-0094-4912-8d0b-2cc473d66803","resolution":{"observed_at":"2026-08-07T12:45:41.680009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15903","last_updated":"2025-04-23T13:23:40Z","snapshot_observed_at":"2026-08-16T11:13:01.577591Z","submitted_at":"2025-04-22T13:43:58Z","title":"Impact of Noise on LLM-Models Performance in Abstraction and Reasoning Corpus (ARC) Tasks with Model Temperature Considerations","version":2},"cited_work":{"arxiv_id":"2504.15903","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.15903","snapshot_observed_at":"2026-08-07T12:45:44.724854Z","title":"Impact of Noise on LLM-Models Performance in Abstraction and Reasoning Corpus (ARC) Tasks with Model Temperature Considerations","venue":"cs.AI","work_id":"88324d80-eb0d-4029-9b93-4e14e1b08a9c","year":2025},"citing_paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:41.896216Z"},"links":{"cited_paper":"/paper/2504.15903","citing_paper":"/paper/2505.23598"},"observation_digest":"sha256:3b487daa1b5f47d9be538e056744fc9cf5b5e5c4dd15f6be4329943debfd6521","observation_id":"01888682-4466-44e0-9d8f-f0328c7d998f","resolution":{"observed_at":"2026-08-07T12:45:44.803019Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.23598","last_updated":"2025-05-29T16:11:18Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T20:10:22.596013Z","submitted_at":"2025-05-29T16:11:18Z","title":"LLM Performance for Code Generation on Noisy Tasks"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":14},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2505.23598."}