{"as_of":"2026-08-23T15:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:17398da0beb12f81d1bba1a5b5e8480372de0b41ad929d23fcef7acff559c3e3","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":33,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:53:25.956850Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":28,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":"2210.14868","doi":"10.48550/arxiv.2210.14868","metadata_source":"arxiv_reference","pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-lingual evaluation of code generation models","venue":"arXiv (Cornell University)","work_id":"1283984e-956f-4584-8b1a-ae121c31626c","year":2023},"citing_paper":{"arxiv_id":"2305.06161","last_updated":"2023-12-13T14:44:10Z","snapshot_observed_at":"2026-07-06T15:25:35.930688Z","submitted_at":"2023-05-09T08:16:42Z","title":"StarCoder: may the source be with you!","version":2},"reference_index":183,"source":"arxiv_source","source_observed_at":"2026-05-10T23:32:59.517389Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2305.06161"},"observation_digest":"sha256:eec62680bc63c7feda4ebc575dedc7f7f44c605999ade2df6d3893bf58b73aba","observation_id":"92af7c64-b7d9-4e51-a2ac-3fbc1a18825c","resolution":{"observed_at":"2026-05-10T23:33:00.359835Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":"2210.14868","doi":"10.48550/arxiv.2210.14868","metadata_source":"arxiv_reference","pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-lingual evaluation of code generation models","venue":"arXiv (Cornell University)","work_id":"1283984e-956f-4584-8b1a-ae121c31626c","year":2023},"citing_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-08-16T07:05:57.323612Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"reference_index":242,"source":"arxiv_source","source_observed_at":"2026-05-10T17:34:42.565806Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2403.07974"},"observation_digest":"sha256:309331193b347214f3f8136749422d4adc27bd6784aba34179154ad7179c333a","observation_id":"1420d9b2-81a0-433c-be42-3a062685c8a6","resolution":{"observed_at":"2026-05-10T17:34:42.863830Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":"2210.14868","doi":"10.48550/arxiv.2210.14868","metadata_source":"arxiv_reference","pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-lingual evaluation of code generation models","venue":"arXiv (Cornell University)","work_id":"1283984e-956f-4584-8b1a-ae121c31626c","year":2023},"citing_paper":{"arxiv_id":"2406.00515","last_updated":"2024-11-10T22:02:27Z","snapshot_observed_at":"2026-08-14T16:40:35.729198Z","submitted_at":"2024-06-01T17:48:15Z","title":"A Survey on Large Language Models for Code Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-13T20:18:06.304134Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2406.00515"},"observation_digest":"sha256:452e7bf9599ed223b68f68eff49d92eaa09b57711bbbbf0113389b6149a48c79","observation_id":"0196dbba-4ba1-401f-ab37-e2d1050ea114","resolution":{"observed_at":"2026-05-13T20:18:06.667539Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-12T17:10:55.406265Z","title":"K., Wang, Z., Li, X., Tian, Y., Tan, M., Ahmad, W","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12882","last_updated":"2025-06-06T05:27:10Z","snapshot_observed_at":"2026-08-15T15:30:04.308785Z","submitted_at":"2024-11-19T22:00:01Z","title":"ProSec: Fortifying Code LLMs with Proactive Security Alignment","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-12T17:10:55.406265Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2411.12882"},"observation_digest":"sha256:1b32a031b83848791b486c710dbbe5c777c52a12b16bacaf80b87cad92abb6a3","observation_id":"127d747b-b722-4093-a323-5fdfad651925","resolution":{"observed_at":"2026-08-12T17:10:55.406265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-12T14:18:33.026719Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15470","last_updated":"2024-11-23T06:40:47Z","snapshot_observed_at":"2026-08-17T00:04:39.986847Z","submitted_at":"2024-11-23T06:40:47Z","title":"A Preliminary Study of Multilingual Code Language Models for Code Generation Task Using Translated Benchmarks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T14:18:33.026719Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2411.15470"},"observation_digest":"sha256:8cd1efc12ec475337cf536f3d62b98072c18e6ecf0ff3061670e97e596b8da0a","observation_id":"bf8a3c85-3d47-400c-b678-b1483b7fc7b7","resolution":{"observed_at":"2026-08-12T14:18:33.026719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-11T19:03:47.980691Z","title":"Multi-lingual evaluation of code generation models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.07298","last_updated":"2025-03-03T06:33:49Z","snapshot_observed_at":"2026-08-20T09:36:42.914841Z","submitted_at":"2024-12-10T08:28:57Z","title":"The Rise and Down of Babel Tower: Investigating the Evolution Process of Multilingual Code Large Language Model","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T19:03:47.980691Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2412.07298"},"observation_digest":"sha256:8e1c909ee6246b948a9f3df1ff2eb77721534c544793488ea357d64c13b7d205","observation_id":"910dc0c6-c405-4c96-ac07-85fd4e810a6b","resolution":{"observed_at":"2026-08-11T19:03:47.980691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-10T23:21:37.683347Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.21199","last_updated":"2024-12-31T08:20:42Z","snapshot_observed_at":"2026-08-12T23:35:38.017550Z","submitted_at":"2024-12-30T18:58:58Z","title":"HumanEval Pro and MBPP Pro: Evaluating Large Language Models on Self-invoking Code Generation","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:37.683347Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2412.21199"},"observation_digest":"sha256:dcd735d295d2da4499e8d35c0be6d38d889971b4738a0ef6bee61e44a9e0c978","observation_id":"033749d6-46d4-4338-83ba-565e6f3dc325","resolution":{"observed_at":"2026-08-10T23:21:37.683347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":"2210.14868","doi":"10.48550/arxiv.2210.14868","metadata_source":"arxiv_reference","pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-lingual evaluation of code generation models","venue":"arXiv (Cornell University)","work_id":"1283984e-956f-4584-8b1a-ae121c31626c","year":2023},"citing_paper":{"arxiv_id":"2503.17181","last_updated":"2026-04-08T09:48:41Z","snapshot_observed_at":"2026-08-17T19:26:44.302566Z","submitted_at":"2025-03-21T14:29:35Z","title":"A Study of LLMs' Preferences for Libraries and Programming Languages","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-22T22:53:16.951417Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2503.17181"},"observation_digest":"sha256:0e762c82b65a91b9066222d92ec6cd90d406eb338c7b1f6e90f01503fee1f36a","observation_id":"14e8420b-741f-4028-b57b-70af239ee457","resolution":{"observed_at":"2026-05-22T22:55:12.191333Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":"2210.14868","doi":"10.48550/arxiv.2210.14868","metadata_source":"arxiv_reference","pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-lingual evaluation of code generation models","venue":"arXiv (Cornell University)","work_id":"1283984e-956f-4584-8b1a-ae121c31626c","year":2023},"citing_paper":{"arxiv_id":"2504.02605","last_updated":"2025-04-03T14:06:17Z","snapshot_observed_at":"2026-08-20T11:26:06.473228Z","submitted_at":"2025-04-03T14:06:17Z","title":"Multi-SWE-bench: A Multilingual Benchmark for Issue Resolving","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T06:48:50.416649Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2504.02605"},"observation_digest":"sha256:981133eec45b53358c09996aa8e83f9c27ace6e8f941c7fcae10966a7448e115","observation_id":"1a3a6e20-84a9-4fa8-8932-036bd34b9600","resolution":{"observed_at":"2026-05-16T06:48:50.496587Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":"2210.14868","doi":"10.48550/arxiv.2210.14868","metadata_source":"arxiv_reference","pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-lingual evaluation of code generation models","venue":"arXiv (Cornell University)","work_id":"1283984e-956f-4584-8b1a-ae121c31626c","year":2023},"citing_paper":{"arxiv_id":"2504.15564","last_updated":"2026-04-30T17:27:03Z","snapshot_observed_at":"2026-08-14T12:59:06.067910Z","submitted_at":"2025-04-22T03:33:57Z","title":"OpenClassGen: A Large-Scale Corpus of Real-World Python Classes for LLM Research","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-22T19:20:54.644575Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2504.15564"},"observation_digest":"sha256:7ebc8ff0c3173d5c00d6b9eb07f2b9da009f5abf64c4462be4918f4dd7e5ff0f","observation_id":"e96b423d-d89a-46a9-a65c-b0025a2d457e","resolution":{"observed_at":"2026-05-09T06:35:19.883923Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-16T05:53:25.956850Z","title":"K.; Wang, Z.; Li, X.; Tian, Y.; Tan, M.; Ahmad, W","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20117","last_updated":"2025-05-03T16:45:38Z","snapshot_observed_at":"2026-08-18T05:20:49.374811Z","submitted_at":"2025-04-28T07:18:45Z","title":"ResearchCodeAgent: An LLM Multi-Agent System for Automated Codification of Research Methodologies","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-16T05:53:25.956850Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2504.20117"},"observation_digest":"sha256:d0a7d3095f646e1161479c8ed061554c4c00f1edce979ce0eddef7354a2adf4d","observation_id":"1fc24f99-0845-40e4-91ff-529b89c40048","resolution":{"observed_at":"2026-08-16T05:53:25.956850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-15T23:27:58.276972Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04606","last_updated":"2025-05-07T17:51:10Z","snapshot_observed_at":"2026-08-19T18:57:46.987747Z","submitted_at":"2025-05-07T17:51:10Z","title":"OmniGIRL: A Multilingual and Multimodal Benchmark for GitHub Issue Resolution","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:58.276972Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2505.04606"},"observation_digest":"sha256:6bfca927cbc14e25bb52005b748742e01b7c8b8bd8d9911ba97b0795633ae5d8","observation_id":"b7d697aa-76ea-4ea8-b57e-b7dbe5ee8fff","resolution":{"observed_at":"2026-08-15T23:27:58.276972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-15T23:21:44.521745Z","title":"Multi-lingual Evaluation of Code Generation Models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.06302","last_updated":"2025-05-08T02:36:21Z","snapshot_observed_at":"2026-08-15T23:16:12.752378Z","submitted_at":"2025-05-08T02:36:21Z","title":"QiMeng-TensorOp: Automatically Generating High-Performance Tensor Operators with Hardware Primitives","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-15T23:21:44.521745Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2505.06302"},"observation_digest":"sha256:760609049217d1de9a14b55b60d1d692673007e0cc806df41dabf91658c3f071","observation_id":"e2d3ac28-05d7-4368-b368-5a434d8bbbcc","resolution":{"observed_at":"2026-08-15T23:21:44.521745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-15T21:32:07.671800Z","title":"Multi-lingual evaluation of code generation models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.09569","last_updated":"2026-05-28T04:44:35Z","snapshot_observed_at":"2026-08-18T13:16:39.102859Z","submitted_at":"2025-05-14T17:11:23Z","title":"MigrationBench: Repository-Level Code Migration Benchmark from Java 8","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:07.671800Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2505.09569"},"observation_digest":"sha256:e7a2d16f4b139cb94f21c5c0837bd402e0249c71d8a57d75b512a7aa892eb83c","observation_id":"8bbdaf7d-2b61-4f8b-a052-81f5602257b0","resolution":{"observed_at":"2026-08-15T21:32:07.671800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-07T12:10:29.962269Z","title":"Jacob Austin, Augustus Odena, Maxwell Nye, Maarten Bosma, Henryk Michalewski, David Dohan, Ellen Jiang, Carrie Cai, Michael Terry, Quoc Le, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00419","last_updated":"2025-09-10T16:01:21Z","snapshot_observed_at":"2026-08-15T21:29:32.633791Z","submitted_at":"2025-05-31T06:48:12Z","title":"Teaching an Old LLM Secure Coding: Localized Preference Optimization on Distilled Preferences","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T12:10:29.962269Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2506.00419"},"observation_digest":"sha256:f252a2f3221fa6f273c8818ebf64cdd02b66946614a3167883995b3ae6536dcc","observation_id":"3bde5860-92bd-4aa0-a342-d77b95197d2e","resolution":{"observed_at":"2026-08-07T12:10:29.962269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":"2210.14868","doi":"10.48550/arxiv.2210.14868","metadata_source":"arxiv_reference","pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-lingual evaluation of code generation models","venue":"arXiv (Cornell University)","work_id":"1283984e-956f-4584-8b1a-ae121c31626c","year":2023},"citing_paper":{"arxiv_id":"2506.02954","last_updated":"2026-04-15T23:50:31Z","snapshot_observed_at":"2026-08-16T21:01:17.960912Z","submitted_at":"2025-06-03T14:47:22Z","title":"Mutation-Guided Unit Test Generation with a Large Language Model","version":8},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-19T11:05:15.898419Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2506.02954"},"observation_digest":"sha256:442387bb8163368e0e63e086e2d85e2bc8e7d7f034e7c7839360ba8373fefe23","observation_id":"25c7c523-b62a-400f-96bd-04ed7f28a192","resolution":{"observed_at":"2026-05-19T11:07:15.188725Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-06T19:34:34.587748Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05200","last_updated":"2025-07-07T17:01:17Z","snapshot_observed_at":"2026-08-20T08:46:53.259208Z","submitted_at":"2025-07-07T17:01:17Z","title":"In-Context Learning as an Effective Estimator of Functional Correctness of LLM-Generated Code","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:34:34.587748Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2507.05200"},"observation_digest":"sha256:fac05506d2265cd45b3bd5c4081284af1dd8d85cdf8ee23165c2cceb03fd03d0","observation_id":"94857e75-89c2-405e-b321-1c7072033fd0","resolution":{"observed_at":"2026-08-06T19:34:34.587748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-06T15:43:35.892082Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.15224","last_updated":"2025-07-21T03:55:41Z","snapshot_observed_at":"2026-08-22T21:35:34.448685Z","submitted_at":"2025-07-21T03:55:41Z","title":"SimdBench: Benchmarking Large Language Models for SIMD-Intrinsic Code Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T15:43:35.892082Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2507.15224"},"observation_digest":"sha256:115e6881d8c9507d1e1e3ca49a15f7b86681278e026ee20ad070d3b6e859aabf","observation_id":"bb257d84-d21b-4eaa-ae39-01df4ebd3ef2","resolution":{"observed_at":"2026-08-06T15:43:35.892082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":"2210.14868","doi":"10.48550/arxiv.2210.14868","metadata_source":"arxiv_reference","pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-lingual evaluation of code generation models","venue":"arXiv (Cornell University)","work_id":"1283984e-956f-4584-8b1a-ae121c31626c","year":2023},"citing_paper":{"arxiv_id":"2508.02193","last_updated":"2025-08-04T08:43:01Z","snapshot_observed_at":"2026-08-22T04:25:53.098928Z","submitted_at":"2025-08-04T08:43:01Z","title":"Seed Diffusion: A Large-Scale Diffusion Language Model with High-Speed Inference","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-15T16:17:50.215935Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2508.02193"},"observation_digest":"sha256:f6d8c9354642ea9984c24ead6cbe05df14452c56de8343b35fce18dcdc29907f","observation_id":"6276f757-6ee0-49cb-b9f8-bfd14b2591fd","resolution":{"observed_at":"2026-05-15T16:17:50.325921Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":"2210.14868","doi":"10.48550/arxiv.2210.14868","metadata_source":"arxiv_reference","pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-lingual evaluation of code generation models","venue":"arXiv (Cornell University)","work_id":"1283984e-956f-4584-8b1a-ae121c31626c","year":2023},"citing_paper":{"arxiv_id":"2604.00239","last_updated":"2026-04-07T18:18:00Z","snapshot_observed_at":"2026-08-12T16:49:09.631418Z","submitted_at":"2026-03-31T21:05:39Z","title":"A Taxonomy of Programming Languages for Code Generation","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-08T02:17:18.127674Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2604.00239"},"observation_digest":"sha256:6123af0a5e6d6cf93db332c81760b8ac12588913150033da5fd82321faa37183","observation_id":"7d567052-2cde-46b6-82b1-7b690d8db3da","resolution":{"observed_at":"2026-05-11T22:56:14.178719Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":"2210.14868","doi":"10.48550/arxiv.2210.14868","metadata_source":"arxiv_reference","pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-lingual evaluation of code generation models","venue":"arXiv (Cornell University)","work_id":"1283984e-956f-4584-8b1a-ae121c31626c","year":2023},"citing_paper":{"arxiv_id":"2604.16321","last_updated":"2026-02-25T07:55:49Z","snapshot_observed_at":"2026-08-15T23:44:14.482796Z","submitted_at":"2026-02-25T07:55:49Z","title":"LLM-Based Multi-Agent Systems for Code Generation: A Multi-Vocal Literature Review","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-15T19:52:49.324500Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2604.16321"},"observation_digest":"sha256:2754e606472ea3834670c932b833033f2df13fab36245249e1377b74216016bf","observation_id":"07e6d07e-56a6-4c4a-ac5c-3cb24345ea5c","resolution":{"observed_at":"2026-05-15T19:56:33.893735Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":"2210.14868","doi":"10.48550/arxiv.2210.14868","metadata_source":"arxiv_reference","pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-lingual evaluation of code generation models","venue":"arXiv (Cornell University)","work_id":"1283984e-956f-4584-8b1a-ae121c31626c","year":2023},"citing_paper":{"arxiv_id":"2604.21505","last_updated":"2026-04-23T10:07:33Z","snapshot_observed_at":"2026-08-15T09:59:00.240479Z","submitted_at":"2026-04-23T10:07:33Z","title":"Assessing the Impact of Requirement Ambiguity on LLM-based Function-Level Code Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-09T21:15:51.570343Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2604.21505"},"observation_digest":"sha256:02079f9ef8a13a2c54004d0317f67618c052c4fa2276d6f94ff32c7fefa869af","observation_id":"22c6f3ed-bb50-4015-8f0d-926367a311e8","resolution":{"observed_at":"2026-05-11T14:41:23.479400Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":"2210.14868","doi":"10.48550/arxiv.2210.14868","metadata_source":"arxiv_reference","pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-lingual evaluation of code generation models","venue":"arXiv (Cornell University)","work_id":"1283984e-956f-4584-8b1a-ae121c31626c","year":2023},"citing_paper":{"arxiv_id":"2604.22659","last_updated":"2026-07-02T07:20:45Z","snapshot_observed_at":"2026-08-15T07:50:17.995756Z","submitted_at":"2026-04-24T15:35:54Z","title":"RealBench: A Repo-Level Code Generation Benchmark Aligned with Real-World Software Development Practices","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-08T11:24:07.839469Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2604.22659"},"observation_digest":"sha256:34e43c4775a8ce58afc10c527cc64ec92efeeb62ae9dc7821d55aeb9782b3e2d","observation_id":"9a93e213-ca79-45b0-bd6c-6345c1df53dc","resolution":{"observed_at":"2026-05-11T19:36:15.364569Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":"2210.14868","doi":"10.48550/arxiv.2210.14868","metadata_source":"arxiv_reference","pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-lingual evaluation of code generation models","venue":"arXiv (Cornell University)","work_id":"1283984e-956f-4584-8b1a-ae121c31626c","year":2023},"citing_paper":{"arxiv_id":"2604.24222","last_updated":"2026-07-08T05:45:02Z","snapshot_observed_at":"2026-08-02T09:53:19.154769Z","submitted_at":"2026-04-27T09:27:59Z","title":"Learning from Execution: Self-Evolving Memory for Private-Library Code Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-08T03:40:05.380630Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2604.24222"},"observation_digest":"sha256:c0b655281ecc4c8e4c20db115cd41a47510757544d129f3c851af880f592b1e7","observation_id":"bcf03380-7c0c-4a78-b7c9-382997f99e5f","resolution":{"observed_at":"2026-05-11T21:56:38.575910Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-07-12T18:16:50.322933Z","title":"Multi-lingual evaluation of code generation models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2604.24222","last_updated":"2026-07-08T05:45:02Z","snapshot_observed_at":"2026-08-02T09:53:19.154769Z","submitted_at":"2026-04-27T09:27:59Z","title":"Learning from Execution: Self-Evolving Memory for Private-Library Code Generation","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-12T18:16:50.322933Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2604.24222"},"observation_digest":"sha256:cf3579af6854fe7cc20f80031dabfc65b9e1133398a2e88c626bd94cb625ec07","observation_id":"c1974c29-71d2-451c-9384-04b3c0e37381","resolution":{"observed_at":"2026-07-12T18:16:50.322933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":"2210.14868","doi":"10.48550/arxiv.2210.14868","metadata_source":"arxiv_reference","pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-lingual evaluation of code generation models","venue":"arXiv (Cornell University)","work_id":"1283984e-956f-4584-8b1a-ae121c31626c","year":2023},"citing_paper":{"arxiv_id":"2605.09059","last_updated":"2026-06-09T18:21:19Z","snapshot_observed_at":"2026-08-16T09:43:39.250159Z","submitted_at":"2026-05-09T17:05:44Z","title":"Evaluating LLM-Generated Code: A Benchmark and Developer Study","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-12T02:27:11.573347Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2605.09059"},"observation_digest":"sha256:2ef20a4875f5cf9135abbf2665677637ab765a961b8676dd4b4c6eb8a52de6e8","observation_id":"f82767ea-48ab-4be6-9bb1-77e1ef813282","resolution":{"observed_at":"2026-05-12T07:37:02.619902Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":"2210.14868","doi":"10.48550/arxiv.2210.14868","metadata_source":"arxiv_reference","pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-lingual evaluation of code generation models","venue":"arXiv (Cornell University)","work_id":"1283984e-956f-4584-8b1a-ae121c31626c","year":2023},"citing_paper":{"arxiv_id":"2605.09059","last_updated":"2026-06-09T18:21:19Z","snapshot_observed_at":"2026-08-16T09:43:39.250159Z","submitted_at":"2026-05-09T17:05:44Z","title":"Evaluating LLM-Generated Code: A Benchmark and Developer Study","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T22:55:49.377456Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2605.09059"},"observation_digest":"sha256:49dbae3375fa7d7e58e661a0ae8660b11265fc499998d674a15b975bd0ee635b","observation_id":"3c81cd13-b026-4d1d-85f3-527c77d0b89d","resolution":{"observed_at":"2026-07-01T13:35:46.801549Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":"2210.14868","doi":"10.48550/arxiv.2210.14868","metadata_source":"arxiv_reference","pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-lingual evaluation of code generation models","venue":"arXiv (Cornell University)","work_id":"1283984e-956f-4584-8b1a-ae121c31626c","year":2023},"citing_paper":{"arxiv_id":"2606.04023","last_updated":"2026-06-01T12:55:10Z","snapshot_observed_at":"2026-08-21T22:58:21.737025Z","submitted_at":"2026-06-01T12:55:10Z","title":"CodegenBench: Can LLMs Write Efficient Code Across Architectures?","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T13:38:48.308683Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2606.04023"},"observation_digest":"sha256:89d1d16a514ee03fec9ba707c26ac21872d9336e9de68f7896b185644b0f356d","observation_id":"c7bbb054-735f-449d-a92e-78d6b9d90019","resolution":{"observed_at":"2026-07-02T00:06:23.764000Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":"2210.14868","doi":"10.48550/arxiv.2210.14868","metadata_source":"arxiv_reference","pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-lingual evaluation of code generation models","venue":"arXiv (Cornell University)","work_id":"1283984e-956f-4584-8b1a-ae121c31626c","year":2023},"citing_paper":{"arxiv_id":"2606.05249","last_updated":"2026-06-03T12:48:53Z","snapshot_observed_at":"2026-08-08T22:49:24.290386Z","submitted_at":"2026-06-03T12:48:53Z","title":"SWE-InfraBench: Evaluating Language Models on Cloud Infrastructure Code","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T05:21:34.772199Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2606.05249"},"observation_digest":"sha256:d960706d22664532904f26356b70e53b6b77fb4195c991d8b9663a2d1d0e344b","observation_id":"5dcc1e99-c490-4ea4-9d2f-5a3e4f3a3954","resolution":{"observed_at":"2026-07-02T09:56:51.758679Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":"2210.14868","doi":"10.48550/arxiv.2210.14868","metadata_source":"arxiv_reference","pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-lingual evaluation of code generation models","venue":"arXiv (Cornell University)","work_id":"1283984e-956f-4584-8b1a-ae121c31626c","year":2023},"citing_paper":{"arxiv_id":"2606.08840","last_updated":"2026-06-07T21:10:30Z","snapshot_observed_at":"2026-07-06T23:48:16.585598Z","submitted_at":"2026-06-07T21:10:30Z","title":"Beyond Pass Rate: A Multilingual, Execution-Grounded Evaluation of Open Code LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T18:19:26.108492Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2606.08840"},"observation_digest":"sha256:e95f790de2c16fc0465a3a81809355efc867ce9b6c44f7ed601058b28c02bb0b","observation_id":"415bb5b3-f6e9-4076-acad-8b24e9d09b86","resolution":{"observed_at":"2026-07-02T23:17:29.743533Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":"2210.14868","doi":"10.48550/arxiv.2210.14868","metadata_source":"arxiv_reference","pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-lingual evaluation of code generation models","venue":"arXiv (Cornell University)","work_id":"1283984e-956f-4584-8b1a-ae121c31626c","year":2023},"citing_paper":{"arxiv_id":"2606.20517","last_updated":"2026-06-18T17:35:57Z","snapshot_observed_at":"2026-08-18T07:35:35.600558Z","submitted_at":"2026-06-18T17:35:57Z","title":"Multi-LCB: Extending LiveCodeBench to Multiple Programming Languages","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-06-26T17:39:27.723253Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2606.20517"},"observation_digest":"sha256:1c43fad37b0f9714b06ed0345a06cabc94a209320e9c4853754bda6756f9c228","observation_id":"be4ed27b-54d6-4ab4-9587-436f81870666","resolution":{"observed_at":"2026-07-04T03:49:30.014285Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-01T04:41:31.803525Z","title":"arXiv preprint arXiv:2210.14868 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22807","last_updated":"2026-07-24T16:41:59Z","snapshot_observed_at":"2026-08-16T11:25:45.091244Z","submitted_at":"2026-07-24T16:41:59Z","title":"The Best Programming Language for Tokenmaxxing: An Investigation of Coding Agent Behavior Across Programming Languages","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-01T04:41:31.803525Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2607.22807"},"observation_digest":"sha256:f5a4b5f5c13028fab14d5f6445674d9a95bfba77c19c61b0cba9d5577ef6cf97","observation_id":"0095572b-c0f4-4ae0-9f99-a69a76488c7f","resolution":{"observed_at":"2026-08-01T04:41:31.803525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.14868","snapshot_observed_at":"2026-08-15T15:06:44.611094Z","title":"2023.Multi-Lingual Evaluation of Code Generation Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03065","last_updated":"2026-08-04T03:26:54Z","snapshot_observed_at":"2026-08-19T23:13:31.751544Z","submitted_at":"2026-08-04T03:26:54Z","title":"Efficient Grammar-Constrained Decoding via Parser Stack Classification","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T15:06:44.611094Z"},"links":{"cited_paper":"/paper/2210.14868","citing_paper":"/paper/2608.03065"},"observation_digest":"sha256:842beb5599ae03e00c393447ef1c88c1a69d357437c04e81fbc5874c8cadea4c","observation_id":"d604f600-da62-41c1-b6ab-1a998ce71052","resolution":{"observed_at":"2026-08-15T15:06:44.611094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2210.14868/citation-record","integrity":"/paper/2210.14868/integrity","json":"/paper/2210.14868/citation-record.json","paper":"/paper/2210.14868"},"outbound":[],"paper":{"arxiv_id":"2210.14868","last_updated":"2023-03-28T19:02:34Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T16:20:54.275993Z","submitted_at":"2022-10-26T17:17:06Z","title":"Multi-lingual Evaluation of Code Generation Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 33 inbound Pith citation observations for arXiv:2210.14868."}