{"as_of":"2026-08-13T15:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e45ec8c8e9dbfa7ebc14989a2a36076ba4dc081cf51f51572fcd6acc86c6b058","coverage":[{"denominator":111,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:55:15.691408Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:54:51.091578Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T23:54:56.588252Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"cited_work":{"arxiv_id":"2506.11059","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.11059","snapshot_observed_at":"2026-08-06T23:54:56.588252Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","venue":"cs.SE","work_id":"0a8d9e70-189d-4186-b18c-968ee59c28e2","year":2025},"citing_paper":{"arxiv_id":"2506.17323","last_updated":"2025-06-18T19:49:41Z","snapshot_observed_at":"2026-08-10T11:07:07.332625Z","submitted_at":"2025-06-18T19:49:41Z","title":"I Know Which LLM Wrote Your Code Last Summer: LLM generated Code Stylometry for Authorship Attribution","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T23:54:51.091578Z"},"links":{"cited_paper":"/paper/2506.11059","citing_paper":"/paper/2506.17323"},"observation_digest":"sha256:2dd74d08baeb97f2d56672b76f714dd052ebd49cce9c46c8ec2121b47996c117","observation_id":"1ed2e67d-6f24-4557-8c0c-03900d823793","resolution":{"observed_at":"2026-08-06T23:54:56.716112Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.11059/citation-record","integrity":"/paper/2506.11059/integrity","json":"/paper/2506.11059/citation-record.json","paper":"/paper/2506.11059"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T13:54:46.476756Z","title":"Gpt-4 technical report.arXiv preprint arXiv:2303.08774, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:46.476756Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:cef1e5cff5f360eaf2bb2b8361212476c607b78f2bbb8c1a01b4b79631fe6b55","observation_id":"65788c0f-6182-4abf-b3a8-2ea9b74c138c","resolution":{"observed_at":"2026-08-07T13:54:46.476756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01423","last_updated":"2023-09-27T12:44:12Z","snapshot_observed_at":"2026-08-13T10:03:57.719833Z","submitted_at":"2023-09-27T12:44:12Z","title":"An Empirical Study of AI Generated Text Detection Tools","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01423","snapshot_observed_at":"2026-08-07T13:54:46.570106Z","title":"An empirical study of ai generated text detection tools.arXiv preprint arXiv:2310.01423, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:46.570106Z"},"links":{"cited_paper":"/paper/2310.01423","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:72bf4c7fc6b81a1a1966f94e17036f8711b69d65b9125bbfe93c8a749db6c1cb","observation_id":"75df5980-73d5-411e-8495-bbdb621b2640","resolution":{"observed_at":"2026-08-07T13:54:46.570106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:46.633741Z","title":"Introducing computer use, a new claude 3.5 sonnet, and claude 3.5 haiku, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:46.633741Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:3f028e0105288932f2db53b58b0caf3d7b7cbb12d9be2d973ecbc4c9c0313a30","observation_id":"908da8b7-9eeb-4478-9439-254c9cab0d7e","resolution":{"observed_at":"2026-08-07T13:54:46.633741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:46.720560Z","title":"Claude 3.7 Sonnet and Claude Code, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:46.720560Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:7aab640b3c55b4ac25e082963f813454e9d1240458a84555d63987d69e495f75","observation_id":"a7846d60-9b79-475a-9822-16282d44c1d2","resolution":{"observed_at":"2026-08-07T13:54:46.720560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:46.811473Z","title":"Is github’s copilot as bad as humans at introducing vulnerabilities in code?Empirical Software Engineering, 28(6):129, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:46.811473Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:0d492406a0a9fd9971955060d1bbbf33570697d05aa9e8871440da5802681438","observation_id":"c5a100e3-a86e-4296-89d1-260fca603978","resolution":{"observed_at":"2026-08-07T13:54:46.811473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:46.895270Z","title":"Random forests.Machine learning, 45:5–32, 2001","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:46.895270Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:4c892eeee0a0be77eb2a44813faeaf15a105b7ac5a677e9b4f4ea0dad9e1c647","observation_id":"c0a0349f-1f09-4419-bb99-36ab95a46fc6","resolution":{"observed_at":"2026-08-07T13:54:46.895270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:46.976947Z","title":"Membership inference attacks from first principles","venue":null,"work_id":null,"year":1914},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:46.976947Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:8a9fcf22ad964cfc9636098ef7a4b364d4157148fcdbfc5d2adf45915bdb487d","observation_id":"f391913e-6860-425b-8fa2-3debfa1511e7","resolution":{"observed_at":"2026-08-07T13:54:46.976947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:47.063202Z","title":"R package version 3.0.1.1","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:47.063202Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:b09105b17d863b288872d0906033fd181291b8440aaed0d474b57f3e2029d0e4","observation_id":"4e3022a3-1094-44a2-af28-e5090a1fb735","resolution":{"observed_at":"2026-08-07T13:54:47.063202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:47.129620Z","title":"Github code clean dataset, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:47.129620Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:d0c68f7640b9157270673e97ccc9b877d947b9b9fd82f9645cc5a85df6f4657e","observation_id":"553cb2d9-df04-4555-913c-b75ef7780dab","resolution":{"observed_at":"2026-08-07T13:54:47.129620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:47.200058Z","title":"Github code dataset, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:47.200058Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:d5a9dd62a7df9d544b260e867f635afad77c05254d8ad12354c8f4f7fe3def60","observation_id":"02afa950-9b55-48b6-b04f-744abf07e8c5","resolution":{"observed_at":"2026-08-07T13:54:47.200058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:47.294524Z","title":"Vulnerabilities in ai code generators: Exploring targeted data poisoning attacks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:47.294524Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:a9ee7261f605f787dbac0ca5aa31c3859033eb10719d10cff50a11ca7a5fee8b","observation_id":"f25dda91-c58c-43df-8202-91a4e16cfd1a","resolution":{"observed_at":"2026-08-07T13:54:47.294524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:47.393332Z","title":"Cursor: The AI Code Editor, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:47.393332Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:2515c43efc5496ef28e89d8d8b6b78cd2157ad6acdf524122fb018da005240d3","observation_id":"29e82846-deea-4d38-bd2e-2d9edfe7f36b","resolution":{"observed_at":"2026-08-07T13:54:47.393332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:47.467782Z","title":"Plagiarism in the age of massive generative pre-trained transformers (gpt-3).Ethics in Science and Environmental Politics, 21:17–23, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:47.467782Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:0bcced5aafa2eb2212121aabfcbc01a3d9b63b5ffccbc2942e45215d66dc7348","observation_id":"1b0a11d0-a7f0-462f-8638-6c5988df77d1","resolution":{"observed_at":"2026-08-07T13:54:47.467782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16594","last_updated":"2025-05-25T09:15:33Z","snapshot_observed_at":"2026-08-11T21:08:06.542432Z","submitted_at":"2024-12-21T11:53:49Z","title":"AIGCodeSet: A New Annotated Dataset for AI Generated Code Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16594","snapshot_observed_at":"2026-08-07T13:54:47.550790Z","title":"Aigcodeset: A new annotated dataset for ai generated code detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:47.550790Z"},"links":{"cited_paper":"/paper/2412.16594","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:2b10961ac46642c41d951cc0584013edc7a7f7bcec663ec9ed00e2a8d704dcf6","observation_id":"9338dc5a-b143-4bc3-821b-57e1450a2458","resolution":{"observed_at":"2026-08-07T13:54:47.550790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07397","last_updated":"2020-10-28T03:48:28Z","snapshot_observed_at":"2026-07-06T09:28:36.954658Z","submitted_at":"2020-06-12T18:15:55Z","title":"The DeepFake Detection Challenge (DFDC) Dataset","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.07397","snapshot_observed_at":"2026-08-07T13:54:47.640002Z","title":"The deepfake detection challenge (dfdc) dataset.arXiv preprint arXiv:2006.07397, 2020","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:47.640002Z"},"links":{"cited_paper":"/paper/2006.07397","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:70d8af7a133b382db56f7b875f6031b3eaa24f2bd2adc09bfcb7d2c51c6eb3fc","observation_id":"d7d6f9c8-d5dd-4eab-8e0f-659fe2ae56a6","resolution":{"observed_at":"2026-08-07T13:54:47.640002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:47.701676Z","title":"Codep: grammatical seq2seq model for general-purpose code generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:47.701676Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:5d524f975b16309942c3fa2ee36044ce9659bb0c09d28d9e43d7a4429a6eb27e","observation_id":"8d87665b-4f0b-46c3-8a0e-7128c09be92f","resolution":{"observed_at":"2026-08-07T13:54:47.701676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12869","last_updated":"2023-03-22T19:01:25Z","snapshot_observed_at":"2026-08-13T12:18:55.573083Z","submitted_at":"2023-03-22T19:01:25Z","title":"JaCoText: A Pretrained Model for Java Code-Text Generation","version":1},"cited_work":{"arxiv_id":"2303.12869","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.12869","snapshot_observed_at":"2026-08-07T13:55:17.044546Z","title":"JaCoText: A Pretrained Model for Java Code-Text Generation","venue":"cs.CL","work_id":"a2676804-c2db-4198-b8fa-8d11aba7fb33","year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:47.773655Z"},"links":{"cited_paper":"/paper/2303.12869","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:9b91c88abd672279a142f57981a59ea2842c99de22dacaf8ca67a1f1c5149fcd","observation_id":"08fb92ab-8479-4797-be7c-5184de1e9f47","resolution":{"observed_at":"2026-08-07T13:55:17.120274Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:47.862883Z","title":"Out of the bleu: how should we assess quality of the code generation models?Journal of Systems and Software, 203:111741, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:47.862883Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:f315236d86bfe62b79751c4c29d391c15b3432c0d379552cb127b7fe1f9796a7","observation_id":"cc471623-5e94-487d-a09f-a0dd57b31ff3","resolution":{"observed_at":"2026-08-07T13:54:47.862883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.08155","last_updated":"2020-09-18T15:38:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-02-19T13:09:07Z","title":"CodeBERT: A Pre-Trained Model for Programming and Natural Languages","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.08155","snapshot_observed_at":"2026-08-07T13:54:47.920730Z","title":"Codebert: A pre-trained model for programming and natural languages.https://arxiv.org/abs/2002.08155, 2020","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:47.920730Z"},"links":{"cited_paper":"/paper/2002.08155","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:7638056229020a9c9fcd00163232e0a7ed40bd87b6017ff5881aecc920abc0a4","observation_id":"11467041-3d7d-44fc-acf8-15269374ff63","resolution":{"observed_at":"2026-08-07T13:54:47.920730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:48.011427Z","title":"Introducing GitHub Copilot: your AI pair programmer, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:48.011427Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:02f9ccdf1b516182f0a9b83c6ff48d5a5c5cc11c4c4bf6fc16f64ee336a5d78a","observation_id":"21847269-8275-48a4-b353-0e7bb165121f","resolution":{"observed_at":"2026-08-07T13:54:48.011427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:48.070030Z","title":"What makes good in-context demonstrations for code intelligence tasks with llms? InIEEE/ACM International Conference on Automated Software Engineering (ASE), pages 761–773, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:48.070030Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:fdd0149da99c94672d1f055ef7be72e445ca29372a8c26fc073ad6966d52fd42","observation_id":"d7e6ddef-b792-4499-8ca8-05d7ac0df019","resolution":{"observed_at":"2026-08-07T13:54:48.070030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:48.124138Z","title":"Gltr: Statistical detection and visualization of generated text","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:48.124138Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:df6e426892841873e3fe38f57e3184ab4c0fc123369eaec1a7efcfce84555260","observation_id":"1528c165-1662-4f98-a82a-3165eaa55899","resolution":{"observed_at":"2026-08-07T13:54:48.124138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:48.246520Z","title":"A survey on the possibilities & impossibilities of ai-generated text detection.Transactions on Machine Learning Research (TMLR), 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:48.246520Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:df8857a853e233cf887f1b22091802b8e472b042b5f78b44455d30b23f310a28","observation_id":"314297cd-8c44-4ef9-b4a0-4a1e554b2176","resolution":{"observed_at":"2026-08-07T13:54:48.246520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:48.359564Z","title":"Deepfake video detection using recurrent neural networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:48.359564Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:67f2d7dae139723a25f8fe3332154dc1946675d516e3ed34e4002e7a3362ff9e","observation_id":"b5aac917-e193-4767-ad10-2fbec12deecd","resolution":{"observed_at":"2026-08-07T13:54:48.359564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:48.449654Z","title":"Graphcodebert: Pre-training code representations with data flow","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:48.449654Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:9285e5a69481bd78f3af6b7fac2727121baf47378fcd3118d787b5c4368ebd09","observation_id":"f13457b0-5431-42a2-b472-218cb58cd458","resolution":{"observed_at":"2026-08-07T13:54:48.449654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-13T09:12:54.999095Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T13:54:48.545437Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:48.545437Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:08104598104a833beeeafd73bd28f1a436f8b0371e9d3bec1529eef18e482806","observation_id":"05003157-91eb-4798-8360-04d2c36081b1","resolution":{"observed_at":"2026-08-07T13:54:48.545437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:48.665601Z","title":"Biscope: Ai-generated text detection by checking memorization of preceding tokens","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:48.665601Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:1b1662f9b08f5b03b69cc024db68622e2e3b12559eaab8f09d773617a7566a7b","observation_id":"eb20765c-9e15-4507-8edc-b618ad05b088","resolution":{"observed_at":"2026-08-07T13:54:48.665601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:48.809631Z","title":"Spotting llms with binoculars: Zero-shot detection of machine-generated text","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:48.809631Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:ff7b8f144ceac54f13aa646c3a1654635208559db16d5753cfb3d90e2346f202","observation_id":"c66b5304-5d20-4b43-abe3-3212d8cf7a90","resolution":{"observed_at":"2026-08-07T13:54:48.809631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:48.908202Z","title":"Denoising diffusion probabilistic models.Advances in Neural Information Processing Systems (NeurIPS), 33:6840–6851, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:48.908202Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:4a5f19c5820e62a6b2e2ac46bb35fbcbe910c2e3dfca69495744f2b4b249e8b8","observation_id":"5195c632-aa5c-4485-855a-96398f705a7d","resolution":{"observed_at":"2026-08-07T13:54:48.908202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-07T13:54:48.989561Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:48.989561Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:466384db39b4c5c40e1584e8f50e277f28a3bfcb7ba6f9730799f0300cadcead","observation_id":"83737ca2-14d0-46cf-85c5-01beb47d2d14","resolution":{"observed_at":"2026-08-07T13:54:48.989561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:49.120454Z","title":"Rethinking plagiarism in the era of generative ai.Journal of Intelligent Communication, 3(2):20–31, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:49.120454Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:ceadeffefa4c42e76dd28df61d2b4c70d874ef1136668cf07395cd1aeb09cad5","observation_id":"77d0cb4e-9f09-4066-ab9d-84f237151c12","resolution":{"observed_at":"2026-08-07T13:54:49.120454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:49.242525Z","title":"Whodunit: Classifying code as human authored or gpt-4 generated-a case study on codechef problems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:49.242525Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:1f68c606bc04782c97a9ddd34685758c13a00d2923b3fce9d9d802b3a60d71d3","observation_id":"3207f12b-4c39-4ebc-951d-9d6ed0e8ceb6","resolution":{"observed_at":"2026-08-07T13:54:49.242525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:49.340671Z","title":"Automatic detection of generated text is easiest when humans are fooled","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:49.340671Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:bdada9bd37452bb788a7f9d962728e95dbbdf780684d4ddcacd9aff007969158","observation_id":"bc477be6-3ca6-452d-a785-58be0314634a","resolution":{"observed_at":"2026-08-07T13:54:49.340671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:49.537272Z","title":"Swe-bench: Can language models resolve real-world github issues? InInternational Conference on Learning Representations (ICLR), 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:49.537272Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:23fe24066a276b4afd496edf11f754ad008ec5b3e650f21c14dda4bd06d75b5c","observation_id":"c4238f08-8892-4f25-8231-5600621c9da7","resolution":{"observed_at":"2026-08-07T13:54:49.537272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:49.661149Z","title":"Access the latest 2.0 experimental models in the gemini app., 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:49.661149Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:59099503ae91b47277b9cffdbd75632ef93865eb10821a1c93f95935233f7045","observation_id":"bae908c6-127e-4bda-a198-82489ae72e37","resolution":{"observed_at":"2026-08-07T13:54:49.661149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:49.780282Z","title":"Vulnerability handling of ai- generated code-existing solutions and open challenges","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:49.780282Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:b321df4d0abcd00ae96aabfdc5bcf5da5d957f935304a23a466ea7d4b5f53545","observation_id":"605bc256-bacb-4710-8e72-c6021ee8bb78","resolution":{"observed_at":"2026-08-07T13:54:49.780282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:49.898415Z","title":"Gemini 2.0 is now available to everyone, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:49.898415Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:0d5a31dfd333d622150bcae589000d5a11042efe5e44bb13d27a7564731f2419","observation_id":"d508cc1b-25f4-4f13-bd1b-d3a77ffe37be","resolution":{"observed_at":"2026-08-07T13:54:49.898415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:50.058627Z","title":"Does attitude towards plagiarism predict aigiarism using chatgpt?AI and Ethics, 5(1):677–688, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:50.058627Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:2116c5cd664c88aae9ef6d18ec142e2820005e6f5a4ee46b537f598b10a79b2a","observation_id":"dbda737d-454c-453b-ba59-b83e84ff4e8e","resolution":{"observed_at":"2026-08-07T13:54:50.058627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:50.183926Z","title":"Will chatgpt g et you caught? rethinking of plagiarism detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:50.183926Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:f5e37457f26bd559f33f348f42c8e838580772d462b84bfef1333de9f802875d","observation_id":"ef0bb54f-4125-47f8-89f4-f384d8462faf","resolution":{"observed_at":"2026-08-07T13:54:50.183926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:26.160853Z","title":"How secure is code generated by chatgpt? InIEEE international conference on systems, man, and cybernetics (SMC), pages 2445–2451","venue":null,"work_id":"63393805-f7a3-4adc-a4ee-bc2c7763ff2a","year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:50.269865Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:a5aedaf9feb6faaff8f5ad01c7d97095b5c2d4b43ab0b65665dd886801f628d6","observation_id":"64ffc721-c503-4bb6-a5a5-533ecc3ba99f","resolution":{"observed_at":"2026-08-07T13:55:26.240995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:26.017519Z","title":"Paraphrasing evades detectors of ai-generated text, but retrieval is an effective defense.Advances in Neural Information Processing Systems (NeurIPS), 2023","venue":null,"work_id":"5d9858fe-6b33-4645-9a71-312a83fbe464","year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:50.386281Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:0e3aa37cb18ece69e6126c99bfd1adad455a10899f2bbb4ec3ae5c167334174b","observation_id":"03f30dd7-d73a-47ee-bd15-91d0063106e0","resolution":{"observed_at":"2026-08-07T13:55:26.074964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:25.859667Z","title":"Detecting fake content with relative entropy scoring","venue":null,"work_id":"c8a04bd1-fb0b-491b-8995-ef30d79b8fbd","year":2008},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:50.553406Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:490085b6cd104dfee6c998923bc507922ae6d09ccaa9d899897dc82ba6178998","observation_id":"4271435f-c3b5-455a-8867-637eaf646188","resolution":{"observed_at":"2026-08-07T13:55:25.908463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:25.779384Z","title":"Protecting intellectual property of large language model-based code generation apis via watermarks","venue":null,"work_id":"b19546b2-022e-4354-b7ed-574adb602695","year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:50.664897Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:ded3827f05b2f2afe591dfdf808779517c165536c575780549b915423db56e23","observation_id":"50499960-1047-4a1f-b5a3-ade3debd7f65","resolution":{"observed_at":"2026-08-07T13:55:25.821311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-11T01:48:59.557045Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T13:54:50.744812Z","title":"Deepseek-v3 technical report.arXiv preprint arXiv:2412.19437, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:50.744812Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:ab2681e29e83b4c423d5e970a1df959ff15f4290c49fad8eea16e3eee30e1056","observation_id":"cabc3883-4bb6-4818-80ea-24f5fff2cfc9","resolution":{"observed_at":"2026-08-07T13:54:50.744812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:25.612110Z","title":null,"venue":null,"work_id":"d53b2a58-2b5e-4332-b62b-5a58faad78ef","year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:50.865882Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:43e74021b5beb0e87d386b508a9e4858964f24044ca25824ad280cb4c3977380","observation_id":"1da2f7b4-1105-407c-a195-1bc12dcf90ad","resolution":{"observed_at":"2026-08-07T13:55:25.697427Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.12644","last_updated":"2025-08-08T04:35:26Z","snapshot_observed_at":"2026-08-12T23:54:59.657803Z","submitted_at":"2024-11-19T16:54:45Z","title":"CodeXEmbed: A Generalist Embedding Model Family for Multiligual and Multi-task Code Retrieval","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.12644","snapshot_observed_at":"2026-08-07T13:54:51.004303Z","title":"Codex- embed: A generalist embedding model family for multiligual and multi-task code retrieval.arXiv preprint arXiv:2411.12644, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:51.004303Z"},"links":{"cited_paper":"/paper/2411.12644","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:ed95ebfe06e22d99708d89571db5b7b1a35eba11f972755dedbe2839435ff90e","observation_id":"04279a04-6e3d-4f41-8e20-d41d409b3ac1","resolution":{"observed_at":"2026-08-07T13:54:51.004303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-07T13:54:51.120028Z","title":"Roberta: A robustly optimized bert pretraining approach.arXiv preprint arXiv:1907.11692, 2019","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:51.120028Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:6f12359352599c44eb7730de8fcb8f7ac18890ae1ab41b894e8fc7d705988625","observation_id":"2ce6caf2-b835-4f6e-80a1-10112003ecd9","resolution":{"observed_at":"2026-08-07T13:54:51.120028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:25.495015Z","title":"Raidar: generative ai detection via rewriting","venue":null,"work_id":"df234be3-ef58-4f56-85db-0f2e4dbce5ce","year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:51.218996Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:8e685fb6843839cb4685fd725ae87546538171fc29945e20814ad4694d1a378d","observation_id":"c6f9638a-d993-4bd4-bf4d-944c3afec798","resolution":{"observed_at":"2026-08-07T13:55:25.537792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:25.351230Z","title":"On the robustness of code generation techniques: An empirical study on github copilot","venue":null,"work_id":"bb9fa83a-cedd-48aa-bc0d-0223aa1fa6ba","year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:51.348636Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:658c538cd6336f3faf8ee7b95b837b440bc666378e4f00d8efac928293b1da3f","observation_id":"db5bea98-ac35-408c-8e6a-9907e16e7a86","resolution":{"observed_at":"2026-08-07T13:55:25.415448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:25.215036Z","title":"Llama 3.3: Model cards & prompt formats, 2024","venue":null,"work_id":"c6defeaa-13bf-43da-b926-88839e02f098","year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:51.489432Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:0892db3d424b83ab943b3837b755d69492c4df014548202afdca79755a0b4b8d","observation_id":"47c2b334-6ec8-4be7-84ef-3bb770d4ba7f","resolution":{"observed_at":"2026-08-07T13:55:25.275821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:25.068023Z","title":"Detectgpt: Zero-shot machine-generated text detection using probability curvature","venue":null,"work_id":"9f698e44-9669-4f3f-b2f8-f7655b0b2578","year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:51.641080Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:2709a43933672a9d7cddc0873ff969ef450f0a97397fd12184bfb7caa1c91737","observation_id":"a1845f18-307f-48db-99d2-ef1065386dff","resolution":{"observed_at":"2026-08-07T13:55:25.167755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09381","last_updated":"2023-08-07T07:41:37Z","snapshot_observed_at":"2026-08-13T10:53:14.464897Z","submitted_at":"2023-07-18T16:01:15Z","title":"Is this Snippet Written by ChatGPT? An Empirical Study with a CodeBERT-Based Classifier","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09381","snapshot_observed_at":"2026-08-07T13:54:51.700600Z","title":"Is this snippet written by chatgpt? an empirical study with a codebert-based classifier.arXiv preprint arXiv:2307.09381, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:51.700600Z"},"links":{"cited_paper":"/paper/2307.09381","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:9a6855e26761c2aad9ccce91a312fe6fb705779243e954db823eaa232c844c60","observation_id":"369ee951-331b-4b17-a544-0fc92734f160","resolution":{"observed_at":"2026-08-07T13:54:51.700600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:24.900036Z","title":"Gptsniffer: A codebert-based classifier to detect source code written by chatgpt.Journal of Systems and Software, 214:112059, 2024","venue":null,"work_id":"cee8fecc-a3ef-4b76-934e-d352dd8e2f9b","year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:51.759655Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:6745dcc9c426f05d2bcfbb489632986134603a2096218d88f347c3f3ab764bd7","observation_id":"e054e314-9f13-4178-bf36-13dc638c012a","resolution":{"observed_at":"2026-08-07T13:55:24.981311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:24.783075Z","title":"Poisoned chatgpt finds work for idle hands: Exploring developers’ coding practices with insecure suggestions from poisoned ai models","venue":null,"work_id":"e89d06ab-5baf-47ef-99da-bfef85185e8c","year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:51.838559Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:9ac47f8a7ba6c6c9e749070a9cc9d4aa8e415aca441866bf2d147e6b6c2de717","observation_id":"5607cbcf-e488-48c7-945f-c638c8485b33","resolution":{"observed_at":"2026-08-07T13:55:24.839371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:51.919051Z","title":"Introducing ChatGPT, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:51.919051Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:b7af25ad37a808a7980cb83009ba3010563effa6861d33bd59f2244156dc580e","observation_id":"16b5d11e-f0ca-4610-be35-b2a5a824779c","resolution":{"observed_at":"2026-08-07T13:54:51.919051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:51.992202Z","title":"Gpt-4o mini: advancing cost-efficient intelligence, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:51.992202Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:161140d29a00f0efe6fd8b3f5a50362527dc0644f162b073c3a2819d26d0d3cf","observation_id":"9e47c2de-2fd7-4582-a635-8af1d6a61da5","resolution":{"observed_at":"2026-08-07T13:54:51.992202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:24.595097Z","title":"Openai o3-mini: Pushing the frontier of cost-effective reasoning, 2025","venue":null,"work_id":"2697c1b4-fcac-4409-af98-18531fd8f504","year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.043090Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:49ad16b28ca47035bea52f555ca8315f22b5be7a955689dbc640697b52f922ef","observation_id":"adbea689-e8b3-492f-b51e-222122821c97","resolution":{"observed_at":"2026-08-07T13:55:24.666988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13733","last_updated":"2025-07-17T15:31:25Z","snapshot_observed_at":"2026-08-12T20:43:27.102739Z","submitted_at":"2025-03-17T21:41:37Z","title":"CoDet-M4: Detecting Machine-Generated Code in Multi-Lingual, Multi-Generator and Multi-Domain Settings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13733","snapshot_observed_at":"2026-08-07T13:54:52.108811Z","title":"Codet-m4: Detecting machine-generated code in multi-lingual, multi-generator and multi-domain settings.arXiv preprint arXiv:2503.13733, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.108811Z"},"links":{"cited_paper":"/paper/2503.13733","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:3315f460948587d2499851fc2aecd20c0d4b31e24a0a7beef1ad7a655b3dd433","observation_id":"3f3a22e2-6ddf-4c0d-8dc1-a910825615d8","resolution":{"observed_at":"2026-08-07T13:54:52.108811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:24.454193Z","title":"Assessing ai detectors in identifying ai-generated code: Implications for education","venue":null,"work_id":"f64fc1fb-6753-4d25-b48f-a694e3c3b29b","year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.157680Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:68b687291f100df4ca79c56e5026c0f200d0898d0c543e8a8c95e3d36205e918","observation_id":"a74c8129-f622-4c8e-855d-711bc48a174f","resolution":{"observed_at":"2026-08-07T13:55:24.515159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:24.309867Z","title":"Bleu: A method for automatic evaluation of machine translation","venue":null,"work_id":"72a3629f-2183-46b8-84bd-e7500029f956","year":2002},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.221757Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:7e0b311fdf800ddf24f4952c277b9391f0de6b068f20f5120d52054a663a19d1","observation_id":"1b147bce-2743-4336-be30-1d54c61c8701","resolution":{"observed_at":"2026-08-07T13:55:24.371342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:24.219658Z","title":"Asleep at the keyboard? assessing the security of github copilot’s code contributions","venue":null,"work_id":"ad87771b-ab65-4e3f-a0da-f6be4b5d942c","year":2022},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.278896Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:d691f10665df8fd876e222362850c6496e63bcdab2bf3f4c10b674a38ab7f537","observation_id":"68814478-2094-4fa8-9715-03362c8d9dfa","resolution":{"observed_at":"2026-08-07T13:55:24.265456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:24.109267Z","title":"Magecode: Machine- generated code detection method using large language models.IEEE Access, 2024","venue":null,"work_id":"2887fdbc-68ed-4353-b07b-3dfa6701b94c","year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.343700Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:c3c622a1e323f1ea59a789e9a0d01c898bd2fd8a48ca0371ef494b8903b3df2f","observation_id":"b8253700-57d5-448a-87ba-54f616a19d6b","resolution":{"observed_at":"2026-08-07T13:55:24.178275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:23.963647Z","title":"Introducing gemini 2.0: our new ai model for the agentic era, 2024","venue":null,"work_id":"65865dc8-71b3-4e58-ae65-dac0af00d340","year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.428624Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:2f16f2aa806103770a5b4201a34dbaef6d8c9f86873a1f44d9a7795134ab7143","observation_id":"b9be9d4a-a780-403d-b1ff-d1c738eadafe","resolution":{"observed_at":"2026-08-07T13:55:24.021607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:23.766888Z","title":"Using tf-idf to determine word relevance in document queries","venue":null,"work_id":"38c183e7-77ab-414e-b642-9597579973d9","year":2003},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.507552Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:ecfc017e9a5aa53b0366ffff5d4732926a3d76a0b7ed30b1afba27fd36071e83","observation_id":"353bcb8a-68f2-4f89-85f2-ebea9ed390cf","resolution":{"observed_at":"2026-08-07T13:55:23.877765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.10297","last_updated":"2020-09-27T04:07:11Z","snapshot_observed_at":"2026-08-12T14:26:33.940158Z","submitted_at":"2020-09-22T03:10:49Z","title":"CodeBLEU: a Method for Automatic Evaluation of Code Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.10297","snapshot_observed_at":"2026-08-07T13:54:52.586166Z","title":"Codebleu: a method for automatic evaluation of code synthesis.arXiv preprint arXiv:2009.10297, 2020","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.586166Z"},"links":{"cited_paper":"/paper/2009.10297","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:717b713a4e5bd55803ec8c4d9fc1f1291cbd2f449b472fbcee7c71d91b7fd748","observation_id":"77607fbd-f9cc-4b54-9e84-827390f386e8","resolution":{"observed_at":"2026-08-07T13:54:52.586166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:52.664974Z","title":"The perceptron: a probabilistic model for information storage and organization in the brain.Psychological review, 65(6):386, 1958","venue":null,"work_id":null,"year":1958},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.664974Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:9366d2c1a4cd6e7fa7f0edef37abc0564309ccc4491f19f34ca5610cedb6d1a9","observation_id":"0aea7182-b91b-4944-a0e6-0b80e6e140b3","resolution":{"observed_at":"2026-08-07T13:54:52.664974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.09179","last_updated":"2018-03-24T23:12:44Z","snapshot_observed_at":"2026-07-06T06:30:02.787977Z","submitted_at":"2018-03-24T23:12:44Z","title":"FaceForensics: A Large-scale Video Dataset for Forgery Detection in Human Faces","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.09179","snapshot_observed_at":"2026-08-07T13:54:52.729191Z","title":"Faceforensics: A large-scale video dataset for forgery detection in human faces.arXiv preprint arXiv:1803.09179, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.729191Z"},"links":{"cited_paper":"/paper/1803.09179","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:233bfdf6ac8873040c79b8b57fc821501395e995ba8e8c682213a61dec8b66c4","observation_id":"01af329a-b3ef-47a6-bfcf-632bd019bb96","resolution":{"observed_at":"2026-08-07T13:54:52.729191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11156","last_updated":"2025-01-17T04:21:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-17T17:53:19Z","title":"Can AI-Generated Text be Reliably Detected?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11156","snapshot_observed_at":"2026-08-07T13:54:52.803803Z","title":"Can ai-generated text be reliably detected?arXiv preprint arXiv:2303.11156, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.803803Z"},"links":{"cited_paper":"/paper/2303.11156","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:e67a5ffba3dcb438303919ed8b8974b72fd43c2368431a2596eafbaba4151c98","observation_id":"dc0d9a15-6988-4450-9b53-7e21e5f7b7c4","resolution":{"observed_at":"2026-08-07T13:54:52.803803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:23.548371Z","title":"Automated detection of ai-obfuscated plagiarism in modeling assignments","venue":null,"work_id":"38e13ca3-9086-4376-8a7d-4e467cbbd9db","year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.878609Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:90e7992a8baf97cc7c5f1dc4c2844bc6edc15cdbaeb90da784ea3c0eadac36b4","observation_id":"2f655c91-4889-4576-9e70-790a4b834762","resolution":{"observed_at":"2026-08-07T13:55:23.647131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:23.399964Z","title":"Between lines of code: Unraveling the distinct patterns of machine and human programmers","venue":null,"work_id":"759d5c0b-dac0-425f-a64e-3ea27562440a","year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.959556Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:60c71b2ee7941677529debaf81e8fbef5e9a5543e221a705bfc4aef65d1c289a","observation_id":"7c3dd540-98d5-48df-8e2d-9f9244f49fba","resolution":{"observed_at":"2026-08-07T13:55:23.470078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:23.167999Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics","venue":null,"work_id":"8ed399cf-6c45-4522-8c34-701d18c2c346","year":2015},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.995946Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:6746a6156f128f003fb7f74f6812cbd4e6598d1a8ecaa02168d318ab5267093d","observation_id":"0c1ca927-6b1f-407a-a316-2911d4455c3b","resolution":{"observed_at":"2026-08-07T13:55:23.301606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:22.887099Z","title":"2024 Stack Overflow Developer Survey, 2024","venue":null,"work_id":"03a66275-a5f2-419f-82b7-cb44561aabc6","year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.024513Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:cd75a7dc2200664b06fc2fe4aac8e0cb6a917328b8dcd2511116a8d9229ad463","observation_id":"78b2e5a4-a0c9-442b-8f13-4145bc6d8800","resolution":{"observed_at":"2026-08-07T13:55:23.023700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10877","last_updated":"2025-06-09T19:48:14Z","snapshot_observed_at":"2026-08-12T19:09:52.644339Z","submitted_at":"2024-11-16T20:06:21Z","title":"Developer Perspectives on Licensing and Copyright Issues Arising from Generative AI for Software Development","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10877","snapshot_observed_at":"2026-08-07T13:55:14.040744Z","title":"Developer perspectives on licensing and copyright issues arising from generative ai for coding.arXiv preprint arXiv:2411.10877, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.040744Z"},"links":{"cited_paper":"/paper/2411.10877","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:04747babc4bba26fc16a75116754a9912c0000aa6a25dfb28a96b8ab6535c460","observation_id":"c3bd3099-8ece-4dc6-bf6f-a010a95a4eb1","resolution":{"observed_at":"2026-08-07T13:55:14.040744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:22.656536Z","title":"Plagiarism in ai empowered world","venue":null,"work_id":"0b85e3ef-46f8-45fa-9a9d-b256094871a4","year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.056712Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:0e9ef3e29ed9c2da8ef5c7ba963cd425cda5fdc593ca285db609a71d6d135fb8","observation_id":"3c1c00e4-1d96-44f0-bb43-aa7ee7d7cd28","resolution":{"observed_at":"2026-08-07T13:55:22.748784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:22.450723Z","title":"An empirical study on automatically detecting ai-generated source code: How far are we? InInternational Conference on Software Engineering (ICSE), 2025","venue":null,"work_id":"96942720-07ed-4fec-b12c-23aaad3b3207","year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.076339Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:8f2e6f9e1c099a9b76432f2f6d15dbb7730282f332624544555a49cf9f978529","observation_id":"ee171013-724e-4eb6-a7ac-0ff12e27303b","resolution":{"observed_at":"2026-08-07T13:55:22.569105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:22.190256Z","title":"Bugs in large language models generated code: An empirical study.Empirical Software Engineering, 30(3):1–48, 2025","venue":null,"work_id":"d75bf698-ea81-4f18-a77e-2d5f08c8990f","year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.096731Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:0e1088e9c1873bc91eb309750f8985f4f98c686c843e64bc5dbba319f41edab1","observation_id":"0fa2b0ba-a5c4-4881-8712-9fa7925527eb","resolution":{"observed_at":"2026-08-07T13:55:22.322393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:21.884580Z","title":"How secure is ai-generated code: a large-scale comparison of large language models.Empirical Software Engineering, 30(2):1–42, 2025","venue":null,"work_id":"8ef6304a-9bcb-4d6c-8eea-3679fad584df","year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.118637Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:e20f13f736fba48d4ac0aff47db127fa707339c81ff63c3d0c53a980daa2cc02","observation_id":"ff6127b3-03dc-40ee-8637-e058f3d68f20","resolution":{"observed_at":"2026-08-07T13:55:22.045275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:21.669725Z","title":"Llms in web development: Evaluating llm-generated php code unveiling vulnerabilities and limitations","venue":null,"work_id":"f587a1eb-61da-445b-88dc-9efea98ba089","year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.179810Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:ae04c1883fd61ab21c497e0fb8c4529b9a0cfab4ca7ed46b6875080fb51dff78","observation_id":"6587dbf4-3410-4e7e-8012-c34f119d7781","resolution":{"observed_at":"2026-08-07T13:55:21.795506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:21.497594Z","title":"Turingbench: A benchmark environ- ment for turing test in the age of neural text generation","venue":null,"work_id":"ed375d13-7d45-4d41-8ecf-b32388480947","year":2021},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.217593Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:94be571887da8477eabd69c1e99a16e8e7cf7afd9fe087835925306fb1abc44d","observation_id":"281323d5-087a-459e-a11e-f0f9bc864f63","resolution":{"observed_at":"2026-08-07T13:55:21.551090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:21.360438Z","title":"A critical look at ai-generate software: Coding with the new ai tools is both irresistible and dangerous.IEEE Spectrum, 60(7):34–39, 2023","venue":null,"work_id":"b23b9404-c35e-46f9-9cda-d3884e7fcbb4","year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.277784Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:f94fd787ba9a72c668afce129b271a5c2b8aaffd1a493cdb40ffe72213d03497","observation_id":"be9e6b2a-63ed-4c8d-abd5-81e52907e025","resolution":{"observed_at":"2026-08-07T13:55:21.423137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:21.276321Z","title":"Attention is all you need.Advances in Neural Information Processing Systems (NeurIPS), 30, 2017","venue":null,"work_id":"c9c1df85-7897-4256-856a-18fadb9a55e8","year":2017},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.310837Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:cd474777a950a7defb14692eca5893b111f918e515ff4dbbf77ee825774e25a8","observation_id":"b88f5d05-c87f-4528-b0b1-f8c8780fe4c7","resolution":{"observed_at":"2026-08-07T13:55:21.314436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02395","last_updated":"2024-07-04T08:59:31Z","snapshot_observed_at":"2026-08-12T23:30:16.904700Z","submitted_at":"2024-07-02T16:13:21Z","title":"Is Your AI-Generated Code Really Safe? Evaluating Large Language Models on Secure Code Generation with CodeSecEval","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02395","snapshot_observed_at":"2026-08-07T13:55:14.361719Z","title":"Is your ai-generated code really safe? evaluating large language models on secure code generation with codeseceval.arXiv preprint arXiv:2407.02395, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.361719Z"},"links":{"cited_paper":"/paper/2407.02395","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:60d183c2378e0bb253bcc453a703d32592cfb405cc877a5b2532bc84deec7082","observation_id":"9d273f42-c329-43ba-bd73-61fc2f03955b","resolution":{"observed_at":"2026-08-07T13:55:14.361719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:21.175355Z","title":"Openhands: An open platform for ai software developers as generalist agents","venue":null,"work_id":"af7fbd5b-f7a3-4899-8bda-e9c4dc3c1ec6","year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.456862Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:8bf4cce24b82b92fb6f7a4a012411606de5e997bc8f786832685e36a3dc0d7f6","observation_id":"5a4c4378-4bcb-4f06-b2ce-31c15e7b716b","resolution":{"observed_at":"2026-08-07T13:55:21.222402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:21.063245Z","title":"Codet5+: Open code large language models for code understanding and generation","venue":null,"work_id":"ded0a691-df64-45ad-92a0-583b4d2e85e6","year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.546271Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:0a3019928f167ca0e7d40d3486fb52782d95bd72e3ca65683203440d7a46a21d","observation_id":"d7b5277a-0773-4316-95da-07206b479896","resolution":{"observed_at":"2026-08-07T13:55:21.117660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:20.918695Z","title":"A new era of plagiarism the danger of cheating using ai","venue":null,"work_id":"1ead372f-1588-4c2d-8961-303f53e63339","year":2022},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.634932Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:f14a3e7b3d352dd75c059b03e9ec23407f310477c616e4d88c5b09d167e01b6e","observation_id":"75d1735f-1810-49cb-ab70-67083d7d1190","resolution":{"observed_at":"2026-08-07T13:55:21.003759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:20.811740Z","title":"Do llms know to respect copyright notice? InConference on Empirical Methods in Natural Language Processing (EMNLP), pages 20604–20619, 2024","venue":null,"work_id":"f7c226e4-7057-487c-a440-2c318cbc64f8","year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.723234Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:ef4fb065962dd2304870769c49a61c89b56abb47707f02f7a9c45ec329051de6","observation_id":"17920c00-40ea-4080-908b-2bac02b2510b","resolution":{"observed_at":"2026-08-07T13:55:20.853496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16525","last_updated":"2025-07-09T10:04:06Z","snapshot_observed_at":"2026-08-11T10:27:39.814063Z","submitted_at":"2024-12-21T08:02:58Z","title":"One Size Does Not Fit All: Investigating Efficacy of Perplexity in Detecting LLM-Generated Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16525","snapshot_observed_at":"2026-08-07T13:55:14.798043Z","title":"Investigating efficacy of perplexity in detecting llm-generated code.arXiv preprint arXiv:2412.16525, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.798043Z"},"links":{"cited_paper":"/paper/2412.16525","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:844f6ac00f7e15628cde065ab904ee7c6842cb6114a8e36130d454925c503cca","observation_id":"4dbac241-c745-401e-a5f6-e9b4a06dcd99","resolution":{"observed_at":"2026-08-07T13:55:14.798043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02487","last_updated":"2025-02-25T08:58:05Z","snapshot_observed_at":"2026-08-12T23:08:28.035149Z","submitted_at":"2024-08-05T14:09:30Z","title":"LiCoEval: Evaluating LLMs on License Compliance in Code Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02487","snapshot_observed_at":"2026-08-07T13:55:14.880420Z","title":"Licoeval: Evaluating llms on license compliance in code generation.arXiv preprint arXiv:2408.02487, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.880420Z"},"links":{"cited_paper":"/paper/2408.02487","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:a83765a98b19779cdd1222120ca8e4bf8fb75ca1d2ecf117ed43b5a78173c716","observation_id":"e1ac7c31-4310-47fd-85cb-983ba9055911","resolution":{"observed_at":"2026-08-07T13:55:14.880420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:20.716338Z","title":"Distin- guishing llm-generated from human-written code by contrastive learning.ACM Transactions on Software Engineering and Methodology, 34(4):1–31, 2025","venue":null,"work_id":"59b01186-9cae-4130-af92-b07d0462ff8e","year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.956953Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:5ce3440846f1ed20f6e8ba8417654d746ad5e8c66365153d07456200ede5f2f3","observation_id":"6e66fc8d-f6ad-4b95-b5bb-5793c48afe27","resolution":{"observed_at":"2026-08-07T13:55:20.760397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:20.483108Z","title":"Detecting ai-generated code assignments using perplexity of large language models","venue":null,"work_id":"b930e94a-021f-47b1-9f60-26bc4f5ed307","year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:15.024786Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:919584b684c97eb0f624a4f1ca295c49e0b65f920197d24bb2166fcfd27151ea","observation_id":"559512f9-8e72-460e-8ef4-c0308bf77398","resolution":{"observed_at":"2026-08-07T13:55:20.608036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:20.353645Z","title":"An {LLM-Assisted}{Easy-to-Trigger} backdoor attack on code completion models: Injecting disguised vulnerabilities against strong detection","venue":null,"work_id":"fb8bd525-0f8b-4c47-951a-15cfc3887e7d","year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:15.059826Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:1ed5d97747f3b100f02045ca87e5e664a41f5bb9530e66c6d185d75c02364ee3","observation_id":"1a0ffe97-c900-4d1d-a030-c9b766ecbe73","resolution":{"observed_at":"2026-08-07T13:55:20.428612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05103","last_updated":"2023-10-08T10:08:21Z","snapshot_observed_at":"2026-08-13T08:09:03.090292Z","submitted_at":"2023-10-08T10:08:21Z","title":"Zero-Shot Detection of Machine-Generated Codes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05103","snapshot_observed_at":"2026-08-07T13:55:15.071294Z","title":"Zero-shot detection of machine-generated codes.arXiv preprint arXiv:2310.05103, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:15.071294Z"},"links":{"cited_paper":"/paper/2310.05103","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:b7fd1d6dbbc9ea51383d400bb8245fc10b410282f64af2a33da47fefb18f7abb","observation_id":"646f7d6b-37ce-431e-8a7a-e7e6bf2dcc18","resolution":{"observed_at":"2026-08-07T13:55:15.071294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:20.135477Z","title":"Uncovering llm-generated code: A zero-shot synthetic code detector via code rewriting","venue":null,"work_id":"264e5b11-49b8-40f6-9e73-16121bbbea1d","year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:15.099323Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:32e63165038748e0adf80b337bfb925628aa15b7f8b53377fd96b49ced6e666a","observation_id":"98df593a-6b3d-46a5-be04-6eb4eac9b636","resolution":{"observed_at":"2026-08-07T13:55:20.249361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:19.952490Z","title":"Codeipprompt: intellectual property infringement assessment of code language models","venue":null,"work_id":"c78bef72-b4cc-4679-b07f-bbc15cace4e3","year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:15.206200Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:a3271b965031f0d8d2d9c07df9996ec3bd5748bb2167f0c35fecec6d4a9c7212","observation_id":"6b711f23-85f8-44f8-929f-41adc1564bf7","resolution":{"observed_at":"2026-08-07T13:55:20.053757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15867","last_updated":"2025-04-22T13:09:20Z","snapshot_observed_at":"2026-08-07T16:00:14.464745Z","submitted_at":"2025-04-22T13:09:20Z","title":"Inducing Vulnerable Code Generation in LLM Coding Assistants","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15867","snapshot_observed_at":"2026-08-07T13:55:15.340847Z","title":"Inducing vulnerable code generation in llm coding assistants.arXiv preprint arXiv:2504.15867, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:15.340847Z"},"links":{"cited_paper":"/paper/2504.15867","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:8e0aa28ccd4d10ffe4d1ce69f25e2c8c5a34e87252f2026589fb58d74d861378","observation_id":"16b48c01-9f40-41ff-888e-384a39c9a208","resolution":{"observed_at":"2026-08-07T13:55:15.340847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:15.407231Z","title":"How well does llm generate security tests?arXiv preprint arXiv:2310.00710, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:15.407231Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:57719c551bf7e2a4284a8870a8edc181c327bf31b7d09058de96789c5c32c2c7","observation_id":"c76f7210-55c6-4567-aaf4-cb8d912ee442","resolution":{"observed_at":"2026-08-07T13:55:15.407231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:19.679102Z","title":"Genimage: A million-scale benchmark for detecting ai-generated image.Advances in Neural Information Processing Systems (NeurIPS), 36:77771–77782, 2023","venue":null,"work_id":"12a55819-84fc-4a33-8629-0c24950f773b","year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:15.510378Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:a13ca010a72434d773f00727c9a3ee847d0ed64433a5b2efbdcf8048d18ffd56","observation_id":"31be87fc-8af6-437f-815a-8d84cee8a050","resolution":{"observed_at":"2026-08-07T13:55:19.823765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:19.419023Z","title":"Wilddeepfake: A challenging real-world dataset for deepfake detection","venue":null,"work_id":"2ddb7889-dba1-4698-bcf5-22694c9020c8","year":2020},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:15.611545Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:6052a2fd5ebd1ca53e6aaaa662dbe790529ca3cbfa8eda70e40c98e280c20957","observation_id":"fa6ba879-fa02-4f20-a6f2-f0e7caf8aec1","resolution":{"observed_at":"2026-08-07T13:55:19.529874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:19.148469Z","title":null,"venue":null,"work_id":"4fabb481-91f8-4dc6-b86b-7500ae44e801","year":null},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:15.642841Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:258f8a11dc9e2649d21b20993cca888181677928475e5a8a57a03342531b6203","observation_id":"3b4e48ee-263b-4fa0-ba3e-0eda070ab4b1","resolution":{"observed_at":"2026-08-07T13:55:19.259887Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:19.017402Z","title":null,"venue":null,"work_id":"e12c277a-654f-402a-bc4a-cc5a8ab845f8","year":null},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:15.691408Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:61938d8eefd9951b0b1c73648e8c195444484839fdb839de8ecd7a21d8ab55ab","observation_id":"83acb047-23d9-4acc-b227-7eb9507bc60f","resolution":{"observed_at":"2026-08-07T13:55:19.095212Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-13T06:16:02.008869Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":59,"verified_exact":1,"verified_fuzzy":40},"total_outbound_references":111},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 100 of 111 outbound references and 1 inbound Pith citation observation for arXiv:2506.11059."}