Pith. sign in

Paper Citation Record · LEDGER

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs

As of 19 August 2026, this Paper Citation Record lists 100 of 111 outbound references and 1 inbound Pith citation observation for arXiv:2506.11059.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2506.11059 v1

Coverage vector

measured 100 of 111 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T13:55:15.691408Z

measured 101 of 101 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-18T06:34:40.430872+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-06T23:54:51.091578Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-08-06T23:54:56.588252Z

Reference resolution

100 of 111 outbound references displayed

  • verified exact1
  • verified fuzzy40
  • unresolved59
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 65788c0f-6182-4abf-b3a8-2ea9b74c138c · outbound

This paper cites GPT-4 Technical Report.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs GPT-4 Technical Report

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:46.476756Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:46.476756Z digest=sha256:a6c01a07cfdac78c6196b0e63302f84b9326d4367dc27fb6cbfbc5b3905c60c8

Observation 75df5980-73d5-411e-8495-bbdb621b2640 · outbound

This paper cites An Empirical Study of AI Generated Text Detection Tools.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs An Empirical Study of AI Generated Text Detection Tools

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:46.570106Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:46.570106Z digest=sha256:11dcde5909233fe370da7a9059f55f4e18cbe834bbf8a96cdf334f9562d3c1bd

Observation 908da8b7-9eeb-4478-9439-254c9cab0d7e · outbound

This paper cites Introducing computer use, a new claude 3.5 sonnet, and claude 3.5 haiku, 2024.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Introducing computer use, a new claude 3.5 sonnet, and claude 3.5 haiku, 2024

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:46.633741Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:46.633741Z digest=sha256:0cc0591ad86c6fff5ea0ce1507c818386167587c2cc697716a909fcb6ac45ab9

Observation a7846d60-9b79-475a-9822-16282d44c1d2 · outbound

This paper cites Claude 3.7 Sonnet and Claude Code, 2025.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Claude 3.7 Sonnet and Claude Code, 2025

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:46.720560Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:46.720560Z digest=sha256:f90a655bfa9235ee1fd6304ef63a49ef1641e3cac419877d38e8fdfa128df703

Observation c5a100e3-a86e-4296-89d1-260fca603978 · outbound

This paper cites Is github’s copilot as bad as humans at introducing vulnerabilities in code?Empirical Software Engineering, 28(6):129, 2023.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Is github’s copilot as bad as humans at introducing vulnerabilities in code?Empirical Software Engineering, 28(6):129, 2023

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:46.811473Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:46.811473Z digest=sha256:91085c8e9c54d0b1d34805d26faf6daa8d49e35d8bcef89750b0ca7c0584f86c

Observation c0a0349f-1f09-4419-bb99-36ab95a46fc6 · outbound

This paper cites Random forests.Machine learning, 45:5–32, 2001.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Random forests.Machine learning, 45:5–32, 2001

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:46.895270Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:46.895270Z digest=sha256:00a991a0719300a4895fc4036a23fbad8397149ce06cec786ea5d941ec2984b2

Observation f391913e-6860-425b-8fa2-3debfa1511e7 · outbound

This paper cites Membership inference attacks from first principles.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Membership inference attacks from first principles

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:46.976947Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:46.976947Z digest=sha256:ed83c1d6c996a3f73c22537bb2be6e71a298e66f2d18e0ce29e2e5723335a7f2

Observation 4e3022a3-1094-44a2-af28-e5090a1fb735 · outbound

This paper cites R package version 3.0.1.1.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs R package version 3.0.1.1

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:47.063202Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:47.063202Z digest=sha256:10af5117f3ea89b996bb63d59b39a542e6b2906aef6db72415b3d6ae5b8c8407

Observation 553cb2d9-df04-4555-913c-b75ef7780dab · outbound

This paper cites Github code clean dataset, 2022.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Github code clean dataset, 2022

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:47.129620Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:47.129620Z digest=sha256:5611f2529a386cb3e827fba028e3e0476b2c891ac6a6f84a295d6838fa565986

Observation 02afa950-9b55-48b6-b04f-744abf07e8c5 · outbound

This paper cites Github code dataset, 2022.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Github code dataset, 2022

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:47.200058Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:47.200058Z digest=sha256:321a05ba580740b882e7706aa050c1ecce5d8a621c55a0be228ff6a4c8b2435b

Observation f25dda91-c58c-43df-8202-91a4e16cfd1a · outbound

This paper cites Vulnerabilities in ai code generators: Exploring targeted data poisoning attacks.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Vulnerabilities in ai code generators: Exploring targeted data poisoning attacks

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:47.294524Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:47.294524Z digest=sha256:c6a4fa100888e92a2041506ae4bf5542740cf915898ae56b383bcd9097a57f8b

Observation 29e82846-deea-4d38-bd2e-2d9edfe7f36b · outbound

This paper cites Cursor: The AI Code Editor, 2023.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Cursor: The AI Code Editor, 2023

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:47.393332Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:47.393332Z digest=sha256:7f6af5e04b588b69c0e0ad4a2a6554f392c01911924cc33feadb7b83a98c6451

Observation 1b0a11d0-a7f0-462f-8638-6c5988df77d1 · outbound

This paper cites Plagiarism in the age of massive generative pre-trained transformers (gpt-3).Ethics in Science and Environmental Politics, 21:17–23, 2021.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Plagiarism in the age of massive generative pre-trained transformers (gpt-3).Ethics in Science and Environmental Politics, 21:17–23, 2021

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:47.467782Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:47.467782Z digest=sha256:d348f88c900fdebf2e61e0aa367496dc2b7bb70387361c78c2fd118211844556

Observation 9338dc5a-b143-4bc3-821b-57e1450a2458 · outbound

This paper cites AIGCodeSet: A New Annotated Dataset for AI Generated Code Detection.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs AIGCodeSet: A New Annotated Dataset for AI Generated Code Detection

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:47.550790Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:47.550790Z digest=sha256:3aece49dfe6be3899e619b8f2447c4fca0aa94ba4dd61c605bd6ef946446024d

Observation d7d6f9c8-d5dd-4eab-8e0f-659fe2ae56a6 · outbound

This paper cites The DeepFake Detection Challenge (DFDC) Dataset.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs The DeepFake Detection Challenge (DFDC) Dataset

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:47.640002Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:47.640002Z digest=sha256:4c578612fd37fac357b58a4545627ebff5e528164b05d66d5925e3064c656b6c

Observation 8d87665b-4f0b-46c3-8a0e-7128c09be92f · outbound

This paper cites Codep: grammatical seq2seq model for general-purpose code generation.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Codep: grammatical seq2seq model for general-purpose code generation

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:47.701676Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:47.701676Z digest=sha256:f45e5402581997e15187335d34b1f12677ebe0ddc1a2001857c1efe3348a23e3

Observation 08fb92ab-8479-4797-be7c-5184de1e9f47 · outbound

This paper cites JaCoText: A Pretrained Model for Java Code-Text Generation.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs JaCoText: A Pretrained Model for Java Code-Text Generation

Reference 17

Resolution
verified exact
local_arxiv, observed 2026-08-07T13:55:17.120274Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:54:47.773655Z digest=sha256:df4f4075dc0c631bbc58556f3682f4f5e7b80c5e9a994ed9d1e62c75334b291c

Observation cc471623-5e94-487d-a09f-a0dd57b31ff3 · outbound

This paper cites Out of the bleu: how should we assess quality of the code generation models?Journal of Systems and Software, 203:111741, 2023.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Out of the bleu: how should we assess quality of the code generation models?Journal of Systems and Software, 203:111741, 2023

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:47.862883Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:47.862883Z digest=sha256:516fd47f4da610eb3c6d039ec43a4533e955cbd076b23cfd9dba20d30136ffe4

Observation 11467041-3d7d-44fc-acf8-15269374ff63 · outbound

This paper cites CodeBERT: A Pre-Trained Model for Programming and Natural Languages.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs CodeBERT: A Pre-Trained Model for Programming and Natural Languages

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:47.920730Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:47.920730Z digest=sha256:97bfe5ba178aa12135f1cf08489bb2cedda3a838b280f93e4e037f51d5077ad0

Observation 21847269-8275-48a4-b353-0e7bb165121f · outbound

This paper cites Introducing GitHub Copilot: your AI pair programmer, 2022.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Introducing GitHub Copilot: your AI pair programmer, 2022

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:48.011427Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:48.011427Z digest=sha256:3bccbfaec09be1082066a6b827acee305b0aaf7e7de856523617693205089f78

Observation d7e6ddef-b792-4499-8ca8-05d7ac0df019 · outbound

This paper cites What makes good in-context demonstrations for code intelligence tasks with llms? InIEEE/ACM International Conference on Automated Software Engineering (ASE), pages 761–773, 2023.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs What makes good in-context demonstrations for code intelligence tasks with llms? InIEEE/ACM International Conference on Automated Software Engineering (ASE), pages 761–773, 2023

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:48.070030Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:48.070030Z digest=sha256:685659600c64a2892f068bfae3def364d0f647514a105b0876e3fb2a3e25e453

Observation 1528c165-1662-4f98-a82a-3165eaa55899 · outbound

This paper cites Gltr: Statistical detection and visualization of generated text.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Gltr: Statistical detection and visualization of generated text

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:48.124138Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:48.124138Z digest=sha256:a7275a9ae02ec31a1d585f676b3ada5071c099f808b6fe7e540370a9f5d384d0

Observation 314297cd-8c44-4ef9-b4a0-4a1e554b2176 · outbound

This paper cites A survey on the possibilities & impossibilities of ai-generated text detection.Transactions on Machine Learning Research (TMLR), 2023.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs A survey on the possibilities & impossibilities of ai-generated text detection.Transactions on Machine Learning Research (TMLR), 2023

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:48.246520Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:48.246520Z digest=sha256:10d3db80ef9391a104b391dd4770d47fb7174ef789620c8fd36bb34b139048ad

Observation b5aac917-e193-4767-ad10-2fbec12deecd · outbound

This paper cites Deepfake video detection using recurrent neural networks.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Deepfake video detection using recurrent neural networks

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:48.359564Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:48.359564Z digest=sha256:ffc21c2ecfa3c6c79df0f73dcaa328b5e06fb2ab55c351bfc81fda8b53359c63

Observation f13457b0-5431-42a2-b472-218cb58cd458 · outbound

This paper cites Graphcodebert: Pre-training code representations with data flow.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Graphcodebert: Pre-training code representations with data flow

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:48.449654Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:48.449654Z digest=sha256:0266ab30bb41f277f44f02383c31eb5e693494bc3e2e2b741718b2b0c348b672

Observation 05003157-91eb-4798-8360-04d2c36081b1 · outbound

This paper cites DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:48.545437Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:48.545437Z digest=sha256:695d19b48ee8155af9425f529ba71662680b272cc834e8c1c40cd16c81a4cfae

Observation eb20765c-9e15-4507-8edc-b618ad05b088 · outbound

This paper cites Biscope: Ai-generated text detection by checking memorization of preceding tokens.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Biscope: Ai-generated text detection by checking memorization of preceding tokens

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:48.665601Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:48.665601Z digest=sha256:0843d82c946ac9bf2f526b40cc2b92151a97d4cd41fdb0b1c0e958aa3284cf5e

Observation c66b5304-5d20-4b43-abe3-3212d8cf7a90 · outbound

This paper cites Spotting llms with binoculars: Zero-shot detection of machine-generated text.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Spotting llms with binoculars: Zero-shot detection of machine-generated text

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:48.809631Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:48.809631Z digest=sha256:80d25f3afd5ee2a5194ec858c587e8cdbc39a632d4d26910cac76c89653df110

Observation 5195c632-aa5c-4485-855a-96398f705a7d · outbound

This paper cites Denoising diffusion probabilistic models.Advances in Neural Information Processing Systems (NeurIPS), 33:6840–6851, 2020.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Denoising diffusion probabilistic models.Advances in Neural Information Processing Systems (NeurIPS), 33:6840–6851, 2020

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:48.908202Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:48.908202Z digest=sha256:20fbe96ece3fb2e01c31ed684fbe8437dcf32554a7b664e4d8ec264f4770e0e0

Observation 83737ca2-14d0-46cf-85c5-01beb47d2d14 · outbound

This paper cites Qwen2.5-Coder Technical Report.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Qwen2.5-Coder Technical Report

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:48.989561Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:48.989561Z digest=sha256:eeafb12fd9df94205a8274264505020b0f2eb2cbbbbf285f3c536f109fe44314

Observation 77d0cb4e-9f09-4066-ab9d-84f237151c12 · outbound

This paper cites Rethinking plagiarism in the era of generative ai.Journal of Intelligent Communication, 3(2):20–31, 2024.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Rethinking plagiarism in the era of generative ai.Journal of Intelligent Communication, 3(2):20–31, 2024

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:49.120454Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:49.120454Z digest=sha256:98b89c140ebe7ad6171946e6136634e9b07485934471f2dd79c49d14b996e82d

Observation 3207f12b-4c39-4ebc-951d-9d6ed0e8ceb6 · outbound

This paper cites Whodunit: Classifying code as human authored or gpt-4 generated-a case study on codechef problems.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Whodunit: Classifying code as human authored or gpt-4 generated-a case study on codechef problems

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:49.242525Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:49.242525Z digest=sha256:db6c8efca91274f14228bd814525426475812a7ddb2cf7ada3eae6d35b0ab217

Observation bc477be6-3ca6-452d-a785-58be0314634a · outbound

This paper cites Automatic detection of generated text is easiest when humans are fooled.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Automatic detection of generated text is easiest when humans are fooled

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:49.340671Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:49.340671Z digest=sha256:e88ebeb4113da6bc634fd3bc368f874679ae9fd6b25cecc30426c9a715f2ec1c

Observation c4238f08-8892-4f25-8231-5600621c9da7 · outbound

This paper cites Swe-bench: Can language models resolve real-world github issues? InInternational Conference on Learning Representations (ICLR), 2024.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Swe-bench: Can language models resolve real-world github issues? InInternational Conference on Learning Representations (ICLR), 2024

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:49.537272Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:49.537272Z digest=sha256:5116a27dbc8792b63482c620329fbe89bb4bf0781849bad70f6b7bfba6370e75

Observation bae908c6-127e-4bda-a198-82489ae72e37 · outbound

This paper cites Access the latest 2.0 experimental models in the gemini app., 2025.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Access the latest 2.0 experimental models in the gemini app., 2025

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:49.661149Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:49.661149Z digest=sha256:4aeed8139b486e4ffa1c93e33dfcee2993068085be39a44a119cc61384b3d792

Observation 605bc256-bacb-4710-8e72-c6021ee8bb78 · outbound

This paper cites Vulnerability handling of ai- generated code-existing solutions and open challenges.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Vulnerability handling of ai- generated code-existing solutions and open challenges

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:49.780282Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:49.780282Z digest=sha256:eec77156e4069f786ae920a4dd183279c8da16f5a325e7554bd807d4dd1db866

Observation d508cc1b-25f4-4f13-bd1b-d3a77ffe37be · outbound

This paper cites Gemini 2.0 is now available to everyone, 2025.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Gemini 2.0 is now available to everyone, 2025

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:49.898415Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:49.898415Z digest=sha256:1fbdbd310a7ff6090a1edbd5a746dd174183ba5d488f147f693e7a88c5b582d9

Observation dbda737d-454c-453b-ba59-b83e84ff4e8e · outbound

This paper cites Does attitude towards plagiarism predict aigiarism using chatgpt?AI and Ethics, 5(1):677–688, 2025.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Does attitude towards plagiarism predict aigiarism using chatgpt?AI and Ethics, 5(1):677–688, 2025

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:50.058627Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:50.058627Z digest=sha256:3c6d92b839ce4be0eee71c1d2bf12d16e9f764c24c5def41e58da95c6302b8d3

Observation ef0bb54f-4125-47f8-89f4-f384d8462faf · outbound

This paper cites Will chatgpt g et you caught? rethinking of plagiarism detection.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Will chatgpt g et you caught? rethinking of plagiarism detection

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:50.183926Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:50.183926Z digest=sha256:16fc27be2f3602847076dd61f1298cc07ab2b929283dd13cd6a0886e2c5aadb5

Observation 64ffc721-c503-4bb6-a5a5-533ecc3ba99f · outbound

This paper cites How secure is code generated by chatgpt? InIEEE international conference on systems, man, and cybernetics (SMC), pages 2445–2451.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs How secure is code generated by chatgpt? InIEEE international conference on systems, man, and cybernetics (SMC), pages 2445–2451

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:26.240995Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:54:50.269865Z digest=sha256:45216a284aef86d646607b1a61a94eb5f007fdbfc1bb04700ac6fd2f367b484e

Observation 03f30dd7-d73a-47ee-bd15-91d0063106e0 · outbound

This paper cites Paraphrasing evades detectors of ai-generated text, but retrieval is an effective defense.Advances in Neural Information Processing Systems (NeurIPS), 2023.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Paraphrasing evades detectors of ai-generated text, but retrieval is an effective defense.Advances in Neural Information Processing Systems (NeurIPS), 2023

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:26.074964Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:54:50.386281Z digest=sha256:6b78de1574707764469ebe92c484f054368013e63c96a7848d97ff360c1303d6

Observation 4271435f-c3b5-455a-8867-637eaf646188 · outbound

This paper cites Detecting fake content with relative entropy scoring.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Detecting fake content with relative entropy scoring

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:25.908463Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:54:50.553406Z digest=sha256:2b51319da97654a15cf683c2773c868332a898e7423d7dca2c3e482935c17710

Observation 50499960-1047-4a1f-b5a3-ade3debd7f65 · outbound

This paper cites Protecting intellectual property of large language model-based code generation apis via watermarks.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Protecting intellectual property of large language model-based code generation apis via watermarks

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:25.821311Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:54:50.664897Z digest=sha256:2abd28cdd5d6b118eeeb89fc3ea8393c5a892d005bb22fa9759ad9dd12ba1d53

Observation cabc3883-4bb6-4818-80ea-24f5fff2cfc9 · outbound

This paper cites DeepSeek-V3 Technical Report.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs DeepSeek-V3 Technical Report

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:50.744812Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:50.744812Z digest=sha256:40b2fe38b4035ce9fbf7709f0eeb63c5a31c5ad96300d02cc927fec3a36417b7

Observation 1da2f7b4-1105-407c-a195-1bc12dcf90ad · outbound

This paper cites an unresolved cited work.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Unresolved cited work

Reference 45

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:55:25.697427Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:54:50.865882Z digest=sha256:53f94977e9857b9086eaf784a40a0a5c555a3610f69186121db427b8e2a3c4b3

Observation 04279a04-6e3d-4f41-8e20-d41d409b3ac1 · outbound

This paper cites CodeXEmbed: A Generalist Embedding Model Family for Multiligual and Multi-task Code Retrieval.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs CodeXEmbed: A Generalist Embedding Model Family for Multiligual and Multi-task Code Retrieval

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:51.004303Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:51.004303Z digest=sha256:9d1eadb6dd101229b31d8e9aee82441cf50a9b218cd3d017a90d128f065d0853

Observation 2ce6caf2-b835-4f6e-80a1-10112003ecd9 · outbound

This paper cites RoBERTa: A Robustly Optimized BERT Pretraining Approach.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs RoBERTa: A Robustly Optimized BERT Pretraining Approach

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:51.120028Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:51.120028Z digest=sha256:23e86e1b00eab3ee0b39682b826f0f331e26b7dfa6233b2bed75115ca684e735

Observation c6f9638a-d993-4bd4-bf4d-944c3afec798 · outbound

This paper cites Raidar: generative ai detection via rewriting.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Raidar: generative ai detection via rewriting

Reference 48

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:25.537792Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:54:51.218996Z digest=sha256:aba4bc79ed9eb4df2699a7e6d81cd3001025a598855e4153a05e42d9554c9d7a

Observation db5bea98-ac35-408c-8e6a-9907e16e7a86 · outbound

This paper cites On the robustness of code generation techniques: An empirical study on github copilot.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs On the robustness of code generation techniques: An empirical study on github copilot

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:25.415448Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:54:51.348636Z digest=sha256:e857d971630ec34c0d3a4959acdb29b370f87fca4a2bb91f8c9bfeeb9cf308f5

Observation 47c2b334-6ec8-4be7-84ef-3bb770d4ba7f · outbound

This paper cites Llama 3.3: Model cards & prompt formats, 2024.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Llama 3.3: Model cards & prompt formats, 2024

Reference 50

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:25.275821Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:54:51.489432Z digest=sha256:c70fdc3544de0a99072052077a890dd7cc7f929693de8c5f048b1506730d73b6

Observation a1845f18-307f-48db-99d2-ef1065386dff · outbound

This paper cites Detectgpt: Zero-shot machine-generated text detection using probability curvature.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Detectgpt: Zero-shot machine-generated text detection using probability curvature

Reference 51

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:25.167755Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:54:51.641080Z digest=sha256:dc4be9c848f10830020c45b7c9f08d1388a4fe915764628181432f560a0c6a63

Observation 369ee951-331b-4b17-a544-0fc92734f160 · outbound

This paper cites Is this Snippet Written by ChatGPT? An Empirical Study with a CodeBERT-Based Classifier.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Is this Snippet Written by ChatGPT? An Empirical Study with a CodeBERT-Based Classifier

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:51.700600Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:51.700600Z digest=sha256:b3d14351bfddf832601735f7d67370e684245d0a9316e818933be62432e6d385

Observation e054e314-9f13-4178-bf36-13dc638c012a · outbound

This paper cites Gptsniffer: A codebert-based classifier to detect source code written by chatgpt.Journal of Systems and Software, 214:112059, 2024.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Gptsniffer: A codebert-based classifier to detect source code written by chatgpt.Journal of Systems and Software, 214:112059, 2024

Reference 53

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:24.981311Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:54:51.759655Z digest=sha256:6f99f285f6c6cfd7473e7063679cd6ab66217ccdd4ea063986275af4987989de

Observation 5607cbcf-e488-48c7-945f-c638c8485b33 · outbound

This paper cites Poisoned chatgpt finds work for idle hands: Exploring developers’ coding practices with insecure suggestions from poisoned ai models.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Poisoned chatgpt finds work for idle hands: Exploring developers’ coding practices with insecure suggestions from poisoned ai models

Reference 54

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:24.839371Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:54:51.838559Z digest=sha256:7d7b6688b7ac68a392317121fe11734a62fa1577962067263632e415d1a1ecbc

Observation 16b5d11e-f0ca-4610-be35-b2a5a824779c · outbound

This paper cites Introducing ChatGPT, 2022.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Introducing ChatGPT, 2022

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:51.919051Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:51.919051Z digest=sha256:ae5832f42ef98a7854724e4b11042c3f18286477d979d82952746c4ed83e0944

Observation 9e47c2de-2fd7-4582-a635-8af1d6a61da5 · outbound

This paper cites Gpt-4o mini: advancing cost-efficient intelligence, 2024.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Gpt-4o mini: advancing cost-efficient intelligence, 2024

Reference 56

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:51.992202Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:51.992202Z digest=sha256:62b3a01e2de4c6482b70748f24593f184d8842ff3bf645175012ef794b50a2df

Observation adbea689-e8b3-492f-b51e-222122821c97 · outbound

This paper cites Openai o3-mini: Pushing the frontier of cost-effective reasoning, 2025.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Openai o3-mini: Pushing the frontier of cost-effective reasoning, 2025

Reference 57

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:24.666988Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:54:52.043090Z digest=sha256:6b7319101a190ab42f6cdb80b5d38aedcee366743292cbaf0fbd78f7b2510420

Observation 3f3a22e2-6ddf-4c0d-8dc1-a910825615d8 · outbound

This paper cites CoDet-M4: Detecting Machine-Generated Code in Multi-Lingual, Multi-Generator and Multi-Domain Settings.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs CoDet-M4: Detecting Machine-Generated Code in Multi-Lingual, Multi-Generator and Multi-Domain Settings

Reference 58

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:52.108811Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:52.108811Z digest=sha256:bce34e4b4e18d9decac533e91935a5e9222d1600a36a6ce42f07ace9ea77f90c

Observation a74c8129-f622-4c8e-855d-711bc48a174f · outbound

This paper cites Assessing ai detectors in identifying ai-generated code: Implications for education.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Assessing ai detectors in identifying ai-generated code: Implications for education

Reference 59

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:24.515159Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:54:52.157680Z digest=sha256:9f9997711effe6c6050aeca5688de6193d8dc9331e35012bd5ce1affebb9229e

Observation 1b147bce-2743-4336-be30-1d54c61c8701 · outbound

This paper cites Bleu: A method for automatic evaluation of machine translation.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Bleu: A method for automatic evaluation of machine translation

Reference 60

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:24.371342Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:54:52.221757Z digest=sha256:6b8046f0f026370704e21d6e5c7a47169ec82fddfa44f95a777d51ab55757d46

Observation 68814478-2094-4fa8-9715-03362c8d9dfa · outbound

This paper cites Asleep at the keyboard? assessing the security of github copilot’s code contributions.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Asleep at the keyboard? assessing the security of github copilot’s code contributions

Reference 61

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:24.265456Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:54:52.278896Z digest=sha256:4a35decceed02cfc9800e9a1105546406c7cfb5d2eae9d552818af212163d34f

Observation b8253700-57d5-448a-87ba-54f616a19d6b · outbound

This paper cites Magecode: Machine- generated code detection method using large language models.IEEE Access, 2024.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Magecode: Machine- generated code detection method using large language models.IEEE Access, 2024

Reference 62

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:24.178275Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:54:52.343700Z digest=sha256:fb39b17f8ecd8dbb0d9ce54014ffee26ed7ebfe48eca3f7916e3a0f1ccdb1780

Observation b9be9d4a-a780-403d-b1ff-d1c738eadafe · outbound

This paper cites Introducing gemini 2.0: our new ai model for the agentic era, 2024.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Introducing gemini 2.0: our new ai model for the agentic era, 2024

Reference 63

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:24.021607Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:54:52.428624Z digest=sha256:d79dbfb8b581502c36a8c334ebc95e986d260effb395848166fcf9ae759be7b9

Observation 353bcb8a-68f2-4f89-85f2-ebea9ed390cf · outbound

This paper cites Using tf-idf to determine word relevance in document queries.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Using tf-idf to determine word relevance in document queries

Reference 64

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:23.877765Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:54:52.507552Z digest=sha256:051069c3fcfe73e98216a62fa67da254bed3a47e5f6bce4940ee875c3f9d2b7d

Observation 77607fbd-f9cc-4b54-9e84-827390f386e8 · outbound

This paper cites CodeBLEU: a Method for Automatic Evaluation of Code Synthesis.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs CodeBLEU: a Method for Automatic Evaluation of Code Synthesis

Reference 65

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:52.586166Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:52.586166Z digest=sha256:aad27dbac46330729a1cc441ce0b6741da90cd73ad2c37e2ed864b8bae5c478a

Observation 0aea7182-b91b-4944-a0e6-0b80e6e140b3 · outbound

This paper cites The perceptron: a probabilistic model for information storage and organization in the brain.Psychological review, 65(6):386, 1958.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs The perceptron: a probabilistic model for information storage and organization in the brain.Psychological review, 65(6):386, 1958

Reference 66

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:52.664974Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:52.664974Z digest=sha256:ed1f9d3dc303b5aded40dfaafb9ea1cabfec5f8f9c1c3da314242b49a0d3921a

Observation 01af329a-b3ef-47a6-bfcf-632bd019bb96 · outbound

This paper cites FaceForensics: A Large-scale Video Dataset for Forgery Detection in Human Faces.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs FaceForensics: A Large-scale Video Dataset for Forgery Detection in Human Faces

Reference 67

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:52.729191Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:52.729191Z digest=sha256:cdeb227ca02c8d0e73001eacb67253de6fc59fcb08b4d458049ca8188c25deeb

Observation dc0d9a15-6988-4450-9b53-7e21e5f7b7c4 · outbound

This paper cites Can AI-Generated Text be Reliably Detected?.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Can AI-Generated Text be Reliably Detected?

Reference 68

Resolution
unresolved
no resolver link, observed 2026-08-07T13:54:52.803803Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:54:52.803803Z digest=sha256:ab397d0f8bd696da9c678f5e036a3c6bce3997988ffff1defe061dfc1d30f7b8

Observation 2f655c91-4889-4576-9e70-790a4b834762 · outbound

This paper cites Automated detection of ai-obfuscated plagiarism in modeling assignments.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Automated detection of ai-obfuscated plagiarism in modeling assignments

Reference 69

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:23.647131Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:54:52.878609Z digest=sha256:4e396cadb82cd38b87c9d1f5fd6a867a5c37a914b5fdea6df3825eb30fb6a29c

Observation 7c3dd540-98d5-48df-8e2d-9f9244f49fba · outbound

This paper cites Between lines of code: Unraveling the distinct patterns of machine and human programmers.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Between lines of code: Unraveling the distinct patterns of machine and human programmers

Reference 70

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:23.470078Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:54:52.959556Z digest=sha256:e1484c12d2a76e157a6a33e34cf4ab60ce0507d2839d78476478c040261680d7

Observation 0c1ca927-6b1f-407a-a316-2911d4455c3b · outbound

This paper cites Deep unsupervised learning using nonequilibrium thermodynamics.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Deep unsupervised learning using nonequilibrium thermodynamics

Reference 71

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:23.301606Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:54:52.995946Z digest=sha256:66d267092681dc8a77fd3dfa3d86cc92c7a3f1121a5ea263a9f401c6d9e2f965

Observation 78b2e5a4-a0c9-442b-8f13-4145bc6d8800 · outbound

This paper cites 2024 Stack Overflow Developer Survey, 2024.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs 2024 Stack Overflow Developer Survey, 2024

Reference 72

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:23.023700Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:55:14.024513Z digest=sha256:e82cee08bef4a8f2fcb30bb02b9020d6eec2f084a7cb616868988840f115aac5

Observation c3bd3099-8ece-4dc6-bf6f-a010a95a4eb1 · outbound

This paper cites Developer Perspectives on Licensing and Copyright Issues Arising from Generative AI for Software Development.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Developer Perspectives on Licensing and Copyright Issues Arising from Generative AI for Software Development

Reference 73

Resolution
unresolved
no resolver link, observed 2026-08-07T13:55:14.040744Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:55:14.040744Z digest=sha256:16442ede3f3583841c035095d295adb714bffe0194ae964c9969804b7fa7df55

Observation 3c1c00e4-1d96-44f0-bb43-aa7ee7d7cd28 · outbound

This paper cites Plagiarism in ai empowered world.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Plagiarism in ai empowered world

Reference 74

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:22.748784Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:55:14.056712Z digest=sha256:50e9ed7e9f972b6c02053ebe1775f41746512bb5728284f4865b38ee432db996

Observation ee171013-724e-4eb6-a7ac-0ff12e27303b · outbound

This paper cites An empirical study on automatically detecting ai-generated source code: How far are we? InInternational Conference on Software Engineering (ICSE), 2025.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs An empirical study on automatically detecting ai-generated source code: How far are we? InInternational Conference on Software Engineering (ICSE), 2025

Reference 75

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:22.569105Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:55:14.076339Z digest=sha256:cc0c68531e87f7657b98633ff2162337f819c57070830a0807f5bea9aa9d8d64

Observation 0fa2b0ba-a5c4-4881-8712-9fa7925527eb · outbound

This paper cites Bugs in large language models generated code: An empirical study.Empirical Software Engineering, 30(3):1–48, 2025.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Bugs in large language models generated code: An empirical study.Empirical Software Engineering, 30(3):1–48, 2025

Reference 76

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:22.322393Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:55:14.096731Z digest=sha256:4b9fdcf71c333a3e8633075360712e36b8abc77e3f6dfa6bbbcfebf9ec49b7b5

Observation ff6127b3-03dc-40ee-8637-e058f3d68f20 · outbound

This paper cites How secure is ai-generated code: a large-scale comparison of large language models.Empirical Software Engineering, 30(2):1–42, 2025.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs How secure is ai-generated code: a large-scale comparison of large language models.Empirical Software Engineering, 30(2):1–42, 2025

Reference 77

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:22.045275Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:55:14.118637Z digest=sha256:cb3828c612706ce3f3b7f2788d16aef343c2a8a0d3aa929e0ada4126c08f8f6a

Observation 6587dbf4-3410-4e7e-8012-c34f119d7781 · outbound

This paper cites Llms in web development: Evaluating llm-generated php code unveiling vulnerabilities and limitations.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Llms in web development: Evaluating llm-generated php code unveiling vulnerabilities and limitations

Reference 78

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:21.795506Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:55:14.179810Z digest=sha256:a7d33b8599d61ef8076f201d50d436208e71b03d6236af0791555f413f332dae

Observation 281323d5-087a-459e-a11e-f0f9bc864f63 · outbound

This paper cites Turingbench: A benchmark environ- ment for turing test in the age of neural text generation.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Turingbench: A benchmark environ- ment for turing test in the age of neural text generation

Reference 79

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:21.551090Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:55:14.217593Z digest=sha256:64c1a9dccac68ee68b5d35ec80bedf086d05d552b0bc63072728660d8b4db320

Observation be9e6b2a-63ed-4c8d-abd5-81e52907e025 · outbound

This paper cites A critical look at ai-generate software: Coding with the new ai tools is both irresistible and dangerous.IEEE Spectrum, 60(7):34–39, 2023.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs A critical look at ai-generate software: Coding with the new ai tools is both irresistible and dangerous.IEEE Spectrum, 60(7):34–39, 2023

Reference 80

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:21.423137Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:55:14.277784Z digest=sha256:3551cc86c5122ee67b05589bdb74db9fc9a22f74764fc021a866d0398e9bd782

Observation b88f5d05-c87f-4528-b0b1-f8c8780fe4c7 · outbound

This paper cites Attention is all you need.Advances in Neural Information Processing Systems (NeurIPS), 30, 2017.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Attention is all you need.Advances in Neural Information Processing Systems (NeurIPS), 30, 2017

Reference 81

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:21.314436Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:55:14.310837Z digest=sha256:943d4691a348a19a1f1977e10a219bc73659834251ba7d4cec874d43e4cc5491

Observation 9d273f42-c329-43ba-bd73-61fc2f03955b · outbound

This paper cites Is Your AI-Generated Code Really Safe? Evaluating Large Language Models on Secure Code Generation with CodeSecEval.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Is Your AI-Generated Code Really Safe? Evaluating Large Language Models on Secure Code Generation with CodeSecEval

Reference 82

Resolution
unresolved
no resolver link, observed 2026-08-07T13:55:14.361719Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:55:14.361719Z digest=sha256:74ca8172791b228af4d6da31d2f5b99da46e7448dc611d81afc31396dd2e6c6e

Observation 5a4c4378-4bcb-4f06-b2ce-31c15e7b716b · outbound

This paper cites Openhands: An open platform for ai software developers as generalist agents.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Openhands: An open platform for ai software developers as generalist agents

Reference 83

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:21.222402Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:55:14.456862Z digest=sha256:2be9c9e942489ee7a18921edd3e5e842696bfb3419f971b79ebbc0b72bf199b7

Observation d7b5277a-0773-4316-95da-07206b479896 · outbound

This paper cites Codet5+: Open code large language models for code understanding and generation.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Codet5+: Open code large language models for code understanding and generation

Reference 84

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:21.117660Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:55:14.546271Z digest=sha256:a90dcfe2482f8b95d5ca67d41bf7368251c30ea9876d46653b56e096e4eb840d

Observation 75d1735f-1810-49cb-ab70-67083d7d1190 · outbound

This paper cites A new era of plagiarism the danger of cheating using ai.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs A new era of plagiarism the danger of cheating using ai

Reference 85

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:21.003759Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:55:14.634932Z digest=sha256:07fd691bf2c9b9824d54d52cf0e2bc42e856dc73a81192371208f38a9200e6be

Observation 17920c00-40ea-4080-908b-2bac02b2510b · outbound

This paper cites Do llms know to respect copyright notice? InConference on Empirical Methods in Natural Language Processing (EMNLP), pages 20604–20619, 2024.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Do llms know to respect copyright notice? InConference on Empirical Methods in Natural Language Processing (EMNLP), pages 20604–20619, 2024

Reference 86

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:20.853496Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:55:14.723234Z digest=sha256:635f78f25a0501eca2b9fde4638bc1e47c0e5b64a276eeb48e58094c0ccc1433

Observation 4dbac241-c745-401e-a5f6-e9b4a06dcd99 · outbound

This paper cites One Size Does Not Fit All: Investigating Efficacy of Perplexity in Detecting LLM-Generated Code.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs One Size Does Not Fit All: Investigating Efficacy of Perplexity in Detecting LLM-Generated Code

Reference 87

Resolution
unresolved
no resolver link, observed 2026-08-07T13:55:14.798043Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:55:14.798043Z digest=sha256:b32fd614f947cd9c42367900dd854824759553f42eaea859ef22dc9e646e4ef4

Observation e1ac7c31-4310-47fd-85cb-983ba9055911 · outbound

This paper cites LiCoEval: Evaluating LLMs on License Compliance in Code Generation.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs LiCoEval: Evaluating LLMs on License Compliance in Code Generation

Reference 88

Resolution
unresolved
no resolver link, observed 2026-08-07T13:55:14.880420Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:55:14.880420Z digest=sha256:3e4c9015230604a4245987f7dee12c27e73fcb945b93ec99bfa56deb91ad4e25

Observation 6e66fc8d-f6ad-4b95-b5bb-5793c48afe27 · outbound

This paper cites Distin- guishing llm-generated from human-written code by contrastive learning.ACM Transactions on Software Engineering and Methodology, 34(4):1–31, 2025.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Distin- guishing llm-generated from human-written code by contrastive learning.ACM Transactions on Software Engineering and Methodology, 34(4):1–31, 2025

Reference 89

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:20.760397Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:55:14.956953Z digest=sha256:4eafba6806cd75449b23d3b170912f6ea1f3a4ac4bddbfd7009e55b4dc84169c

Observation 559512f9-8e72-460e-8ef4-c0308bf77398 · outbound

This paper cites Detecting ai-generated code assignments using perplexity of large language models.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Detecting ai-generated code assignments using perplexity of large language models

Reference 90

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:20.608036Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:55:15.024786Z digest=sha256:1da53556be36afbd742c453425bc8fd87e2b9cc044ff991b68bcc57546ce5bf5

Observation 1a0ffe97-c900-4d1d-a030-c9b766ecbe73 · outbound

This paper cites An {LLM-Assisted}{Easy-to-Trigger} backdoor attack on code completion models: Injecting disguised vulnerabilities against strong detection.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs An {LLM-Assisted}{Easy-to-Trigger} backdoor attack on code completion models: Injecting disguised vulnerabilities against strong detection

Reference 91

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:20.428612Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:55:15.059826Z digest=sha256:315038594222bfddcc48673dfa6ec13c271b9d67fa903fa3a0c5ba29d262fb11

Observation 646f7d6b-37ce-431e-8a7a-e7e6bf2dcc18 · outbound

This paper cites Zero-Shot Detection of Machine-Generated Codes.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Zero-Shot Detection of Machine-Generated Codes

Reference 92

Resolution
unresolved
no resolver link, observed 2026-08-07T13:55:15.071294Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:55:15.071294Z digest=sha256:436395b71ee8391f27ccf705e7225f8ef97946b0a5d41d4774d8c13a57561849

Observation 98df593a-6b3d-46a5-be04-6eb4eac9b636 · outbound

This paper cites Uncovering llm-generated code: A zero-shot synthetic code detector via code rewriting.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Uncovering llm-generated code: A zero-shot synthetic code detector via code rewriting

Reference 93

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:20.249361Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:55:15.099323Z digest=sha256:ff3631ac63e4c0fb9b0915f8bc3a94aefac71892d2b1332b5ee1c679016894be

Observation 6b711f23-85f8-44f8-929f-41adc1564bf7 · outbound

This paper cites Codeipprompt: intellectual property infringement assessment of code language models.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Codeipprompt: intellectual property infringement assessment of code language models

Reference 94

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:20.053757Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:55:15.206200Z digest=sha256:721038105ccec82208134f5304e7e8392f6b61f16d6543144e29ca0e61dfb2c5

Observation 16b48c01-9f40-41ff-888e-384a39c9a208 · outbound

This paper cites Inducing Vulnerable Code Generation in LLM Coding Assistants.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Inducing Vulnerable Code Generation in LLM Coding Assistants

Reference 95

Resolution
unresolved
no resolver link, observed 2026-08-07T13:55:15.340847Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:55:15.340847Z digest=sha256:816b926de58de496fb26ac372b85198b7fadd2a8eb509e253b13162e5d2cce85

Observation c76f7210-55c6-4567-aaf4-cb8d912ee442 · outbound

This paper cites How well does llm generate security tests?arXiv preprint arXiv:2310.00710, 2023.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs How well does llm generate security tests?arXiv preprint arXiv:2310.00710, 2023

Reference 96

Resolution
unresolved
no resolver link, observed 2026-08-07T13:55:15.407231Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:55:15.407231Z digest=sha256:b2a89429d4f6a81b26b5bd30f8604687574a43650843c0589c4f7c303c4dda75

Observation 31be87fc-8af6-437f-815a-8d84cee8a050 · outbound

This paper cites Genimage: A million-scale benchmark for detecting ai-generated image.Advances in Neural Information Processing Systems (NeurIPS), 36:77771–77782, 2023.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Genimage: A million-scale benchmark for detecting ai-generated image.Advances in Neural Information Processing Systems (NeurIPS), 36:77771–77782, 2023

Reference 97

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:19.823765Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:55:15.510378Z digest=sha256:b8bcc31df09eb476bcc38783d25508e527cf0a3d4e837c7e79ba5d5511eea901

Observation fa6ba879-fa02-4f20-a6f2-f0e7caf8aec1 · outbound

This paper cites Wilddeepfake: A challenging real-world dataset for deepfake detection.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Wilddeepfake: A challenging real-world dataset for deepfake detection

Reference 98

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:55:19.529874Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:55:15.611545Z digest=sha256:467ec7fa92e4b2a1da228a083ced9c5611c44570e5e2e111594aa3aa44ac300e

Observation 3b4e48ee-263b-4fa0-ba3e-0eda070ab4b1 · outbound

This paper cites an unresolved cited work.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Unresolved cited work

Reference 99

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:55:19.259887Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:55:15.642841Z digest=sha256:c4d939fe85b79ec05d42f6726a87ecd7bb556ef9114a21105fabc7a7f349b119

Observation 83acb047-23d9-4acc-b227-7eb9507bc60f · outbound

This paper cites an unresolved cited work.

CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs Unresolved cited work

Reference 100

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:55:19.095212Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-07T13:55:15.691408Z digest=sha256:3015a5d6f4bb6982a6570d7e2c253182e44eb75e64847170dbc5f4645ebf281c

Pith citing papers

Observation 1ed2e67d-6f24-4557-8c0c-03900d823793 · inbound

I Know Which LLM Wrote Your Code Last Summer: LLM generated Code Stylometry for Authorship Attribution cites this paper.

I Know Which LLM Wrote Your Code Last Summer: LLM generated Code Stylometry for Authorship Attribution CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs

Reference 2025

Resolution
metadata mismatch
local_arxiv, observed 2026-08-06T23:54:56.716112Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T23:54:51.091578Z digest=sha256:8aa237bc375dedb157ab06d38d6665938d12645c9e546af8f587672761bff332