{"as_of":"2026-08-13T23:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c1a3d7c4214ad3db4d9ce93a0437ade043a806b8e9e0b54fd68b53ad0e74358f","coverage":[{"denominator":77,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":77,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T19:19:26.565045Z","state":"measured"},{"denominator":79,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":79,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T03:04:43.380469Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-19T11:53:03.485242Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"cited_work":{"arxiv_id":"2411.10842","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.10842","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Available: https://arxiv.org/abs/2411.10842","venue":null,"work_id":"89a451dc-3a45-414c-b5cb-ea68b91f9671","year":null},"citing_paper":{"arxiv_id":"2506.03535","last_updated":"2026-04-20T04:02:41Z","snapshot_observed_at":"2026-08-11T10:26:42.867757Z","submitted_at":"2025-06-04T03:31:00Z","title":"Across Programming Language Silos: A Study on Cross-Lingual Retrieval-augmented Code Generation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-19T11:52:44.990234Z"},"links":{"cited_paper":"/paper/2411.10842","citing_paper":"/paper/2506.03535"},"observation_digest":"sha256:dc575db5748e8d2b38d3f7e6ace9e7842f5659fa5b35d3bddf70be9e647b312f","observation_id":"9456c85e-73f0-46a5-b62b-7a297af0b4cb","resolution":{"observed_at":"2026-05-19T11:53:03.487111Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10842","snapshot_observed_at":"2026-08-03T03:04:43.380469Z","title":"Codecleaner: Elevating standards with a robust data contamination mitigation toolkit.arXiv preprint arXiv:2411.10842,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.09305","last_updated":"2026-06-28T18:13:37Z","snapshot_observed_at":"2026-08-12T17:14:29.445906Z","submitted_at":"2026-02-10T00:45:24Z","title":"Reward Modeling for Reinforcement Learning-Based LLM Reasoning: Design, Challenges, and Evaluation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T03:04:43.380469Z"},"links":{"cited_paper":"/paper/2411.10842","citing_paper":"/paper/2602.09305"},"observation_digest":"sha256:4608cc0e58b296330e3747cd56ef83edd0798b675042ac5d6a30b1a5627da07d","observation_id":"5ff6ebf3-321e-45e5-8090-e84b1f6268ff","resolution":{"observed_at":"2026-08-03T03:04:43.380469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.10842/citation-record","integrity":"/paper/2411.10842/integrity","json":"/paper/2411.10842/citation-record.json","paper":"/paper/2411.10842"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:26.095568Z","title":"Large language models are zero-shot fuzzers: Fuzzing deep-learning libraries via large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.095568Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:d114e102e97e4ce83317dc508c534fae5c5b1f5fd6a5aa180b1dee7da6a4d9c0","observation_id":"023335db-4002-4975-9554-53b93e192ec2","resolution":{"observed_at":"2026-08-12T19:19:26.095568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:29.144810Z","title":"Large language models are edge-case generators: Crafting unusual programs for fuzzing deep learning libraries,","venue":null,"work_id":"d9259c02-065f-48e6-9232-075e21508663","year":2024},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.105417Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:0e6bbaf9e2d22f4e144c47edddb07045881842164889b7f1c55de6a02a3483dc","observation_id":"ecf1dcc1-1f56-495e-8b3d-c2764e071017","resolution":{"observed_at":"2026-08-12T19:19:29.156299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:29.100600Z","title":"Fuzz4all: Universal fuzzing with large language models,","venue":null,"work_id":"5afec7b7-6974-4016-b359-047c033d245a","year":2024},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.111359Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:c1c2204484e66965d5727be8a102b5c7fb758f4e2d68ed34cbfac9b345c4e1e6","observation_id":"daf6ddb4-bc11-490d-a56b-3372978b9b4e","resolution":{"observed_at":"2026-08-12T19:19:29.119482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:26.116613Z","title":"Automated program repair in the era of large pre-trained language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.116613Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:952e9a06168c5271a380931610935c8773191caf8e87190bfe912064882cb931","observation_id":"e8956fac-76cf-4df3-a098-19ab67254503","resolution":{"observed_at":"2026-08-12T19:19:26.116613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08493","last_updated":"2024-02-21T22:02:26Z","snapshot_observed_at":"2026-08-13T10:33:32.397439Z","submitted_at":"2023-08-16T16:48:57Z","title":"Time Travel in LLMs: Tracing Data Contamination in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08493","snapshot_observed_at":"2026-08-12T19:19:26.122323Z","title":"Time travel in llms: Tracing data contamination in large language models,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.122323Z"},"links":{"cited_paper":"/paper/2308.08493","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:8ca9bd9324cc765ce32485f8e2f7949c40810422e4db4fe6728af3364f3485b0","observation_id":"93350e49-40f3-4045-84aa-39163f286771","resolution":{"observed_at":"2026-08-12T19:19:26.122323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:29.021255Z","title":"NLP evaluation in trouble: On the need to measure LLM data contamination for each benchmark,","venue":null,"work_id":"b4bdfc21-9c21-428b-abaa-40d978f08e8d","year":2023},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.132408Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:bf5e9cea41fdee78c341cf58a909f4af8acd1a83aad734439dc71cb5a0542744","observation_id":"aec18199-5022-430c-be9c-f18334480712","resolution":{"observed_at":"2026-08-12T19:19:29.035929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.16337","last_updated":"2023-12-26T21:17:46Z","snapshot_observed_at":"2026-08-13T04:53:38.675557Z","submitted_at":"2023-12-26T21:17:46Z","title":"Task Contamination: Language Models May Not Be Few-Shot Anymore","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.16337","snapshot_observed_at":"2026-08-12T19:19:26.137171Z","title":"Task contamination: Language models may not be few-shot anymore,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.137171Z"},"links":{"cited_paper":"/paper/2312.16337","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:ffc3f6a3df4e480cdf8c9c99b22ddeeaeba54f278d3f5789d41f1946554c275c","observation_id":"2b484a52-2013-4f30-adda-d5acefe41291","resolution":{"observed_at":"2026-08-12T19:19:26.137171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17589","last_updated":"2024-01-29T02:11:01Z","snapshot_observed_at":"2026-08-13T05:39:39.584485Z","submitted_at":"2023-10-26T17:11:42Z","title":"An Open Source Data Contamination Report for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.17589","snapshot_observed_at":"2026-08-12T19:19:26.143329Z","title":"An open source data contamination report for llama series models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.143329Z"},"links":{"cited_paper":"/paper/2310.17589","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:fafb3aa823a4ae37db0d4b18a837ee80bd7b41940d1094a17028a7bd26d2d062","observation_id":"c576fd31-1149-4b0a-a936-5a58ff3106f0","resolution":{"observed_at":"2026-08-12T19:19:26.143329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16898","last_updated":"2024-03-28T05:00:47Z","snapshot_observed_at":"2026-08-13T00:45:32.721908Z","submitted_at":"2024-03-25T16:10:25Z","title":"Concerned with Data Contamination? Assessing Countermeasures in Code Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16898","snapshot_observed_at":"2026-08-12T19:19:26.148289Z","title":"Concerned with data contamina- tion? assessing countermeasures in code language model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.148289Z"},"links":{"cited_paper":"/paper/2403.16898","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:a5fe4c5d1eecea1790dec2938433e211419003b507401b76533c373a0e7524f5","observation_id":"4b3a46d8-7c2d-4baf-b71d-0bcad4624cae","resolution":{"observed_at":"2026-08-12T19:19:26.148289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.990369Z","title":"Leak, cheat, repeat: Data contamination and evaluation malpractices in closed-source LLMs,","venue":null,"work_id":"1434526e-b923-4a63-a70b-26889ea54d5e","year":2024},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.154463Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:e684b379a4252a1a3af60a767ab6911f94176b19820bb39307d0fc752da1cff9","observation_id":"bf2ed20c-f118-4400-a3b8-dbbd726e9ade","resolution":{"observed_at":"2026-08-12T19:19:28.999155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.955435Z","title":"Memorization without overfitting: Analyzing the training dynamics of large language models,","venue":null,"work_id":"c3a3ffb6-846e-42fe-a169-7e9dc61d5372","year":2022},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.159302Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:17ca60dec3f1ae64dda01f9d6801ef821ef74d110895c6e76e8f73a1073a8aa9","observation_id":"9a29b4ed-b5a0-4a4e-8462-966f6ff92dc2","resolution":{"observed_at":"2026-08-12T19:19:28.966363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.894579Z","title":"Deduplicating training data mitigates privacy risks in language models,","venue":null,"work_id":"ac6672e5-443f-4a07-9af3-b2a5b63fb9dd","year":2022},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.164413Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:7f256195f164be623687c778a52ceb696c72eefedb1295a764538acca29c66ae","observation_id":"a66c0329-2cec-41b6-8a08-cbdc3767b83a","resolution":{"observed_at":"2026-08-12T19:19:28.904071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.07118","last_updated":"2021-04-12T08:16:59Z","snapshot_observed_at":"2026-08-09T17:05:57.285017Z","submitted_at":"2020-09-15T14:18:53Z","title":"It's Not Just Size That Matters: Small Language Models Are Also Few-Shot Learners","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.07118","snapshot_observed_at":"2026-08-12T19:19:26.169621Z","title":"It’s not just size that matters: Small language models are also few-shot learners,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.169621Z"},"links":{"cited_paper":"/paper/2009.07118","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:03fc0957d6471cd5a2e1c82d8cbbcf773f3b2cb2e4afbee28a4b292663c169d9","observation_id":"b7585dca-54b9-45b2-8d98-a039975f0732","resolution":{"observed_at":"2026-08-12T19:19:26.169621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.08242","last_updated":"2022-03-15T20:37:16Z","snapshot_observed_at":"2026-08-13T16:22:28.521968Z","submitted_at":"2022-03-15T20:37:16Z","title":"Data Contamination: From Memorization to Exploitation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.08242","snapshot_observed_at":"2026-08-12T19:19:26.176641Z","title":"Data contamination: From memorization to exploitation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.176641Z"},"links":{"cited_paper":"/paper/2203.08242","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:eda665c4fbddc8c0eaca5dba1edd84cc4b197570b4f2d72045a56e1aa0337167","observation_id":"0810c142-9362-487c-acd8-ef25dcf0ffa2","resolution":{"observed_at":"2026-08-12T19:19:26.176641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18041","last_updated":"2024-02-28T04:35:51Z","snapshot_observed_at":"2026-08-13T04:08:35.663182Z","submitted_at":"2024-02-28T04:35:51Z","title":"Datasets for Large Language Models: A Comprehensive Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18041","snapshot_observed_at":"2026-08-12T19:19:26.182568Z","title":"Datasets for large language models: A comprehensive survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.182568Z"},"links":{"cited_paper":"/paper/2402.18041","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:581761956f79f4d2e01f15e9829ad5a0e7ac58c0e2f7d100c80c0dd636e079eb","observation_id":"bde182f8-6e4d-45d2-9792-87174f3d41e5","resolution":{"observed_at":"2026-08-12T19:19:26.182568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16789","last_updated":"2024-03-09T22:26:06Z","snapshot_observed_at":"2026-08-08T18:07:29.632928Z","submitted_at":"2023-10-25T17:21:23Z","title":"Detecting Pretraining Data from Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16789","snapshot_observed_at":"2026-08-12T19:19:26.188805Z","title":"Detecting pretraining data from large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.188805Z"},"links":{"cited_paper":"/paper/2310.16789","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:c5cabfd0953ed893e791d2c0a3813301f4dd73183e9c073bc5fc5f227715274d","observation_id":"170c7ba4-d033-4d13-9e52-6f40f66fcc99","resolution":{"observed_at":"2026-08-12T19:19:26.188805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.857219Z","title":"Extracting training data from large language models,","venue":null,"work_id":"3bde4e99-efd4-444a-82d8-fd31c2e4a008","year":2021},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.193804Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:edd038b992898284d9da8751baa642b14f23eaab1d687c1a2f8c37c5a7660b23","observation_id":"bf0e6f64-8ba2-4272-a239-44baaad9b4fd","resolution":{"observed_at":"2026-08-12T19:19:28.864143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-12T19:19:26.198876Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.198876Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:7d28e5633c2bde7b67476354acef9e59b1387ec69d77afe3e571be4bdc7b5291","observation_id":"7c00b709-b95d-4b4a-8ff1-01dacce75833","resolution":{"observed_at":"2026-08-12T19:19:26.198876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.823998Z","title":"An ethnographic study of copy and paste programming practices in oopl,","venue":null,"work_id":"78a26819-5ea8-4382-a743-5ba6bed61422","year":2004},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.206260Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:88952c317be9b06564f0c2dfc1891907f32e72a0b08944855d7c35e0e251fc54","observation_id":"4853edc5-54cf-41a4-8d7b-3f926a6bd77e","resolution":{"observed_at":"2026-08-12T19:19:28.833503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.790574Z","title":"Github copilot,","venue":null,"work_id":"833bb956-7af5-4d06-9c46-684fe52e4c0b","year":2023},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.211901Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:8b38e8f9637c8902276c5a4ec7843398d089583042ee69e6417c426f2031763b","observation_id":"75274934-9f53-41db-9d32-f3759fe61c64","resolution":{"observed_at":"2026-08-12T19:19:28.801411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:26.216415Z","title":"Github survey finds nearly all developers using ai coding tools,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.216415Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:7817419df909b1d10e2ad6f7c14dd83e5d21c785475834b4b9114845a112b4b3","observation_id":"4dfdde71-f3cc-4068-b802-46833b6fa7bd","resolution":{"observed_at":"2026-08-12T19:19:26.216415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.759567Z","title":"Generalization or memorization: Data contamination and trustworthy evaluation for large language models,","venue":null,"work_id":"81373acc-bf64-4d66-a9d6-15f6cd965e1e","year":2024},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.222108Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:70759d8d6b67876ec28634f9f5c5895a71502032fd28883cb619a1c09022185b","observation_id":"3dea7ad3-cbbd-470b-b3e5-8b7ab4bb3733","resolution":{"observed_at":"2026-08-12T19:19:28.768918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04448","last_updated":"2024-12-12T12:57:59Z","snapshot_observed_at":"2026-08-13T05:30:09.121180Z","submitted_at":"2023-11-08T04:19:28Z","title":"Boosting Static Resource Leak Detection via LLM-based Resource-Oriented Intention Inference","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04448","snapshot_observed_at":"2026-08-12T19:19:26.226880Z","title":"Inferring resource-oriented intentions using llms for static resource leak detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.226880Z"},"links":{"cited_paper":"/paper/2311.04448","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:4bdf3cc29a1fcc4ae10f9dc363f029a4690be49c88e6dc1740d0936666a07026","observation_id":"0df144da-b511-4307-91e6-1026e02cb5b1","resolution":{"observed_at":"2026-08-12T19:19:26.226880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.727627Z","title":"Mr-adopt: Automatic deduction of input transformation function for metamorphic testing,","venue":null,"work_id":"9bd9e7c5-b0d5-44af-8845-c77d22ed12db","year":2024},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.232464Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:2760a2fc8808d96ebacc50f9415c3836b749ea6bd651e9cd57f07b100ce98821","observation_id":"b937deba-1425-4a4c-839e-7df0355cce19","resolution":{"observed_at":"2026-08-12T19:19:28.735213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:26.237833Z","title":"Evaluating large language models trained on code,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.237833Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:e7aa816143c09411e0d29a516d5666f21582494a9f0e2c44872c123b04fadf24","observation_id":"d49d0cf5-20df-4e3b-a059-b26fd4cd7013","resolution":{"observed_at":"2026-08-12T19:19:26.237833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.675534Z","title":"SWE-bench: Can language models resolve real-world github issues?","venue":null,"work_id":"bd9324f7-dc69-4a49-8b90-e1d1500fdbc5","year":2024},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.242490Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:d8840c224c374baac9ae2b61748ee3489a37d9336cc8965acc0de13b5305598a","observation_id":"a87a9a84-88e0-4321-970f-5610276d86c3","resolution":{"observed_at":"2026-08-12T19:19:28.683167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07565","last_updated":"2024-10-03T16:48:55Z","snapshot_observed_at":"2026-08-12T23:25:07.570083Z","submitted_at":"2024-07-10T11:50:20Z","title":"On Leakage of Code Generation Evaluation Datasets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07565","snapshot_observed_at":"2026-08-12T19:19:26.247246Z","title":"On leakage of code generation evaluation datasets,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.247246Z"},"links":{"cited_paper":"/paper/2407.07565","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:565da1d68ed87a8b1be7f4ac8fd787ea7b38aa9f7b16f311d032a59b774eb8cc","observation_id":"400562a5-4b06-4464-a87d-5e112fa05651","resolution":{"observed_at":"2026-08-12T19:19:26.247246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11690","last_updated":"2023-11-20T11:43:45Z","snapshot_observed_at":"2026-08-13T05:22:00.173727Z","submitted_at":"2023-11-20T11:43:45Z","title":"Refactoring Programs Using Large Language Models with Few-Shot Examples","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.11690","snapshot_observed_at":"2026-08-12T19:19:26.253196Z","title":"Refactoring programs using large language models with few-shot examples,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.253196Z"},"links":{"cited_paper":"/paper/2311.11690","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:bd4b382730437d713fe1284a5d80a148e004e05dea0e177964c594799f7459c9","observation_id":"85a76b72-d987-48db-aaa3-77a4d7b45f0d","resolution":{"observed_at":"2026-08-12T19:19:26.253196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:26.259029Z","title":"How effective are neural networks for fixing security vulnerabilities,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.259029Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:3925f94d8e6cfd489977c6750437915ac71165cfecf5871b1b1d976b6ae2c3c9","observation_id":"07a887de-ed89-4d3b-ba82-9cbcd84f99db","resolution":{"observed_at":"2026-08-12T19:19:26.259029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19368","last_updated":"2024-04-30T08:51:49Z","snapshot_observed_at":"2026-08-13T00:18:46.695599Z","submitted_at":"2024-04-30T08:51:49Z","title":"Exploring Multi-Lingual Bias of Large Code Models in Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19368","snapshot_observed_at":"2026-08-12T19:19:26.264412Z","title":"Exploring multi-lingual bias of large code models in code generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.264412Z"},"links":{"cited_paper":"/paper/2404.19368","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:e0eb7acf9740d5b860930d1beebfc25bc05e3b1e19b225257d5b7983b387bd15","observation_id":"04de4643-be26-407c-83f9-19ebe3d19f86","resolution":{"observed_at":"2026-08-12T19:19:26.264412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:26.271834Z","title":"Perplexity—a measure of the difficulty of speech recognition tasks,","venue":null,"work_id":null,"year":1977},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.271834Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:310d6b61b8bb99dc446b0e795c9cccbfbca47a06c1d537063b4d6c462ea00ff7","observation_id":"bcf8021b-256e-4701-9d0d-55d8da3cbd3d","resolution":{"observed_at":"2026-08-12T19:19:26.271834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.613628Z","title":"The Stack","venue":null,"work_id":"70b0fa13-9912-4ddc-a03f-c2e563395e39","year":null},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.276671Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:979f30fba43a0ed24c3ee176fc846493d43b345c9e303464835cc74d7ae813b2","observation_id":"4d9bd4ad-4cab-4306-9ce4-1b905e732451","resolution":{"observed_at":"2026-08-12T19:19:28.623475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03919","last_updated":"2023-12-14T16:55:42Z","snapshot_observed_at":"2026-08-13T12:31:00.505321Z","submitted_at":"2023-03-06T04:22:33Z","title":"Data Portraits: Recording Foundation Model Training Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03919","snapshot_observed_at":"2026-08-12T19:19:26.285625Z","title":"Data portraits: Recording foundation model training data,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.285625Z"},"links":{"cited_paper":"/paper/2303.03919","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:24891af0b480d04baef8b186cb881c0ef32f59fa23a6deba4a4b474d7a9e85f2","observation_id":"78a6b93f-100b-4bfb-a38f-353218349291","resolution":{"observed_at":"2026-08-12T19:19:26.285625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.591099Z","title":"DataPortraits","venue":null,"work_id":"9d62cffa-5cdc-4ea2-af5e-eb453281522b","year":null},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.291241Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:ad742c13a5bd8764868bfbe0d887ba8b7d2b884a453f72ca6c4300b87c553cd8","observation_id":"4c3a3010-f2c3-402b-9213-419fe217b97c","resolution":{"observed_at":"2026-08-12T19:19:28.597572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.529043Z","title":"Code of sklearn.externals. arff.LODGeneratorData class","venue":null,"work_id":"508a51d1-b32d-4e81-835c-2d70df592746","year":null},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.296960Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:4e1585c637930832170dbf7b694c7a52b2da475afb39a57756ad1dc4fee7542e","observation_id":"a12f2833-3d95-435c-ab7c-75a438acae07","resolution":{"observed_at":"2026-08-12T19:19:28.547454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.499350Z","title":"Kreuzer and L","venue":null,"work_id":"c6d5ace8-e607-4828-92f2-bbdc128b535c","year":2000},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.303546Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:385d8af9ecc2359d12b97d1c0ee6ef870faaf6428cb846344bd8cf5d2d02e793","observation_id":"eff7f8c2-715b-4f48-a81b-e62623e1cfc8","resolution":{"observed_at":"2026-08-12T19:19:28.508352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.475926Z","title":"Semmt: a semantic-based testing approach for machine translation systems,","venue":null,"work_id":"340e29d6-0e91-4967-a453-54d037c36903","year":2022},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.308910Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:813fb563f8f9e8fe892d1e9ecbaab37447b76b6861c5990e9c4bb3d6b479b315","observation_id":"5f44f6ef-bdd4-4303-b7c7-be95ed1d5f11","resolution":{"observed_at":"2026-08-12T19:19:28.483248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.438911Z","title":"Testing your question answering software via asking recursively,","venue":null,"work_id":"d3fed192-bfb4-4aee-a0d8-b2fffee26a2a","year":2021},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.314086Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:70e97363803a4d5fa7f4f9d627c956eb8337e053e6ebda45f4cf331887064f38","observation_id":"0d79fab7-706d-4088-b4e0-15e949e63ac0","resolution":{"observed_at":"2026-08-12T19:19:28.449723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.409598Z","title":"Structure-invariant testing for machine translation,","venue":null,"work_id":"5751f798-ef9b-4196-8546-b7c18a029be7","year":2020},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.319723Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:9426d06521d6e6a8e4e480c958e2a3ad2cf4d3129589ad7477bb37035cbb9a6f","observation_id":"f38a357a-4da1-4520-8795-602b10e5b536","resolution":{"observed_at":"2026-08-12T19:19:28.417973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.383427Z","title":"Validation on machine reading compre- hension software without annotated labels: A property-based method,","venue":null,"work_id":"6b077604-f481-4df2-8289-fb78bb2c3ad4","year":2021},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.324854Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:9dcb77a1168ba835e0888ea698165e8b0f4fd197039b9b98f240d456e12a855e","observation_id":"62f7a8ff-dd66-44c5-8835-a36ea1fd1163","resolution":{"observed_at":"2026-08-12T19:19:28.390664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.357520Z","title":"Word closure-based metamorphic testing for machine translation,","venue":null,"work_id":"1364ac38-def7-4eea-98e6-f22556da1c80","year":2024},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.329502Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:ff3e7945ded94103ab33f05ac138c3234a0ddb85579e5f7ac43a97e9bcc85f33","observation_id":"8e49d4e7-9b81-4721-b9e8-7523cafe2a43","resolution":{"observed_at":"2026-08-12T19:19:28.365330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.331734Z","title":null,"venue":null,"work_id":"230a0d93-f9cb-47d7-801a-0ebea8678ed4","year":2024},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.334620Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:00fcded9db5531c5be327a3c2dd110cc63ad94f5bf9ce58cc973b499b84de5f8","observation_id":"aaae39e2-62ed-4fed-9c53-274e594731a0","resolution":{"observed_at":"2026-08-12T19:19:28.340102Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.307660Z","title":"codellama/codellama-7b-instruct-hf,","venue":null,"work_id":"c7c516fb-7eba-4aad-8734-0207bbf05489","year":2023},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.339850Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:e5595d7c5040e5eb38672879cfecf6a1e9fb0eeea8f77e97188923fd6a721874","observation_id":"0422d2e5-bada-46e3-9667-723384fc0979","resolution":{"observed_at":"2026-08-12T19:19:28.314337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.283982Z","title":"Starcoder-code-instruct,","venue":null,"work_id":"140473b2-9158-4b6c-9eba-1a83294a2bd6","year":2023},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.345020Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:b11e150f374417a92c48ba2e3cf24102b0c544be8ff5d85ff22124be46cc870a","observation_id":"f3db0995-9290-4d1d-ac5f-4c4bf94239ad","resolution":{"observed_at":"2026-08-12T19:19:28.291076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.251497Z","title":"The stack: 3 tb of permissively licensed source code,","venue":null,"work_id":"0365bb9f-a4f8-4cdd-a8d4-55a4415f5e51","year":2022},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.350529Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:65881c4de6869e2b887c86f22b88cf6897f6bd68ea05a6afc8f2aeccb43bb2f3","observation_id":"33115363-90ce-4ffd-813b-819cbd8927ec","resolution":{"observed_at":"2026-08-12T19:19:28.259663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.225003Z","title":"Huggingfaceh4/starchat-beta,","venue":null,"work_id":"82112093-e48f-4a24-b81c-352a1f804e7c","year":2023},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.356816Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:765045fe5130f9f223e7b4b2fe0d5bd1f07e936e92a6fae5875b99a0fa79e658","observation_id":"6ebd5c34-980a-459b-9f08-a7216493ab3c","resolution":{"observed_at":"2026-08-12T19:19:28.232607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.198477Z","title":"Wizardlm/wizardcoder,","venue":null,"work_id":"5b4501cf-16e9-4711-9495-d7ba288f51db","year":2023},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.362469Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:7ef2d80d836eb8945431d0c36a3a3f5f18c20d21d7f976c4181fbd78cd06bef8","observation_id":"5fb57f79-3c97-433e-9375-c0c28ff4d9eb","resolution":{"observed_at":"2026-08-12T19:19:28.206731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00288","last_updated":"2024-02-23T08:29:16Z","snapshot_observed_at":"2026-08-13T12:53:41.278602Z","submitted_at":"2023-02-01T07:39:28Z","title":"CoderEval: A Benchmark of Pragmatic Code Generation with Generative Pre-trained Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00288","snapshot_observed_at":"2026-08-12T19:19:26.367153Z","title":"Codereval: A benchmark of pragmatic code generation with generative pre-trained models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.367153Z"},"links":{"cited_paper":"/paper/2302.00288","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:5565034346ae777ae1acf8a039184016fb4fc51ca8e0b5b79db73eaef87c1610","observation_id":"cf407ddd-6bd9-4496-bbce-cffcffa80531","resolution":{"observed_at":"2026-08-12T19:19:26.367153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.169663Z","title":"Scikit-Learn Project","venue":null,"work_id":"ef972abc-9608-4bee-b211-7043593c7acb","year":null},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.373160Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:72256ab3858821998385da641769fcf67d1ea84594da84f24f875504ff0f38a7","observation_id":"6a97b00a-8771-4518-b133-9e644a85620c","resolution":{"observed_at":"2026-08-12T19:19:28.183623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.143572Z","title":"Pandas Project","venue":null,"work_id":"1bdd95bd-07d5-4f4f-9863-1bbe73851b89","year":null},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.378454Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:b357adb27f9df19265b0d7ba01683e38b6be92c2a9dd354be2fb4158ce540394","observation_id":"be14be25-c0a6-441f-b251-30d5bd84ba98","resolution":{"observed_at":"2026-08-12T19:19:28.151123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.114634Z","title":"NumPy Project","venue":null,"work_id":"1ee10324-23a9-4bf3-8a49-dbf392dc87a0","year":null},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.384054Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:5b40fcbde1555d15bf37eb1e4c883be0661159b0bd8d26ea4cef75190564b80d","observation_id":"02bfbb5f-02b9-4250-9e44-64c3036837ee","resolution":{"observed_at":"2026-08-12T19:19:28.122485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06059","last_updated":"2024-01-11T17:24:49Z","snapshot_observed_at":"2026-08-13T04:44:25.401800Z","submitted_at":"2024-01-11T17:24:49Z","title":"Investigating Data Contamination for Pre-training Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06059","snapshot_observed_at":"2026-08-12T19:19:26.389387Z","title":"Investigating data contamination for pre-training language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.389387Z"},"links":{"cited_paper":"/paper/2401.06059","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:cc5bc6c133d8d478fe80552c5f53e34b24dd731307386c9ba4ac62f43344199e","observation_id":"4ea151a6-1bec-4b8c-b819-43b3143a950e","resolution":{"observed_at":"2026-08-12T19:19:26.389387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08758","last_updated":"2021-09-30T17:20:01Z","snapshot_observed_at":"2026-08-11T11:33:47.725577Z","submitted_at":"2021-04-18T07:42:52Z","title":"Documenting Large Webtext Corpora: A Case Study on the Colossal Clean Crawled Corpus","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08758","snapshot_observed_at":"2026-08-12T19:19:26.396819Z","title":"Documenting large webtext corpora: A case study on the colossal clean crawled corpus,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.396819Z"},"links":{"cited_paper":"/paper/2104.08758","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:86e72999add7df0196957bd15bc161f9d9fbe147e665bb8eb77ae326947583dc","observation_id":"fa66654b-602b-4b33-8f7a-4f5f1e8d0f5a","resolution":{"observed_at":"2026-08-12T19:19:26.396819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06161","last_updated":"2023-12-13T14:44:10Z","snapshot_observed_at":"2026-07-06T15:25:35.930688Z","submitted_at":"2023-05-09T08:16:42Z","title":"StarCoder: may the source be with you!","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06161","snapshot_observed_at":"2026-08-12T19:19:26.401865Z","title":"Starcoder: may the source be with you!","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.401865Z"},"links":{"cited_paper":"/paper/2305.06161","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:90c3861fd7bb25c073582d99c8ecaeff75e4df3d54261e8d69b879cb969a3899","observation_id":"9fceabdd-9569-470c-b336-e9316c5a8668","resolution":{"observed_at":"2026-08-12T19:19:26.401865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.083041Z","title":"The secret sharer: Evaluating and testing unintended memorization in neural networks,","venue":null,"work_id":"e24c4dd5-ea9c-4173-a35e-753312ea11d7","year":2019},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.407988Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:a50c646b2e06dee62648ef33d8331ae9074f91190b1e5da24fbf7affb5b41caa","observation_id":"7d5f8697-fff6-44c3-9205-0f002c6259eb","resolution":{"observed_at":"2026-08-12T19:19:28.088191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:28.049550Z","title":"Language models are few-shot learners,","venue":null,"work_id":"9c920f5a-f6c3-4d8a-b9df-02404f83d4e1","year":2020},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.413677Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:763269cc26401903038a186d0fdc6f91184589f9493fc492cf5f0059a0746c13","observation_id":"716801ea-41fe-4022-80c0-3f7a7604c1be","resolution":{"observed_at":"2026-08-12T19:19:28.056931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:26.420159Z","title":"Palm: Scaling language modeling with pathways,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.420159Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:e3cf2eee36329c8ef01866a74629cf7981d68644ef86e670ca0e3b46c319a3aa","observation_id":"23d99221-32d9-4862-80bc-61a7c7af6706","resolution":{"observed_at":"2026-08-12T19:19:26.420159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:27.990093Z","title":"The pile","venue":null,"work_id":"abf07f2d-aab5-4375-a5fb-29efcd4621dd","year":null},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.425533Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:5dbc3abb1b8ceda4e11b14040947d32ec628ee0729b43d3b53ca0aa0810e79e0","observation_id":"9510a7a5-53f2-440f-957e-aab03daeb324","resolution":{"observed_at":"2026-08-12T19:19:27.997463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:27.958674Z","title":"The Stack-V2","venue":null,"work_id":"d4d9813a-7005-4965-bd7a-583dc906d8d3","year":null},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.431179Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:4a1cc183069ed48cd09ea2d40c6053dd58b40f3444b6611aa91554f22e7e75e4","observation_id":"c926a424-d340-49c3-8287-d90427752b51","resolution":{"observed_at":"2026-08-12T19:19:27.971739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09783","last_updated":"2024-04-03T23:29:03Z","snapshot_observed_at":"2026-08-13T05:23:58.579496Z","submitted_at":"2023-11-16T11:03:04Z","title":"Investigating Data Contamination in Modern Benchmarks for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09783","snapshot_observed_at":"2026-08-12T19:19:26.436599Z","title":"Investigating data contamination in modern benchmarks for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.436599Z"},"links":{"cited_paper":"/paper/2311.09783","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:6e41952f72e2f5791225b6b19c32d1f94079e58b5898e017aa34775216b2e984","observation_id":"396bd525-a13b-4500-9158-e533453342e7","resolution":{"observed_at":"2026-08-12T19:19:26.436599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.07958","last_updated":"2022-05-08T02:43:02Z","snapshot_observed_at":"2026-08-03T16:26:48.747700Z","submitted_at":"2021-09-08T17:15:27Z","title":"TruthfulQA: Measuring How Models Mimic Human Falsehoods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.07958","snapshot_observed_at":"2026-08-12T19:19:26.442574Z","title":"Truthfulqa: Measuring how models mimic human falsehoods,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.442574Z"},"links":{"cited_paper":"/paper/2109.07958","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:fa10568621aa62de9c5cb4cf708b112b8e0958666a76766c1676ec973f8d5c63","observation_id":"9de5d46d-f6f7-489b-9712-2d986141ef57","resolution":{"observed_at":"2026-08-12T19:19:26.442574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-12T19:19:26.449798Z","title":"Measuring massive multitask language understanding,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.449798Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:d5e1969ff7a56d52aeb7f8d8a202344482db55354dc411a8b6eefd1f000d6a12","observation_id":"e467217f-ad2b-4a32-9587-7d6668f40eff","resolution":{"observed_at":"2026-08-12T19:19:26.449798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:27.919650Z","title":"Privacy risk in machine learning: Analyzing the connection to overfitting,","venue":null,"work_id":"ea87c1f2-131e-4b35-8829-eff5e7fb990f","year":2018},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.455821Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:7f38abf6c91f68249173a1bdc1d40094c0c8deae32f651037e94ca469a046806","observation_id":"7b6d5c71-4828-4a74-aed9-dc64817b5297","resolution":{"observed_at":"2026-08-12T19:19:27.930181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:26.474590Z","title":"Zlib compression library,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.474590Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:798c899d5f73b23678b8c97da0cd7d3ec2203cbd6852577dae2dfe5de9e4b2b0","observation_id":"ad0d76e5-a035-479d-993b-5ed85a40aada","resolution":{"observed_at":"2026-08-12T19:19:26.474590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18462","last_updated":"2023-08-07T06:32:56Z","snapshot_observed_at":"2026-08-13T11:30:31.522963Z","submitted_at":"2023-05-29T07:06:03Z","title":"Membership Inference Attacks against Language Models via Neighbourhood Comparison","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18462","snapshot_observed_at":"2026-08-12T19:19:26.484724Z","title":"Membership inference attacks against language models via neighbourhood comparison,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.484724Z"},"links":{"cited_paper":"/paper/2305.18462","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:2ee3b31f14322443d973ff9e51a88d03da85de1e33368ddd9b7a046fb40076d2","observation_id":"73ccc18a-2f03-42d4-ac13-aab4a1642d12","resolution":{"observed_at":"2026-08-12T19:19:26.484724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07841","last_updated":"2024-09-16T13:18:23Z","snapshot_observed_at":"2026-08-13T04:20:24.398988Z","submitted_at":"2024-02-12T17:52:05Z","title":"Do Membership Inference Attacks Work on Large Language Models?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07841","snapshot_observed_at":"2026-08-12T19:19:26.491701Z","title":"Do membership inference attacks work on large language models?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.491701Z"},"links":{"cited_paper":"/paper/2402.07841","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:70ec02a445ba7d353e0e4f7d9ef412183ece580beb555e4bf92342bb2c44e8b1","observation_id":"efef95b9-ffe5-4db4-90ec-3de08df662ca","resolution":{"observed_at":"2026-08-12T19:19:26.491701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-12T19:19:26.499246Z","title":"Program synthesis with large language models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.499246Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:560623a9b70be8db47183e5677effbb8029fe9829b80031b061b08cb1576cf2f","observation_id":"9efa1576-106c-4170-9bed-f45f839b6fd4","resolution":{"observed_at":"2026-08-12T19:19:26.499246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:26.505608Z","title":"Is your code generated by chatGPT really correct? rigorous evaluation of large language models for code generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.505608Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:ecfcb837b9500f7ab032f09153a361a40bcdb0346e778f8ec4c9006a4ee848c0","observation_id":"9e3865b1-3146-413f-8197-5b0f768f513a","resolution":{"observed_at":"2026-08-12T19:19:26.505608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:27.848238Z","title":"Classeval: A manually-crafted benchmark for evaluating llms on class-level code generation,","venue":null,"work_id":"a23c95be-1bc1-4c2f-bbc9-e15eb611c386","year":2023},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.511034Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:8fa158f1cdb43534769226d0f75bcc0601520366c753b00696efe6a27a8439c3","observation_id":"adccf255-7cc6-46b7-a737-cae38867b728","resolution":{"observed_at":"2026-08-12T19:19:27.856437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-08-13T09:04:30.125777Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-08-12T19:19:26.517105Z","title":"Livecodebench: Holistic and contamination free evaluation of large language models for code,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.517105Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:8c899aebe3e8c9e401705dd34aae5c2f7ed2b2c148220a251303699f87c7c5c7","observation_id":"1c761014-dc7b-427b-8f24-c3319c0e84a8","resolution":{"observed_at":"2026-08-12T19:19:26.517105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03533","last_updated":"2023-11-11T21:15:19Z","snapshot_observed_at":"2026-08-13T19:41:02.082932Z","submitted_at":"2023-10-05T13:33:26Z","title":"Large Language Models for Software Engineering: Survey and Open Problems","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03533","snapshot_observed_at":"2026-08-12T19:19:26.525517Z","title":"Large language models for software engineering: Survey and open problems,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.525517Z"},"links":{"cited_paper":"/paper/2310.03533","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:175f558af35aa5cb0a252160760c11298a5819ef9bf4061007dbd648b159f45b","observation_id":"b8fa02bd-40b4-40cc-9852-ac01fb36b273","resolution":{"observed_at":"2026-08-12T19:19:26.525517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13187","last_updated":"2023-04-25T22:59:01Z","snapshot_observed_at":"2026-08-13T11:55:06.646971Z","submitted_at":"2023-04-25T22:59:01Z","title":"AI-assisted coding: Experiments with GPT-4","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.13187","snapshot_observed_at":"2026-08-12T19:19:26.535637Z","title":"Ai-assisted coding: Experiments with gpt-4,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.535637Z"},"links":{"cited_paper":"/paper/2304.13187","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:34caeee513180eafc4eda925397fa8018b0e58a3de309a43d68543e5298cd89c","observation_id":"d6d1c045-831f-409c-83fe-6b3c24dd6611","resolution":{"observed_at":"2026-08-12T19:19:26.535637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.03373","last_updated":"2023-01-05T23:17:17Z","snapshot_observed_at":"2026-08-13T13:09:03.815890Z","submitted_at":"2023-01-05T23:17:17Z","title":"Chatbots As Fluent Polyglots: Revisiting Breakthrough Code Snippets","version":1},"cited_work":{"arxiv_id":"2301.03373","doi":null,"metadata_source":"pith","pith_arxiv_id":"2301.03373","snapshot_observed_at":"2026-08-12T19:19:26.744183Z","title":"Chatbots As Fluent Polyglots: Revisiting Breakthrough Code Snippets","venue":"cs.LG","work_id":"787be6dd-f2ca-4eb8-b39e-9e02b75cd95f","year":2023},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.543665Z"},"links":{"cited_paper":"/paper/2301.03373","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:e15d16666b1deea43a2469dd243c03ec9b2d2fccb3df511d8b5dc98433016095","observation_id":"1859ee00-1fef-444c-b274-e0e364c001dc","resolution":{"observed_at":"2026-08-12T19:19:26.753852Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.09436","last_updated":"2020-06-08T09:09:28Z","snapshot_observed_at":"2026-08-06T10:54:14.530969Z","submitted_at":"2019-09-20T11:52:45Z","title":"CodeSearchNet Challenge: Evaluating the State of Semantic Code Search","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.09436","snapshot_observed_at":"2026-08-12T19:19:26.551871Z","title":"CodeSearchNet challenge: Evaluating the state of semantic code search,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.551871Z"},"links":{"cited_paper":"/paper/1909.09436","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:56a1903a33924d38095b6e9638f9cc2273f57c0ceb7bae6a4adeb4a946fdde8c","observation_id":"38cd1af4-0d46-4eb3-955f-5f9a6b3f722c","resolution":{"observed_at":"2026-08-12T19:19:26.551871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:26.557949Z","title":"Measuring coding challenge competence with apps,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.557949Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:62af5ca2288d97a66dd05719fee109ce0515c76b10eca012f75ac0317d6aa39e","observation_id":"7daf727d-707b-4bb8-8756-62011fcbd6ef","resolution":{"observed_at":"2026-08-12T19:19:26.557949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:19:27.810846Z","title":"Code Language Models trained on Stack","venue":null,"work_id":"1c259b89-0ff8-4939-801e-3cb3e1be3463","year":null},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.565045Z"},"links":{"citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:bc1ef8ca430ff471e66644a52317604783c4e5c16b6f7a0443a841986bc512d1","observation_id":"fdd642bf-bc89-404b-b8e5-fb7e16400bf2","resolution":{"observed_at":"2026-08-12T19:19:27.817579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08493","last_updated":"2024-02-21T22:02:26Z","snapshot_observed_at":"2026-08-13T10:33:32.397439Z","submitted_at":"2023-08-16T16:48:57Z","title":"Time Travel in LLMs: Tracing Data Contamination in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08493","snapshot_observed_at":"2026-08-12T19:19:26.127610Z","title":"Available: https://doi.org/10.48550/arXiv.2308.08493","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-12T19:19:26.127610Z"},"links":{"cited_paper":"/paper/2308.08493","citing_paper":"/paper/2411.10842"},"observation_digest":"sha256:e8c9f85fddbb1951effb2073ac37c051c05aa9688dd7adf81fffa10c6ed39e26","observation_id":"6650bce7-b782-41ae-b321-d9a0a4beb8eb","resolution":{"observed_at":"2026-08-12T19:19:26.127610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.10842","last_updated":"2024-11-16T17:06:21Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-13T19:49:46.624754Z","submitted_at":"2024-11-16T17:06:21Z","title":"CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit"},"reference_resolution":{"displayed":77,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":40,"verified_exact":1,"verified_fuzzy":36},"total_outbound_references":77},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 77 of 77 outbound references and 2 inbound Pith citation observations for arXiv:2411.10842."}