{"as_of":"2026-08-14T00:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8648a01ac9ebcb06537150a9616de4e50f74dca25353e4d25e37ff1b7683cab5","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:51:08.296878Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:39:07.157245Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T04:06:35.135954Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.06971","snapshot_observed_at":"2026-08-05T10:39:07.157245Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03871","last_updated":"2025-09-04T04:12:31Z","snapshot_observed_at":"2026-08-08T03:54:26.940042Z","submitted_at":"2025-09-04T04:12:31Z","title":"A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models","version":1},"reference_index":192,"source":"pdf_text","source_observed_at":"2026-08-05T10:39:07.157245Z"},"links":{"cited_paper":"/paper/2506.06971","citing_paper":"/paper/2509.03871"},"observation_digest":"sha256:9e6723d21b67e2a0bfd96051591df599d76c10583da68d73d704de3b0011f9ad","observation_id":"18593e05-7b44-4af2-b289-62364271ef2b","resolution":{"observed_at":"2026-08-05T10:39:07.157245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"cited_work":{"arxiv_id":"2506.06971","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.06971","snapshot_observed_at":"2026-07-02T04:06:35.135954Z","title":"Chain -of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","venue":null,"work_id":"7a69171b-abe9-4a44-a099-2ba8d26e8210","year":2025},"citing_paper":{"arxiv_id":"2512.05929","last_updated":"2026-06-29T18:18:24Z","snapshot_observed_at":"2026-08-03T18:19:06.255338Z","submitted_at":"2025-12-05T18:12:21Z","title":"LLM Harms: A Taxonomy and Discussion","version":2},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-05-17T00:29:07.951709Z"},"links":{"cited_paper":"/paper/2506.06971","citing_paper":"/paper/2512.05929"},"observation_digest":"sha256:a20a01be9baca6d03d39b6c29a6cfe0074f1b9c8ad99ce8c276adf207277f25c","observation_id":"8d421516-874e-474e-9b4e-89c13f29d2e7","resolution":{"observed_at":"2026-05-17T00:31:24.747791Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.06971","snapshot_observed_at":"2026-08-03T18:19:19.974924Z","title":"Chain -of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.05929","last_updated":"2026-06-29T18:18:24Z","snapshot_observed_at":"2026-08-03T18:19:06.255338Z","submitted_at":"2025-12-05T18:12:21Z","title":"LLM Harms: A Taxonomy and Discussion","version":4},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-08-03T18:19:19.974924Z"},"links":{"cited_paper":"/paper/2506.06971","citing_paper":"/paper/2512.05929"},"observation_digest":"sha256:dd7aa02bfcadda58dcd8b376cea9971d0dc4deb5770a1b97e0cf3ef5b1bda8d4","observation_id":"f41b8102-6318-49a8-ad9c-8d91cff7844a","resolution":{"observed_at":"2026-08-03T18:19:19.974924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"cited_work":{"arxiv_id":"2506.06971","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.06971","snapshot_observed_at":"2026-07-02T04:06:35.135954Z","title":"Chain -of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","venue":null,"work_id":"7a69171b-abe9-4a44-a099-2ba8d26e8210","year":2025},"citing_paper":{"arxiv_id":"2603.03332","last_updated":"2026-04-16T23:41:41Z","snapshot_observed_at":"2026-08-04T02:21:24.392691Z","submitted_at":"2026-02-11T03:11:30Z","title":"Fragile Thoughts: How Large Language Models Handle Chain-of-Thought Perturbations","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T03:43:18.987241Z"},"links":{"cited_paper":"/paper/2506.06971","citing_paper":"/paper/2603.03332"},"observation_digest":"sha256:70af09539150c0926b38306358ff0ed040c6aa50b90fc57b1f7764f2768d262a","observation_id":"dc34b590-72f1-4af7-ad4c-22d199aaba51","resolution":{"observed_at":"2026-05-16T03:47:15.321963Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"cited_work":{"arxiv_id":"2506.06971","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.06971","snapshot_observed_at":"2026-07-02T04:06:35.135954Z","title":"Chain -of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","venue":null,"work_id":"7a69171b-abe9-4a44-a099-2ba8d26e8210","year":2025},"citing_paper":{"arxiv_id":"2604.02776","last_updated":"2026-04-03T06:37:51Z","snapshot_observed_at":"2026-08-02T13:25:19.726180Z","submitted_at":"2026-04-03T06:37:51Z","title":"Evaluating the Environmental Impact of using SLMs and Prompt Engineering for Code Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-13T20:12:12.283350Z"},"links":{"cited_paper":"/paper/2506.06971","citing_paper":"/paper/2604.02776"},"observation_digest":"sha256:2c7a16e02e404112be8242237370d29110bbbf3e95719765f417160d6c8e06b6","observation_id":"68590926-ccbb-4007-b745-06c1472dd8c3","resolution":{"observed_at":"2026-05-13T20:13:13.226797Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"cited_work":{"arxiv_id":"2506.06971","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.06971","snapshot_observed_at":"2026-07-02T04:06:35.135954Z","title":"Chain -of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","venue":null,"work_id":"7a69171b-abe9-4a44-a099-2ba8d26e8210","year":2025},"citing_paper":{"arxiv_id":"2604.24712","last_updated":"2026-04-27T17:21:09Z","snapshot_observed_at":"2026-08-11T11:25:28.268331Z","submitted_at":"2026-04-27T17:21:09Z","title":"When Prompt Under-Specification Improves Code Correctness: An Exploratory Study of Prompt Wording and Structure Effects on LLM-Based Code Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T03:00:26.137401Z"},"links":{"cited_paper":"/paper/2506.06971","citing_paper":"/paper/2604.24712"},"observation_digest":"sha256:35e6da09442b20af24108b571946a7abed21a38e6626f38bde0a088230e5a016","observation_id":"ae55b03f-1380-4ca0-b2a9-940c6a69186e","resolution":{"observed_at":"2026-05-11T22:17:08.280584Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"cited_work":{"arxiv_id":"2506.06971","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.06971","snapshot_observed_at":"2026-07-02T04:06:35.135954Z","title":"Chain -of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","venue":null,"work_id":"7a69171b-abe9-4a44-a099-2ba8d26e8210","year":2025},"citing_paper":{"arxiv_id":"2604.25247","last_updated":"2026-04-28T05:52:57Z","snapshot_observed_at":"2026-08-12T19:03:18.623190Z","submitted_at":"2026-04-28T05:52:57Z","title":"R-CoT: A Reasoning-Layer Watermark via Redundant Chain-of-Thought in Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-07T15:54:22.189376Z"},"links":{"cited_paper":"/paper/2506.06971","citing_paper":"/paper/2604.25247"},"observation_digest":"sha256:5560cf76483ba87ec82299c2243b2f0ef9634358a641223b5f15a2685ada7334","observation_id":"8b0bd2e4-a2e6-4695-abf1-b7d4f4f748d9","resolution":{"observed_at":"2026-05-12T00:01:16.603177Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"cited_work":{"arxiv_id":"2506.06971","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.06971","snapshot_observed_at":"2026-07-02T04:06:35.135954Z","title":"Chain -of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","venue":null,"work_id":"7a69171b-abe9-4a44-a099-2ba8d26e8210","year":2025},"citing_paper":{"arxiv_id":"2606.03606","last_updated":"2026-06-03T12:40:36Z","snapshot_observed_at":"2026-08-05T13:58:58.657681Z","submitted_at":"2026-06-02T13:09:44Z","title":"Testing LLM Arithmetic Reasoning Generalization with Automatic Numeric-Remapping Attacks","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T09:27:30.923556Z"},"links":{"cited_paper":"/paper/2506.06971","citing_paper":"/paper/2606.03606"},"observation_digest":"sha256:26af96ac0cdd3707d0a34053fca71a207c7bf0ca0223062ab0f18d69f02d6de5","observation_id":"1c751d0a-ac3c-4453-a69f-9c738afe5221","resolution":{"observed_at":"2026-07-02T04:06:35.137777Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.06971/citation-record","integrity":"/paper/2506.06971/integrity","json":"/paper/2506.06971/citation-record.json","paper":"/paper/2506.06971"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:08.145300Z","title":"URL: \" 'urlintro :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.145300Z"},"links":{"citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:bb5d0a858147fdc2da1a5b895205516f74b7405585933817a87d701609afd87c","observation_id":"1cc80f4a-1b19-4098-a200-3c42fdac6bd7","resolution":{"observed_at":"2026-08-07T05:51:08.145300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:08.150604Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.150604Z"},"links":{"citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:c687ea4511acaa3c788fb56c27d99726a4f26bdae8c551c79f3410e451ad27c7","observation_id":"25a45a19-72f3-4669-98b4-b3c5bfe7d344","resolution":{"observed_at":"2026-08-07T05:51:08.150604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:08.996898Z","title":"Claude 3.5 sonnet model card addendum","venue":null,"work_id":"72f2c28e-d616-4d4c-b10b-efd89edad05d","year":2024},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.155720Z"},"links":{"citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:975771543c76ed1650c1a7d2d521a2a3c877066d13aa1c51717cd0cca36e27e9","observation_id":"4576ad32-3c13-4e05-bd36-f65481606d51","resolution":{"observed_at":"2026-08-07T05:51:09.001469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-07T05:51:08.160153Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.160153Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:8e6d219cb9f3f25bda80f89fc6a1720c2c065dc668c501b3c171ab448893410a","observation_id":"d5204a0a-3cb1-43c1-a339-9aadcfabc6e1","resolution":{"observed_at":"2026-08-07T05:51:08.160153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2306.04761","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:08.880793Z","title":null,"venue":null,"work_id":"11120cd6-a2eb-4dc3-93cc-ce74f264f799","year":2023},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.165145Z"},"links":{"citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:a610ac88b9614cf28307326bece46ce96f60574d315b29d6c9599728c2871d97","observation_id":"8024a898-52c8-4871-8dda-8812174d5f89","resolution":{"observed_at":"2026-08-07T05:51:08.887769Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:08.982387Z","title":"B., Mann, B., Ryder, N., Subbiah, M., Kaplan, J., Dhariwal, P., et al","venue":null,"work_id":"b3e9c37e-5dd8-4f56-a059-b829b1c0bf17","year":2020},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.169687Z"},"links":{"citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:a49f0a6d09cfeccc13ca175d2701c78a9d6cce14896f248fb51316d01b44d38a","observation_id":"6f2d7cb4-bf2f-4855-a711-9fba19f45d9b","resolution":{"observed_at":"2026-08-07T05:51:08.987211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:08.174079Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.174079Z"},"links":{"citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:8ac9648d9e76c1a2af58ff36832aeed400c69f401071ebedc2cac278bf4dc6ff","observation_id":"a05ed8dd-349a-41e4-9ac3-3f8917fc2b31","resolution":{"observed_at":"2026-08-07T05:51:08.174079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04322","last_updated":"2025-08-02T02:38:57Z","snapshot_observed_at":"2026-08-10T05:24:12.729944Z","submitted_at":"2025-02-06T18:59:02Z","title":"Speak Easy: Eliciting Harmful Jailbreaks from LLMs with Simple Interactions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04322","snapshot_observed_at":"2026-08-07T05:51:08.178292Z","title":"S., Ri, N., Xiao, Y., and Ghassemi, M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.178292Z"},"links":{"cited_paper":"/paper/2502.04322","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:9027909ea80f81ff717e2e6c102dc6bdce807f9c9dfe2eb542d13d19c096499e","observation_id":"f3be7efb-d35d-43b4-9c65-2d8fecfd881a","resolution":{"observed_at":"2026-08-07T05:51:08.178292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-07T05:51:08.184087Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.184087Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:60437c693ed15db62a3509ff724c90538ad6cc57370b3d9b75c4057f400cd432","observation_id":"5a20a6cb-b99a-4df5-a395-290fbf69998a","resolution":{"observed_at":"2026-08-07T05:51:08.184087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.12588","last_updated":"2023-10-23T01:27:38Z","snapshot_observed_at":"2026-08-02T13:06:11.850456Z","submitted_at":"2022-11-22T21:06:00Z","title":"Program of Thoughts Prompting: Disentangling Computation from Reasoning for Numerical Reasoning Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.12588","snapshot_observed_at":"2026-08-07T05:51:08.188690Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.188690Z"},"links":{"cited_paper":"/paper/2211.12588","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:088796ff5785eb3a0a42ab9f0eeff353c89b5268660fc5a62caa035a1eee17b1","observation_id":"166905c1-58f0-405c-8995-a48634ab6de8","resolution":{"observed_at":"2026-08-07T05:51:08.188690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02311","last_updated":"2022-10-05T06:02:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-05T16:11:45Z","title":"PaLM: Scaling Language Modeling with Pathways","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.02311","snapshot_observed_at":"2026-08-07T05:51:08.193698Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.193698Z"},"links":{"cited_paper":"/paper/2204.02311","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:7f6bbdd4b4ff93d16a4a3c4dd7e9582909b2c319815bf6bf479dd2b177dc9508","observation_id":"406460a9-b7f9-46ec-82de-f6e95517a595","resolution":{"observed_at":"2026-08-07T05:51:08.193698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:08.967060Z","title":null,"venue":null,"work_id":"7d9edf9f-842b-4327-83bd-78f7ebab839e","year":2024},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.198459Z"},"links":{"citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:13f0581a28c401535dfc4110ec26518604fb9ff21390f6666fad40a1ad3d4be9","observation_id":"ea126601-bc10-4287-81be-f3a96c7854a8","resolution":{"observed_at":"2026-08-07T05:51:08.971841Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:08.202745Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.202745Z"},"links":{"citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:f061c59f03e65294279192bf20ec3e95c86e6d13201d772ebcc9a5fba6042dd3","observation_id":"f4ff5f4c-af3d-44fb-afe9-397637c5d5a6","resolution":{"observed_at":"2026-08-07T05:51:08.202745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.05345","last_updated":"2024-11-08T05:54:05Z","snapshot_observed_at":"2026-08-12T22:05:03.787778Z","submitted_at":"2024-11-08T05:54:05Z","title":"Reasoning Robustness of LLMs to Adversarial Typographical Errors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.05345","snapshot_observed_at":"2026-08-07T05:51:08.207227Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.207227Z"},"links":{"cited_paper":"/paper/2411.05345","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:9b8560d27ff07d2299ced85799aca834d4107f971d1f47c3e6cbc1b139318ac8","observation_id":"17441521-0ea3-466a-916a-3477adb86b6a","resolution":{"observed_at":"2026-08-07T05:51:08.207227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.07919","last_updated":"2023-09-12T15:08:46Z","snapshot_observed_at":"2026-08-13T13:20:43.534597Z","submitted_at":"2022-12-15T15:52:39Z","title":"ROSCOE: A Suite of Metrics for Scoring Step-by-Step Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.07919","snapshot_observed_at":"2026-08-07T05:51:08.212502Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.212502Z"},"links":{"cited_paper":"/paper/2212.07919","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:17900a892635d88948e3ee7390ed8278d30eef45aa9ee9c938cd7c5b178acf64","observation_id":"fb7d36f6-e76c-4daa-83bb-36b16ce378b4","resolution":{"observed_at":"2026-08-07T05:51:08.212502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-13T15:58:13.809876Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T05:51:08.217351Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.217351Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:53258acd7d158d53f9edafbfedd4f7fce13f91aa8b9d6ea2be960892fd4d41f8","observation_id":"e789521a-ec05-4200-9790-db0e2307b013","resolution":{"observed_at":"2026-08-07T05:51:08.217351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-08-13T09:04:30.125777Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-08-07T05:51:08.222098Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.222098Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:ece1a13dff9863ef3edd6f80c0fa014dec1bdddf8876cca911dda3332d8033f8","observation_id":"d9d8ee22-e5c0-433d-8521-cbf204bd4b19","resolution":{"observed_at":"2026-08-07T05:51:08.222098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00515","last_updated":"2024-11-10T22:02:27Z","snapshot_observed_at":"2026-07-29T20:40:25.374189Z","submitted_at":"2024-06-01T17:48:15Z","title":"A Survey on Large Language Models for Code Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00515","snapshot_observed_at":"2026-08-07T05:51:08.226705Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.226705Z"},"links":{"cited_paper":"/paper/2406.00515","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:2eaf4cc777d1475f80e1f5dbebca5d1d3ce8b432aec18fd4a274b1b6815ff24f","observation_id":"269a8631-4d0f-4694-972b-72d75345b3b0","resolution":{"observed_at":"2026-08-07T05:51:08.226705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:08.951351Z","title":"Introducing llama 3.1: Our most capable models to date","venue":null,"work_id":"65460910-7511-442b-a2f2-2cfdf3956ad2","year":2024},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.232645Z"},"links":{"citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:12295fce4bc2108b49fbd9bdadf201ed0ba69ebb572572d8c66a7e78a1c18126","observation_id":"d56653d6-2a94-4d38-a31a-07e357cd0ac7","resolution":{"observed_at":"2026-08-07T05:51:08.956039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05229","last_updated":"2025-08-27T16:24:39Z","snapshot_observed_at":"2026-07-06T19:29:09.714725Z","submitted_at":"2024-10-07T17:36:37Z","title":"GSM-Symbolic: Understanding the Limitations of Mathematical Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05229","snapshot_observed_at":"2026-08-07T05:51:08.236834Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.236834Z"},"links":{"cited_paper":"/paper/2410.05229","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:b66389a1611fe16d10fb7f111eebdd91fea14e5be86dd9157e3130aefd8569b0","observation_id":"3af16814-659a-4225-ae08-783fd29db0d6","resolution":{"observed_at":"2026-08-07T05:51:08.236834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01869","last_updated":"2024-08-06T11:58:53Z","snapshot_observed_at":"2026-08-13T00:39:21.902938Z","submitted_at":"2024-04-02T11:46:31Z","title":"Beyond Accuracy: Evaluating the Reasoning Behavior of Large Language Models -- A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01869","snapshot_observed_at":"2026-08-07T05:51:08.241334Z","title":"and Plank, B","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.241334Z"},"links":{"cited_paper":"/paper/2404.01869","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:8cce4c6826bdd229dd8501cf18787d52425dba4e3deb07f448253e0de58bf2f0","observation_id":"5eae57af-4b47-48db-ac84-34593590a22b","resolution":{"observed_at":"2026-08-07T05:51:08.241334Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19730","last_updated":"2025-04-28T12:28:55Z","snapshot_observed_at":"2026-08-12T03:43:17.785240Z","submitted_at":"2025-04-28T12:28:55Z","title":"Evaluate-and-Purify: Fortifying Code Language Models Against Adversarial Attacks Using LLM-as-a-Judge","version":1},"cited_work":{"arxiv_id":"2504.19730","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.19730","snapshot_observed_at":"2026-08-07T05:51:08.543165Z","title":"Evaluate-and-Purify: Fortifying Code Language Models Against Adversarial Attacks Using LLM-as-a-Judge","venue":"cs.SE","work_id":"1398215e-cc5b-42c6-8d3b-6ff6a38f91bb","year":2025},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.245901Z"},"links":{"cited_paper":"/paper/2504.19730","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:e2c4493d2c162e1071766432dcc4fdec2c3cb59b09a2f0bcac4424448da91672","observation_id":"616200a2-78ed-404f-a347-e7e31ee6f17c","resolution":{"observed_at":"2026-08-07T05:51:08.549047Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:08.936774Z","title":"Gpt-4 technical report","venue":null,"work_id":"67f5dfb2-bfee-46e7-8917-10dbf2f0d066","year":2023},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.250595Z"},"links":{"citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:54cb104562abcf6fc0d6df6e25c173b1fb10b0873cf5b102606d496122646308","observation_id":"e31c552c-5ad9-4857-94ed-d91255800a02","resolution":{"observed_at":"2026-08-07T05:51:08.941207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10703","last_updated":"2023-11-30T23:33:07Z","snapshot_observed_at":"2026-08-13T11:58:22.300522Z","submitted_at":"2023-04-21T02:19:06Z","title":"ReCEval: Evaluating Reasoning Chains via Correctness and Informativeness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10703","snapshot_observed_at":"2026-08-07T05:51:08.254881Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.254881Z"},"links":{"cited_paper":"/paper/2304.10703","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:b340a55bd7cc672dd622ee4649b269169dbe7155bc9062accc35ce9b44c6ec8b","observation_id":"7d6bf28a-8846-4d2c-a4c9-afa79093e908","resolution":{"observed_at":"2026-08-07T05:51:08.254881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19103","last_updated":"2024-05-29T14:07:44Z","snapshot_observed_at":"2026-08-12T23:55:10.891438Z","submitted_at":"2024-05-29T14:07:44Z","title":"Voice Jailbreak Attacks Against GPT-4o","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19103","snapshot_observed_at":"2026-08-07T05:51:08.260580Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.260580Z"},"links":{"cited_paper":"/paper/2405.19103","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:1852c80684cfc61b8db0b9e3afe21bec5c5dfe662999bdc635777d6202adc820","observation_id":"965cd3c1-0dec-41e0-a7f7-cdc7e40210b8","resolution":{"observed_at":"2026-08-07T05:51:08.260580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2501.13115","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:08.492551Z","title":null,"venue":null,"work_id":"0d1682e1-68b8-4f03-878e-c38dadc5d09a","year":2025},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.265077Z"},"links":{"citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:da4996a05fe49437bce595a2275a48e65695bb59ed3c67170834c4d3323d6f03","observation_id":"2b9881c2-b2a5-46d4-901b-0e920d6cc20b","resolution":{"observed_at":"2026-08-07T05:51:08.500557Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02184","last_updated":"2024-10-03T03:58:03Z","snapshot_observed_at":"2026-08-13T18:45:39.738577Z","submitted_at":"2024-10-03T03:58:03Z","title":"CodeJudge: Evaluating Code Generation with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02184","snapshot_observed_at":"2026-08-07T05:51:08.269551Z","title":"and Zhang, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.269551Z"},"links":{"cited_paper":"/paper/2410.02184","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:ed8bfc94eeda33b3d1ca388bd62f8835d8bac86e40aeea9cf702c2c1efcbe956","observation_id":"20ac46b0-20b6-4df8-954f-b7a22e8fb6c9","resolution":{"observed_at":"2026-08-07T05:51:08.269551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.04091","last_updated":"2023-05-26T07:06:48Z","snapshot_observed_at":"2026-07-06T15:24:07.662207Z","submitted_at":"2023-05-06T16:34:37Z","title":"Plan-and-Solve Prompting: Improving Zero-Shot Chain-of-Thought Reasoning by Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.04091","snapshot_observed_at":"2026-08-07T05:51:08.274247Z","title":"K.-W., and Lim, E.-P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.274247Z"},"links":{"cited_paper":"/paper/2305.04091","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:69b48d47ff9ee5d5b946773a557d3c8a3eed44eeba6c4f0560a5e4130c923a4d","observation_id":"ba98e327-84fd-4114-8df8-c1c236ec837e","resolution":{"observed_at":"2026-08-07T05:51:08.274247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:08.279011Z","title":"V., Zhou, D., et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.279011Z"},"links":{"citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:20a659d68005e297c02f19c9df7a59cd75af9dd832987d010f71b830e09733f2","observation_id":"423aab1f-ee95-4121-aaf2-efe02d4cb7ba","resolution":{"observed_at":"2026-08-07T05:51:08.279011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04730","last_updated":"2023-12-12T19:42:11Z","snapshot_observed_at":"2026-08-13T05:07:34.377384Z","submitted_at":"2023-12-07T22:19:06Z","title":"DeceptPrompt: Exploiting LLM-driven Code Generation via Adversarial Natural Language Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.04730","snapshot_observed_at":"2026-08-07T05:51:08.283547Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.283547Z"},"links":{"cited_paper":"/paper/2312.04730","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:20f49026586f051cd8499337bcd7829d267eb5daa295c92d1cc6052a8d3465f5","observation_id":"937e60db-bb68-4755-864e-e46940ef7d65","resolution":{"observed_at":"2026-08-07T05:51:08.283547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20545","last_updated":"2025-07-08T09:46:27Z","snapshot_observed_at":"2026-08-13T05:08:05.227627Z","submitted_at":"2024-12-29T18:34:10Z","title":"The Impact of Prompt Programming on Function-Level Code Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20545","snapshot_observed_at":"2026-08-07T05:51:08.288204Z","title":"V., and Xiong, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.288204Z"},"links":{"cited_paper":"/paper/2412.20545","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:4e4f5e10d670c1eb29183b6cb3084a30b97537e7563e197260c0706043e8328f","observation_id":"58279d8c-98e0-4b95-b414-cb3b8de897e8","resolution":{"observed_at":"2026-08-07T05:51:08.288204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:08.913356Z","title":null,"venue":null,"work_id":"ef76ea49-3596-4d3e-a9d3-caa6aff3e159","year":2024},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.292601Z"},"links":{"citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:19907f1f109200af05bc466a0fa18fc83c2ec221585ebd9ac3ca929de497a683","observation_id":"5cc1ba21-d991-4b98-b340-126cd5f76231","resolution":{"observed_at":"2026-08-07T05:51:08.918066Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15341","last_updated":"2025-03-19T15:40:45Z","snapshot_observed_at":"2026-08-07T16:51:34.078217Z","submitted_at":"2025-03-19T15:40:45Z","title":"Uncertainty-Guided Chain-of-Thought for Code Generation with LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.15341","snapshot_observed_at":"2026-08-07T05:51:08.296878Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.296878Z"},"links":{"cited_paper":"/paper/2503.15341","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:964fe9e6f3a8edbc2fdccf4d73e4a5667bf47c0823b9cc61a9794c457fec80c2","observation_id":"eba1995d-3f9b-43be-9282-c8fcc94267ad","resolution":{"observed_at":"2026-08-07T05:51:08.296878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T00:52:54.262167Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":3,"verified_fuzzy":4},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 8 inbound Pith citation observations for arXiv:2506.06971."}