{"as_of":"2026-08-20T23:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bb2a7098a2e6e536b3ea32abf57a6e0cddb5754b3b3c77f79385e34f1eb28e02","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T07:01:49.222325Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.03968/citation-record","integrity":"/paper/2607.03968/integrity","json":"/paper/2607.03968/citation-record.json","paper":"/paper/2607.03968"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Using large language models for multi-level commit message generation for large diffs,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:eac38f2f638f8af29bb748c40e64622e017a8b73f63da0ad0eef7830107d4f35","observation_id":"3bb8f63f-d30f-43be-8d61-dfd7a46afe36","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Summarize me: The future of issue thread interpretation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:95872755a06c256d4c5d6802fe3dc0206b30e60d3151e8a2ebc77244424f7558","observation_id":"27799e65-5fc3-4abd-88aa-be0363a837f1","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Large language models for software engi- neering: A systematic literature review,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:26c9af69651bde4857c106a91ca3a391e6fe4da2a9b4fcb00627d35e838e99d8","observation_id":"9518fea1-e73d-4eb0-a150-017d8673981a","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.04664","last_updated":"2021-03-16T08:28:37Z","snapshot_observed_at":"2026-08-17T12:20:19.399739Z","submitted_at":"2021-02-09T06:16:25Z","title":"CodeXGLUE: A Machine Learning Benchmark Dataset for Code Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.04664","snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Codexglue: A machine learning benchmark dataset for code understanding and generation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"cited_paper":"/paper/2102.04664","citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:25ae99c69b7d18285e8aa47acceb73d85df26bbd0fef716ffcd92407c26329da","observation_id":"297d5a61-f2b6-44d8-b3e6-ff7019c41760","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"A systematic evaluation of large language models of code,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:6f41138f9fab3e1094ffe6a2b79e2c08690b47368f523a3d5868c19a72785cb9","observation_id":"f296076a-ad16-4c32-99e5-948ede4b3c51","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-20T20:50:23.483838Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Evaluating large language models trained on code,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:fbebdf747f2fbe76d90bbde133b2a830ae9ea1d723495ce5e7ae5b76905dd511","observation_id":"234c1bed-9d20-4312-9117-a73c2a63ec83","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Language models for code completion: A practical evaluation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:9b44568e0cfeb47f4f59eb27bace5092d0f34fff2831c9778138a152ff65a607","observation_id":"7ffd0578-f33b-4a04-9f97-d11162ec0621","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"A review on code generation with llms: Application and evaluation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:0b0210faefde6c6b77ff1102c439008031b05f271fa03865122a1f81d81a2049","observation_id":"88a1b7ef-679e-479b-aa47-94ad31f5bff8","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04724","last_updated":"2023-12-07T22:07:54Z","snapshot_observed_at":"2026-08-19T12:42:32.480799Z","submitted_at":"2023-12-07T22:07:54Z","title":"Purple Llama CyberSecEval: A Secure Coding Benchmark for Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.04724","snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Purple llama cyberseceval: A secure coding benchmark for language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"cited_paper":"/paper/2312.04724","citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:03129d41a153a4d5e26b7d31335c16b90402864e316ea4b8abee825b74188d6c","observation_id":"c4b6b2a4-983a-46fb-a945-a3a224793c59","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09932","last_updated":"2024-09-06T00:46:40Z","snapshot_observed_at":"2026-08-18T08:23:26.325897Z","submitted_at":"2024-04-15T16:58:28Z","title":"Foundational Challenges in Assuring Alignment and Safety of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09932","snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Foundational challenges in assuring alignment and safety of large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"cited_paper":"/paper/2404.09932","citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:47aa2714f758f475963a77e353f076dbdc1572392570e5cc635dee06a6fb94b7","observation_id":"580bb6d7-6b73-421a-b14f-02db6794d56d","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Universal and transferable adversarial attacks on aligned language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:7c027d3b2c967bfe2e510d00ba9d19846b9761aea82b698aed2436d925e5fd83","observation_id":"c56be8a3-ac77-4531-843a-6fb3f7279177","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Don’t say no: Jailbreaking llm by suppressing refusal,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:0fc468cb09561d1db9e7fe74ace06c0e71bb28b78d941052ffcca2d1b199dbcf","observation_id":"971b9bd0-b9c8-46dc-b1f3-4551475613a2","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Endless jailbreaks with bijection learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:7a4334c2702f009aa9a98fb1903c78b877a02623989411a77de94116af58c2c4","observation_id":"4e5b7cd7-4993-4e93-bcf2-529fa95ed843","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Many-shot jailbreaking,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:e49467b5636f1ec77416906d8abb37ff0df5e403ea91e207d46c99872c29edbc","observation_id":"3693395a-6f3e-407b-8a2b-e1e7be03c29b","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Codeattack: Revealing safety generalization challenges of large lan- guage models via code completion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:eec0a48938ff6cbf00c265348794c98ab42b1d03e90143acf6c2b2f06eb42b3b","observation_id":"3d4fb4e5-36bb-4b48-bfb7-34d3ce874c58","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Great, now write an article about that: The crescendo{Multi-Turn}{LLM}jailbreak attack,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:c34ef9b5b21536de844abe5e8b7c54abc22872625c8815ca8f2666e0e052d922","observation_id":"c7ad9aa9-b190-4f8b-9b69-648dfb57e760","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Code red! on the harmfulness of applying off-the-shelf large language models to programming tasks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:2be9b372bcb59b6670f086aa8764884794a37831d64925008180b577a53bbbc6","observation_id":"5a4e9452-c72a-4b12-a65a-3abdf8e56def","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.30777","last_updated":"2026-08-13T02:37:51Z","snapshot_observed_at":"2026-08-16T23:09:40.232830Z","submitted_at":"2026-05-29T03:09:37Z","title":"What Breaks When LLMs Code? Characterizing Operational Safety Failures of Agentic Code Assistants","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.30777","snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"What breaks when llms code? characteriz- ing operational safety failures of agentic code assistants,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"cited_paper":"/paper/2605.30777","citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:bad4da254b775a7fb1faa2eb6923ef75ce6eb1a034b0ddcc255e4eb06b8e3c68","observation_id":"1098af1d-4af5-4470-8d30-6e25479fdf3c","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-08-16T09:07:20.265665Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Harmbench: A standardized evaluation framework for automated red teaming and robust refusal,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:5daf0c7c1065f6fdeae7f0f0c0b20962c42a7cb34c1bb0781d6bb4289fcfc8ce","observation_id":"6676761b-75c8-41a0-a11d-bbf4dc26c2fc","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Jailbreak and guard aligned language models with only few in-context demonstrations,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:ab04681a03ab53e52239b9a013b431f0ed9efe28239c5a92ba4084b8967dd1a7","observation_id":"d39c16c6-ac1c-47f6-94b1-5c34437337a1","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.17953","last_updated":"2025-03-23T06:06:12Z","snapshot_observed_at":"2026-08-18T18:54:29.137657Z","submitted_at":"2025-03-23T06:06:12Z","title":"Smoke and Mirrors: Jailbreaking LLM-based Code Generation via Implicit Malicious Prompts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.17953","snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Smoke and mirrors: Jailbreaking llm-based code generation via implicit malicious prompts,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"cited_paper":"/paper/2503.17953","citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:b5fe48a6eda2b0051eabb8c848cb3a7a5160cc07a12bea0c22b4eccaa769a176","observation_id":"934d8f74-9ba6-467b-bac7-946e5e2e6054","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Redcode: Risky code execution and generation benchmark for code agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:b52c1abfd76295fb0cd0e7efdfcddb50d27b521e5612e6c89dc7022c39db030a","observation_id":"1d2c6a6f-88f7-4a31-a2cf-dda07a7df6d6","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09024","last_updated":"2025-04-18T14:30:31Z","snapshot_observed_at":"2026-08-16T05:17:43.289570Z","submitted_at":"2024-10-11T17:39:22Z","title":"AgentHarm: A Benchmark for Measuring Harmfulness of LLM Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09024","snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Agentharm: A benchmark for measuring harmfulness of llm agents, 2024,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"cited_paper":"/paper/2410.09024","citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:7152cdf8ce26952c834e065e87233cb13e6e18f303070f61e0a031c1be0bf20b","observation_id":"ba10b06a-18b6-4678-b764-e04350b519dd","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13886","last_updated":"2024-10-21T18:06:58Z","snapshot_observed_at":"2026-08-16T13:10:26.693808Z","submitted_at":"2024-10-11T06:54:12Z","title":"Refusal-Trained LLMs Are Easily Jailbroken As Browser Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13886","snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Refusal-trained llms are easily jailbroken as browser agents, 2024,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"cited_paper":"/paper/2410.13886","citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:0f200d7e1ddbc82686b26aadef31b9b888ce39c1e310782b3996bee368ababf8","observation_id":"1e38be30-be24-4324-9734-978f2d789f73","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Agentdojo: A dynamic environment to evaluate prompt injection attacks and defenses for llm agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:ac703f98c9d9a1493240e56c985df964246bd03b4f5cc2762a9cd39a5a8f127e","observation_id":"777998ec-968d-4417-bf33-fbafa7dcbc5b","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Os-harm: A benchmark for measuring safety of computer use agents, 2025,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:f03d986fec6b564df22076f3e48f319595f8a125e87f5eaf94e153875296efe0","observation_id":"6d6729c1-235c-4217-bd9f-6b08cfff4630","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Redcoder: Automated multi-turn red teaming for code llms,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:bc57bec79e10eed6f60a489d01e9c96466ec9a6c0add5733d5418f9a920f667c","observation_id":"1d576a44-fcf0-4f74-82a8-e2b1bf542b52","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.01359","last_updated":"2026-06-15T23:34:33Z","snapshot_observed_at":"2026-08-18T01:27:13.335437Z","submitted_at":"2025-10-01T18:38:20Z","title":"Breaking the Code: Security Assessment of AI Code Agents Through Systematic Jailbreaking Attacks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.01359","snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Breaking the code: Security assessment of ai code agents through systematic jailbreaking attacks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"cited_paper":"/paper/2510.01359","citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:99be5d066a4a26e9543e840f41ead856c941b3aee225b74d369010bdf3f8c94c","observation_id":"d631095a-1211-4997-afa3-eabd4b9fdfd8","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Sema: Simple yet effective learning for multi-turn jailbreak attacks,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:e4230a95e3109aec33645771135af789daadf200e717ddcb9db8e6339524bfc4","observation_id":"646b76ec-4243-4da9-901e-2c53bc1219ef","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-18T02:53:19.588193Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00782","snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Jailbreak-r1: Exploring the jailbreak capabilities of llms via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"cited_paper":"/paper/2506.00782","citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:d16d32e9534d38af42131450067c2704a1312ae82a2c3d75fcff61fb35177017","observation_id":"0b78426c-7ced-42f2-b964-4f713e454373","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Llms as evaluators: A novel approach to commit message quality assessment,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:618995dbc8ea73d58d42f83e20dc57fc8eefcea5492c2d3809e508133dbeafa8","observation_id":"b6bdaf64-4287-4eb9-9133-2f2413721191","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05579","last_updated":"2024-12-10T05:49:12Z","snapshot_observed_at":"2026-08-17T10:18:05.650518Z","submitted_at":"2024-12-07T08:07:24Z","title":"LLMs-as-Judges: A Comprehensive Survey on LLM-based Evaluation Methods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05579","snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Llms- as-judges: a comprehensive survey on llm-based evaluation methods,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"cited_paper":"/paper/2412.05579","citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:51087a8c3c95bf7b66d41d4ab51af57a5f2884797c7c130d08194ccf595938ad","observation_id":"dfe038c8-ed6b-4e43-a486-271dfd3ca83a","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"A coin flip for safety: Llm judges fail to reliably measure adversarial robustness,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:ee6350f4b7591fa86357916a0ad3a272954a20e1d33795fd5c067a8e9d67a5ac","observation_id":"28a407e4-338f-44fd-bf39-6c4af7adee6b","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12855","last_updated":"2024-10-18T02:35:22Z","snapshot_observed_at":"2026-08-16T13:10:17.932945Z","submitted_at":"2024-10-11T14:56:28Z","title":"JAILJUDGE: A Comprehensive Jailbreak Judge Benchmark with Multi-Agent Enhanced Explanation Evaluation Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12855","snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Jailjudge: A comprehensive jailbreak judge benchmark with multi- agent enhanced explanation evaluation framework,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"cited_paper":"/paper/2410.12855","citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:4661b7b1d79eb28d0af2c9aca47693214dec0077a8dad4092c794a76be155811","observation_id":"92b849b1-c7f8-4bfe-ba88-60e431f2db42","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Llms cannot reliably judge (yet?): A comprehensive assessment on the robustness of llm-as-a-judge,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:7d4f091083e9a2f2a696b15583f070d0d8de2f92fe5af1c254cac76aea490be6","observation_id":"6a200fc6-1537-442d-873b-706e30c97462","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01724","last_updated":"2024-05-02T20:42:28Z","snapshot_observed_at":"2026-08-19T07:52:50.883828Z","submitted_at":"2024-05-02T20:42:28Z","title":"Large Language Models are Inconsistent and Biased Evaluators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.01724","snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Large language models are inconsistent and biased evaluators,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"cited_paper":"/paper/2405.01724","citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:b2681f4dd4b7a62022ce753dcd9dce0475644eaeaa8dc8a3526962ee00ee4124","observation_id":"b62673e9-7d84-45f7-a38b-f6d5e0294d6a","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","latest_version":2,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-20T11:46:11.360588Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2607.03968."}