{"as_of":"2026-08-08T23:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:20438aed8a65283862f47c770487b8c798300be9963dab2dac4f7a5e297c0735","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":24,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:26:13.657815Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":27,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2307.02483","last_updated":"2023-07-05T17:58:10Z","snapshot_observed_at":"2026-08-08T18:11:45.725753Z","submitted_at":"2023-07-05T17:58:10Z","title":"Jailbroken: How Does LLM Safety Training Fail?","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-14T18:17:42.752997Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2307.02483"},"observation_digest":"sha256:27b9add8f2c75abe8b6633d5edd49b50a2d0954475f0c863d328c58c9510836f","observation_id":"40842c4f-588b-44d0-85a7-b46df7e64d03","resolution":{"observed_at":"2026-05-14T18:17:42.855510Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2308.03825","last_updated":"2024-05-15T12:06:31Z","snapshot_observed_at":"2026-07-06T16:03:34.432602Z","submitted_at":"2023-08-07T16:55:20Z","title":"\"Do Anything Now\": Characterizing and Evaluating In-The-Wild Jailbreak Prompts on Large Language Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-17T08:39:28.047394Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2308.03825"},"observation_digest":"sha256:7e03d8c4fcd1da93ead856b7b9c3ef1064408c09ed1d21123e20f590b43d072e","observation_id":"890a477b-2c06-42aa-b0c7-c603ae315350","resolution":{"observed_at":"2026-05-17T08:39:28.174978Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2309.00614","last_updated":"2023-09-04T17:47:36Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:44Z","title":"Baseline Defenses for Adversarial Attacks Against Aligned Language Models","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-13T23:24:39.835347Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2309.00614"},"observation_digest":"sha256:9e7494708afcfb0e4296a14bf002c984bb9fcc5aefb99a2cf4a108381c83e0c3","observation_id":"72287e84-52b2-4c64-83c7-763383e4bd24","resolution":{"observed_at":"2026-05-13T23:24:40.023866Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2310.04451","last_updated":"2024-03-20T21:34:56Z","snapshot_observed_at":"2026-08-06T02:57:30.438059Z","submitted_at":"2023-10-03T19:44:37Z","title":"AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-12T16:28:03.996446Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2310.04451"},"observation_digest":"sha256:4fa408edaf3bc5262b528f92e33fa38f3a073ed0a496dcb1530c8c2e655be2b3","observation_id":"dec75bb5-f715-4e46-a240-8010246d6287","resolution":{"observed_at":"2026-05-12T16:28:04.062859Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2310.06987","last_updated":"2023-10-10T20:15:54Z","snapshot_observed_at":"2026-07-06T16:30:46.321160Z","submitted_at":"2023-10-10T20:15:54Z","title":"Catastrophic Jailbreak of Open-source LLMs via Exploiting Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-16T22:00:51.487120Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2310.06987"},"observation_digest":"sha256:29ee7487661ddb1d987911f1d54bf2980fe1390ca78ddb2a1cb55fef5f99bfa6","observation_id":"5ca57504-058d-4863-8fff-5f7e9942d0d9","resolution":{"observed_at":"2026-05-16T22:00:51.556822Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2402.06922","last_updated":"2026-04-21T14:06:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-10T11:07:24Z","title":"Whispers in the Machine: Confidentiality in Agentic Systems","version":5},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-24T03:59:03.972043Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2402.06922"},"observation_digest":"sha256:65330eb31379ec71f778f98d39eecdd73cb74cd786ba9883b9ea85a7b97b1185","observation_id":"8f19794a-fcc9-4122-ac96-88a49465957f","resolution":{"observed_at":"2026-05-24T04:03:53.849912Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2402.10260","last_updated":"2024-08-27T03:32:47Z","snapshot_observed_at":"2026-08-04T21:32:35.483431Z","submitted_at":"2024-02-15T18:58:09Z","title":"A StrongREJECT for Empty Jailbreaks","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T21:28:02.745230Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2402.10260"},"observation_digest":"sha256:a5bd52e71c0ce5bcf1a54118d686e510e591ab26823475ac56dbe46692e9ad0b","observation_id":"a1aa8d47-9e09-4692-b3f3-498a0ada33ba","resolution":{"observed_at":"2026-05-16T21:28:02.825041Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2404.08144","last_updated":"2024-04-17T04:34:39Z","snapshot_observed_at":"2026-08-08T10:18:09.304124Z","submitted_at":"2024-04-11T22:07:19Z","title":"LLM Agents can Autonomously Exploit One-day Vulnerabilities","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-18T04:18:27.597704Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2404.08144"},"observation_digest":"sha256:b50cbcc7b1b41eea4b8ff8c4164b36ee94c077e80057bbb90e306a00ce7936af","observation_id":"83ea2ea0-dc41-4608-8feb-36b8746ef217","resolution":{"observed_at":"2026-05-18T04:18:27.709259Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2407.04295","last_updated":"2024-08-30T11:57:47Z","snapshot_observed_at":"2026-08-04T23:34:13.332065Z","submitted_at":"2024-07-05T06:57:30Z","title":"Jailbreak Attacks and Defenses Against Large Language Models: A Survey","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-15T02:20:44.368219Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2407.04295"},"observation_digest":"sha256:3cb67def6adb041ffcbb99955425b3e85ac7e93bcad45c0e006e5e89b9636c13","observation_id":"db4aa327-8f7b-4cc0-938c-63201fa0ad10","resolution":{"observed_at":"2026-05-15T02:20:44.691880Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2410.07283","last_updated":"2024-10-09T11:01:29Z","snapshot_observed_at":"2026-08-02T17:12:52.352951Z","submitted_at":"2024-10-09T11:01:29Z","title":"Prompt Infection: LLM-to-LLM Prompt Injection within Multi-Agent Systems","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-05-15T19:32:19.405615Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2410.07283"},"observation_digest":"sha256:42342f814c5a9fa9396fdbfdda3174cb3cff16114f7b4e1d2b4167601f9db962","observation_id":"d826b6f6-c434-4f2f-9f3c-ebcb4d31cbff","resolution":{"observed_at":"2026-05-15T19:32:19.734280Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2410.15362","last_updated":"2026-05-19T04:19:17Z","snapshot_observed_at":"2026-07-06T19:36:36.994783Z","submitted_at":"2024-10-20T11:27:41Z","title":"Faster-GCG: Efficient Discrete Optimization Jailbreak Attacks against Aligned Large Language Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-23T19:01:43.922848Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2410.15362"},"observation_digest":"sha256:5c541bf54ff8f65f3a6d98d451195203f4e984029175d4f790cbe694ad14b7ac","observation_id":"87dea015-967a-41c4-b047-429f37b479c2","resolution":{"observed_at":"2026-05-23T19:03:21.401463Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-06T19:26:13.657815Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08020","last_updated":"2025-07-08T03:01:00Z","snapshot_observed_at":"2026-08-06T19:19:20.387278Z","submitted_at":"2025-07-08T03:01:00Z","title":"Circumventing Safety Alignment in Large Language Models Through Embedding Space Toxicity Attenuation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:26:13.657815Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2507.08020"},"observation_digest":"sha256:64fd8e123bcb9cf509cc3fc5f71eeaecd4ef6ac2c899965368fb46d3891e8f32","observation_id":"87c3da8a-2bd1-4af8-98b4-e89550e2d730","resolution":{"observed_at":"2026-08-06T19:26:13.657815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T20:31:41.107700Z","title":"Exploiting programmatic behavior of llms: Dual-use through standard secu- rity attacks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.10404","last_updated":"2025-08-14T07:12:44Z","snapshot_observed_at":"2026-08-08T02:31:17.622343Z","submitted_at":"2025-08-14T07:12:44Z","title":"Layer-Wise Perturbations via Sparse Autoencoders for Adversarial Text Generation","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-05T20:31:41.107700Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2508.10404"},"observation_digest":"sha256:72951007d680926bb8302c0b2faba1295e72f49fd3a1c306af21e51ebad5f644","observation_id":"503994c0-873c-4d01-bc23-7d6f96f3ef5c","resolution":{"observed_at":"2026-08-05T20:31:41.107700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T14:51:03.693056Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security At- tacks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20848","last_updated":"2025-08-28T14:40:27Z","snapshot_observed_at":"2026-08-08T18:12:52.209270Z","submitted_at":"2025-08-28T14:40:27Z","title":"JADES: A Universal Framework for Jailbreak Assessment via Decompositional Scoring","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T14:51:03.693056Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2508.20848"},"observation_digest":"sha256:204a27f653315ab185c8b776994c4bf44f5436ccee2f47bdb8ea12a10a1a5ecb","observation_id":"a6857368-c41a-444e-9b2e-866c399a234a","resolution":{"observed_at":"2026-08-05T14:51:03.693056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T05:59:27.941873Z","title":"Exploiting programmatic behavior of llms: Dual-use through standard security attacks, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.04615","last_updated":"2025-09-04T18:59:07Z","snapshot_observed_at":"2026-08-08T07:38:10.301418Z","submitted_at":"2025-09-04T18:59:07Z","title":"Breaking to Build: A Threat Model of Prompt-Based Attacks for Securing LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T05:59:27.941873Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2509.04615"},"observation_digest":"sha256:8aaa1b74af1e7b3979605e2870549df13e45de041c3061869d3ec216ce860074","observation_id":"7f0c4c94-9fea-4cec-b91e-ed6b9cb57b4e","resolution":{"observed_at":"2026-08-05T05:59:27.941873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-04T23:10:21.297410Z","title":"Exploiting programmatic behavior of llms: Dual-use through standard security attacks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.06795","last_updated":"2025-09-08T15:24:33Z","snapshot_observed_at":"2026-08-06T11:18:33.345942Z","submitted_at":"2025-09-08T15:24:33Z","title":"Anchoring Refusal Direction: Mitigating Safety Risks in Tuning via Projection Constraint","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T23:10:21.297410Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2509.06795"},"observation_digest":"sha256:847eec5b775f19d808652b6060c3361bcf5972247a88a260d863b4b037fc026c","observation_id":"3540126a-5c94-4b96-a78e-565f1ab7fa6f","resolution":{"observed_at":"2026-08-04T23:10:21.297410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-04T23:09:41.524212Z","title":"Exploiting programmatic behavior of llms: Dual-use through standard security attacks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.06807","last_updated":"2025-09-08T15:39:17Z","snapshot_observed_at":"2026-08-06T11:18:26.434722Z","submitted_at":"2025-09-08T15:39:17Z","title":"MoGU V2: Toward a Higher Pareto Frontier Between Model Usability and Security","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-04T23:09:41.524212Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2509.06807"},"observation_digest":"sha256:98e0d973bde9221e6ed22ecc31999d1b546cd10acc7b913729902cedeb00e255","observation_id":"efbff674-42ba-4754-b406-ece032bb95c6","resolution":{"observed_at":"2026-08-04T23:09:41.524212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-03T02:51:56.253042Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.09629","last_updated":"2026-02-10T10:17:25Z","snapshot_observed_at":"2026-08-08T14:35:13.402060Z","submitted_at":"2026-02-10T10:17:25Z","title":"Stop Testing Attacks, Start Diagnosing Defenses: The Four-Checkpoint Framework Reveals Where LLM Safety Breaks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T02:51:56.253042Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2602.09629"},"observation_digest":"sha256:cbddbb105cd35d7f0e4ebc8e492dbad1c2366f9cbbd1ba6ec752712cce4f8fad","observation_id":"d508c59e-88d6-4476-ab2e-39b72eba5cac","resolution":{"observed_at":"2026-08-03T02:51:56.253042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2604.27001","last_updated":"2026-04-29T03:58:55Z","snapshot_observed_at":"2026-07-06T23:12:33.898150Z","submitted_at":"2026-04-29T03:58:55Z","title":"An Empirical Security Evaluation of LLM-Generated Cryptographic Rust Code","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-07T13:26:17.100399Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2604.27001"},"observation_digest":"sha256:47587315421ec59983a44565adb11b3eef578e207a9aa4b67f22fa7d1893df44","observation_id":"1160e7af-8cad-404a-a8de-db28bcebb7d5","resolution":{"observed_at":"2026-05-12T08:56:26.794119Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2605.00348","last_updated":"2026-06-23T05:52:02Z","snapshot_observed_at":"2026-08-02T18:11:47.818278Z","submitted_at":"2026-05-01T02:14:38Z","title":"Block-wise Codeword Embedding for Reliable Multi-bit Text Watermarking","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-05-09T19:52:21.350072Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2605.00348"},"observation_digest":"sha256:0e3dfdee6947f9cdbc7120e968f91b6a4273333e4f3b5a4e9a0cdf059458be8c","observation_id":"ed14cc08-8635-43ca-add9-8f1e6044f166","resolution":{"observed_at":"2026-05-11T15:31:06.043863Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2606.25097","last_updated":"2026-06-23T19:06:42Z","snapshot_observed_at":"2026-08-02T20:00:46.182561Z","submitted_at":"2026-06-23T19:06:42Z","title":"Speculative Decoding at Temperature Zero: A Scoped Safety-Invariance Screen with a 48,072-Sample Expansion","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-26T00:05:06.647295Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2606.25097"},"observation_digest":"sha256:6c60e0841276b362557be2aaf27293938c5c114877e42e9257606e02abc74d2e","observation_id":"a2877a87-885f-4c60-b65a-24eb260debe9","resolution":{"observed_at":"2026-07-04T16:59:58.296057Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2606.30783","last_updated":"2026-06-29T18:11:17Z","snapshot_observed_at":"2026-08-08T22:30:38.879886Z","submitted_at":"2026-06-29T18:11:17Z","title":"Security--Fidelity Tradeoffs: The Hidden Cost of Prompt Injection Defense","version":1},"reference_index":107,"source":"arxiv_source","source_observed_at":"2026-07-01T01:44:07.700127Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2606.30783"},"observation_digest":"sha256:cb2efd300404da2261a199762ff6acfbd8df59135d6faf44eb165cf68f968746","observation_id":"a0791066-8569-4077-912c-6a9276d55ff4","resolution":{"observed_at":"2026-07-01T12:45:44.893381Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2606.31639","last_updated":"2026-06-30T13:21:43Z","snapshot_observed_at":"2026-08-03T05:59:43.224416Z","submitted_at":"2026-06-30T13:21:43Z","title":"A Lifecycle and Application-Stack Survey of Large Language Model Vulnerabilities: Attacks, Risks, Defenses, and Open Problems","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-01T04:44:23.543728Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2606.31639"},"observation_digest":"sha256:8ae940a7baa086b71f01627b739d25249bffb18b3e19cbbce700c8ed5e916dd8","observation_id":"6b1f1121-dc29-424d-8748-8d7fa42f2719","resolution":{"observed_at":"2026-07-01T11:05:42.347271Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-01T08:37:33.396857Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27373","last_updated":"2026-07-29T18:25:30Z","snapshot_observed_at":"2026-08-07T20:54:40.976131Z","submitted_at":"2026-07-29T18:25:30Z","title":"RoguePrompt: Dual-Layer Encoding for Self-Reconstruction to Circumvent LLM Moderation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:33.396857Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2607.27373"},"observation_digest":"sha256:98a9fb559d52f777291e488c4da54786635eff80269c7fb0c98d0b06aa6b6fa7","observation_id":"9d2ee81b-6ff7-4404-86db-19c084bdfc09","resolution":{"observed_at":"2026-08-01T08:37:33.396857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2302.05733/citation-record","integrity":"/paper/2302.05733/integrity","json":"/paper/2302.05733/citation-record.json","paper":"/paper/2302.05733"},"outbound":[],"paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 24 inbound Pith citation observations for arXiv:2302.05733."}