{"as_of":"2026-08-10T00:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c6d91d0dea562bfd83c3d343b38c592ec367f13e46bd2b412adc27d83044d57c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":35,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T18:31:14.091976Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T01:47:31.647956Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":"2307.08715","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-07-03T01:47:31.647956Z","title":"Jail- breaker: Automated jailbreak across multiple large language model chatbots","venue":null,"work_id":"aa1418bb-738e-4eb1-a94f-4bc672faaef3","year":2023},"citing_paper":{"arxiv_id":"2308.03825","last_updated":"2024-05-15T12:06:31Z","snapshot_observed_at":"2026-07-06T16:03:34.432602Z","submitted_at":"2023-08-07T16:55:20Z","title":"\"Do Anything Now\": Characterizing and Evaluating In-The-Wild Jailbreak Prompts on Large Language Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-17T08:39:28.047394Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2308.03825"},"observation_digest":"sha256:c356ac57ba782aa30f4b4db3c82de14679069f7ca94e3389bd92ce4101796597","observation_id":"c5f1c862-6e97-40f6-ac36-9955d9dc47ed","resolution":{"observed_at":"2026-05-17T08:39:28.154026Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":"2307.08715","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-07-03T01:47:31.647956Z","title":"Jail- breaker: Automated jailbreak across multiple large language model chatbots","venue":null,"work_id":"aa1418bb-738e-4eb1-a94f-4bc672faaef3","year":2023},"citing_paper":{"arxiv_id":"2309.10253","last_updated":"2024-06-27T16:01:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-19T02:19:48Z","title":"GPTFUZZER: Red Teaming Large Language Models with Auto-Generated Jailbreak Prompts","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-15T06:25:20.966510Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2309.10253"},"observation_digest":"sha256:47674d7dc658ba475929a8b8ec41f698b0324c85d5e7eeaf6b45e8a8b5105037","observation_id":"a3acd945-6bb3-4a14-a5ae-4adf0b1d625c","resolution":{"observed_at":"2026-05-15T06:25:21.048409Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":"2307.08715","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-07-03T01:47:31.647956Z","title":"Jail- breaker: Automated jailbreak across multiple large language model chatbots","venue":null,"work_id":"aa1418bb-738e-4eb1-a94f-4bc672faaef3","year":2023},"citing_paper":{"arxiv_id":"2402.06922","last_updated":"2026-04-21T14:06:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-10T11:07:24Z","title":"Whispers in the Machine: Confidentiality in Agentic Systems","version":5},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-24T03:59:03.972043Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2402.06922"},"observation_digest":"sha256:fc2a8099591dfe2d67c233c365fb806f08bcaae10367bc5b793c5717215b8124","observation_id":"10e49467-9e2f-4dbf-95b5-1e4d3a326017","resolution":{"observed_at":"2026-05-24T04:03:53.820558Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":"2307.08715","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-07-03T01:47:31.647956Z","title":"Jail- breaker: Automated jailbreak across multiple large language model chatbots","venue":null,"work_id":"aa1418bb-738e-4eb1-a94f-4bc672faaef3","year":2023},"citing_paper":{"arxiv_id":"2402.10260","last_updated":"2024-08-27T03:32:47Z","snapshot_observed_at":"2026-08-04T21:32:35.483431Z","submitted_at":"2024-02-15T18:58:09Z","title":"A StrongREJECT for Empty Jailbreaks","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T21:28:02.745230Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2402.10260"},"observation_digest":"sha256:3bbc10912056c261927248ecd4906789fcfb118c459e5d9f02e5c3b0dbc67549","observation_id":"4f5b30e4-f42a-463f-96ef-a15840a5a095","resolution":{"observed_at":"2026-05-16T21:28:02.807339Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":"2307.08715","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-07-03T01:47:31.647956Z","title":"Jail- breaker: Automated jailbreak across multiple large language model chatbots","venue":null,"work_id":"aa1418bb-738e-4eb1-a94f-4bc672faaef3","year":2023},"citing_paper":{"arxiv_id":"2404.01833","last_updated":"2025-02-26T13:41:41Z","snapshot_observed_at":"2026-08-03T07:26:39.431128Z","submitted_at":"2024-04-02T10:45:49Z","title":"Great, Now Write an Article About That: The Crescendo Multi-Turn LLM Jailbreak Attack","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-18T02:12:41.431156Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2404.01833"},"observation_digest":"sha256:8dfc4357121b1fd5d9f487cd6eb9acea07ba8d4c18680085d03112773982c43d","observation_id":"e4b584f3-269d-4e4c-9d5b-90fd0c37cd12","resolution":{"observed_at":"2026-05-18T02:12:41.510124Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":"2307.08715","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-07-03T01:47:31.647956Z","title":"Jail- breaker: Automated jailbreak across multiple large language model chatbots","venue":null,"work_id":"aa1418bb-738e-4eb1-a94f-4bc672faaef3","year":2023},"citing_paper":{"arxiv_id":"2407.04295","last_updated":"2024-08-30T11:57:47Z","snapshot_observed_at":"2026-08-04T23:34:13.332065Z","submitted_at":"2024-07-05T06:57:30Z","title":"Jailbreak Attacks and Defenses Against Large Language Models: A Survey","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-15T02:20:44.368219Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2407.04295"},"observation_digest":"sha256:875a88185557562d8f37392a807b195b104ca06b4cb19a069003299159c23245","observation_id":"c88ede7e-1e5c-4a97-a2d8-46cb7f385a2f","resolution":{"observed_at":"2026-05-15T02:20:44.597045Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-08-09T18:31:14.091976Z","title":"Jailbreaker: Automated jailbreak across multiple large language model chatbots","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00580","last_updated":"2025-02-01T22:26:30Z","snapshot_observed_at":"2026-08-09T18:23:58.529851Z","submitted_at":"2025-02-01T22:26:30Z","title":"Defense Against the Dark Prompts: Mitigating Best-of-N Jailbreaking with Prompt Evaluation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T18:31:14.091976Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2502.00580"},"observation_digest":"sha256:6f767e54c3ff993a03242708628e6d8d48d31e9cea6e6432c498d07623239339","observation_id":"61eb7d40-2757-4f15-aed8-30a48687bceb","resolution":{"observed_at":"2026-08-09T18:31:14.091976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-08-08T12:25:30.551145Z","title":"Jailbreaker: Automated jailbreak across mul- tiple large language model chatbots","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07557","last_updated":"2025-02-11T13:50:50Z","snapshot_observed_at":"2026-08-09T03:24:13.351555Z","submitted_at":"2025-02-11T13:50:50Z","title":"JBShield: Defending Large Language Models from Jailbreak Attacks through Activated Concept Analysis and Manipulation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T12:25:30.551145Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2502.07557"},"observation_digest":"sha256:13a0229d52fcb18cc5b5c7a858a0ef730651ff999800c9dadb6526a63c7b1aa4","observation_id":"f5bacc40-e2df-4e5e-a5be-90e2ac9abb2b","resolution":{"observed_at":"2026-08-08T12:25:30.551145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-08-07T14:52:15.531093Z","title":"Jailbreaker: Automated jailbreak across multiple large language model chatbots","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18212","last_updated":"2025-05-22T22:06:09Z","snapshot_observed_at":"2026-08-09T04:52:54.835590Z","submitted_at":"2025-05-22T22:06:09Z","title":"Towards medical AI misalignment: a preliminary study","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:52:15.531093Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2505.18212"},"observation_digest":"sha256:a4b01af8adf54b7685a7a5c9fedf552790d6ffd5217ce4e257cc54933433cb5b","observation_id":"37eb964d-83b0-48d2-b96b-bb82039b6d59","resolution":{"observed_at":"2026-08-07T14:52:15.531093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-08-07T05:40:20.580018Z","title":"Masterkey: Automated jailbreak across multiple large language model chatbots","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07402","last_updated":"2025-06-09T03:52:43Z","snapshot_observed_at":"2026-08-07T10:07:41.500171Z","submitted_at":"2025-06-09T03:52:43Z","title":"Beyond Jailbreaks: Revealing Stealthier and Broader LLM Security Risks Stemming from Alignment Failures","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:20.580018Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2506.07402"},"observation_digest":"sha256:0aaa7a4b073e92da964291ced9e669da3e1b9d6d7bf7a61cdb8e9e8be64ef478","observation_id":"ff06be60-b1ab-4ac7-b4c7-f3d678f2af6b","resolution":{"observed_at":"2026-08-07T05:40:20.580018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-08-06T23:20:55.350714Z","title":"Masterkey: Automated jailbreak across multiple large language model chatbots.arXiv preprint arXiv:2307.087152023","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18543","last_updated":"2026-05-25T10:15:56Z","snapshot_observed_at":"2026-08-08T08:35:45.497926Z","submitted_at":"2025-06-23T11:53:31Z","title":"SoK: A Comprehensive Security Analysis of Jailbreak Resilience in GPT and DeepSeek Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:55.350714Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2506.18543"},"observation_digest":"sha256:a9fd2c7b67777d7d1b853e5ebff3aa0bcf22e539e4ccd9557f6e0ce71e5a7703","observation_id":"4e48964a-e6cf-40b9-95be-f7f0537b1c4b","resolution":{"observed_at":"2026-08-06T23:20:55.350714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-08-06T01:03:49.724134Z","title":"Masterkey: Automated jailbreak across multiple large language model chatbots","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.03933","last_updated":"2025-08-05T21:55:14Z","snapshot_observed_at":"2026-08-07T23:14:31.511391Z","submitted_at":"2025-08-05T21:55:14Z","title":"Towards terahertz nanomechanics","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T01:03:49.724134Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2508.03933"},"observation_digest":"sha256:9de35b37468f30cb00f466ffafe4a478082c05f3e00d8b4485ced30fd89c38d5","observation_id":"56ff5e57-e124-4244-94b6-d607d48c4265","resolution":{"observed_at":"2026-08-06T01:03:49.724134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-08-06T01:04:32.814351Z","title":"Masterkey: Automated jailbreak across multiple large language model chatbots","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.03936","last_updated":"2025-08-05T21:57:52Z","snapshot_observed_at":"2026-08-08T12:25:04.397522Z","submitted_at":"2025-08-05T21:57:52Z","title":"ASTRA: Autonomous Spatial-Temporal Red-teaming for AI Software Assistants","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T01:04:32.814351Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2508.03936"},"observation_digest":"sha256:4e8d5cd91752daf8bf370e311efc7aa47d6d8912ed6db7ead3db952b2a9e2b95","observation_id":"ad80f914-a20d-4181-b716-6065bec45b40","resolution":{"observed_at":"2026-08-06T01:04:32.814351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-08-05T19:39:09.679117Z","title":"Jailbreaker: Automated jailbreak across multiple large language model chatbots","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.12175","last_updated":"2025-08-16T22:56:51Z","snapshot_observed_at":"2026-08-09T06:07:29.095199Z","submitted_at":"2025-08-16T22:56:51Z","title":"Invitation Is All You Need! Promptware Attacks Against LLM-Powered Assistants in Production Are Practical and Dangerous","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T19:39:09.679117Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2508.12175"},"observation_digest":"sha256:17259a175255e13daf5403689d58607948eccedf8992e0dde53a17ca6a5867eb","observation_id":"992ff8f6-82d4-43a8-b028-e13f44571af0","resolution":{"observed_at":"2026-08-05T19:39:09.679117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":"2307.08715","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-07-03T01:47:31.647956Z","title":"Jail- breaker: Automated jailbreak across multiple large language model chatbots","venue":null,"work_id":"aa1418bb-738e-4eb1-a94f-4bc672faaef3","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:25a537167bdcc50cf9e8b01e75db6d9c6e23ff4c018d7f85decdd0866dea7515","observation_id":"a5be04eb-7089-4b62-a33c-3f3cd94f841e","resolution":{"observed_at":"2026-05-18T21:36:52.533755Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-08-05T10:44:10.439996Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03787","last_updated":"2025-09-04T00:45:58Z","snapshot_observed_at":"2026-08-08T11:14:03.361977Z","submitted_at":"2025-09-04T00:45:58Z","title":"Evaluating the Robustness of Retrieval-Augmented Generation to Adversarial Evidence in the Health Domain","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T10:44:10.439996Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2509.03787"},"observation_digest":"sha256:499a5984af6e431b9f25fb008edbeb639f8e2014a5f53de02f2dc229ba223817","observation_id":"4a909c0b-6654-4cbe-aebf-7d55ade6bc19","resolution":{"observed_at":"2026-08-05T10:44:10.439996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-08-05T05:59:28.711730Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04615","last_updated":"2025-09-04T18:59:07Z","snapshot_observed_at":"2026-08-08T07:38:10.301418Z","submitted_at":"2025-09-04T18:59:07Z","title":"Breaking to Build: A Threat Model of Prompt-Based Attacks for Securing LLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T05:59:28.711730Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2509.04615"},"observation_digest":"sha256:cba66112ee474cf693c8959ec7c71cede501ec067c72a10eb85e8de51c8fd82a","observation_id":"21332e49-ab08-4b7c-a50d-302f69aa472d","resolution":{"observed_at":"2026-08-05T05:59:28.711730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-08-04T09:25:38.849327Z","title":"Masterkey: Automated jailbreak across multiple large language model chatbots.arXiv preprint arXiv:2307.08715, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.15476","last_updated":"2026-07-04T04:20:15Z","snapshot_observed_at":"2026-08-06T02:45:04.316908Z","submitted_at":"2025-10-17T09:38:54Z","title":"SoK: Systematizing LLM Prompt Security: Taxonomies, Datasets, and Unified Evaluation of Attacks and Defenses","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T09:25:38.849327Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2510.15476"},"observation_digest":"sha256:0b6157f71b87cc299406c17bd87e1daa3f1300ed01f63143cc730ec20812204b","observation_id":"9817fec3-0c68-4669-a3f1-b040e5fcea88","resolution":{"observed_at":"2026-08-04T09:25:38.849327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":"2307.08715","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-07-03T01:47:31.647956Z","title":"Jail- breaker: Automated jailbreak across multiple large language model chatbots","venue":null,"work_id":"aa1418bb-738e-4eb1-a94f-4bc672faaef3","year":2023},"citing_paper":{"arxiv_id":"2510.16558","last_updated":"2026-04-27T18:24:07Z","snapshot_observed_at":"2026-07-06T22:33:28.866887Z","submitted_at":"2025-10-18T16:09:05Z","title":"A First Look at the Security Issues in the Model Context Protocol Ecosystem","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-18T06:10:58.928119Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2510.16558"},"observation_digest":"sha256:321eb427a7c627d00b3a6a3f40f05b38bbe154e504313c2b53beb10b8f2b9072","observation_id":"9727615b-4d51-444d-84bc-ad5fe86d2338","resolution":{"observed_at":"2026-05-18T06:12:26.320889Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":"2307.08715","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-07-03T01:47:31.647956Z","title":"Jail- breaker: Automated jailbreak across multiple large language model chatbots","venue":null,"work_id":"aa1418bb-738e-4eb1-a94f-4bc672faaef3","year":2023},"citing_paper":{"arxiv_id":"2602.02280","last_updated":"2026-05-12T03:47:11Z","snapshot_observed_at":"2026-07-06T22:44:09.804048Z","submitted_at":"2026-02-02T16:20:51Z","title":"RACC: Representation-Aware Coverage Criteria for LLM Safety Testing","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T08:12:55.296932Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2602.02280"},"observation_digest":"sha256:78ff281a87e4b09a706fc175ec5f4fba9078e6c9599d389225b272cfb242a245","observation_id":"7f87a8d2-13a9-4d2c-a46b-7fedbaf66d6d","resolution":{"observed_at":"2026-05-16T08:17:36.579007Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":"2307.08715","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-07-03T01:47:31.647956Z","title":"Jail- breaker: Automated jailbreak across multiple large language model chatbots","venue":null,"work_id":"aa1418bb-738e-4eb1-a94f-4bc672faaef3","year":2023},"citing_paper":{"arxiv_id":"2603.04459","last_updated":"2026-05-14T18:30:07Z","snapshot_observed_at":"2026-07-06T22:47:50.848191Z","submitted_at":"2026-03-03T09:10:45Z","title":"Benchmark of Benchmarks: Unpacking Influence and Code Repository Quality in LLM Safety Benchmarks","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-21T12:09:55.500940Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2603.04459"},"observation_digest":"sha256:dc54615515e424004448c6a59ae711501052ee1cc2db2a026cf70d3dfddd55fe","observation_id":"778da053-7351-4176-a8aa-1d7206303803","resolution":{"observed_at":"2026-05-21T12:10:06.523393Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":"2307.08715","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-07-03T01:47:31.647956Z","title":"Jail- breaker: Automated jailbreak across multiple large language model chatbots","venue":null,"work_id":"aa1418bb-738e-4eb1-a94f-4bc672faaef3","year":2023},"citing_paper":{"arxiv_id":"2604.04060","last_updated":"2026-04-05T11:06:13Z","snapshot_observed_at":"2026-08-02T08:01:35.924581Z","submitted_at":"2026-04-05T11:06:13Z","title":"CoopGuard: Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Round Attacks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-13T17:06:46.917177Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2604.04060"},"observation_digest":"sha256:c782559ad5e98aeb8d7bc046f18dde2a3e4bb881a125fd22c51c99dfb44fb92e","observation_id":"6040b3e6-516a-4706-8a89-5f5cf44ab93a","resolution":{"observed_at":"2026-05-13T17:08:00.809212Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":"2307.08715","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-07-03T01:47:31.647956Z","title":"Jail- breaker: Automated jailbreak across multiple large language model chatbots","venue":null,"work_id":"aa1418bb-738e-4eb1-a94f-4bc672faaef3","year":2023},"citing_paper":{"arxiv_id":"2604.05498","last_updated":"2026-04-07T06:41:41Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T06:41:41Z","title":"JailWAM: Jailbreaking World Action Models in Robot Control","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T19:22:13.890495Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2604.05498"},"observation_digest":"sha256:d27edc588c3c8bbd74a99258508787922951e47eb05fd006226e5c3c0100e3a5","observation_id":"661e6200-45f7-414b-8900-1c9eef914f08","resolution":{"observed_at":"2026-05-10T23:05:48.118308Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":"2307.08715","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-07-03T01:47:31.647956Z","title":"Jail- breaker: Automated jailbreak across multiple large language model chatbots","venue":null,"work_id":"aa1418bb-738e-4eb1-a94f-4bc672faaef3","year":2023},"citing_paper":{"arxiv_id":"2604.08846","last_updated":"2026-04-10T01:01:56Z","snapshot_observed_at":"2026-08-02T14:54:38.934183Z","submitted_at":"2026-04-10T01:01:56Z","title":"Dictionary-Aligned Concept Control for Safeguarding Multimodal LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T18:04:05.157103Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2604.08846"},"observation_digest":"sha256:99fd0e933364126620a1388d05f0a8b6408675a0fa50d8f83aaf24496b6aad73","observation_id":"97b0de2a-1632-41c3-b64d-fe7cbbe3554c","resolution":{"observed_at":"2026-05-11T05:35:57.270894Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":"2307.08715","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-07-03T01:47:31.647956Z","title":"Jail- breaker: Automated jailbreak across multiple large language model chatbots","venue":null,"work_id":"aa1418bb-738e-4eb1-a94f-4bc672faaef3","year":2023},"citing_paper":{"arxiv_id":"2604.10326","last_updated":"2026-04-11T19:19:05Z","snapshot_observed_at":"2026-07-06T22:59:01.129724Z","submitted_at":"2026-04-11T19:19:05Z","title":"Jailbreaking the Matrix: Nullspace Steering for Controlled Model Subversion","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-10T15:19:46.920899Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2604.10326"},"observation_digest":"sha256:7aac4546908ec93ae273322c3b8e0f5e13eae605a57d1eac99f4fdc3e089ee64","observation_id":"ac8409fb-721a-4be8-a2d1-8cb4ad73d442","resolution":{"observed_at":"2026-05-11T10:46:04.231965Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":"2307.08715","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-07-03T01:47:31.647956Z","title":"Jail- breaker: Automated jailbreak across multiple large language model chatbots","venue":null,"work_id":"aa1418bb-738e-4eb1-a94f-4bc672faaef3","year":2023},"citing_paper":{"arxiv_id":"2604.12168","last_updated":"2026-04-14T00:54:24Z","snapshot_observed_at":"2026-07-06T23:00:22.690154Z","submitted_at":"2026-04-14T00:54:24Z","title":"Fully Homomorphic Encryption on Llama 3 model for privacy preserving LLM inference","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T16:30:13.049159Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2604.12168"},"observation_digest":"sha256:148913ff948b80e2550e50718a0cfa5d0bc402184dbdee10a5d145f794b889db","observation_id":"c2d1e8e1-e84d-4d89-8635-75834d9277cb","resolution":{"observed_at":"2026-05-11T08:45:59.802236Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":"2307.08715","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-07-03T01:47:31.647956Z","title":"Jail- breaker: Automated jailbreak across multiple large language model chatbots","venue":null,"work_id":"aa1418bb-738e-4eb1-a94f-4bc672faaef3","year":2023},"citing_paper":{"arxiv_id":"2604.15780","last_updated":"2026-04-17T07:37:41Z","snapshot_observed_at":"2026-07-06T23:03:16.345488Z","submitted_at":"2026-04-17T07:37:41Z","title":"Pruning Unsafe Tickets: A Resource-Efficient Framework for Safer and More Robust LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T09:10:55.001543Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2604.15780"},"observation_digest":"sha256:4412168f611740ea76c4bf4bf9580182c5ed5b979c7fd0ba659b376febf50adb","observation_id":"75ba162f-e48d-43e1-b0e0-ba920fa44074","resolution":{"observed_at":"2026-05-10T09:13:29.780129Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":"2307.08715","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-07-03T01:47:31.647956Z","title":"Jail- breaker: Automated jailbreak across multiple large language model chatbots","venue":null,"work_id":"aa1418bb-738e-4eb1-a94f-4bc672faaef3","year":2023},"citing_paper":{"arxiv_id":"2605.02187","last_updated":"2026-07-22T08:25:06Z","snapshot_observed_at":"2026-08-02T15:04:18.239470Z","submitted_at":"2026-05-04T03:35:17Z","title":"Rewriting the Response Path: Silent Tampering and Provider-Signed Defense in BYOK LLM Agents","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-08T18:42:06.418583Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2605.02187"},"observation_digest":"sha256:ef036e4cf1f33cd4319983d428aebaf453a3e88242e7404dbd9be0c07a5a2ad8","observation_id":"099872d2-fb7c-4e66-b714-db2a0499ef8d","resolution":{"observed_at":"2026-05-09T06:15:38.478818Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-08-02T15:04:25.405741Z","title":"Masterkey: Automated jailbreak across multiple large language model chatbots.arXiv preprint arXiv:2307.08715, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.02187","last_updated":"2026-07-22T08:25:06Z","snapshot_observed_at":"2026-08-02T15:04:18.239470Z","submitted_at":"2026-05-04T03:35:17Z","title":"Rewriting the Response Path: Silent Tampering and Provider-Signed Defense in BYOK LLM Agents","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-02T15:04:25.405741Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2605.02187"},"observation_digest":"sha256:906230cd92b952dd89874a56ccee5c1da65cd5f45d9ca93f6b42799011c26283","observation_id":"60e41919-bd9a-424e-bcb9-6ec7bb29f550","resolution":{"observed_at":"2026-08-02T15:04:25.405741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":"2307.08715","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-07-03T01:47:31.647956Z","title":"Jail- breaker: Automated jailbreak across multiple large language model chatbots","venue":null,"work_id":"aa1418bb-738e-4eb1-a94f-4bc672faaef3","year":2023},"citing_paper":{"arxiv_id":"2605.05868","last_updated":"2026-05-07T08:34:14Z","snapshot_observed_at":"2026-07-06T23:18:26.864785Z","submitted_at":"2026-05-07T08:34:14Z","title":"SkillScope: Toward Fine-Grained Least-Privilege Enforcement for Agent Skills","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T09:33:30.464441Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2605.05868"},"observation_digest":"sha256:e4bcd79ce6d0bee53c5a96f5cf1b778efea7c43d5513496e24dfc7159bb28671","observation_id":"4c08f071-ba22-42e7-b94b-5fcfd5d0583e","resolution":{"observed_at":"2026-05-11T20:21:08.978825Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":"2307.08715","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-07-03T01:47:31.647956Z","title":"Jail- breaker: Automated jailbreak across multiple large language model chatbots","venue":null,"work_id":"aa1418bb-738e-4eb1-a94f-4bc672faaef3","year":2023},"citing_paper":{"arxiv_id":"2605.21362","last_updated":"2026-05-20T16:27:00Z","snapshot_observed_at":"2026-07-06T23:31:51.443407Z","submitted_at":"2026-05-20T16:27:00Z","title":"LASH: Adaptive Semantic Hybridization for Black-Box Jailbreaking of Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-21T04:48:19.926845Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2605.21362"},"observation_digest":"sha256:7c3d1492c463937d0241fa06ed22a7407d54a9249bf11d869b344124751d7d45","observation_id":"7fe1d23b-d502-45ac-9ad1-4109756ef5b5","resolution":{"observed_at":"2026-05-21T04:49:35.502471Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":"2307.08715","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-07-03T01:47:31.647956Z","title":"Jail- breaker: Automated jailbreak across multiple large language model chatbots","venue":null,"work_id":"aa1418bb-738e-4eb1-a94f-4bc672faaef3","year":2023},"citing_paper":{"arxiv_id":"2606.05609","last_updated":"2026-06-04T02:31:29Z","snapshot_observed_at":"2026-08-05T14:48:48.513078Z","submitted_at":"2026-06-04T02:31:29Z","title":"SlotGCG: Exploiting the Positional Vulnerability in LLMs for Jailbreak Attacks","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-28T01:16:07.252429Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2606.05609"},"observation_digest":"sha256:e1b561b719ee56630df3d43e6b3f9a982dcc5eb74943b71c20cd37e8e28c7748","observation_id":"c7e8521d-eb01-4c74-8bd5-9c8de7699127","resolution":{"observed_at":"2026-07-02T13:26:59.297030Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":"2307.08715","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-07-03T01:47:31.647956Z","title":"Jail- breaker: Automated jailbreak across multiple large language model chatbots","venue":null,"work_id":"aa1418bb-738e-4eb1-a94f-4bc672faaef3","year":2023},"citing_paper":{"arxiv_id":"2606.09700","last_updated":"2026-06-19T20:34:30Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T16:21:34Z","title":"What the Eyes See, the LLMs Miss: Exploiting Human Perception for Adversarial Text Attacks","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T16:18:01.850874Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2606.09700"},"observation_digest":"sha256:303ddb98fd14e9f5451af4975b029e34677d858c726c1e9247f211fd2f4703da","observation_id":"abe709be-cc72-428c-a433-d3fe323b70ff","resolution":{"observed_at":"2026-07-03T01:47:31.649531Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-08-01T18:54:54.483085Z","title":"arXiv preprint arXiv:2307.08715 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17152","last_updated":"2026-07-19T09:18:35Z","snapshot_observed_at":"2026-08-09T14:18:14.468847Z","submitted_at":"2026-07-19T09:18:35Z","title":"How Jailbreak Attacks Inform Safety Alignment: A Defender-Centric, Shapley-Based Evaluation of Jailbreak Contributions","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-01T18:54:54.483085Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2607.17152"},"observation_digest":"sha256:dfc92fbbff0e8611918e2dd2932da6d8c23a769701caff31b4d28a2e949e5716","observation_id":"fe62a189-eca0-4386-96c1-2a54cc8a66c3","resolution":{"observed_at":"2026-08-01T18:54:54.483085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-08-04T01:16:10.099322Z","title":"Jailbreaker: Automated jailbreak across multiple large language model chatbots,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.099322Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:55c950e6dc9661987f94247806af723e44cf8bfda23e5439b94fedc6e7bd0294","observation_id":"d9fddcb5-449b-45cc-b026-56190ae5a93b","resolution":{"observed_at":"2026-08-04T01:16:10.099322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2307.08715/citation-record","integrity":"/paper/2307.08715/integrity","json":"/paper/2307.08715/citation-record.json","paper":"/paper/2307.08715"},"outbound":[],"paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","latest_version":2,"primary_category":"cs.CR","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 35 inbound Pith citation observations for arXiv:2307.08715."}