{"as_of":"2026-08-09T09:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:872c495350e53422a4f26a0638964c64bb782baaf32b2f3fd97510aa89e5c298","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":39,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T21:24:15.119613Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T17:09:59.501805Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":"2402.02309","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-07-04T17:09:59.501805Z","title":"Jailbreaking attack against multimodal large language model","venue":null,"work_id":"851954dd-f188-4ea4-ac2e-661a15b87ae8","year":2024},"citing_paper":{"arxiv_id":"2502.05206","last_updated":"2026-04-14T16:10:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-02T05:14:22Z","title":"Safety at Scale: A Comprehensive Survey of Large Model and Agent Safety","version":6},"reference_index":277,"source":"pdf_text","source_observed_at":"2026-05-23T04:39:04.591722Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2502.05206"},"observation_digest":"sha256:516d1645aac9399ffaa9990f89a80f0ada203973cd08f52844bed42fbd90b664","observation_id":"4c3fd471-8f18-490d-b5ad-d3595edb6745","resolution":{"observed_at":"2026-05-23T04:42:33.704305Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-08-07T19:45:19.455384Z","title":"Jailbreaking at- tack against multimodal large language model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.14881","last_updated":"2025-02-14T08:42:43Z","snapshot_observed_at":"2026-08-07T22:02:21.919237Z","submitted_at":"2025-02-14T08:42:43Z","title":"A Survey of Safety on Large Vision-Language Models: Attacks, Defenses and Evaluations","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-07T19:45:19.455384Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2502.14881"},"observation_digest":"sha256:97863cd7ed52a36275d7f52cde09c74a932507b4d1bee023467db7d1adb032f8","observation_id":"62953b4f-099a-40f2-aefb-1eb1689793bf","resolution":{"observed_at":"2026-08-07T19:45:19.455384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":"2402.02309","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-07-04T17:09:59.501805Z","title":"Jailbreaking attack against multimodal large language model","venue":null,"work_id":"851954dd-f188-4ea4-ac2e-661a15b87ae8","year":2024},"citing_paper":{"arxiv_id":"2503.06223","last_updated":"2026-08-06T06:47:13Z","snapshot_observed_at":"2026-08-09T08:09:21.090475Z","submitted_at":"2025-03-08T13:51:40Z","title":"RedDiffuser: Auditing Multimodal Safety Failures in Vision-Language Models via Reinforced Diffusion","version":5},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-23T00:13:08.603115Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2503.06223"},"observation_digest":"sha256:43b269f4e8cd8bafef4efd03b6dbd81e920ce9d5676aa03df56613e9a1dcb835","observation_id":"cd0e7da3-7bf1-4b07-b78c-50ae536fba44","resolution":{"observed_at":"2026-05-23T00:15:14.861591Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-08-07T15:03:41.212799Z","title":"Jailbreaking attack against multimodal large language model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:41.212799Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:c9f797cb68cb6fa7d023ff210952391301d4a508ea8028f74eff369de15873fe","observation_id":"0a807ade-441e-4832-bbba-1083940ab6a8","resolution":{"observed_at":"2026-08-07T15:03:41.212799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-08-07T14:13:18.788937Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:18.788937Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:379aa11e5b926c97583854d7699c516b2441b4d46afa01067a3e9303bb65e83d","observation_id":"e6ae206d-8a14-46ff-a90e-f034fbb448a4","resolution":{"observed_at":"2026-08-07T14:13:18.788937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-08-07T12:08:00.063288Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00548","last_updated":"2025-05-31T13:11:14Z","snapshot_observed_at":"2026-08-08T10:05:29.642578Z","submitted_at":"2025-05-31T13:11:14Z","title":"Con Instruction: Universal Jailbreaking of Multimodal Large Language Models via Non-Textual Modalities","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T12:08:00.063288Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2506.00548"},"observation_digest":"sha256:b2bb2165797bb8244a992ecffa8fa9c5d0cc4fe6208d4163a0b4da69750edca1","observation_id":"b63719bd-e60e-4d8c-8b9e-fc5079bdf55a","resolution":{"observed_at":"2026-08-07T12:08:00.063288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-08-07T11:51:31.629125Z","title":"Jailbreaking attack against multimodal large language model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01307","last_updated":"2025-06-02T04:33:56Z","snapshot_observed_at":"2026-08-07T11:42:31.717394Z","submitted_at":"2025-06-02T04:33:56Z","title":"Align is not Enough: Multimodal Universal Jailbreak Attack against Multimodal Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:51:31.629125Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2506.01307"},"observation_digest":"sha256:3ec623c5c1b514706f02962b55dc8c387f313210a221474815fc3654d121e135","observation_id":"63fcc7da-0de8-450c-9094-c3e55489aac6","resolution":{"observed_at":"2026-08-07T11:51:31.629125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-08-06T23:42:41.206394Z","title":"arXiv preprint arXiv:2402.02309 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:41.206394Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:63239065403b1774160fd482a33c3609b8b0e67d5d523540a02262cf736c157e","observation_id":"b4af6ff0-a14e-441c-983f-55d47c155843","resolution":{"observed_at":"2026-08-06T23:42:41.206394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-08-06T17:09:23.717332Z","title":"Jailbreaking attack against multimodal large lan- guage model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11968","last_updated":"2025-07-16T07:02:15Z","snapshot_observed_at":"2026-08-07T07:48:36.747502Z","submitted_at":"2025-07-16T07:02:15Z","title":"Watch, Listen, Understand, Mislead: Tri-modal Adversarial Attacks on Short Videos for Content Appropriateness Evaluation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T17:09:23.717332Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2507.11968"},"observation_digest":"sha256:dab72422840150a841527b0d7f095219e5c168c55c786df0206d1a8a3a47d2de","observation_id":"531a2f32-3929-4b2e-9217-77d748f5e1b7","resolution":{"observed_at":"2026-08-06T17:09:23.717332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-08-06T12:40:05.428251Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21637","last_updated":"2025-07-29T09:48:57Z","snapshot_observed_at":"2026-08-07T14:28:15.638129Z","submitted_at":"2025-07-29T09:48:57Z","title":"Self-Aware Safety Augmentation: Leveraging Internal Semantic Understanding to Enhance Safety in Vision-Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T12:40:05.428251Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2507.21637"},"observation_digest":"sha256:7626d86a5102aa63cf491b71da305ccdfeca7646d46fcfb198e834327c432781","observation_id":"4c76b68e-ddb7-4c99-8ef0-83cc44840e74","resolution":{"observed_at":"2026-08-06T12:40:05.428251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-08-06T00:59:42.292989Z","title":"Jailbreaking attack against multimodal large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.03986","last_updated":"2025-08-06T00:39:28Z","snapshot_observed_at":"2026-08-07T09:03:43.592840Z","submitted_at":"2025-08-06T00:39:28Z","title":"The Emotional Baby Is Truly Deadly: Does your Multimodal Large Reasoning Model Have Emotional Flattery towards Humans?","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T00:59:42.292989Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2508.03986"},"observation_digest":"sha256:aad73683f84404230a1166281359164c1b4f3837f205e4e5d10485ab56a85c90","observation_id":"d08f107e-70c0-4818-aedb-846a2a165859","resolution":{"observed_at":"2026-08-06T00:59:42.292989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-08-05T22:21:02.815552Z","title":"Jailbreaking attack against multimodal large language model.arXiv preprint arXiv:2402.02309,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09206","last_updated":"2025-08-10T00:55:54Z","snapshot_observed_at":"2026-08-09T01:17:03.252350Z","submitted_at":"2025-08-10T00:55:54Z","title":"The First Differentiable Transfer-Based Algorithm for Discrete MicroLED Repair","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:02.815552Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2508.09206"},"observation_digest":"sha256:df4a17de02b38fccc5b081376c4ae962af2dc2fc474b633c040b169aa1bfb776","observation_id":"dff3da5a-ba49-46ce-813a-0738cd567db5","resolution":{"observed_at":"2026-08-05T22:21:02.815552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-08-05T20:29:06.045697Z","title":"Niu et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10955","last_updated":"2025-08-14T07:25:45Z","snapshot_observed_at":"2026-08-07T18:23:08.889281Z","submitted_at":"2025-08-14T07:25:45Z","title":"Empowering Multimodal LLMs with External Tools: A Comprehensive Survey","version":1},"reference_index":227,"source":"arxiv_source","source_observed_at":"2026-08-05T20:29:06.045697Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2508.10955"},"observation_digest":"sha256:4766930077d0d08fc790306ac2fdf452bf4cd89633282be4dd64767a7b0709bc","observation_id":"e350606f-d206-4aa4-8070-41f75bc26b45","resolution":{"observed_at":"2026-08-05T20:29:06.045697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-08-05T16:00:48.773024Z","title":"Jailbreaking attack against multimodal large language model, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19445","last_updated":"2026-06-16T17:34:06Z","snapshot_observed_at":"2026-08-08T05:25:02.825611Z","submitted_at":"2025-08-26T21:36:45Z","title":"On Surjectivity of Neural Networks: Can you elicit any behavior from your model?","version":3},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-05T16:00:48.773024Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2508.19445"},"observation_digest":"sha256:32d0a05934dd41e2cb8c97117abe2dc61d977b01c64dd8f35f025a5ce8eecc3f","observation_id":"ac603fb1-6a9c-4430-9457-d22bfc524c9f","resolution":{"observed_at":"2026-08-05T16:00:48.773024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-08-04T09:02:38.962519Z","title":"Jailbreaking attack against multimodal large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.17759","last_updated":"2026-05-26T07:09:27Z","snapshot_observed_at":"2026-08-08T08:27:20.629192Z","submitted_at":"2025-10-20T17:12:10Z","title":"VERA-V: Variational Inference Framework for Jailbreaking Vision-Language Models","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T09:02:38.962519Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2510.17759"},"observation_digest":"sha256:79bc4f26e4616f496fe60da9a12a04c078491dc5aefba03f288fe4dd56c60502","observation_id":"497efb19-bc19-44ac-8cc9-4ceb95cea2f9","resolution":{"observed_at":"2026-08-04T09:02:38.962519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-08-03T04:45:52.726856Z","title":"Describe this image","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.04356","last_updated":"2026-07-05T15:49:42Z","snapshot_observed_at":"2026-08-07T07:47:54.192085Z","submitted_at":"2026-02-04T09:29:10Z","title":"Stage-wise Attention-Guided Region Sequencing for Adversarial Attacks on Large Vision-Language Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T04:45:52.726856Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2602.04356"},"observation_digest":"sha256:f01bebcf935241ee72fcc7477b2bcc2f2636c5cc389563263c5c638457d2f4ee","observation_id":"f6346b06-94eb-4ff7-a9da-705136153986","resolution":{"observed_at":"2026-08-03T04:45:52.726856Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":"2402.02309","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-07-04T17:09:59.501805Z","title":"Jailbreaking attack against multimodal large language model","venue":null,"work_id":"851954dd-f188-4ea4-ac2e-661a15b87ae8","year":2024},"citing_paper":{"arxiv_id":"2604.12232","last_updated":"2026-04-14T03:12:19Z","snapshot_observed_at":"2026-07-06T23:00:28.036409Z","submitted_at":"2026-04-14T03:12:19Z","title":"TEMPLATEFUZZ: Fine-Grained Chat Template Fuzzing for Jailbreaking and Red Teaming LLMs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-10T16:02:52.006859Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2604.12232"},"observation_digest":"sha256:f5cf0d47a7e7e07ce671dab02fd20a679c4b3dfc68234f460b5d122d7e2b0c6a","observation_id":"ac6d8b35-da04-48be-aaad-51c5d7806a10","resolution":{"observed_at":"2026-05-11T09:26:00.003112Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":"2402.02309","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-07-04T17:09:59.501805Z","title":"Jailbreaking attack against multimodal large language model","venue":null,"work_id":"851954dd-f188-4ea4-ac2e-661a15b87ae8","year":2024},"citing_paper":{"arxiv_id":"2604.12616","last_updated":"2026-04-14T11:44:59Z","snapshot_observed_at":"2026-07-06T23:00:46.620106Z","submitted_at":"2026-04-14T11:44:59Z","title":"Every Picture Tells a Dangerous Story: Memory-Augmented Multi-Agent Jailbreak Attacks on VLMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-10T15:06:43.140580Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2604.12616"},"observation_digest":"sha256:e853fdbbc89da5c8139899c33b134e6d9b5517dbab55b28971373c60d954b6b4","observation_id":"f6727b7a-bc53-41e2-ac0f-10da53980a4e","resolution":{"observed_at":"2026-05-11T11:11:05.554349Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":"2402.02309","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-07-04T17:09:59.501805Z","title":"Jailbreaking attack against multimodal large language model","venue":null,"work_id":"851954dd-f188-4ea4-ac2e-661a15b87ae8","year":2024},"citing_paper":{"arxiv_id":"2604.27818","last_updated":"2026-04-30T12:58:57Z","snapshot_observed_at":"2026-08-02T17:42:15.364009Z","submitted_at":"2026-04-30T12:58:57Z","title":"MASCing: Configurable Mixture-of-Experts Behavior via Activation Steering Masks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-07T05:31:47.682478Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2604.27818"},"observation_digest":"sha256:bb3062d6cea5eb12fff4f7e215881b2fea724317be16f109bcd8f4795e3eb1e4","observation_id":"d7d25542-88db-4d12-8f81-346360803851","resolution":{"observed_at":"2026-05-12T10:36:30.183612Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":"2402.02309","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-07-04T17:09:59.501805Z","title":"Jailbreaking attack against multimodal large language model","venue":null,"work_id":"851954dd-f188-4ea4-ac2e-661a15b87ae8","year":2024},"citing_paper":{"arxiv_id":"2605.02946","last_updated":"2026-05-01T11:54:55Z","snapshot_observed_at":"2026-07-31T02:35:59.178763Z","submitted_at":"2026-05-01T11:54:55Z","title":"RouteHijack: Routing-Aware Attack on Mixture-of-Experts LLMs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-09T19:22:00.217729Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2605.02946"},"observation_digest":"sha256:15379fa22bccb2b155b8fa29eb1332691eaab694c40b934544bc716df3930b7b","observation_id":"0f892499-f84a-417f-9916-9a149f5de710","resolution":{"observed_at":"2026-05-11T15:46:15.875346Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":"2402.02309","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-07-04T17:09:59.501805Z","title":"Jailbreaking attack against multimodal large language model","venue":null,"work_id":"851954dd-f188-4ea4-ac2e-661a15b87ae8","year":2024},"citing_paper":{"arxiv_id":"2605.05058","last_updated":"2026-05-06T15:53:17Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T15:53:17Z","title":"SoK: Robustness in Large Language Models against Jailbreak Attacks","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-08T16:42:41.137808Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2605.05058"},"observation_digest":"sha256:37ff2f3526b32d5f47d6fedf53ee20f542466b85abb1525145e49513160e8349","observation_id":"93c6dddc-2fe2-49ec-b90c-55d13ea13525","resolution":{"observed_at":"2026-05-11T18:01:08.773065Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":"2402.02309","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-07-04T17:09:59.501805Z","title":"Jailbreaking attack against multimodal large language model","venue":null,"work_id":"851954dd-f188-4ea4-ac2e-661a15b87ae8","year":2024},"citing_paper":{"arxiv_id":"2605.11716","last_updated":"2026-05-12T08:05:10Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T08:05:10Z","title":"SafeSteer: A Decoding-level Defense Mechanism for Multimodal Large Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-13T06:56:10.053418Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2605.11716"},"observation_digest":"sha256:5924b1e4ba6ba9a26dcea33b6dbbeeb2c6a47acc43deacc2458827a9f17bca80","observation_id":"10ca3428-cee9-42ab-adca-1555595ed1b9","resolution":{"observed_at":"2026-05-13T06:57:27.526468Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":"2402.02309","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-07-04T17:09:59.501805Z","title":"Jailbreaking attack against multimodal large language model","venue":null,"work_id":"851954dd-f188-4ea4-ac2e-661a15b87ae8","year":2024},"citing_paper":{"arxiv_id":"2605.17248","last_updated":"2026-05-17T04:10:55Z","snapshot_observed_at":"2026-08-02T22:41:54.302633Z","submitted_at":"2026-05-17T04:10:55Z","title":"Image-to-Video Diffusion: From Foundations to Open Frontiers","version":1},"reference_index":190,"source":"pdf_text","source_observed_at":"2026-05-20T15:06:02.084336Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2605.17248"},"observation_digest":"sha256:9caaae05630eb55b8d1d5a17664ebf498c78ae4adf73c696ca7dce4eb8c557ab","observation_id":"cb710650-c582-4b31-a734-afd6cf108384","resolution":{"observed_at":"2026-05-20T15:08:25.023734Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":"2402.02309","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-07-04T17:09:59.501805Z","title":"Jailbreaking attack against multimodal large language model","venue":null,"work_id":"851954dd-f188-4ea4-ac2e-661a15b87ae8","year":2024},"citing_paper":{"arxiv_id":"2605.17310","last_updated":"2026-05-17T08:02:27Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T08:02:27Z","title":"Attention Hijacking: Response Manipulation Across Queries in Vision-Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-20T14:25:10.603780Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2605.17310"},"observation_digest":"sha256:71201593bb84c8e6779576adddabc1f541a96b05cce63a1409fd78dd4451cee2","observation_id":"0202761f-d495-4e23-93ee-fcc1c7b93444","resolution":{"observed_at":"2026-05-20T14:28:21.573062Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":"2402.02309","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-07-04T17:09:59.501805Z","title":"Jailbreaking attack against multimodal large language model","venue":null,"work_id":"851954dd-f188-4ea4-ac2e-661a15b87ae8","year":2024},"citing_paper":{"arxiv_id":"2605.23157","last_updated":"2026-05-22T02:12:45Z","snapshot_observed_at":"2026-07-06T23:33:24.215365Z","submitted_at":"2026-05-22T02:12:45Z","title":"Same Model, Different Weakness: How Language and Modality Reshape the Jailbreak Attack Surface in Frontier MLLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-25T05:03:57.453043Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2605.23157"},"observation_digest":"sha256:8b72106ee8679ea071ad195762b7401175380c520e575865ba4372b555aec654","observation_id":"4be9aff0-2103-434d-bf62-54f790753010","resolution":{"observed_at":"2026-05-25T05:05:22.769377Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":"2402.02309","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-07-04T17:09:59.501805Z","title":"Jailbreaking attack against multimodal large language model","venue":null,"work_id":"851954dd-f188-4ea4-ac2e-661a15b87ae8","year":2024},"citing_paper":{"arxiv_id":"2606.03713","last_updated":"2026-06-02T14:34:48Z","snapshot_observed_at":"2026-08-01T18:41:34.888563Z","submitted_at":"2026-06-02T14:34:48Z","title":"Investigating Adversarial Robustness of Multi-modal Large Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-28T11:11:34.152223Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2606.03713"},"observation_digest":"sha256:1ea3ca568885cc10aa44a7dea808b47c9c8ce2a3a0baa3252e502837157ad3d8","observation_id":"0e4f2f4f-9722-4f0a-8554-87ae01a70ee6","resolution":{"observed_at":"2026-07-02T02:06:27.647825Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":"2402.02309","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-07-04T17:09:59.501805Z","title":"Jailbreaking attack against multimodal large language model","venue":null,"work_id":"851954dd-f188-4ea4-ac2e-661a15b87ae8","year":2024},"citing_paper":{"arxiv_id":"2606.09125","last_updated":"2026-06-08T07:19:42Z","snapshot_observed_at":"2026-07-06T23:48:30.569726Z","submitted_at":"2026-06-08T07:19:42Z","title":"Unveiling Privacy Risks in Multi-modal Large Language Models: Task-specific Vulnerabilities and Mitigation Challenges","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-06-27T16:33:28.848573Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2606.09125"},"observation_digest":"sha256:aae9162571599bd1a8ad5cf915b663681972a014f45d65645a3e9243ef12ba62","observation_id":"fa02dd5a-df9e-434d-94e1-c02c950ab1fc","resolution":{"observed_at":"2026-07-03T01:27:30.916833Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":"2402.02309","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-07-04T17:09:59.501805Z","title":"Jailbreaking attack against multimodal large language model","venue":null,"work_id":"851954dd-f188-4ea4-ac2e-661a15b87ae8","year":2024},"citing_paper":{"arxiv_id":"2606.10904","last_updated":"2026-07-16T08:23:49Z","snapshot_observed_at":"2026-08-05T14:18:44.309610Z","submitted_at":"2026-06-09T14:13:54Z","title":"Auditing Inference-Time Defense Evaluation for Multimodal Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-27T12:44:15.097414Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2606.10904"},"observation_digest":"sha256:eac0ad5eb8e417b59399e4d9067f0690c2baf1cc4cec92239d800c76798f6345","observation_id":"bc2ce0d4-adb9-44ae-814e-ee807b1aa111","resolution":{"observed_at":"2026-07-03T06:17:42.474785Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-07-15T10:53:29.444919Z","title":"arXiv preprint arXiv:2402.02309 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.10904","last_updated":"2026-07-16T08:23:49Z","snapshot_observed_at":"2026-08-05T14:18:44.309610Z","submitted_at":"2026-06-09T14:13:54Z","title":"Auditing Inference-Time Defense Evaluation for Multimodal Large Language Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-15T10:53:29.444919Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2606.10904"},"observation_digest":"sha256:33232152380b8b76de9571d4596e6187fbf7a8d82e7b014823c63d0e258f70ce","observation_id":"7bac70bb-0cea-41c8-b159-712ed0fa5e0a","resolution":{"observed_at":"2026-07-15T10:53:29.444919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-08-02T11:57:00.845929Z","title":"arXiv preprint arXiv:2402.02309 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.10904","last_updated":"2026-07-16T08:23:49Z","snapshot_observed_at":"2026-08-05T14:18:44.309610Z","submitted_at":"2026-06-09T14:13:54Z","title":"Auditing Inference-Time Defense Evaluation for Multimodal Large Language Models","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T11:57:00.845929Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2606.10904"},"observation_digest":"sha256:daf7c71e5213e25f4e06eb0f5fc7f4127d333d6fdecc0a0e701137032ebeac22","observation_id":"cde27886-07b5-4c14-9760-02973eddba71","resolution":{"observed_at":"2026-08-02T11:57:00.845929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":"2402.02309","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-07-04T17:09:59.501805Z","title":"Jailbreaking attack against multimodal large language model","venue":null,"work_id":"851954dd-f188-4ea4-ac2e-661a15b87ae8","year":2024},"citing_paper":{"arxiv_id":"2606.24388","last_updated":"2026-06-23T10:20:40Z","snapshot_observed_at":"2026-07-06T23:58:58.854077Z","submitted_at":"2026-06-23T10:20:40Z","title":"PHANTOM: A Large-Scale Dataset of Multimodal Adversarial Attacks for Vision-Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-25T23:52:02.327522Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2606.24388"},"observation_digest":"sha256:f41b231575d06abc63730fb05ae0460333291e9d9881501a7712841298bb8120","observation_id":"1aac3086-7f1a-4713-86c4-e1ba70a9d904","resolution":{"observed_at":"2026-07-04T17:09:59.503542Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-07-12T06:18:42.939955Z","title":"arXiv preprint arXiv:2402.02309 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.02897","last_updated":"2026-07-03T02:48:26Z","snapshot_observed_at":"2026-08-08T10:43:33.140478Z","submitted_at":"2026-07-03T02:48:26Z","title":"PPE-Bench: A Benchmark for Evaluating MLLM Unlearning under Private-Public Entanglement","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-07-12T06:18:42.939955Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2607.02897"},"observation_digest":"sha256:42691b8cad6b68a8e6b05cac7a9e7a4811574710603880ff3a5c21eabc8af646","observation_id":"bb39aa8e-1b45-4e47-b26c-e4ba0d287974","resolution":{"observed_at":"2026-07-12T06:18:42.939955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-07-14T17:33:49.041193Z","title":"arXiv preprint arXiv:2402.02309 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09697","last_updated":"2026-06-20T12:09:13Z","snapshot_observed_at":"2026-08-08T10:05:10.130285Z","submitted_at":"2026-06-20T12:09:13Z","title":"Safe responses matter: Output-aware safety guardrail mitigate over-refusal in MLLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-14T17:33:49.041193Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2607.09697"},"observation_digest":"sha256:ad7488d766d746c4b71335f64b284bec4c15356ceb6a167d2142d97369f9c244","observation_id":"6f760412-24ec-4612-9dda-842489c2f236","resolution":{"observed_at":"2026-07-14T17:33:49.041193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-07-14T06:09:46.933171Z","title":"Jailbreaking attack against multimodal large language model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11228","last_updated":"2026-07-13T08:19:09Z","snapshot_observed_at":"2026-08-07T07:46:53.646267Z","submitted_at":"2026-07-13T08:19:09Z","title":"DeepBias: Adaptive In-depth Probing of Social Biases in LVLMs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-14T06:09:46.933171Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2607.11228"},"observation_digest":"sha256:6ce63b179e364d00c725a55620fc2eb6507b95ba18c6a10305b6ee2b5f461171","observation_id":"28df8a8c-e9c4-47d3-a7fe-de824eca5015","resolution":{"observed_at":"2026-07-14T06:09:46.933171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-08-02T07:51:48.610737Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16280","last_updated":"2026-07-09T17:55:54Z","snapshot_observed_at":"2026-08-08T14:09:09.503382Z","submitted_at":"2026-07-09T17:55:54Z","title":"3D FaceShell: Attribute Transfer in 3D Face Avatars as a VLM Defense Mechanism","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T07:51:48.610737Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2607.16280"},"observation_digest":"sha256:39945d78bef7458f2c5d1145f63c7c64c76bdd0e7741648ebaf9952a2254879c","observation_id":"ff277b5d-ee1b-4d25-b036-52896e707d62","resolution":{"observed_at":"2026-08-02T07:51:48.610737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-08-02T15:03:00.340843Z","title":"Oh, S., Jin, Y ., Sharma, M., Kim, D., Ma, E., Verma, G., and Kumar, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21600","last_updated":"2026-05-03T19:21:06Z","snapshot_observed_at":"2026-08-06T09:31:16.482834Z","submitted_at":"2026-05-03T19:21:06Z","title":"Securing Multimodal AI through Internal Information Decomposition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T15:03:00.340843Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2607.21600"},"observation_digest":"sha256:b1dad076791fc5c5189871590518c6bdeb5e62b55153eac35ce69ff27eecb1c0","observation_id":"ffa5c034-8062-4550-bd25-f6d4e4260c05","resolution":{"observed_at":"2026-08-02T15:03:00.340843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-08-01T13:10:37.513530Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22716","last_updated":"2026-07-21T15:52:30Z","snapshot_observed_at":"2026-08-06T12:10:57.542923Z","submitted_at":"2026-07-21T15:52:30Z","title":"Visual Token Compression Enhances Robustness of MLLMs","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-01T13:10:37.513530Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2607.22716"},"observation_digest":"sha256:a49d68a22654c241341e0c2ec01c53379d1d5772ef073a3539a4a47de53c9c6a","observation_id":"e3028523-0261-4c98-8bd1-09b06d24c495","resolution":{"observed_at":"2026-08-01T13:10:37.513530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-08-07T00:14:48.786733Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04034","last_updated":"2026-08-03T02:28:52Z","snapshot_observed_at":"2026-08-09T03:07:12.142624Z","submitted_at":"2026-08-03T02:28:52Z","title":"A Multimodal Automatic Redteaming Evaluation based on Atomic Jailbreak Strategy Decoupling and Combination","version":1},"reference_index":136,"source":"arxiv_source","source_observed_at":"2026-08-07T00:14:48.786733Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2608.04034"},"observation_digest":"sha256:4e98ad9882ad94c8fe1f421cf677a941f9c7d631fb9b461095fb39c83abcd570","observation_id":"4969d073-5cd9-4173-bb04-83b8a3060986","resolution":{"observed_at":"2026-08-07T00:14:48.786733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-08-07T21:24:15.119613Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05909","last_updated":"2026-08-06T11:39:08Z","snapshot_observed_at":"2026-08-09T08:12:56.291136Z","submitted_at":"2026-08-06T11:39:08Z","title":"MMAligner: Safeguarding Multimodal Large Language Models through Representation Calibration","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T21:24:15.119613Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2608.05909"},"observation_digest":"sha256:577f079eed0d591f71bfe51a6e9dad93d9f4d1e7c99f8486effe60e6a619c4ba","observation_id":"f3729127-b5f5-46be-b210-979ee62939a9","resolution":{"observed_at":"2026-08-07T21:24:15.119613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2402.02309/citation-record","integrity":"/paper/2402.02309/integrity","json":"/paper/2402.02309/citation-record.json","paper":"/paper/2402.02309"},"outbound":[],"paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 39 inbound Pith citation observations for arXiv:2402.02309."}