{"as_of":"2026-08-12T13:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:49b24fd258384ba9cf6d7e3cfc8fed31bf4d2d27b05dc342ea89d9841446f8d9","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":30,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T10:32:28.295755Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-11T10:32:28.295755Z","title":"Visual-roleplay: Uni- versal jailbreak attack on multimodal large language models via role-playing image characte.arXiv preprint arXiv:2405.20773, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16555","last_updated":"2025-05-29T14:05:50Z","snapshot_observed_at":"2026-08-11T10:26:44.510354Z","submitted_at":"2024-12-21T09:43:51Z","title":"Divide and Conquer: A Hybrid Strategy Defeats Multimodal Large Language Models","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:28.295755Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2412.16555"},"observation_digest":"sha256:a66a5049d8e39c42b5c572b449cc3c47939c95df299f42b5e47af18fabce7d8f","observation_id":"e3b24ad5-4c12-46d1-ba32-413f9cc03941","resolution":{"observed_at":"2026-08-11T10:32:28.295755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-10T14:29:28.074482Z","title":"Visual- roleplay: Universal jailbreak attack on multimodal large language models via role-playing image char- acte","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15269","last_updated":"2025-01-25T16:36:00Z","snapshot_observed_at":"2026-08-11T16:16:46.058658Z","submitted_at":"2025-01-25T16:36:00Z","title":"Mirage in the Eyes: Hallucination Attack on Multi-modal Large Language Models with Only Attention Sink","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-10T14:29:28.074482Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2501.15269"},"observation_digest":"sha256:20f6e6d44c06202f6dabbcad9711dd1d7f98e3f75c78195bf950fc53e7bbe9cf","observation_id":"d06010ab-dcd7-464f-9472-a6daabaff6c6","resolution":{"observed_at":"2026-08-10T14:29:28.074482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":"2405.20773","doi":"10.48550/arxiv.2405.20773","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Visual- roleplay: Universal jailbreak attack on multimodal large language mod- els via role-playing image character","venue":"arXiv (Cornell University)","work_id":"cfff0289-3100-466e-9e4e-d6998de6b0b4","year":2022},"citing_paper":{"arxiv_id":"2502.05206","last_updated":"2026-04-14T16:10:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-02T05:14:22Z","title":"Safety at Scale: A Comprehensive Survey of Large Model and Agent Safety","version":6},"reference_index":283,"source":"pdf_text","source_observed_at":"2026-05-23T04:39:04.591722Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2502.05206"},"observation_digest":"sha256:bd6620150a41c8f6f19003623114cf0e735e79da61c23733714ba92aa3e6777b","observation_id":"11d35ee0-45f9-4f58-9bdd-aea793577148","resolution":{"observed_at":"2026-05-23T04:42:34.086175Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-08T15:38:17.089320Z","title":"Visual-roleplay: Universal jailbreak attack on multimodal large language models via role-playing image character,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06390","last_updated":"2025-02-11T04:42:24Z","snapshot_observed_at":"2026-08-09T09:14:59.400822Z","submitted_at":"2025-02-10T12:20:08Z","title":"When Data Manipulation Meets Attack Goals: An In-depth Survey of Attacks for VLMs","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T15:38:17.089320Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2502.06390"},"observation_digest":"sha256:0de52d7ecd966cae40c14541d84ca0df80d36c88f583fc1d43dec8fd2dd63638","observation_id":"631adf9a-90c7-43e1-ae22-9610b9e7c1ea","resolution":{"observed_at":"2026-08-08T15:38:17.089320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-08T11:17:01.654636Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07987","last_updated":"2025-06-04T18:10:51Z","snapshot_observed_at":"2026-08-09T07:48:53.248560Z","submitted_at":"2025-02-11T22:07:47Z","title":"Universal Adversarial Attack on Aligned Multimodal LLMs","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-08T11:17:01.654636Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2502.07987"},"observation_digest":"sha256:cbea8936455ecc03a39a8c9fef41601a8b531fef160544200d4fa8b83b79d2e3","observation_id":"f7fb9fc0-da95-4b8a-b745-96f5d8022a25","resolution":{"observed_at":"2026-08-08T11:17:01.654636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-07T19:45:19.478474Z","title":"Visual-roleplay: Universal jailbreak attack on multimodal large language models via role-playing image characte,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.14881","last_updated":"2025-02-14T08:42:43Z","snapshot_observed_at":"2026-08-07T22:02:21.919237Z","submitted_at":"2025-02-14T08:42:43Z","title":"A Survey of Safety on Large Vision-Language Models: Attacks, Defenses and Evaluations","version":1},"reference_index":105,"source":"pdf_text","source_observed_at":"2026-08-07T19:45:19.478474Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2502.14881"},"observation_digest":"sha256:a8a49faaae4ecfcc77fc71c8b0bfd00b162923a9300f14e66cfab952574b4bb8","observation_id":"2983a16f-e1b5-4204-a268-c3055cc3eced","resolution":{"observed_at":"2026-08-07T19:45:19.478474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":"2405.20773","doi":"10.48550/arxiv.2405.20773","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Visual- roleplay: Universal jailbreak attack on multimodal large language mod- els via role-playing image character","venue":"arXiv (Cornell University)","work_id":"cfff0289-3100-466e-9e4e-d6998de6b0b4","year":2022},"citing_paper":{"arxiv_id":"2503.06223","last_updated":"2026-08-06T06:47:13Z","snapshot_observed_at":"2026-08-09T23:09:10.814238Z","submitted_at":"2025-03-08T13:51:40Z","title":"RedDiffuser: Auditing Multimodal Safety Failures in Vision-Language Models via Reinforced Diffusion","version":5},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-23T00:13:08.603115Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2503.06223"},"observation_digest":"sha256:46831e0003acba574c4bbc91d147243a3ff8cf4f0e9aae0cd29e9fd1fb55208b","observation_id":"8e654e81-4eeb-4fc4-9474-7c49d04a16fd","resolution":{"observed_at":"2026-05-23T00:15:14.824301Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-07T14:56:53.654176Z","title":"Visual- roleplay: Universal jailbreak attack on multimodal large language models via role-playing image characte.arXiv preprint arXiv:2405.20773, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16916","last_updated":"2025-05-22T17:11:58Z","snapshot_observed_at":"2026-08-09T17:32:27.997542Z","submitted_at":"2025-05-22T17:11:58Z","title":"Backdoor Cleaning without External Guidance in MLLM Fine-tuning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:53.654176Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2505.16916"},"observation_digest":"sha256:0062d38f2f1356aec35bf1a933f5be50f15f6b9636b8a8f2ccb19ea8b1233ee4","observation_id":"db1cdf8a-433a-4028-a163-02d76706a3b6","resolution":{"observed_at":"2026-08-07T14:56:53.654176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-07T14:52:15.961141Z","title":"Visual-roleplay: Universal jailbreak attack on multimodal large language models via role-playing image characte","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18212","last_updated":"2025-05-22T22:06:09Z","snapshot_observed_at":"2026-08-11T03:24:38.012752Z","submitted_at":"2025-05-22T22:06:09Z","title":"Towards medical AI misalignment: a preliminary study","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:52:15.961141Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2505.18212"},"observation_digest":"sha256:1d38bd7ab9db7259a8c983b60d25756a916d6e324ee79d7a4057888191c409cb","observation_id":"8e8cf2df-b10e-489a-ac96-bc15025f4f03","resolution":{"observed_at":"2026-08-07T14:52:15.961141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-07T13:22:01.801888Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21967","last_updated":"2025-05-28T04:43:39Z","snapshot_observed_at":"2026-08-08T01:18:33.252536Z","submitted_at":"2025-05-28T04:43:39Z","title":"Seeing the Threat: Vulnerabilities in Vision-Language Models to Adversarial Attack","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:01.801888Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2505.21967"},"observation_digest":"sha256:db92315e32710bfe8ca76be8329f6527df0545976684405b81715e4476cbc148","observation_id":"175db9d6-728f-4140-a7eb-cb7830d3e6b1","resolution":{"observed_at":"2026-08-07T13:22:01.801888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-07T00:57:13.747840Z","title":"4711–4728, Philadelphia, PA, August 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12430","last_updated":"2025-07-11T02:01:54Z","snapshot_observed_at":"2026-08-09T20:22:46.693664Z","submitted_at":"2025-06-14T10:03:17Z","title":"Pushing the Limits of Safety: A Technical Report on the ATLAS Challenge 2025","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:13.747840Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2506.12430"},"observation_digest":"sha256:21fbd0557dd3f941d1963d6af111108a86e7815b198aa25a4449fdc29538d398","observation_id":"c2d64ec6-2de9-4e5a-b235-bc0f4f94626a","resolution":{"observed_at":"2026-08-07T00:57:13.747840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-05T23:13:05.101293Z","title":"arXiv preprint arXiv:2405.20773 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05775","last_updated":"2026-07-27T20:50:40Z","snapshot_observed_at":"2026-08-10T01:02:48.484224Z","submitted_at":"2025-08-07T18:42:16Z","title":"Guardians and Offenders: A Survey on Harmful Content Generation and Safety Mitigation of LLM","version":3},"reference_index":184,"source":"arxiv_source","source_observed_at":"2026-08-05T23:13:05.101293Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2508.05775"},"observation_digest":"sha256:6185cb5cb4071f0cf8f9b79cd6c4da8196b345467c316074fa77adb34b0746c5","observation_id":"b9874aa5-95cf-4190-b522-76878372fe42","resolution":{"observed_at":"2026-08-05T23:13:05.101293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-05T22:21:02.811865Z","title":"Visual-roleplay: Universal jailbreak attack on multimodal large language models via role-playing image character.arXiv preprint arXiv:2405.20773,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09206","last_updated":"2025-08-10T00:55:54Z","snapshot_observed_at":"2026-08-10T10:40:44.843068Z","submitted_at":"2025-08-10T00:55:54Z","title":"The First Differentiable Transfer-Based Algorithm for Discrete MicroLED Repair","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:02.811865Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2508.09206"},"observation_digest":"sha256:e00dea0807fdb74a1f2a4e0e2f551d4baf32b750e6e392f142ae5a2c92959f47","observation_id":"7427c66f-c0ee-49c1-b825-77a9ac21efee","resolution":{"observed_at":"2026-08-05T22:21:02.811865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-05T21:22:37.649627Z","title":"Visual-roleplay: Universal jailbreak attack on multimodal large language models via role-playing image characte.arXiv preprint arXiv:2405.20773,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.09237","last_updated":"2025-08-12T12:11:43Z","snapshot_observed_at":"2026-08-08T17:20:22.464472Z","submitted_at":"2025-08-12T12:11:43Z","title":"Blockchain Network Analysis using Quantum Inspired Graph Neural Networks & Ensemble Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T21:22:37.649627Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2508.09237"},"observation_digest":"sha256:4a2027f450e5dfe970acff90da22d49fceb461d09e5e14092f5c052176fb7bcb","observation_id":"f0fab43f-50a9-42b8-9577-5e536a723db5","resolution":{"observed_at":"2026-08-05T21:22:37.649627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-05T20:29:06.482070Z","title":"Ma et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10955","last_updated":"2025-08-14T07:25:45Z","snapshot_observed_at":"2026-08-09T12:54:37.629481Z","submitted_at":"2025-08-14T07:25:45Z","title":"Empowering Multimodal LLMs with External Tools: A Comprehensive Survey","version":1},"reference_index":231,"source":"arxiv_source","source_observed_at":"2026-08-05T20:29:06.482070Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2508.10955"},"observation_digest":"sha256:6e86f2c7e97534765ed93187aec6ff686566c02b14b93d96196be5915b8b5dae","observation_id":"507b2e82-a73e-4034-8334-7fa17ee9e1e8","resolution":{"observed_at":"2026-08-05T20:29:06.482070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-05T16:00:48.746871Z","title":"Visual-roleplay: Universal jailbreak attack on multimodal large language models via role-playing image character, 2024 b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19445","last_updated":"2026-06-16T17:34:06Z","snapshot_observed_at":"2026-08-08T05:25:02.825611Z","submitted_at":"2025-08-26T21:36:45Z","title":"On Surjectivity of Neural Networks: Can you elicit any behavior from your model?","version":3},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-05T16:00:48.746871Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2508.19445"},"observation_digest":"sha256:90fd812ad185d0cff34802c0ffa3e3852ba8ecbf63b0989f0917db8209e856d2","observation_id":"672e6be8-72ed-474c-b237-579cc9d71b9e","resolution":{"observed_at":"2026-08-05T16:00:48.746871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-04T09:25:50.007530Z","title":"Visual-roleplay: Universal jailbreak attack on multimodal large language models via role-playing image characte.CoRR, abs/2405.20773, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.15476","last_updated":"2026-07-04T04:20:15Z","snapshot_observed_at":"2026-08-06T02:45:04.316908Z","submitted_at":"2025-10-17T09:38:54Z","title":"SoK: Systematizing LLM Prompt Security: Taxonomies, Datasets, and Unified Evaluation of Attacks and Defenses","version":3},"reference_index":133,"source":"pdf_text","source_observed_at":"2026-08-04T09:25:50.007530Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2510.15476"},"observation_digest":"sha256:73c402f5edccc09f3dc25487ab79d17e92f14f178cfbbfab8174214cf05ea1de","observation_id":"d5be7c2a-2861-4dfc-a5c9-102b6a476f91","resolution":{"observed_at":"2026-08-04T09:25:50.007530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-04T09:02:38.637172Z","title":"Visual-roleplay: Universal jailbreak attack on multimodal large language models via role-playing image character","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.17759","last_updated":"2026-05-26T07:09:27Z","snapshot_observed_at":"2026-08-08T08:27:20.629192Z","submitted_at":"2025-10-20T17:12:10Z","title":"VERA-V: Variational Inference Framework for Jailbreaking Vision-Language Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T09:02:38.637172Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2510.17759"},"observation_digest":"sha256:d26ee0ea228e3ba20addb754861f53881de47162e3e59b0e5cfd3272ace9e7ab","observation_id":"59cd7582-ec3a-4e5a-9246-11362bc47eb0","resolution":{"observed_at":"2026-08-04T09:02:38.637172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-02T23:16:36.824638Z","title":"Visual-roleplay: Universal jailbreak attack on multimodal large language models via role-playing image character.arXiv preprint arXiv:2405.20773,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14399","last_updated":"2026-05-28T04:31:34Z","snapshot_observed_at":"2026-08-06T22:03:52.645334Z","submitted_at":"2026-02-16T02:15:58Z","title":"Multi-Turn Adaptive Prompting Attack on Large Vision-Language Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T23:16:36.824638Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2602.14399"},"observation_digest":"sha256:9f091914d4eb3799072aaf1b3cdc5725cc29fc035de37252c17825053d5240e0","observation_id":"f036b930-a299-47f6-ba77-7ab84fc7cea0","resolution":{"observed_at":"2026-08-02T23:16:36.824638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":"2405.20773","doi":"10.48550/arxiv.2405.20773","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Visual- roleplay: Universal jailbreak attack on multimodal large language mod- els via role-playing image character","venue":"arXiv (Cornell University)","work_id":"cfff0289-3100-466e-9e4e-d6998de6b0b4","year":2022},"citing_paper":{"arxiv_id":"2604.06950","last_updated":"2026-04-09T01:50:11Z","snapshot_observed_at":"2026-08-11T17:00:39.376798Z","submitted_at":"2026-04-08T11:13:16Z","title":"Making MLLMs Blind: Adversarial Smuggling Attacks in MLLM Content Moderation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T18:19:58.970952Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2604.06950"},"observation_digest":"sha256:05e5897d9d3e587e1233385f2ddf99a631b743489deccb3276b2285c059dad4c","observation_id":"f22ac78a-055d-4254-a4df-a8e26b4706be","resolution":{"observed_at":"2026-05-11T00:45:50.274862Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":"2405.20773","doi":"10.48550/arxiv.2405.20773","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Visual- roleplay: Universal jailbreak attack on multimodal large language mod- els via role-playing image character","venue":"arXiv (Cornell University)","work_id":"cfff0289-3100-466e-9e4e-d6998de6b0b4","year":2022},"citing_paper":{"arxiv_id":"2604.08846","last_updated":"2026-04-10T01:01:56Z","snapshot_observed_at":"2026-08-02T14:54:38.934183Z","submitted_at":"2026-04-10T01:01:56Z","title":"Dictionary-Aligned Concept Control for Safeguarding Multimodal LLMs","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-10T18:04:05.157103Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2604.08846"},"observation_digest":"sha256:f877cb01420e354685e03fd498eef40d7beeddcef7dce412d61aa76bcbc8d49d","observation_id":"92aad731-47a5-4fca-8760-fc4a54da3ee5","resolution":{"observed_at":"2026-05-11T05:35:57.164743Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":"2405.20773","doi":"10.48550/arxiv.2405.20773","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Visual- roleplay: Universal jailbreak attack on multimodal large language mod- els via role-playing image character","venue":"arXiv (Cornell University)","work_id":"cfff0289-3100-466e-9e4e-d6998de6b0b4","year":2022},"citing_paper":{"arxiv_id":"2604.08881","last_updated":"2026-07-30T10:00:35Z","snapshot_observed_at":"2026-08-11T03:10:45.292504Z","submitted_at":"2026-04-10T02:42:52Z","title":"Targeted Interpretable Safety Neuron Enhancement for Multilingual Vision-Language Large Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T18:12:34.909229Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2604.08881"},"observation_digest":"sha256:15ada9652a57e18655d7de0008e53ec94ede32793602ef797fce3349f55f4f66","observation_id":"83a652be-a6d8-4526-9a4e-2fc782028d26","resolution":{"observed_at":"2026-05-11T05:20:58.246993Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-02T16:34:05.343320Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.08881","last_updated":"2026-07-30T10:00:35Z","snapshot_observed_at":"2026-08-11T03:10:45.292504Z","submitted_at":"2026-04-10T02:42:52Z","title":"Targeted Interpretable Safety Neuron Enhancement for Multilingual Vision-Language Large Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T16:34:05.343320Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2604.08881"},"observation_digest":"sha256:2da23515e97f54696532baecc84c2f4a6d5b21e68fe195d9f828eb33c2f71658","observation_id":"5e4b0086-e642-4c06-9d0b-98d122104444","resolution":{"observed_at":"2026-08-02T16:34:05.343320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":"2405.20773","doi":"10.48550/arxiv.2405.20773","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Visual- roleplay: Universal jailbreak attack on multimodal large language mod- els via role-playing image character","venue":"arXiv (Cornell University)","work_id":"cfff0289-3100-466e-9e4e-d6998de6b0b4","year":2022},"citing_paper":{"arxiv_id":"2605.09443","last_updated":"2026-05-10T09:40:43Z","snapshot_observed_at":"2026-08-10T22:19:16.890614Z","submitted_at":"2026-05-10T09:40:43Z","title":"Through the Lens of Character: Resolving Modality-Role Interference in Multimodal Role-Playing Agent","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-12T04:49:56.954433Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2605.09443"},"observation_digest":"sha256:986acd5b85a1f23b093ec1c94adb5869c96c84df3902d564efe12917f6e30458","observation_id":"0ae55dc8-cbca-449b-a83a-7bd0208d6261","resolution":{"observed_at":"2026-05-12T05:51:27.691230Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":"2405.20773","doi":"10.48550/arxiv.2405.20773","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Visual- roleplay: Universal jailbreak attack on multimodal large language mod- els via role-playing image character","venue":"arXiv (Cornell University)","work_id":"cfff0289-3100-466e-9e4e-d6998de6b0b4","year":2022},"citing_paper":{"arxiv_id":"2605.25194","last_updated":"2026-05-24T17:51:34Z","snapshot_observed_at":"2026-07-06T23:35:11.987278Z","submitted_at":"2026-05-24T17:51:34Z","title":"Localization then Neutralization: Gradient-guided Token Suppression against Visual Prompt Injection Attack","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T12:19:12.910048Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2605.25194"},"observation_digest":"sha256:297c0f96b6e36d0bb63ae0fcdf672098b60cc50e1c3f3a65c555af0f1429477c","observation_id":"c8fc2ab4-fa70-42b6-b1e0-179ecf95f63e","resolution":{"observed_at":"2026-06-30T12:24:39.790379Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":"2405.20773","doi":"10.48550/arxiv.2405.20773","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Visual- roleplay: Universal jailbreak attack on multimodal large language mod- els via role-playing image character","venue":"arXiv (Cornell University)","work_id":"cfff0289-3100-466e-9e4e-d6998de6b0b4","year":2022},"citing_paper":{"arxiv_id":"2606.07706","last_updated":"2026-06-05T10:10:53Z","snapshot_observed_at":"2026-08-08T03:05:31.159664Z","submitted_at":"2026-06-05T10:10:53Z","title":"MLingualFC: Evaluating Jailbreak Vulnerabilities in Multilingual Vision-Language Models","version":1},"reference_index":103,"source":"arxiv_source","source_observed_at":"2026-06-27T21:47:22.295896Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2606.07706"},"observation_digest":"sha256:d86da7aa573786c36a5f0d39694e3f15b1f2b9b0b44631686e5d5dc6e5612b8b","observation_id":"7a59e5e3-7b94-4e75-b435-471ac28639ca","resolution":{"observed_at":"2026-07-02T18:57:16.800737Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":"2405.20773","doi":"10.48550/arxiv.2405.20773","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Visual- roleplay: Universal jailbreak attack on multimodal large language mod- els via role-playing image character","venue":"arXiv (Cornell University)","work_id":"cfff0289-3100-466e-9e4e-d6998de6b0b4","year":2022},"citing_paper":{"arxiv_id":"2606.26566","last_updated":"2026-06-25T03:32:12Z","snapshot_observed_at":"2026-08-03T17:22:40.185111Z","submitted_at":"2026-06-25T03:32:12Z","title":"Adversarial Diffusion Across Modalities: A Fusion Survey of Attacks, Defenses, and Evaluation for Text, Vision, and Vision-Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-26T04:35:51.583460Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2606.26566"},"observation_digest":"sha256:87bac877f35421e5a791be57566c1dc664fd4a11a12a4dcc4fda6bc19d540cb2","observation_id":"883b4f59-0aa4-434a-8c3e-0dd1f017de4b","resolution":{"observed_at":"2026-06-26T04:38:59.119984Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-01T08:23:25.911168Z","title":"Visual-roleplay: Universal jailbreak attack on multimodal large language models via role-playing image character,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21151","last_updated":"2026-07-26T23:23:12Z","snapshot_observed_at":"2026-08-06T16:53:45.184525Z","submitted_at":"2026-07-23T10:35:38Z","title":"V-DEAL: Diagnosing Video Safety De-Calibration as an Understanding-Refusal Coupling Failure","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T08:23:25.911168Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2607.21151"},"observation_digest":"sha256:0c89d251dbfd08e311ef955d32b1b36981bfdaf7086eb0cc34217b55a8949256","observation_id":"8d8a2ab6-d404-41d3-971f-ace533de2ab2","resolution":{"observed_at":"2026-08-01T08:23:25.911168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-07-30T20:22:15.367808Z","title":"Maity, S.; and Saikia, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24859","last_updated":"2026-07-26T07:46:28Z","snapshot_observed_at":"2026-08-09T20:46:17.449338Z","submitted_at":"2026-07-26T07:46:28Z","title":"The Mirage of LLM Guardrails: A Case Study in AI-Assisted Medical Note Manipulation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-30T20:22:15.367808Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2607.24859"},"observation_digest":"sha256:8f3877d6b96bd1c2c5b57ee1b93d71836762688515bbb11adcc63ad52ed121f2","observation_id":"7e46ab36-d070-4706-8c15-0307e586e9e0","resolution":{"observed_at":"2026-07-30T20:22:15.367808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-07-31T23:07:39.941483Z","title":"arXiv preprint arXiv:2405.20773 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27917","last_updated":"2026-07-30T09:30:03Z","snapshot_observed_at":"2026-08-10T00:35:44.804679Z","submitted_at":"2026-07-30T09:30:03Z","title":"One Anchor for All: Unified Multilingual and Multimodal Safety Alignment for LVLMs","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-07-31T23:07:39.941483Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2607.27917"},"observation_digest":"sha256:bc48a0c7a7d4a31abf0460d26fed65bf13d55ffbdd80aa5997895fcb57d27fda","observation_id":"07a487c6-9b7a-4608-b51e-29d8e149ba68","resolution":{"observed_at":"2026-07-31T23:07:39.941483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2405.20773/citation-record","integrity":"/paper/2405.20773/integrity","json":"/paper/2405.20773/citation-record.json","paper":"/paper/2405.20773"},"outbound":[],"paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","latest_version":2,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-08T10:04:07.258178Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 30 inbound Pith citation observations for arXiv:2405.20773."}