{"as_of":"2026-08-10T00:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e8f3ebb9fa34790f0dcd62bddbb71128efef730e79527f3ea66db6cc104c1413","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":25,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T18:05:52.403894Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":1,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.04031","last_updated":"2024-07-01T14:25:23Z","snapshot_observed_at":"2026-08-05T18:40:45.767406Z","submitted_at":"2024-06-06T13:00:42Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt","version":2},"cited_work":{"arxiv_id":"2406.04031","doi":"10.48550/arxiv.2406.04031","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04031","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jailbreak vision language models via bi-modal adversarial prompt","venue":"arXiv (Cornell University)","work_id":"ffab1d67-665f-4bc2-bb81-d8f8964115f5","year":2024},"citing_paper":{"arxiv_id":"2411.18275","last_updated":"2026-04-21T10:31:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-27T12:09:43Z","title":"Visual Adversarial Attack on Vision-Language Models for Autonomous Driving","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-23T16:35:24.063578Z"},"links":{"cited_paper":"/paper/2406.04031","citing_paper":"/paper/2411.18275"},"observation_digest":"sha256:14eed753ee7b500c549d5df155a8756fc2f246948b73ffbf695e8658b40c2127","observation_id":"30864464-a2bb-479a-9f5d-00825b8bef33","resolution":{"observed_at":"2026-05-23T16:35:42.163051Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04031","last_updated":"2024-07-01T14:25:23Z","snapshot_observed_at":"2026-08-05T18:40:45.767406Z","submitted_at":"2024-06-06T13:00:42Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04031","snapshot_observed_at":"2026-08-09T18:05:52.403894Z","title":"Jailbreak vision language models via bi-modal adversarial prompt, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00718","last_updated":"2025-07-10T14:44:44Z","snapshot_observed_at":"2026-08-09T21:15:27.675893Z","submitted_at":"2025-02-02T08:36:23Z","title":"\"I am bad\": Interpreting Stealthy, Universal and Robust Audio Jailbreaks in Audio-Language Models","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-09T18:05:52.403894Z"},"links":{"cited_paper":"/paper/2406.04031","citing_paper":"/paper/2502.00718"},"observation_digest":"sha256:c7830a5aa3e9997980e78889efe51c6f5f98aac8e41434ae76de60b052326090","observation_id":"80ed813d-ef3c-4083-beec-a5ac8fd8c19d","resolution":{"observed_at":"2026-08-09T18:05:52.403894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04031","last_updated":"2024-07-01T14:25:23Z","snapshot_observed_at":"2026-08-05T18:40:45.767406Z","submitted_at":"2024-06-06T13:00:42Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04031","snapshot_observed_at":"2026-08-07T19:45:19.363130Z","title":"Jail- break vision language models via bi-modal adversarial prompt,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.14881","last_updated":"2025-02-14T08:42:43Z","snapshot_observed_at":"2026-08-07T22:02:21.919237Z","submitted_at":"2025-02-14T08:42:43Z","title":"A Survey of Safety on Large Vision-Language Models: Attacks, Defenses and Evaluations","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T19:45:19.363130Z"},"links":{"cited_paper":"/paper/2406.04031","citing_paper":"/paper/2502.14881"},"observation_digest":"sha256:6c3c2d8ccaf99ef2109ab704022958b05cf4bde1dc0da2aa4eccb5292177007e","observation_id":"17617b06-e3ce-4470-8cd3-2e1a01db0ce9","resolution":{"observed_at":"2026-08-07T19:45:19.363130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04031","last_updated":"2024-07-01T14:25:23Z","snapshot_observed_at":"2026-08-05T18:40:45.767406Z","submitted_at":"2024-06-06T13:00:42Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04031","snapshot_observed_at":"2026-08-07T15:11:05.926019Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16104","last_updated":"2025-07-22T10:32:33Z","snapshot_observed_at":"2026-08-08T05:51:03.174420Z","submitted_at":"2025-05-22T01:06:28Z","title":"Hierarchical Safety Realignment: Lightweight Restoration of Safety in Pruned Large Vision-Language Models","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T15:11:05.926019Z"},"links":{"cited_paper":"/paper/2406.04031","citing_paper":"/paper/2505.16104"},"observation_digest":"sha256:3cdce8f4c76dddd0258c980576721cabcff29c80b88edc05cca5246ee69b0ef5","observation_id":"44fc0931-9434-46b7-8d0d-cdbcfe1a0931","resolution":{"observed_at":"2026-08-07T15:11:05.926019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04031","last_updated":"2024-07-01T14:25:23Z","snapshot_observed_at":"2026-08-05T18:40:45.767406Z","submitted_at":"2024-06-06T13:00:42Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04031","snapshot_observed_at":"2026-08-07T15:08:13.366909Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16241","last_updated":"2025-05-26T02:28:07Z","snapshot_observed_at":"2026-08-07T21:56:02.136924Z","submitted_at":"2025-05-22T05:19:42Z","title":"Three Minds, One Legend: Jailbreak Large Reasoning Model with Adaptive Stacked Ciphers","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T15:08:13.366909Z"},"links":{"cited_paper":"/paper/2406.04031","citing_paper":"/paper/2505.16241"},"observation_digest":"sha256:00c5ee245bcbbebbc4c3cdf466d87d39c63dd27da10c03dcc1ff723fa63e67da","observation_id":"0c0fbad8-071f-44db-a668-11ea5518a66c","resolution":{"observed_at":"2026-08-07T15:08:13.366909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04031","last_updated":"2024-07-01T14:25:23Z","snapshot_observed_at":"2026-08-05T18:40:45.767406Z","submitted_at":"2024-06-06T13:00:42Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04031","snapshot_observed_at":"2026-08-07T13:36:00.334024Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21277","last_updated":"2025-05-28T14:16:10Z","snapshot_observed_at":"2026-08-09T03:35:23.473114Z","submitted_at":"2025-05-27T14:48:44Z","title":"Breaking the Ceiling: Exploring the Potential of Jailbreak Attacks through Expanding Strategy Space","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T13:36:00.334024Z"},"links":{"cited_paper":"/paper/2406.04031","citing_paper":"/paper/2505.21277"},"observation_digest":"sha256:794face8cf8abb27dcff62a79f5428247610d34b3ed4cb8e6ffdd846afe18193","observation_id":"8cf43540-c992-4d50-a46c-a9d45d12c8bf","resolution":{"observed_at":"2026-08-07T13:36:00.334024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04031","last_updated":"2024-07-01T14:25:23Z","snapshot_observed_at":"2026-08-05T18:40:45.767406Z","submitted_at":"2024-06-06T13:00:42Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04031","snapshot_observed_at":"2026-08-07T14:01:11.165635Z","title":"Jailbreak vision language models via bi-modal adversarial prompt","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21556","last_updated":"2025-05-26T17:27:32Z","snapshot_observed_at":"2026-08-08T12:25:50.926744Z","submitted_at":"2025-05-26T17:27:32Z","title":"Benign-to-Toxic Jailbreaking: Inducing Harmful Responses from Harmless Prompts","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:11.165635Z"},"links":{"cited_paper":"/paper/2406.04031","citing_paper":"/paper/2505.21556"},"observation_digest":"sha256:8379626b192fc2ef7850f6a4cfd471cdcf4f423611242cd78657db8d9203093e","observation_id":"2506fa70-0265-491c-9720-27f438d9d0da","resolution":{"observed_at":"2026-08-07T14:01:11.165635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04031","last_updated":"2024-07-01T14:25:23Z","snapshot_observed_at":"2026-08-05T18:40:45.767406Z","submitted_at":"2024-06-06T13:00:42Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04031","snapshot_observed_at":"2026-08-07T11:51:32.894561Z","title":"Jailbreak vision language models via bi-modal adversarial prompt,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01307","last_updated":"2025-06-02T04:33:56Z","snapshot_observed_at":"2026-08-07T11:42:31.717394Z","submitted_at":"2025-06-02T04:33:56Z","title":"Align is not Enough: Multimodal Universal Jailbreak Attack against Multimodal Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:51:32.894561Z"},"links":{"cited_paper":"/paper/2406.04031","citing_paper":"/paper/2506.01307"},"observation_digest":"sha256:f8f8c6b5f40bad059c99e3428dade84714e5587435b1d53bb3d91dfcd1fb17b0","observation_id":"22298515-bd24-4400-84c9-790d5dad6e67","resolution":{"observed_at":"2026-08-07T11:51:32.894561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04031","last_updated":"2024-07-01T14:25:23Z","snapshot_observed_at":"2026-08-05T18:40:45.767406Z","submitted_at":"2024-06-06T13:00:42Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04031","snapshot_observed_at":"2026-08-07T11:02:03.532221Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.03683","last_updated":"2025-06-04T08:13:53Z","snapshot_observed_at":"2026-08-09T21:25:05.413505Z","submitted_at":"2025-06-04T08:13:53Z","title":"PRJ: Perception-Retrieval-Judgement for Generated Images","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:02:03.532221Z"},"links":{"cited_paper":"/paper/2406.04031","citing_paper":"/paper/2506.03683"},"observation_digest":"sha256:e9aef4026e376a0f4d9d6d1bf78772d982f34b76e4f9cc5fa9d9d41754030956","observation_id":"31c5f5a1-8f32-465e-965f-77fdacbc0fd4","resolution":{"observed_at":"2026-08-07T11:02:03.532221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04031","last_updated":"2024-07-01T14:25:23Z","snapshot_observed_at":"2026-08-05T18:40:45.767406Z","submitted_at":"2024-06-06T13:00:42Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04031","snapshot_observed_at":"2026-08-06T23:01:04.686795Z","title":"Jailbreak vision language models via bi-modal adversarial prompt.arXiv preprint arXiv:2406.04031,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00052","last_updated":"2025-06-25T02:56:38Z","snapshot_observed_at":"2026-08-08T22:10:18.231261Z","submitted_at":"2025-06-25T02:56:38Z","title":"VSF-Med:A Vulnerability Scoring Framework for Medical Vision-Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:01:04.686795Z"},"links":{"cited_paper":"/paper/2406.04031","citing_paper":"/paper/2507.00052"},"observation_digest":"sha256:1bbbdbffae2f6422fa30a28afc3baec641fdd8dd6160dc3135055a33b9d5ac63","observation_id":"6195d26a-623c-434c-995a-39f5edcafdb9","resolution":{"observed_at":"2026-08-06T23:01:04.686795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04031","last_updated":"2024-07-01T14:25:23Z","snapshot_observed_at":"2026-08-05T18:40:45.767406Z","submitted_at":"2024-06-06T13:00:42Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04031","snapshot_observed_at":"2026-08-06T21:11:18.221976Z","title":"Jailbreak vision language models via bi-modal adversarial prompt,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-09T01:33:11.153119Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.221976Z"},"links":{"cited_paper":"/paper/2406.04031","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:680ec23c979802e9070982859b4ce53ac5f48623be5cb053882958c4c951f831","observation_id":"667e004a-1aaf-4620-82b6-ff1b3d6d6ffe","resolution":{"observed_at":"2026-08-06T21:11:18.221976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04031","last_updated":"2024-07-01T14:25:23Z","snapshot_observed_at":"2026-08-05T18:40:45.767406Z","submitted_at":"2024-06-06T13:00:42Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt","version":2},"cited_work":{"arxiv_id":"2406.04031","doi":"10.48550/arxiv.2406.04031","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04031","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jailbreak vision language models via bi-modal adversarial prompt","venue":"arXiv (Cornell University)","work_id":"ffab1d67-665f-4bc2-bb81-d8f8964115f5","year":2024},"citing_paper":{"arxiv_id":"2507.21540","last_updated":"2026-04-08T13:05:48Z","snapshot_observed_at":"2026-07-06T22:04:26.078628Z","submitted_at":"2025-07-29T07:13:56Z","title":"PRISM: Programmatic Reasoning with Image Sequence Manipulation for LVLM Jailbreaking","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-19T03:36:24.013477Z"},"links":{"cited_paper":"/paper/2406.04031","citing_paper":"/paper/2507.21540"},"observation_digest":"sha256:0899eaf089131d413e50446c071a23ffb74293ed2849837866496c9b2fae9df6","observation_id":"630d645b-ce3a-474b-bc30-f6c34f4e2371","resolution":{"observed_at":"2026-05-19T03:37:01.063367Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04031","last_updated":"2024-07-01T14:25:23Z","snapshot_observed_at":"2026-08-05T18:40:45.767406Z","submitted_at":"2024-06-06T13:00:42Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04031","snapshot_observed_at":"2026-08-05T20:31:43.597526Z","title":"Jailbreak vision language models via bi-modal adversarial prompt","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10404","last_updated":"2025-08-14T07:12:44Z","snapshot_observed_at":"2026-08-08T02:31:17.622343Z","submitted_at":"2025-08-14T07:12:44Z","title":"Layer-Wise Perturbations via Sparse Autoencoders for Adversarial Text Generation","version":1},"reference_index":115,"source":"pdf_text","source_observed_at":"2026-08-05T20:31:43.597526Z"},"links":{"cited_paper":"/paper/2406.04031","citing_paper":"/paper/2508.10404"},"observation_digest":"sha256:cb41d0a7d8acd4dded9baf0fd518036d2c3c38f84de305f8d38c5d582ef825eb","observation_id":"1d3abdd7-d341-43bb-b3d4-21e9f885d2f3","resolution":{"observed_at":"2026-08-05T20:31:43.597526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04031","last_updated":"2024-07-01T14:25:23Z","snapshot_observed_at":"2026-08-05T18:40:45.767406Z","submitted_at":"2024-06-06T13:00:42Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04031","snapshot_observed_at":"2026-08-05T20:29:06.610465Z","title":"Ying et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10955","last_updated":"2025-08-14T07:25:45Z","snapshot_observed_at":"2026-08-09T12:54:37.629481Z","submitted_at":"2025-08-14T07:25:45Z","title":"Empowering Multimodal LLMs with External Tools: A Comprehensive Survey","version":1},"reference_index":232,"source":"arxiv_source","source_observed_at":"2026-08-05T20:29:06.610465Z"},"links":{"cited_paper":"/paper/2406.04031","citing_paper":"/paper/2508.10955"},"observation_digest":"sha256:94dda1cf94239fb35119be11aa0d67680116c7851ef33a041ae2592a1373e409","observation_id":"38b60e6e-d2e0-4de8-8ba2-edb6f8936389","resolution":{"observed_at":"2026-08-05T20:29:06.610465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04031","last_updated":"2024-07-01T14:25:23Z","snapshot_observed_at":"2026-08-05T18:40:45.767406Z","submitted_at":"2024-06-06T13:00:42Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04031","snapshot_observed_at":"2026-08-05T16:00:52.253832Z","title":"Jailbreak vision language models via bi-modal adversarial prompt, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19445","last_updated":"2026-06-16T17:34:06Z","snapshot_observed_at":"2026-08-08T05:25:02.825611Z","submitted_at":"2025-08-26T21:36:45Z","title":"On Surjectivity of Neural Networks: Can you elicit any behavior from your model?","version":3},"reference_index":108,"source":"arxiv_source","source_observed_at":"2026-08-05T16:00:52.253832Z"},"links":{"cited_paper":"/paper/2406.04031","citing_paper":"/paper/2508.19445"},"observation_digest":"sha256:e4e6ddcfe46d0a6d0c4631e14cdb4d8795e6567c674dc835c50fed36771312bd","observation_id":"d2d09ee6-0988-4a21-afbd-8110667ce07d","resolution":{"observed_at":"2026-08-05T16:00:52.253832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04031","last_updated":"2024-07-01T14:25:23Z","snapshot_observed_at":"2026-08-05T18:40:45.767406Z","submitted_at":"2024-06-06T13:00:42Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04031","snapshot_observed_at":"2026-08-04T14:58:40.894740Z","title":"Jailbreak vision language models via bi-modal adversarial prompt","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.22415","last_updated":"2026-07-15T06:42:59Z","snapshot_observed_at":"2026-08-08T12:02:30.220130Z","submitted_at":"2025-09-26T14:39:13Z","title":"Evidence Recomposition and Predictive Context Residualization for Visual Attribution in Multimodal Large Language Models","version":4},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-04T14:58:40.894740Z"},"links":{"cited_paper":"/paper/2406.04031","citing_paper":"/paper/2509.22415"},"observation_digest":"sha256:3b0a0a3c1b830f73bdde5bd4740bd14391d1c6094a54f1ff2ed95e43934898ac","observation_id":"e4b34017-fd2e-46ab-84b7-de38e5014b22","resolution":{"observed_at":"2026-08-04T14:58:40.894740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04031","last_updated":"2024-07-01T14:25:23Z","snapshot_observed_at":"2026-08-05T18:40:45.767406Z","submitted_at":"2024-06-06T13:00:42Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04031","snapshot_observed_at":"2026-08-04T09:25:58.141356Z","title":"Jailbreak vision language models via bi-modal adversarial prompt.CoRR, abs/2406.04031, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.15476","last_updated":"2026-07-04T04:20:15Z","snapshot_observed_at":"2026-08-06T02:45:04.316908Z","submitted_at":"2025-10-17T09:38:54Z","title":"SoK: Systematizing LLM Prompt Security: Taxonomies, Datasets, and Unified Evaluation of Attacks and Defenses","version":3},"reference_index":221,"source":"pdf_text","source_observed_at":"2026-08-04T09:25:58.141356Z"},"links":{"cited_paper":"/paper/2406.04031","citing_paper":"/paper/2510.15476"},"observation_digest":"sha256:ca2330d5dac66cd7035ce639200a77c5fcb72134b2e43eb2c89c98224a9c919c","observation_id":"172ab056-f2f2-4ede-aee0-38548d9ae382","resolution":{"observed_at":"2026-08-04T09:25:58.141356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04031","last_updated":"2024-07-01T14:25:23Z","snapshot_observed_at":"2026-08-05T18:40:45.767406Z","submitted_at":"2024-06-06T13:00:42Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04031","snapshot_observed_at":"2026-08-03T20:27:03.863353Z","title":"Jailbreak vision language models via bi-modal adversarial prompt.arXiv preprint arXiv:2406.04031,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.20002","last_updated":"2026-06-17T05:14:08Z","snapshot_observed_at":"2026-08-03T20:27:02.365537Z","submitted_at":"2025-11-25T07:13:13Z","title":"Semantic Router: On the Feasibility of Hijacking MLLMs via a Single Adversarial Perturbation","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T20:27:03.863353Z"},"links":{"cited_paper":"/paper/2406.04031","citing_paper":"/paper/2511.20002"},"observation_digest":"sha256:16ec676e8a84b6d690aef38d036af6b24ebc760a6584b10d835027a425160f41","observation_id":"7216e311-fdd7-4b39-96ea-783fb2e30473","resolution":{"observed_at":"2026-08-03T20:27:03.863353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04031","last_updated":"2024-07-01T14:25:23Z","snapshot_observed_at":"2026-08-05T18:40:45.767406Z","submitted_at":"2024-06-06T13:00:42Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt","version":2},"cited_work":{"arxiv_id":"2406.04031","doi":"10.48550/arxiv.2406.04031","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04031","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jailbreak vision language models via bi-modal adversarial prompt","venue":"arXiv (Cornell University)","work_id":"ffab1d67-665f-4bc2-bb81-d8f8964115f5","year":2024},"citing_paper":{"arxiv_id":"2604.04488","last_updated":"2026-04-06T07:27:04Z","snapshot_observed_at":"2026-08-05T13:21:08.142791Z","submitted_at":"2026-04-06T07:27:04Z","title":"A Patch-based Cross-view Regularized Framework for Backdoor Defense in Multimodal Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T20:14:02.553313Z"},"links":{"cited_paper":"/paper/2406.04031","citing_paper":"/paper/2604.04488"},"observation_digest":"sha256:e80b88cf26ad5b1a104b45c72aa2ff71382d77b3365292f08cdb0e87fc98332a","observation_id":"caa29f76-9ae6-47f8-b5ef-2113bd0f7225","resolution":{"observed_at":"2026-05-10T22:05:49.112628Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04031","last_updated":"2024-07-01T14:25:23Z","snapshot_observed_at":"2026-08-05T18:40:45.767406Z","submitted_at":"2024-06-06T13:00:42Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt","version":2},"cited_work":{"arxiv_id":"2406.04031","doi":"10.48550/arxiv.2406.04031","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04031","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jailbreak vision language models via bi-modal adversarial prompt","venue":"arXiv (Cornell University)","work_id":"ffab1d67-665f-4bc2-bb81-d8f8964115f5","year":2024},"citing_paper":{"arxiv_id":"2604.04630","last_updated":"2026-04-06T12:29:49Z","snapshot_observed_at":"2026-07-06T22:53:33.177713Z","submitted_at":"2026-04-06T12:29:49Z","title":"Multimodal Backdoor Attack on VLMs for Autonomous Driving via Graffiti and Cross-Lingual Triggers","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T20:30:29.032353Z"},"links":{"cited_paper":"/paper/2406.04031","citing_paper":"/paper/2604.04630"},"observation_digest":"sha256:279fbb88cd545badb077f02e520ca203b3fa005f518fc7ae71dc2c7a2ba768d7","observation_id":"46391421-e264-4d6e-9dc2-d895c864b488","resolution":{"observed_at":"2026-05-10T21:55:49.742793Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04031","last_updated":"2024-07-01T14:25:23Z","snapshot_observed_at":"2026-08-05T18:40:45.767406Z","submitted_at":"2024-06-06T13:00:42Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt","version":2},"cited_work":{"arxiv_id":"2406.04031","doi":"10.48550/arxiv.2406.04031","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04031","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jailbreak vision language models via bi-modal adversarial prompt","venue":"arXiv (Cornell University)","work_id":"ffab1d67-665f-4bc2-bb81-d8f8964115f5","year":2024},"citing_paper":{"arxiv_id":"2604.18803","last_updated":"2026-04-25T21:48:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-20T20:21:27Z","title":"LLM-as-Judge Framework for Evaluating Tone-Induced Hallucination in Vision-Language Models","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-10T05:11:01.039309Z"},"links":{"cited_paper":"/paper/2406.04031","citing_paper":"/paper/2604.18803"},"observation_digest":"sha256:ddac6009d3d64918407df230e4c0f3e97d53f23d037373a464e0ab01d8ad0aa2","observation_id":"bf63562f-4f2e-4eda-8cea-7c1cd4710d3b","resolution":{"observed_at":"2026-05-10T09:38:43.129002Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04031","last_updated":"2024-07-01T14:25:23Z","snapshot_observed_at":"2026-08-05T18:40:45.767406Z","submitted_at":"2024-06-06T13:00:42Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt","version":2},"cited_work":{"arxiv_id":"2406.04031","doi":"10.48550/arxiv.2406.04031","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04031","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jailbreak vision language models via bi-modal adversarial prompt","venue":"arXiv (Cornell University)","work_id":"ffab1d67-665f-4bc2-bb81-d8f8964115f5","year":2024},"citing_paper":{"arxiv_id":"2605.04261","last_updated":"2026-05-05T19:55:28Z","snapshot_observed_at":"2026-07-06T23:17:04.200299Z","submitted_at":"2026-05-05T19:55:28Z","title":"Laundering AI Authority with Adversarial Examples","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-08T17:19:38.662062Z"},"links":{"cited_paper":"/paper/2406.04031","citing_paper":"/paper/2605.04261"},"observation_digest":"sha256:66eaa54c3d0242486ce75c466100e35f790ba35277a14a4b54289f380eee8ba7","observation_id":"cebbc9fd-bf29-4a68-b47e-4bf63477d9cf","resolution":{"observed_at":"2026-05-11T17:41:07.993730Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04031","last_updated":"2024-07-01T14:25:23Z","snapshot_observed_at":"2026-08-05T18:40:45.767406Z","submitted_at":"2024-06-06T13:00:42Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt","version":2},"cited_work":{"arxiv_id":"2406.04031","doi":"10.48550/arxiv.2406.04031","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04031","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jailbreak vision language models via bi-modal adversarial prompt","venue":"arXiv (Cornell University)","work_id":"ffab1d67-665f-4bc2-bb81-d8f8964115f5","year":2024},"citing_paper":{"arxiv_id":"2605.25194","last_updated":"2026-05-24T17:51:34Z","snapshot_observed_at":"2026-07-06T23:35:11.987278Z","submitted_at":"2026-05-24T17:51:34Z","title":"Localization then Neutralization: Gradient-guided Token Suppression against Visual Prompt Injection Attack","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T12:19:12.910048Z"},"links":{"cited_paper":"/paper/2406.04031","citing_paper":"/paper/2605.25194"},"observation_digest":"sha256:98f87ad975847c90bcf08f6e5fdaf7d0ebccddc7376863c62b668191dde83127","observation_id":"fc0bf83b-9254-4bf7-bdc2-d4148539f05c","resolution":{"observed_at":"2026-06-30T12:24:39.793465Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04031","last_updated":"2024-07-01T14:25:23Z","snapshot_observed_at":"2026-08-05T18:40:45.767406Z","submitted_at":"2024-06-06T13:00:42Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt","version":2},"cited_work":{"arxiv_id":"2406.04031","doi":"10.48550/arxiv.2406.04031","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04031","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jailbreak vision language models via bi-modal adversarial prompt","venue":"arXiv (Cornell University)","work_id":"ffab1d67-665f-4bc2-bb81-d8f8964115f5","year":2024},"citing_paper":{"arxiv_id":"2606.26566","last_updated":"2026-06-25T03:32:12Z","snapshot_observed_at":"2026-08-03T17:22:40.185111Z","submitted_at":"2026-06-25T03:32:12Z","title":"Adversarial Diffusion Across Modalities: A Fusion Survey of Attacks, Defenses, and Evaluation for Text, Vision, and Vision-Language Models","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-06-26T04:35:51.583460Z"},"links":{"cited_paper":"/paper/2406.04031","citing_paper":"/paper/2606.26566"},"observation_digest":"sha256:258e223038e8c8fdbcd5244273d8e72aa64565f9484c4aa14c835a481b3712e2","observation_id":"a51ec3bc-a427-4317-886b-1db2d4d5f433","resolution":{"observed_at":"2026-06-26T04:38:59.191152Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04031","last_updated":"2024-07-01T14:25:23Z","snapshot_observed_at":"2026-08-05T18:40:45.767406Z","submitted_at":"2024-06-06T13:00:42Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04031","snapshot_observed_at":"2026-08-01T12:04:27.555375Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19683","last_updated":"2026-07-22T02:33:56Z","snapshot_observed_at":"2026-08-07T20:47:58.956911Z","submitted_at":"2026-07-22T02:33:56Z","title":"GhostPrompt: Cross-Image Adversarial Prompt for Vision-Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-01T12:04:27.555375Z"},"links":{"cited_paper":"/paper/2406.04031","citing_paper":"/paper/2607.19683"},"observation_digest":"sha256:f55b2e8f16bda7a6cb39c1d762d64341d8c251de706d2bf6939efff3515da3b7","observation_id":"e2c429a6-3c47-4176-8030-153b619f6b56","resolution":{"observed_at":"2026-08-01T12:04:27.555375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.04031/citation-record","integrity":"/paper/2406.04031/integrity","json":"/paper/2406.04031/citation-record.json","paper":"/paper/2406.04031"},"outbound":[],"paper":{"arxiv_id":"2406.04031","last_updated":"2024-07-01T14:25:23Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-05T18:40:45.767406Z","submitted_at":"2024-06-06T13:00:42Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 25 inbound Pith citation observations for arXiv:2406.04031."}