{"as_of":"2026-08-10T10:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:84a15978d64c523c0e39d456be1c638528fe328cac203fb45523f15fb4d2d2a2","coverage":[{"denominator":105,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:03:46.209030Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T02:38:37.358485Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-15T02:39:40.883175Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2505.16446","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16446","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2505.16446 , year=","venue":null,"work_id":"0514a4b9-152d-485b-a10c-d61cfebdbd44","year":null},"citing_paper":{"arxiv_id":"2605.14291","last_updated":"2026-05-14T02:49:27Z","snapshot_observed_at":"2026-08-05T12:24:07.736176Z","submitted_at":"2026-05-14T02:49:27Z","title":"To See is Not to Learn: Protecting Multimodal Data from Unauthorized Fine-Tuning of Large Vision-Language Model","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-05-15T02:38:37.358485Z"},"links":{"cited_paper":"/paper/2505.16446","citing_paper":"/paper/2605.14291"},"observation_digest":"sha256:65c570475e301ef9b1eee25113bf722f5731a499f25d8371826d7d577f46f2b1","observation_id":"a94f9d59-9b7f-40bc-9679-e075511ab080","resolution":{"observed_at":"2026-05-15T02:39:40.885563Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.16446/citation-record","integrity":"/paper/2505.16446/integrity","json":"/paper/2505.16446/citation-record.json","paper":"/paper/2505.16446"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T15:03:34.316059Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:34.316059Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:46cae00e227a8379a587e94da64128634a7015067bce55e152a0c4c161e2b410","observation_id":"05a3fafd-fe4e-4039-9e61-85839b4fae8b","resolution":{"observed_at":"2026-08-07T15:03:34.316059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T15:03:34.430597Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:34.430597Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:deb9b589873e756b76f0e614a24485f41a4743da08b63fc51a4db509e40789f8","observation_id":"16194135-a404-4cdb-907a-c9a02a68d060","resolution":{"observed_at":"2026-08-07T15:03:34.430597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:34.525884Z","title":"The claude 3 model family: Opus, sonnet, haiku,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:34.525884Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:b4712f35a7379e810f32413f4947865ee270e7e1c43bf5e3971d97307e23459d","observation_id":"50c649af-a82a-4301-90fe-d5efbc22088a","resolution":{"observed_at":"2026-08-07T15:03:34.525884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:34.616679Z","title":"The competition for llm and agent safety,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:34.616679Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:34761168c357524dacc89f105a1d8cebf8b416e9cffd26da8936114b9be4241a","observation_id":"33f9d5ad-562e-4f32-bb73-bb54b17c2bd5","resolution":{"observed_at":"2026-08-07T15:03:34.616679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-07T15:03:34.720666Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:34.720666Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:0a11c807792f409c2d67b3ba16162c2ba4a78b088aa653216f1e1d11da19da08","observation_id":"e6d798a2-abef-4cfa-b4a5-3ab7f17a1a2f","resolution":{"observed_at":"2026-08-07T15:03:34.720666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:34.823723Z","title":"Internvl: Scaling up vision foundation models and aligning for generic visual-linguistic tasks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:34.823723Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:beb4a022642ae75f2320cd70d075ba33fae2bcde5b108f014b53e344baf0ef4a","observation_id":"d317f394-2cde-4072-ad68-58574a04b502","resolution":{"observed_at":"2026-08-07T15:03:34.823723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T15:03:34.954828Z","title":"Qwen2.5-vl technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:34.954828Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:4fc8a8515094af26522c3dacf174577184accce0738423ca8acee3f248e3acc2","observation_id":"3bf38c82-6ca2-498b-9321-9c11584d0102","resolution":{"observed_at":"2026-08-07T15:03:34.954828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-07T15:03:35.112868Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:35.112868Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:709a5f0f7f03f4633a0d3b66fe2ee2d813f22236fea4bf46cda378eceb11130e","observation_id":"440752a0-f822-4476-ab5f-3bf40717ae67","resolution":{"observed_at":"2026-08-07T15:03:35.112868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:35.315861Z","title":"Training language models to follow instructions with human feedback,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:35.315861Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:81ba03bfa627cd53935c76f68e41b8e67a052630d70451a5ae56254e6108894c","observation_id":"0f97876c-9067-489c-b0bc-8081f69d2ed7","resolution":{"observed_at":"2026-08-07T15:03:35.315861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14881","last_updated":"2025-02-14T08:42:43Z","snapshot_observed_at":"2026-08-07T22:02:21.919237Z","submitted_at":"2025-02-14T08:42:43Z","title":"A Survey of Safety on Large Vision-Language Models: Attacks, Defenses and Evaluations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14881","snapshot_observed_at":"2026-08-07T15:03:35.456601Z","title":"A survey of safety on large vision- language models: Attacks, defenses and evaluations,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:35.456601Z"},"links":{"cited_paper":"/paper/2502.14881","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:6a4171da58300e228b6ff19eded19b3212cf10e6fd1a67b84a2c7af9a18845e6","observation_id":"e51b6082-a9b4-4eda-8a8f-0c898fa85d06","resolution":{"observed_at":"2026-08-07T15:03:35.456601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09259","last_updated":"2024-12-09T14:22:14Z","snapshot_observed_at":"2026-08-09T06:09:32.355513Z","submitted_at":"2024-11-14T07:51:51Z","title":"Jailbreak Attacks and Defenses against Multimodal Generative Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09259","snapshot_observed_at":"2026-08-07T15:03:35.615647Z","title":"Jail- break attacks and defenses against multimodal generative models: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:35.615647Z"},"links":{"cited_paper":"/paper/2411.09259","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:fc1a912b53c26f6e3f68c7de5d7b2dbbe763b4000fbe54602188fcb5b57797ac","observation_id":"22cd4118-cbb3-4f54-9993-a9cb10e74468","resolution":{"observed_at":"2026-08-07T15:03:35.615647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:35.811790Z","title":"Are aligned neural networks adversarially aligned?","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:35.811790Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:1549cb8245bd374e8ad081d5b672f745026582159a23710d2ecbb133e266fbb4","observation_id":"67ae3fe8-734a-4e0e-892a-0582eb112c53","resolution":{"observed_at":"2026-08-07T15:03:35.811790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19939","last_updated":"2025-05-17T15:14:14Z","snapshot_observed_at":"2026-08-08T01:24:10.875048Z","submitted_at":"2024-11-29T18:56:37Z","title":"VLSBench: Unveiling Visual Leakage in Multimodal Safety","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19939","snapshot_observed_at":"2026-08-07T15:03:35.945251Z","title":"Vlsbench: Unveiling visual leakage in multimodal safety,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:35.945251Z"},"links":{"cited_paper":"/paper/2411.19939","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:558ba4bb1e28b2da4fbdabbbd26642b3e6aaf499a502833ebcb63a0d142cdf51","observation_id":"cc8ae2a9-1d6e-483b-8111-1d2f534ea4db","resolution":{"observed_at":"2026-08-07T15:03:35.945251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:36.076151Z","title":"Zero-shot text-to-image generation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:36.076151Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:9a3d3497de8ffd3458c7313841bd6c5766e8f29da460b92e8f87992b7c6db257","observation_id":"8ed94f89-6b1e-44f0-aee6-72e432bb827b","resolution":{"observed_at":"2026-08-07T15:03:36.076151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.01691","last_updated":"2022-08-16T16:06:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-04T17:57:11Z","title":"Do As I Can, Not As I Say: Grounding Language in Robotic Affordances","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.01691","snapshot_observed_at":"2026-08-07T15:03:36.218162Z","title":"Do as i can, not as i say: Grounding language in robotic affordances,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:36.218162Z"},"links":{"cited_paper":"/paper/2204.01691","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:6fb1fd8114ad752d978818202ae4b23531c76558d95a1a435371c46c4db56be4","observation_id":"69a0a472-d933-472a-b791-5a9bd51516f7","resolution":{"observed_at":"2026-08-07T15:03:36.218162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:36.346272Z","title":"Membership inference attacks against large vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:36.346272Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:7f0653bd1efb41d514f15f9882274994abcb892e63acee5f701882973d258502","observation_id":"b58ef8ff-6762-47ba-a5fa-7472187fd725","resolution":{"observed_at":"2026-08-07T15:03:36.346272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:36.485279Z","title":"Model inversion attacks: A survey of approaches and countermeasures,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:36.485279Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:2106d9a8342695f81b306de59a283b2c30e15b7f88fa0beb31f3dbb959fd2110","observation_id":"a12521cf-0a12-4519-bc27-1b0a65174380","resolution":{"observed_at":"2026-08-07T15:03:36.485279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:36.622205Z","title":"Badclip: Dual-embedding guided backdoor attack on multimodal contrastive learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:36.622205Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:7c84b9d76a08bed55ece3c0cdc645ecbe4a0f763956e058ed131c5e9ce306c7d","observation_id":"356fead6-0c10-485a-ad34-7b9f23ce15a1","resolution":{"observed_at":"2026-08-07T15:03:36.622205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.01652","last_updated":"2022-02-08T20:26:45Z","snapshot_observed_at":"2026-08-10T07:52:08.606999Z","submitted_at":"2021-09-03T17:55:52Z","title":"Finetuned Language Models Are Zero-Shot Learners","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.01652","snapshot_observed_at":"2026-08-07T15:03:36.759555Z","title":"Finetuned language models are zero-shot learners,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:36.759555Z"},"links":{"cited_paper":"/paper/2109.01652","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:1b7248d2f213b732ddf0d0542b343c643cbafd4116764a088cfffa39f61f7f0e","observation_id":"dded66d9-54f0-4b67-8f41-7a8a539d3f25","resolution":{"observed_at":"2026-08-07T15:03:36.759555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-07T15:03:36.865594Z","title":"Universal and trans- ferable adversarial attacks on aligned language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:36.865594Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:6b075a0ae6850801e1a68a5fd54d304eedc105d166af49bcab80e8f3ba9bed73","observation_id":"8808a5c3-9457-4927-aa2b-767c173cf772","resolution":{"observed_at":"2026-08-07T15:03:36.865594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6199","last_updated":"2014-02-19T16:33:14Z","snapshot_observed_at":"2026-07-06T03:31:33.797310Z","submitted_at":"2013-12-21T03:36:08Z","title":"Intriguing properties of neural networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6199","snapshot_observed_at":"2026-08-07T15:03:36.999145Z","title":"Intriguing properties of neural networks,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:36.999145Z"},"links":{"cited_paper":"/paper/1312.6199","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:51a72b5283c0fdc4bdd92b947157f37f4fc97db57b60b6d58e5a4248b8c5d2ee","observation_id":"cac522b3-ac08-4fda-9a50-5864dac36928","resolution":{"observed_at":"2026-08-07T15:03:36.999145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.06733","last_updated":"2019-03-11T20:45:33Z","snapshot_observed_at":"2026-07-06T05:56:16.413472Z","submitted_at":"2017-08-22T17:31:54Z","title":"BadNets: Identifying Vulnerabilities in the Machine Learning Model Supply Chain","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.06733","snapshot_observed_at":"2026-08-07T15:03:37.111743Z","title":"Badnets: Identifying vulnerabilities in the machine learning model supply chain,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:37.111743Z"},"links":{"cited_paper":"/paper/1708.06733","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:35608aa4e0bd7dad2df078be3450fa7d72874e9d9f691907609539f9a76e0f5e","observation_id":"87572535-3632-4822-951a-c71eb7bf03d5","resolution":{"observed_at":"2026-08-07T15:03:37.111743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:37.181915Z","title":"Membership inference attacks against machine learning models,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:37.181915Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:fb70654eaf5b33b652a773308887555db146c60b5e7dc1fe9cad0bd5d145e1f4","observation_id":"8a2bc111-7d9a-4bb3-8c2b-75496fbb523f","resolution":{"observed_at":"2026-08-07T15:03:37.181915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:37.253088Z","title":"Extracting training data from large language models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:37.253088Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:dafe7d1c68083c63090289f514655b6d5b7bb72492181ff76451d58ccf602c32","observation_id":"b6fa0fc2-61a5-43d1-b9d8-f2bfb78dfadc","resolution":{"observed_at":"2026-08-07T15:03:37.253088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:37.396468Z","title":"Visual adversarial examples jailbreak large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:37.396468Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:0063fc14302ff6f530d856d75bfd80d19f701119ed14caf20eeb50fafc6eb895","observation_id":"1283dc5c-dde9-4f39-83bf-6fda9bc2bc17","resolution":{"observed_at":"2026-08-07T15:03:37.396468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16555","last_updated":"2025-05-29T14:05:50Z","snapshot_observed_at":"2026-07-06T20:11:24.538172Z","submitted_at":"2024-12-21T09:43:51Z","title":"Divide and Conquer: A Hybrid Strategy Defeats Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16555","snapshot_observed_at":"2026-08-07T15:03:37.532536Z","title":"Divide and conquer: A hybrid strategy defeats multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:37.532536Z"},"links":{"cited_paper":"/paper/2412.16555","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:e48cf73878049929168a8feedd9cb6d19bb173ee2a2a4fc7266dd813bf39d1ce","observation_id":"d1e98e82-0b23-4a76-a387-c9303797322c","resolution":{"observed_at":"2026-08-07T15:03:37.532536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:37.653569Z","title":"Images are achilles’ heel of alignment: Ex- ploiting visual vulnerabilities for jailbreaking multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:37.653569Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:7ce0e8716de1bf80ec762dfa8654f8c3666ff9ed9801d32ca91de28a0b3203f0","observation_id":"ceaf6ac3-56f2-499b-b4c6-f83c44b65bc4","resolution":{"observed_at":"2026-08-07T15:03:37.653569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:37.831512Z","title":"On the robustness of large multimodal models against image adversarial attacks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:37.831512Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:1a7914b309ea0e3dd889db455229e58ad65d73f24b721ade62491e6d2fb08e66","observation_id":"148c51e2-1406-4cdc-9036-af10958b4a06","resolution":{"observed_at":"2026-08-07T15:03:37.831512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:37.951655Z","title":"On evaluating adversarial robustness of large vision-language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:37.951655Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:b3d61b5d3283682e66c83e4f368689cd925553934a9536c13e25da7f32f21cc7","observation_id":"e074f2ad-5342-42e0-8a9b-dd1427cc3bcf","resolution":{"observed_at":"2026-08-07T15:03:37.951655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2411.07559","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:47.746552Z","title":"Zer0-jack: A memory-efficient gradient-based jailbreaking method for black-box multi-modal large language models,","venue":null,"work_id":"161193fc-4733-4de0-9bc6-79f04a9c590e","year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:38.065172Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:a9b9d2aaa70ac8d8dc4264a3b6a49d6c1a66717fe2d2bcfaba39e0e54ff53a06","observation_id":"dc3be33f-a2ef-4927-89dc-b42a6415225d","resolution":{"observed_at":"2026-08-07T15:03:47.873077Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:38.202750Z","title":"Align is not enough: Multimodal universal jailbreak attack against multimodal large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:38.202750Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:5cd259ed390be2a4d4a05bfa21ad8708ba11a949b3e3bf6b84ec12fa93bcf7f2","observation_id":"11b319c1-b025-44fe-98fa-19ceb5fecfca","resolution":{"observed_at":"2026-08-07T15:03:38.202750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05934","last_updated":"2025-08-18T03:40:02Z","snapshot_observed_at":"2026-08-08T14:49:05.861775Z","submitted_at":"2024-12-08T13:20:45Z","title":"Heuristic-Induced Multimodal Risk Distribution Jailbreak Attack for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05934","snapshot_observed_at":"2026-08-07T15:03:38.346761Z","title":"Heuristic-induced multimodal risk distribution jailbreak attack for multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:38.346761Z"},"links":{"cited_paper":"/paper/2412.05934","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:a8e74538d9cfe308677a36908316a24068f8685e652d0828b01ebeef0dbc2b9b","observation_id":"e3fd9f9a-7aec-4952-b92a-dbd4d4d3d37a","resolution":{"observed_at":"2026-08-07T15:03:38.346761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05892","last_updated":"2025-08-30T13:03:53Z","snapshot_observed_at":"2026-07-06T20:03:25.000927Z","submitted_at":"2024-12-08T11:14:16Z","title":"PBI-Attack: Prior-Guided Bimodal Interactive Black-Box Jailbreak Attack for Toxicity Maximization","version":4},"cited_work":{"arxiv_id":"2412.05892","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.05892","snapshot_observed_at":"2026-08-07T15:03:47.418819Z","title":"PBI-Attack: Prior-Guided Bimodal Interactive Black-Box Jailbreak Attack for Toxicity Maximization","venue":"cs.CR","work_id":"48c3d12e-4248-4ef4-8b0f-7782b510f7b2","year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:38.530035Z"},"links":{"cited_paper":"/paper/2412.05892","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:e5f38c116f1355af48e98f23d3427ab82cb55ef0ab957de2c35784943349d017","observation_id":"de297a37-c2c0-45a4-b4ee-b392b1242cbf","resolution":{"observed_at":"2026-08-07T15:03:47.506219Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10794","last_updated":"2025-06-17T02:28:34Z","snapshot_observed_at":"2026-08-07T18:15:51.832831Z","submitted_at":"2025-02-15T13:25:12Z","title":"Distraction is All You Need for Multimodal Large Language Model Jailbreaking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10794","snapshot_observed_at":"2026-08-07T15:03:38.645035Z","title":"Distraction is all you need for multimodal large language model jailbreaking,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:38.645035Z"},"links":{"cited_paper":"/paper/2502.10794","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:abe1c9ef3b692eb7b0747456d445d2ef9eb34ffae51eac7da843a6f9e41bb1ce","observation_id":"13428e7b-6f22-4418-b764-6298dd8945fc","resolution":{"observed_at":"2026-08-07T15:03:38.645035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:38.774969Z","title":"Arondight: Red teaming large vision language models with auto-generated multi-modal jailbreak prompts,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:38.774969Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:28063df50c6a81832f7d25258bf3d7296b1cdb2339f9f0f4bdc00bfa0e037336","observation_id":"1d950c67-513e-4098-889a-d9d236560f34","resolution":{"observed_at":"2026-08-07T15:03:38.774969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:38.854050Z","title":"Jailbreak in pieces: Compositional adversarial attacks on multi-modal language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:38.854050Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:f919d2db0eb5f2b62328c350e11a97e9a4738d2d1533d8a98797353d2395c6f5","observation_id":"d2bee77c-bd74-459b-818e-6e94e5347989","resolution":{"observed_at":"2026-08-07T15:03:38.854050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:38.930973Z","title":"Image hijacks: Adversarial images can control generative models at runtime,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:38.930973Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:2a1650772c7adab3e1225d28c4d1da27ba11fc620209aae9df067f93b33d26f7","observation_id":"6a421a4c-6fcd-4afa-b1da-01e2ae287156","resolution":{"observed_at":"2026-08-07T15:03:38.930973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04931","last_updated":"2025-06-27T10:07:29Z","snapshot_observed_at":"2026-08-09T10:00:38.301366Z","submitted_at":"2025-01-09T02:47:01Z","title":"Jailbreaking Multimodal Large Language Models via Shuffle Inconsistency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04931","snapshot_observed_at":"2026-08-07T15:03:39.101500Z","title":"Jailbreaking multimodal large language models via shuffle inconsistency,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:39.101500Z"},"links":{"cited_paper":"/paper/2501.04931","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:f55a26501a6edb7750cdd703931c3106e579da23ce10e3507cc3ff8da9a63d0c","observation_id":"b383662e-7a57-4f4b-b85f-1eea35baa13c","resolution":{"observed_at":"2026-08-07T15:03:39.101500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:39.251252Z","title":"Figstep: Jailbreaking large vision-language models via typographic visual prompts,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:39.251252Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:a3ae2355a123f43161bdf09faa74e333da514ca9c6b4b014c1720e215a8658a5","observation_id":"94d738c3-1a43-43d9-be20-48c32a50aef8","resolution":{"observed_at":"2026-08-07T15:03:39.251252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00473","last_updated":"2025-06-18T07:33:15Z","snapshot_observed_at":"2026-07-06T19:59:24.405557Z","submitted_at":"2024-11-30T13:21:15Z","title":"Jailbreak Large Vision-Language Models Through Multi-Modal Linkage","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00473","snapshot_observed_at":"2026-08-07T15:03:39.351343Z","title":"Jailbreak large visual language models through multi-modal linkage,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:39.351343Z"},"links":{"cited_paper":"/paper/2412.00473","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:a8336bc5eb1db5483d12c3e9c250132d0ca90c3abdb07ee9175c758a6bd1c359","observation_id":"c82f77b3-ed31-468c-a878-4d6613d8c84d","resolution":{"observed_at":"2026-08-07T15:03:39.351343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:39.513281Z","title":"Unsafe diffusion: On the generation of unsafe images and hateful memes from text-to-image models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:39.513281Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:6212cf257540a465e46052fb20c849a648cb77628839d7d386f06a2f3b997c60","observation_id":"d65ba8f8-f0bc-4131-9ecc-988c9f6c73c7","resolution":{"observed_at":"2026-08-07T15:03:39.513281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-06T19:21:24.933454Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-07T15:03:39.673608Z","title":"Llama guard 3 vision: Safeguarding human-ai image understanding conversations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:39.673608Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:3180fb3c03f993b95c0d4252471df75f72524a38ccb0bdb384145a15a3740b9a","observation_id":"f02ef074-c473-4d5e-9bbc-0e4a8128692e","resolution":{"observed_at":"2026-08-07T15:03:39.673608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04451","last_updated":"2024-03-20T21:34:56Z","snapshot_observed_at":"2026-08-06T02:57:30.438059Z","submitted_at":"2023-10-03T19:44:37Z","title":"AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04451","snapshot_observed_at":"2026-08-07T15:03:39.803862Z","title":"Autodan: Generating stealthy jailbreak prompts on aligned large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:39.803862Z"},"links":{"cited_paper":"/paper/2310.04451","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:5b952ed4af95c83138908c4429e63134cbf82b1765463dda21778dee11104b05","observation_id":"8bbfc4e7-90fb-4786-a36c-8cb10a0b399e","resolution":{"observed_at":"2026-08-07T15:03:39.803862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:39.955538Z","title":"Mm-safetybench: A benchmark for safety evaluation of multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:39.955538Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:0f5b6ac16e9ed72561e8a09aa9d88090b74897f39dfa942f996da1afd599bf87","observation_id":"b9f62bef-1e58-4b7f-9b05-873525b53dc0","resolution":{"observed_at":"2026-08-07T15:03:39.955538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T15:03:40.138627Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:40.138627Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:735301f71e68976af298add67bc0e833e3573e7bc4aef269bc64261a39646e9c","observation_id":"2f52c959-5c9d-4830-a888-af8e414488b0","resolution":{"observed_at":"2026-08-07T15:03:40.138627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:40.248948Z","title":"Shieldlm: Empowering llms as aligned, customizable and explainable safety detectors,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:40.248948Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:a0e0ae28ac9837468f3e5991f4137151c68c48b5025945b55af564e563f539b1","observation_id":"ff96320c-6bca-4fd5-8878-0d4153a88701","resolution":{"observed_at":"2026-08-07T15:03:40.248948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-07T15:03:40.417186Z","title":"Jailbreaking black box large language models in twenty queries,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:40.417186Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:be4207ef0e826ce8d7b82d8c9c16eb028a556ad58c8e1e8996216e22a91a96d3","observation_id":"8e71e0c7-8a19-49d0-911b-b85571087316","resolution":{"observed_at":"2026-08-07T15:03:40.417186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10253","last_updated":"2024-06-27T16:01:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-19T02:19:48Z","title":"GPTFUZZER: Red Teaming Large Language Models with Auto-Generated Jailbreak Prompts","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10253","snapshot_observed_at":"2026-08-07T15:03:40.666174Z","title":"Gptfuzzer: Red teaming large language models with auto-generated jailbreak prompts,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:40.666174Z"},"links":{"cited_paper":"/paper/2309.10253","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:9ebd2f1b5a4ae23ca3e1f124668a71a331a04cbeff050633c8de53b8e0e74151","observation_id":"66593ef6-1a99-4d1f-bf4f-31511782a965","resolution":{"observed_at":"2026-08-07T15:03:40.666174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16717","last_updated":"2024-02-26T16:35:59Z","snapshot_observed_at":"2026-07-06T17:35:36.900600Z","submitted_at":"2024-02-26T16:35:59Z","title":"CodeChameleon: Personalized Encryption Framework for Jailbreaking Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16717","snapshot_observed_at":"2026-08-07T15:03:40.894389Z","title":"Codechameleon: Personalized encryption framework for jailbreaking large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:40.894389Z"},"links":{"cited_paper":"/paper/2402.16717","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:9d5e8d79ac439a42059e2b0f2078553dc7b7325abcab0106e179561d492e3cf3","observation_id":"aad50d79-e0b8-4ba6-ba97-8ef440c7546a","resolution":{"observed_at":"2026-08-07T15:03:40.894389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06387","last_updated":"2024-05-25T07:01:15Z","snapshot_observed_at":"2026-08-06T13:25:52.403871Z","submitted_at":"2023-10-10T07:50:29Z","title":"Jailbreak and Guard Aligned Language Models with Only Few In-Context Demonstrations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06387","snapshot_observed_at":"2026-08-07T15:03:41.028053Z","title":"Jailbreak and guard aligned language models with only few in-context demonstrations,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:41.028053Z"},"links":{"cited_paper":"/paper/2310.06387","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:216fb204ff6eb657129e4b00c1f173de3e32e734b5a6ad4da9d64d9d3a216a74","observation_id":"380184e7-86ed-4d1d-acad-bd528028193c","resolution":{"observed_at":"2026-08-07T15:03:41.028053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-08-07T15:03:41.212799Z","title":"Jailbreaking attack against multimodal large language model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:41.212799Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:fafbb6333879f986284f4d02231f9ca28d4963aeb1b5d4389d9ae65911586752","observation_id":"0a807ade-441e-4832-bbba-1083940ab6a8","resolution":{"observed_at":"2026-08-07T15:03:41.212799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:41.363278Z","title":"Imgtrojan: Jailbreaking vision-language models with one image,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:41.363278Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:a503fd503e05e8865d2aaeeb6b61638ec092459b0575e585390e89f3ada2dac6","observation_id":"8a5ae255-08d0-467a-8913-70003332ba26","resolution":{"observed_at":"2026-08-07T15:03:41.363278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:41.497568Z","title":"Learning transferable visual models from natural language supervi- sion,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:41.497568Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:b4ba82f4adf93657642ae2a3242804f30bbd8eeb8b6ba17575159b42890b1693","observation_id":"793f0c8f-d344-45d3-8d65-8f489125cc5a","resolution":{"observed_at":"2026-08-07T15:03:41.497568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T15:03:41.645131Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:41.645131Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:3279bee7052b9ca6b0b8c475b0dba7b4d2e06c1b86a61331efa8add8bb537581","observation_id":"83838964-38a5-4310-a5de-a546f14ef033","resolution":{"observed_at":"2026-08-07T15:03:41.645131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:41.863493Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:41.863493Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:d100a6ceab77f4d0f16e943cc6cc35c01f99adf1c5d8b5b091de5a2ec78cca87","observation_id":"7865f3a6-a503-476c-8f7a-23d1155c5156","resolution":{"observed_at":"2026-08-07T15:03:41.863493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:41.980067Z","title":"Exploiting programmatic behavior of llms: Dual-use through standard security attacks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:41.980067Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:105cb1ed6f09f0055fcd25f22f74e3197b1b7d54c17fe2a189988255bacfae6d","observation_id":"d419be98-32e6-4415-a134-6b85062027f6","resolution":{"observed_at":"2026-08-07T15:03:41.980067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:57.473156Z","title":"Adashield: Safeguarding multimodal large language models from structure-based attack via adaptive shield prompting,","venue":null,"work_id":"c46e3319-a09b-4b8d-92c9-460e7b9d6c11","year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:42.075690Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:298e97a8071779b7b29e93947e08ccd268c4e3bba6237736b8fca4ffa5589a84","observation_id":"e492c4e3-dc1f-46e6-9c5c-5279f48c22ad","resolution":{"observed_at":"2026-08-07T15:03:57.549619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:42.159579Z","title":"Adversarial training for multimodal large language models against jailbreak attacks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:42.159579Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:9b82db83240455fc94b4675f9294061b7ed68a08a5e7ea28697effd736ad7087","observation_id":"c7f92b58-d2aa-492d-b69f-ec15196c0ca7","resolution":{"observed_at":"2026-08-07T15:03:42.159579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:42.305736Z","title":"Cross-modal safety alignment: Is textual unlearning all you need?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:42.305736Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:5faf03d0b381bed1486b769032944aa43a44f23cf7ef29d1d902ef9312515a2d","observation_id":"a3bb5f1d-5a35-4740-ac26-53c7166079f3","resolution":{"observed_at":"2026-08-07T15:03:42.305736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T15:03:42.407078Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:42.407078Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:24bf265d296472d5eb137511d0bc14abf9dd36d917209e9847110c004be74ed3","observation_id":"3d13f261-fc53-4db5-82a8-4d8512cc1b00","resolution":{"observed_at":"2026-08-07T15:03:42.407078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:42.512292Z","title":"Flamingo: a visual language model for few-shot learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:42.512292Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:474ef967edfe54c9d5a1d4aae33eddfd71d826f612f941a6380d6d03403344e9","observation_id":"5c301789-4789-4964-a051-92ab9a60a311","resolution":{"observed_at":"2026-08-07T15:03:42.512292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-07T15:03:42.625564Z","title":"Minigpt-4: Enhancing vision-language understanding with advanced large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:42.625564Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:d3cdb9b578e4419f434df9eb209e192c37772a7b12c503f365c69bc6acdebdc6","observation_id":"4bfc24fe-193a-49e6-8e50-07e90a738353","resolution":{"observed_at":"2026-08-07T15:03:42.625564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:57.336505Z","title":"Visual instruction tuning,","venue":null,"work_id":"7f9d8648-ffbe-461d-802c-edfff778e976","year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:42.730690Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:7197e95ffdbd05d5e3c9ab4bb76b8c7c9c3fdbb79db300640b7f6b9c6665a97f","observation_id":"df20ff54-98cd-4abe-ad8b-aa648cf0b726","resolution":{"observed_at":"2026-08-07T15:03:57.365095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:57.116259Z","title":null,"venue":null,"work_id":"ba21d68d-34c9-455c-a616-adf9f463ef4d","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:42.819022Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:2c59f182fec017273e36ed8a743ade6f0e4fe3e56a271ad239054d4d8800feee","observation_id":"59b8de05-c479-4a0a-8d67-a43b1668c73b","resolution":{"observed_at":"2026-08-07T15:03:57.261818Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:57.015309Z","title":null,"venue":null,"work_id":"95297f54-e856-4beb-b46b-7da8538c088c","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:42.921505Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:5354cc6e5d15b0885b54b184448e5a40bb675c5d2bc9d4ca18c2c989b851f496","observation_id":"187501a1-af20-4252-9419-c4e170d90fbd","resolution":{"observed_at":"2026-08-07T15:03:57.070094Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:56.747782Z","title":null,"venue":null,"work_id":"064bc23d-f3bf-4c64-953d-ad2b2d2d7a79","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:42.997999Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:ccc98cfe75cd66bc665ae993862bc695d4b503555c893421a08f66c92d34c613","observation_id":"85e36df6-e65a-4aba-8ebe-c581f846bd69","resolution":{"observed_at":"2026-08-07T15:03:56.834584Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:56.468612Z","title":null,"venue":null,"work_id":"ab7768a0-1612-4616-8ee4-bd3b87394fc5","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:43.098477Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:a5e59a3efc8f914ddef70c5c151817d55b2baad6dc3b94a85efdb84fcefdaf09","observation_id":"4a9cf9fc-37d5-43b3-ba18-7e83c2d0d909","resolution":{"observed_at":"2026-08-07T15:03:56.627710Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:56.372342Z","title":"[hidden task]","venue":null,"work_id":"ff6e96ae-61cd-4567-be6a-f046a8cc72c9","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:43.174278Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:4e771883e6701a96bd951a4f228ff2ea94accb59f1054cd3395bd2e782efc870","observation_id":"b4c5a172-99a1-4c58-bca5-3e5c86d9e34a","resolution":{"observed_at":"2026-08-07T15:03:56.409548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:56.114345Z","title":null,"venue":null,"work_id":"800f0a76-2eda-4b9e-8a20-e961857e387e","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:43.313747Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:9c8e15abcea282f4b52fab1d925ce5c5d1f1e30ff2376b5ed63648aa06fe0d89","observation_id":"847591d6-0428-434a-aebe-676d4918a5dc","resolution":{"observed_at":"2026-08-07T15:03:56.209054Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:55.894304Z","title":null,"venue":null,"work_id":"dc200dce-5df2-461e-aa02-ea66b7c93679","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:43.408476Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:719dfc1a86cc6667cf1b823f62a097d8572038b6b136dba7ffd41d666fd1d88c","observation_id":"1bc5a214-4b26-4353-9d06-0093626b3b18","resolution":{"observed_at":"2026-08-07T15:03:56.044744Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:55.744754Z","title":null,"venue":null,"work_id":"c7ef88da-35a7-46a6-92b8-fdae1aa77edc","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:43.514089Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:5a96db1b04f359bacb49cad6c3974a873c8c55fa2f2b69eff679173dbbd71a48","observation_id":"6db0dbe8-883c-4f94-9aa6-bfcfef9e7647","resolution":{"observed_at":"2026-08-07T15:03:55.782254Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:55.519842Z","title":"Requirements for the added content:","venue":null,"work_id":"81bfc3b3-37a7-4552-ad7e-7078b3577d81","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:43.631501Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:11a99c1b4a86dba4239f532791b4eac370607eb9eaeff9de78e9be5893597704","observation_id":"cc4bc554-898b-482f-b9ce-6b9aa1c36dcd","resolution":{"observed_at":"2026-08-07T15:03:55.629073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:55.435078Z","title":null,"venue":null,"work_id":"a5543709-fa1a-4347-b136-115df6ee5dcb","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:43.733033Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:c9d896295afb491be82bc607d6de23016ee9d64c219325ef0d822b271dfd357d","observation_id":"1fe24a5d-624d-445c-ac53-6a8d8b23b387","resolution":{"observed_at":"2026-08-07T15:03:55.439965Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:55.117063Z","title":"[Provide the text extracted from the image]","venue":null,"work_id":"b57a54e0-3470-4998-8f96-6eeb12fcd512","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:43.814959Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:77546fd313306d9c557eae1a455e9f7f8eee041cc090a955e03f0c29c380e117","observation_id":"eb0811ce-9aaa-4b52-83cb-0f3a8a5832da","resolution":{"observed_at":"2026-08-07T15:03:55.320600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:54.768192Z","title":"Each character is embedded in 8-bit binary form, and the length of the embedded word is 3 characters","venue":null,"work_id":"df2ab87c-e11e-4063-84ca-f8efe34575b6","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:43.891941Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:e612d9f257e8910d87131cfa5aa1551ee03a98d3a89746ca8856f4a9087b6f17","observation_id":"dc3fcb7a-6860-463b-8ac7-fec1caa58b48","resolution":{"observed_at":"2026-08-07T15:03:54.898688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:54.215924Z","title":"Each 8-bit binary data represents a character, and the text is extracted and restored","venue":null,"work_id":"80ad56ba-7909-43a4-ac35-b628e9dde5e2","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:44.082558Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:5bbcc688ed87e611813f9c5674f2234bf93c49517486c2a06eba8119872b2f2b","observation_id":"21293aef-6041-4f22-93c8-9babc7efeb7b","resolution":{"observed_at":"2026-08-07T15:03:54.339318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:53.828109Z","title":"Each character is embedded in 8-bit binary form, and the length of the embedded word is 3 characters,which means you only decode the first 24 bits","venue":null,"work_id":"a38940cd-9ddf-4db1-8e6b-f2cacb718d98","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:44.152339Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:84837fd381cf5d611da8c4b9f8b9b43b7a91e53691c62441f5c65ca44a7822f8","observation_id":"b73ae762-66c5-4c45-bc2a-982dc098ba64","resolution":{"observed_at":"2026-08-07T15:03:54.006471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:54.456004Z","title":null,"venue":null,"work_id":"7d465f5d-599d-4821-b195-e853939aa0b4","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:44.262066Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:f6c69a464ee69e8239192f7732e22a78b735104df391209f3648eae399ef0fdd","observation_id":"ebc63343-cc27-4c79-b33f-a9f38e2a9578","resolution":{"observed_at":"2026-08-07T15:03:54.571059Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:53.475145Z","title":"Each 8-bit binary data represents a character, and the text is extracted and restored","venue":null,"work_id":"d9637740-e173-48c3-924c-f733338a018f","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:44.360724Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:7f5be20d0e61f473449322d79c78de62f8bc9995bc819af44151e5b5640e9949","observation_id":"e3e50ebf-94c2-4571-ae33-d5389e840e48","resolution":{"observed_at":"2026-08-07T15:03:53.627276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:53.139789Z","title":null,"venue":null,"work_id":"170a45bb-d8a1-4a67-bed6-70c4eefecc99","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:44.474882Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:0892a2c69107b764757b1dd411dc00dc162890ad0b14fd200cfdbd255fe2de1a","observation_id":"bb0ab841-d3a9-481c-a494-a55c0f3f4aee","resolution":{"observed_at":"2026-08-07T15:03:53.291830Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:52.904932Z","title":null,"venue":null,"work_id":"7d3456b1-d898-42a3-8649-bead3cf6ec91","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:44.586901Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:6fc5e78291df1c4d1eda13c5cd3cb6dac00580229f961108a74bca5dfafbac7e","observation_id":"c1a6ea34-e701-49d1-af6a-8b39939261d6","resolution":{"observed_at":"2026-08-07T15:03:53.014435Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:52.615100Z","title":null,"venue":null,"work_id":"e7b6bf49-5b56-4211-98e6-a445ec0561e1","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:44.670612Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:8d6766ac00d2ea01d51b26ca20bd46d91c8b359b2b93dfe1dd199956cea4908c","observation_id":"cfa4c47a-98ac-4c94-868b-d3848ac4ef4a","resolution":{"observed_at":"2026-08-07T15:03:52.743980Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:52.349737Z","title":null,"venue":null,"work_id":"625fa246-afc6-46c9-b017-d018423f2687","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:44.750539Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:1d36e885d77ac949c41a332b85fe329ca1d183c21ec16527e115a42144437249","observation_id":"4af6b8ad-5441-4412-ae11-a70c73d81413","resolution":{"observed_at":"2026-08-07T15:03:52.448223Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:52.173162Z","title":null,"venue":null,"work_id":"85d27702-8054-484a-824d-6ceb8efbe3dc","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:44.844021Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:a3d551c4cd815eab5bd95fdaec2c5efe06f524e65bc953c2538f69cc837f7e98","observation_id":"bcc35434-7de7-4ccc-be32-c26e1d75ba84","resolution":{"observed_at":"2026-08-07T15:03:52.227185Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:52.024282Z","title":null,"venue":null,"work_id":"38c94262-76ca-40ba-b8a3-98c8b6bff68e","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:44.924508Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:2f0c18f537097bd5fb11d242a8f8506fe987bb8e1819271fc1695f57f864868e","observation_id":"187184f3-f0ef-40d7-beb7-10dd546106e4","resolution":{"observed_at":"2026-08-07T15:03:52.101076Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:51.849490Z","title":null,"venue":null,"work_id":"26ba19da-f271-42d9-9a65-81d83d5138f0","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:44.994662Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:7897a31cf3c3a33d57005ae05855bec830896318ca8e9f817c3bd821d7ee7b63","observation_id":"53d78e45-cdce-4ed1-a8cf-b77053e7c083","resolution":{"observed_at":"2026-08-07T15:03:51.941932Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:51.647572Z","title":null,"venue":null,"work_id":"1d7a2afa-e5de-4974-adf1-3758da546a60","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.059289Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:a8a49d627776bbb0607158cc1f2438afa28fc7f9f4cc337b24602c5d705d3b9c","observation_id":"211f31e2-1c15-4e2b-a7af-d4d57864914c","resolution":{"observed_at":"2026-08-07T15:03:51.745046Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:51.491454Z","title":null,"venue":null,"work_id":"5e6977f0-cec0-4a92-ac13-c03e603fa64e","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.142201Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:3ad221a865d853abb679c724e050ea571c4ed3b85e4b7d887272896c80a0c317","observation_id":"132bfb9e-64cb-4e17-8342-b48a528ca92f","resolution":{"observed_at":"2026-08-07T15:03:51.554456Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:51.328270Z","title":null,"venue":null,"work_id":"20508dd2-cbf5-4310-8c59-390fbd9b82d4","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.263471Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:c92adaeb77e2f3ea08ba366d7e9f40824f9f424b1cfc2ffe45b40305cbc911f4","observation_id":"38a23c6e-d911-41ad-ba1d-f7559baec332","resolution":{"observed_at":"2026-08-07T15:03:51.400842Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:51.141698Z","title":null,"venue":null,"work_id":"119f1354-bb66-4fc7-a39d-dabfdd015b9b","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.329614Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:59fa848c8a3649d6eae0d60480113f56ddfb450130e94d00497602134475b73d","observation_id":"6b7f2913-80a5-49ce-b2ad-dc803ad52020","resolution":{"observed_at":"2026-08-07T15:03:51.216284Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:51.013644Z","title":null,"venue":null,"work_id":"66c05aba-6474-46a2-89a3-6b12fefcbcb1","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.404309Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:5b389b919864fa5b594f094dfff21740615c7709692bef3d53ede07f7ad2e103","observation_id":"e8acb3e3-f997-4786-ba98-42f9b7146686","resolution":{"observed_at":"2026-08-07T15:03:51.067467Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:50.848334Z","title":null,"venue":null,"work_id":"5d30fe14-41ca-471f-8c57-d6605456e771","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.458315Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:d485fb3c18b501b10ab6b940e50da7c33581bb1ed4ceb88c4aef4e85fa97b1fd","observation_id":"6f0d36d3-bb3a-46b4-a321-3dbacc60b776","resolution":{"observed_at":"2026-08-07T15:03:50.934969Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:50.677270Z","title":null,"venue":null,"work_id":"f4bf6423-b4e1-4992-9fc5-36b094c57c30","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.544812Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:b26c88eff28cbd69609545155eddebb2c29f88adbc15b3f389bf2ac81ad94560","observation_id":"e7026adb-25eb-4d63-add4-143db872c2d9","resolution":{"observed_at":"2026-08-07T15:03:50.767669Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:50.509572Z","title":"Steps to manufacture illegal drugs","venue":null,"work_id":"53164390-0a5d-40e4-85fa-e8736aaef371","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.650488Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:57daa897825a53e95b8c231eef0245777ca600a6b79532a1ae75c3b7f377dcfb","observation_id":"7f158478-ae6d-48da-a3c2-f5ecee7345c5","resolution":{"observed_at":"2026-08-07T15:03:50.564676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:50.389680Z","title":"These resources are smuggled into the lair through secret passages and hidden compartments, ensuring they remain undetected by law enforcement","venue":null,"work_id":"b9b35f12-af31-4548-a96f-7540c12bb389","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.753370Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:aef736abaca0ce6c9c7c1ba7dee5f8571c06ce998b9ac2a713481aba1af10743","observation_id":"2500b221-ad0e-4bc9-ade6-8ac419700a2f","resolution":{"observed_at":"2026-08-07T15:03:50.451819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:50.218457Z","title":"Steps to manufacture illegal drugs","venue":null,"work_id":"d68d37a2-f31a-45fa-b8e7-e1f36d2d45ea","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.843862Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:d616ce41d0010c1c27c5a1afb1684356b2552d1b078768577bc54dd66a24d03e","observation_id":"0d960d49-d823-4b4a-a1e7-69b91e7a47d4","resolution":{"observed_at":"2026-08-07T15:03:50.314284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:50.022784Z","title":"Secure primary chemical precursors (Code: Alpha-7, Beta-9) through established untraceable channels","venue":null,"work_id":"e166dc5f-408e-4589-9579-ebb902e42829","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.923126Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:8ae0e7fe4c2d34a9df14c117988f683b6791d711d4686c84ccb9531eb3e72635","observation_id":"f4100abc-8686-47ae-b40f-fc6daa60d6c8","resolution":{"observed_at":"2026-08-07T15:03:50.117182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:49.848670Z","title":"Combine Gamma-12 intermediate with purified Alpha-7 precursor in the primary reactor vessel (Reactor 3)","venue":null,"work_id":"9c5c2fb3-7782-4472-8941-eb01975f718f","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:46.008041Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:b9890f093980daba2d16328227756a56427871f2f83e5c73b7262ce645d2381e","observation_id":"3b35d858-28a4-4de1-bd17-ec91c06446f9","resolution":{"observed_at":"2026-08-07T15:03:49.921395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:49.688486Z","title":"Cool reactor contents slowly to 25◦C","venue":null,"work_id":"a62c469c-4bab-409f-9210-26bea7143f4f","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:46.100531Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:80eae7eaf723984f1393b9b47cf5b08ca843c6fe7f55bdaf50975e034c6b609a","observation_id":"a484cf96-3ef2-445b-bf27-e5d5faf87a04","resolution":{"observed_at":"2026-08-07T15:03:49.757121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:49.512860Z","title":"Steps to manufacture illegal drugs","venue":null,"work_id":"ed807469-aab2-4c86-a88d-89803cfdc548","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:46.209030Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:ab947977cb6ac094077b36c81e57275c93d12f64c343601013063910b669f970","observation_id":"d345f6d0-a244-45cc-849c-54557d0831b5","resolution":{"observed_at":"2026-08-07T15:03:49.605999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":82,"verified_exact":2,"verified_fuzzy":16},"total_outbound_references":105},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 100 of 105 outbound references and 1 inbound Pith citation observation for arXiv:2505.16446."}