{"as_of":"2026-08-11T07:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fb4781b0e4aee522a2bcbb142f1e1a3fe693698d27ba28adee30962a66ed3f8b","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:42:43.269669Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.16760/citation-record","integrity":"/paper/2506.16760/integrity","json":"/paper/2506.16760/citation-record.json","paper":"/paper/2506.16760"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:38.365135Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:38.365135Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:69704c26a3e4370b7526de2ea170c967b8bed1061f9aedacdad7aea23f728553","observation_id":"d204f17c-1770-4b55-97e0-ac8438e63efb","resolution":{"observed_at":"2026-08-06T23:42:38.365135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T23:42:38.611607Z","title":"arXiv preprint arXiv:2303.08774 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:38.611607Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:07b8f7c05fc4296052b471866ee4b98c082af124e8ba5d05b879fb419c7c3621","observation_id":"41261ed3-e84b-4928-af26-2b0df8d2067b","resolution":{"observed_at":"2026-08-06T23:42:38.611607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:49.738002Z","title":"https://together.ai (2025), accessed: 2025- 06","venue":null,"work_id":"1e52fc77-8e60-43b7-8447-2fdee884402c","year":2025},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:38.735036Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:b742d60fd734e21aff4a353d3d6171eb022a9f7f5f45d4721dad49c4963a4b30","observation_id":"fbfa95c3-7b3a-4a3b-a2db-1260d716177a","resolution":{"observed_at":"2026-08-06T23:42:49.814753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02151","last_updated":"2025-04-17T18:55:45Z","snapshot_observed_at":"2026-08-10T11:04:18.421023Z","submitted_at":"2024-04-02T17:58:27Z","title":"Jailbreaking Leading Safety-Aligned LLMs with Simple Adaptive Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02151","snapshot_observed_at":"2026-08-06T23:42:38.875494Z","title":"arXiv preprint arXiv:2404.02151 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:38.875494Z"},"links":{"cited_paper":"/paper/2404.02151","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:f9c9312090c76ced01f32b8f1cd399cd464d74e4c80eeb6225ecfe4e8f55f0b9","observation_id":"22ca9b99-9f0f-4a3f-a0e6-42b811b09326","resolution":{"observed_at":"2026-08-06T23:42:38.875494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-06T23:42:38.985969Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:38.985969Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:86d5f76af89da795f00e643b7102e83e1f87c1f521607851bd69609c846c86f8","observation_id":"864b1d06-e646-4b04-8962-2d50ea9004ea","resolution":{"observed_at":"2026-08-06T23:42:38.985969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:49.454831Z","title":null,"venue":null,"work_id":"6626b999-65c2-4159-92d9-efc7b7bfb130","year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:39.101586Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:91b00815a9a346e9b487d22b14a5bde60fc078f6cacb29708d7b74247fc2b283","observation_id":"9af55388-72f1-4d6d-8645-b79be8e28636","resolution":{"observed_at":"2026-08-06T23:42:49.563495Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-06T23:42:39.216412Z","title":"arXiv preprint arXiv:2310.08419 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:39.216412Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:ad06ccb7c0bb5e1928251699bd8f292d92342e37311ac8f503710058876cbd53","observation_id":"6bc3847a-7a3e-4c32-af17-778fd7fab464","resolution":{"observed_at":"2026-08-06T23:42:39.216412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:49.204892Z","title":"In: Proceedings of the AAAI Confer- ence on Artificial Intelligence","venue":null,"work_id":"2fff6e1c-55c2-4de7-b852-ac86aae09ce2","year":2025},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:39.317685Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:ae64de4f98efa969c7a9529e70502f69988e4fb5ea4c69128d2de56f34f3a014","observation_id":"58d4f8c3-ac1a-4392-9c3d-2dfed39261b3","resolution":{"observed_at":"2026-08-06T23:42:49.303543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:39.438993Z","title":"arXiv preprint arXiv:2402.10601 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:39.438993Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:535816a4f2be77b8ce467d70db78748c32bc84d92dc5291caaaf817dbeadd57b","observation_id":"7d6339da-4eb8-4313-87ea-e6e94e8870cf","resolution":{"observed_at":"2026-08-06T23:42:39.438993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-06T23:42:39.589878Z","title":"arXiv preprint arXiv:2410.21276 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:39.589878Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:0abae84bbf6260a5de5358cc1322069bbacfd5b4be1c57f325949c2224118a3f","observation_id":"c63fd57d-3bff-4954-9b0f-a10b07749024","resolution":{"observed_at":"2026-08-06T23:42:39.589878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:48.970848Z","title":"https://pypi.org/project/easyocr/1.7.1/ (2023), accessed: 2024-02-09","venue":null,"work_id":"3a16b87f-37db-4f81-9898-476802092640","year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:39.787246Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:2faa77f1c8d7e11c45f1e0b01a79ca55e11829459e52b4a4066173d0b346c8ba","observation_id":"835a3e93-2361-4b44-b00c-33241bd8a543","resolution":{"observed_at":"2026-08-06T23:42:49.054821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00614","last_updated":"2023-09-04T17:47:36Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:44Z","title":"Baseline Defenses for Adversarial Attacks Against Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00614","snapshot_observed_at":"2026-08-06T23:42:39.896114Z","title":"arXiv preprint arXiv:2309.00614 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:39.896114Z"},"links":{"cited_paper":"/paper/2309.00614","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:7451eef387427078fbd29eaeba048f371de33bb3a4f608630ee665b5b072a6d1","observation_id":"ff304ecb-6229-456a-9f57-fe650cf25fc4","resolution":{"observed_at":"2026-08-06T23:42:39.896114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:48.725258Z","title":"In: International conference on machine learning","venue":null,"work_id":"db4e799b-b3bc-4cfb-a112-34b97f4c6837","year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:40.096590Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:0e4bb98f750b65e87628265b8445c9425937316b69fb776f3f243c3fad39b506","observation_id":"190e3b4f-485e-4189-80c1-27120b0fcbb8","resolution":{"observed_at":"2026-08-06T23:42:48.839995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:48.448672Z","title":"In: European Conference on Computer Vision","venue":null,"work_id":"02a8cd70-7c2c-44f4-b25b-8ada900c05a5","year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:40.255076Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:a14a33b58dd6f532e8f108a6ad864908e3aee409dcd50f4add370227205fdb92","observation_id":"b6ab3f03-9479-4fe9-a079-99a02e47787f","resolution":{"observed_at":"2026-08-06T23:42:48.558798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07921","last_updated":"2024-11-24T18:03:43Z","snapshot_observed_at":"2026-08-10T23:27:47.484934Z","submitted_at":"2024-04-11T17:05:50Z","title":"AmpleGCG: Learning a Universal and Transferable Generative Model of Adversarial Suffixes for Jailbreaking Both Open and Closed LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07921","snapshot_observed_at":"2026-08-06T23:42:40.394893Z","title":"arXiv preprint arXiv:2404.07921 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:40.394893Z"},"links":{"cited_paper":"/paper/2404.07921","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:679e99370fd7af05a0b872b9ef267df6a56aeb7f5576200691f4c9b2672b4ce9","observation_id":"6cbea444-5a75-419d-a0aa-fce307d28d7a","resolution":{"observed_at":"2026-08-06T23:42:40.394893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:48.194754Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"0a615ffe-8f3b-4b5a-a0a6-174bce50002b","year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:40.504823Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:831b351bd2a15c7742db2dd6621b7440585c65ab1b5d5ada0f5f853b1ea881d1","observation_id":"982b7b19-af86-4167-9b65-c5b88ab5fb9e","resolution":{"observed_at":"2026-08-06T23:42:48.304761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:47.924764Z","title":"In: 33rd USENIX Security Symposium (USENIX Security 24)","venue":null,"work_id":"f7638d63-415b-4d79-a8b0-3d738f232bff","year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:40.643737Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:83b2e31c0b513fbd2e0760506f9e1b00c3bf9be1f6e8ce979c77af27c1c071b8","observation_id":"e904f8bd-0f34-42c2-893e-6422cd680200","resolution":{"observed_at":"2026-08-06T23:42:48.024974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04451","last_updated":"2024-03-20T21:34:56Z","snapshot_observed_at":"2026-08-06T02:57:30.438059Z","submitted_at":"2023-10-03T19:44:37Z","title":"AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04451","snapshot_observed_at":"2026-08-06T23:42:40.739634Z","title":"arXiv preprint arXiv:2310.04451 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:40.739634Z"},"links":{"cited_paper":"/paper/2310.04451","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:bf2732a7309792ea90e040630b4642ca20ecb7bd1adc2ba8b9c469ad05ec7d1d","observation_id":"f947fcdf-6ac4-4019-b54a-c4a7f1f57347","resolution":{"observed_at":"2026-08-06T23:42:40.739634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03027","last_updated":"2024-11-24T06:22:37Z","snapshot_observed_at":"2026-08-06T14:20:00.145899Z","submitted_at":"2024-04-03T19:23:18Z","title":"JailBreakV: A Benchmark for Assessing the Robustness of MultiModal Large Language Models against Jailbreak Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03027","snapshot_observed_at":"2026-08-06T23:42:40.840053Z","title":"arXiv preprint arXiv:2404.03027 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:40.840053Z"},"links":{"cited_paper":"/paper/2404.03027","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:703d0f469a18da8a7faa30d1fd4a84089b6dba52d09224534ce90e02b455fcd0","observation_id":"79ed48ae-7ca7-4c59-b021-fe15e5a9a1cb","resolution":{"observed_at":"2026-08-06T23:42:40.840053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:47.714768Z","title":"Proceedings of Machine Learning Research235, 35181–35224 (2024)","venue":null,"work_id":"d0283d14-ee0b-4c02-b80d-3d7905ff0d49","year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:40.967020Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:11c3350ab61a58b730268667444fcf63890af96b4c2d4a9fb6c25bcfe530c4a7","observation_id":"68c36517-5c9c-4150-af93-e2a760df8424","resolution":{"observed_at":"2026-08-06T23:42:47.781778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-08-06T23:42:41.206394Z","title":"arXiv preprint arXiv:2402.02309 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:41.206394Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:63239065403b1774160fd482a33c3609b8b0e67d5d523540a02262cf736c157e","observation_id":"b4af6ff0-a14e-441c-983f-55d47c155843","resolution":{"observed_at":"2026-08-06T23:42:41.206394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:47.433056Z","title":"https://platform.openai.com/ docs/guides/moderation (2024), accessed: 2024-02-09","venue":null,"work_id":"c826a932-b16c-4e20-8f63-7d2495d73564","year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:41.294752Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:de4ab4733ea65246eecbe1e3d61e0a3b3aaf942b8e202330d199a9121a768688","observation_id":"2896ce1f-c4c1-4d4e-aa3f-cb99aedcc184","resolution":{"observed_at":"2026-08-06T23:42:47.544754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:47.164833Z","title":"https://openai.com/index/ gpt-4-1/ (2025), accessed: 2025-06","venue":null,"work_id":"530ccf91-28cc-4766-a78f-85a0d602959e","year":2025},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:41.417982Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:ebec9dfabc8b261505892af9baa7d3da5d857abc916b12abe0bf97bd6b5e691a","observation_id":"db215771-bb22-4178-8afe-facd88371c62","resolution":{"observed_at":"2026-08-06T23:42:47.275459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:46.984259Z","title":"In: The Twelfth International Conference on Learning Representations (2023)","venue":null,"work_id":"4709573f-5961-47b1-9800-d244d467b31e","year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:41.766685Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:9912b265ea1558ca696e4274a7cd9929fc29d1f8093c598a9196a8f67b43c530","observation_id":"6cd89896-2a5f-442b-896b-2f847f6f69fe","resolution":{"observed_at":"2026-08-06T23:42:47.048335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-06T23:42:41.934834Z","title":"arXiv preprint arXiv:2403.05530 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:41.934834Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:d6c5d2489ab7005f165e390b09127699c7f9f194d854f84a5261761635c5bb17","observation_id":"5ea30eb6-5d5f-4bf6-9d01-dc0b3a1c8436","resolution":{"observed_at":"2026-08-06T23:42:41.934834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:46.749381Z","title":null,"venue":null,"work_id":"92ae31da-57e1-4629-b06f-3b1f46ae5dcd","year":2025},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:42.057341Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:150e4b221276660e0fc71a41e5fe48c240b11cdfdfc9e32cbd6d062e4c086516","observation_id":"8a3a3a96-ad71-4c9d-b489-e026c2e90ac6","resolution":{"observed_at":"2026-08-06T23:42:46.854892Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-06T23:42:42.179391Z","title":"arXiv preprint arXiv:2307.09288 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:42.179391Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:ca14e5c1573b13b99087a19acede4c0b2b71a36cb94c61dd3986f85f91dac933","observation_id":"81fb3274-f7c0-480e-b65b-cb8f14eb9ac0","resolution":{"observed_at":"2026-08-06T23:42:42.179391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T23:42:42.384833Z","title":"arXiv preprint arXiv:2409.12191 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:42.384833Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:b7d433cf9c4bbb4bdceaff3af8bffa336bb341fc4a1d89c3dfa987f664d5fde1","observation_id":"e188cac1-90db-4257-90e6-106dfa414d3e","resolution":{"observed_at":"2026-08-06T23:42:42.384833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:46.574856Z","title":"In: Proceedings of the 32nd ACM International Conference on Multime- dia","venue":null,"work_id":"91dc9985-3918-4d79-aac9-0301c5c82279","year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:42.488866Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:ca1003da86c8a84865c1574799227f1b98131d95ec5bfbbde7e842b364f9c049","observation_id":"c05cc6b6-df0a-4b80-a1be-aba46ecb7652","resolution":{"observed_at":"2026-08-06T23:42:46.649677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03079","last_updated":"2024-02-04T08:23:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-06T13:04:39Z","title":"CogVLM: Visual Expert for Pretrained Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03079","snapshot_observed_at":"2026-08-06T23:42:42.594752Z","title":"arXiv preprint arXiv:2311.03079 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:42.594752Z"},"links":{"cited_paper":"/paper/2311.03079","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:3824fbeb4bb17c8e921827a18d6f7c81aa41fc98ed0d0a91c05762c4be132fa0","observation_id":"f1443ad0-5f48-4817-8693-1e369d10af80","resolution":{"observed_at":"2026-08-06T23:42:42.594752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-06T23:42:42.674859Z","title":"arXiv preprint arXiv:2407.10671 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:42.674859Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:986bcc0d2a7df72570c5279c3b93dd572671af44cf39027f035795529ef8b2a4","observation_id":"99ec7fa8-3e09-4ae9-8ff6-46491f808e1f","resolution":{"observed_at":"2026-08-06T23:42:42.674859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13549","last_updated":"2024-11-29T15:51:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T15:21:52Z","title":"A Survey on Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13549","snapshot_observed_at":"2026-08-06T23:42:42.738914Z","title":"arXiv preprint arXiv:2306.13549 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:42.738914Z"},"links":{"cited_paper":"/paper/2306.13549","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:1d055ca034581e9b6e70c682356d0e69551b31640675990b7b98c0d4558fc0cf","observation_id":"ab1fac99-7b25-45e7-aefb-79ca5e1c65eb","resolution":{"observed_at":"2026-08-06T23:42:42.738914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-06T23:42:42.798103Z","title":"arXiv preprint arXiv:2310.02446 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:42.798103Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:e278841128095abb6b64b26d18821f0e617bf8c3d33e1c36eb885fe4e8f098a1","observation_id":"feee3bb0-1f51-4cd0-a73d-c45e8e78c78d","resolution":{"observed_at":"2026-08-06T23:42:42.798103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06463","last_updated":"2024-03-26T04:23:12Z","snapshot_observed_at":"2026-07-06T16:05:31.757410Z","submitted_at":"2023-08-12T04:05:57Z","title":"GPT-4 Is Too Smart To Be Safe: Stealthy Chat with LLMs via Cipher","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06463","snapshot_observed_at":"2026-08-06T23:42:42.971360Z","title":"arXiv preprint arXiv:2308.06463 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:42.971360Z"},"links":{"cited_paper":"/paper/2308.06463","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:6fb0a96da3dff3b3c559311c90cf67364ed8a0c619be0473b6d7e9a2a397675c","observation_id":"820d8f86-6714-42f3-8fd9-c2763326728f","resolution":{"observed_at":"2026-08-06T23:42:42.971360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:46.324910Z","title":"In: Proceedings of the 62nd Annual Meeting of the Association for Computational Linguis- tics (V olume 1: Long Papers)","venue":null,"work_id":"89d29c7b-685d-47a7-842c-2a4d6d097dae","year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:43.045055Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:9e7a199295914b17b89be905bb0bb460d28e3831ca07e1888ac4969146a0504d","observation_id":"ad1bbe46-1f26-4f24-96cd-381d9f5f9ab1","resolution":{"observed_at":"2026-08-06T23:42:46.457553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-06T23:42:43.107250Z","title":"arXiv preprint arXiv:2304.10592 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:43.107250Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:b1a3a8401549141918fb406cc02b903ce9e429291207e09360afe2aa53860257","observation_id":"8282f364-aaa8-42d3-86a1-11243466b13c","resolution":{"observed_at":"2026-08-06T23:42:43.107250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-06T23:42:43.172464Z","title":"arXiv preprint arXiv:2307.15043 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:43.172464Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:c3d13558ca1e08f9d9b70f2558536aa07299b4c14d853f0b2853c827bc592ece","observation_id":"f732304b-780e-4793-b2b8-d551cfef81b4","resolution":{"observed_at":"2026-08-06T23:42:43.172464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:46.041471Z","title":null,"venue":null,"work_id":"9c58b147-8ee3-4fa4-ac00-0a46d7786577","year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:43.269669Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:2d095beb5bc48ffa2bbb60e656fefb5bbb8f849b37c83ddd1c5341385e2aec10","observation_id":"19f92926-8a56-4b08-abb8-150322b8b4cb","resolution":{"observed_at":"2026-08-06T23:42:46.123015Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T20:36:58.393923Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":0,"verified_fuzzy":13},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2506.16760."}