{"as_of":"2026-08-10T05:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d644ac12566b523da959736ba4324a508cb3e72f776936a7d6a45c4e2716cbdd","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T11:02:15.122716Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-17T04:15:38.632039Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-17T04:19:00.663878Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"cited_work":{"arxiv_id":"2507.23202","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23202","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adversarial-guided diffusion for multimodal llm attacks","venue":null,"work_id":"e69d17a3-e7fd-4729-b993-d7159cb47f11","year":2025},"citing_paper":{"arxiv_id":"2511.21893","last_updated":"2026-04-21T12:31:10Z","snapshot_observed_at":"2026-08-02T23:18:14.454521Z","submitted_at":"2025-11-26T20:18:20Z","title":"Breaking the Illusion: Consensus-Based Generative Mitigation of Adversarial Illusions in Multi-Modal Embeddings","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-17T04:15:38.632039Z"},"links":{"cited_paper":"/paper/2507.23202","citing_paper":"/paper/2511.21893"},"observation_digest":"sha256:d808e552e8d391f71d03319203ca0eeaf0081c169b74014cfb5e0c2fea0c395d","observation_id":"caf603f1-7592-4b30-b0be-4309dec69664","resolution":{"observed_at":"2026-05-17T04:19:00.669610Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.23202/citation-record","integrity":"/paper/2507.23202/integrity","json":"/paper/2507.23202/citation-record.json","paper":"/paper/2507.23202"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2309.00236","last_updated":"2024-09-17T19:56:09Z","snapshot_observed_at":"2026-08-06T06:17:45.496933Z","submitted_at":"2023-09-01T03:53:40Z","title":"Image Hijacks: Adversarial Images can Control Generative Models at Runtime","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00236","snapshot_observed_at":"2026-08-06T11:02:14.914452Z","title":"Image hijacks: Adversarial images can control generative models at runtime","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.914452Z"},"links":{"cited_paper":"/paper/2309.00236","citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:de7879b0003ab8c58dfa95eb68f7707ffb63b883b59c07bb3b643892366bacad","observation_id":"355b679a-62d3-4fc7-9471-be2b086b490b","resolution":{"observed_at":"2026-08-06T11:02:14.914452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.822384Z","title":"One transformer fits all distributions in multi-modal diffusion at scale","venue":null,"work_id":"a933d4b8-1c20-45a4-9e20-6fb843e85e67","year":2023},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.919697Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:540601fc9c58219660d4b26c3beaf90a6b0056136bca73da7aee1bbe268de632","observation_id":"c62a5ea3-2c0e-4f90-b56d-9a999fc89421","resolution":{"observed_at":"2026-08-06T11:02:15.827406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.807178Z","title":"A young boy is playing with a baseball bat A blue bird sitting on a tree branch","venue":null,"work_id":"b9a5f978-f075-49fb-a9cc-cc61f0061d5f","year":null},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.924173Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:683161ae1ffe5311c4b8d29be39a43582dde959518b3875986d861080c2f22cd","observation_id":"ed2edd90-7dc1-4ab1-9044-a9fe90407b89","resolution":{"observed_at":"2026-08-06T11:02:15.812072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.791549Z","title":"Content-based unrestricted ad- versarial attack","venue":null,"work_id":"c5adf899-ffca-41f8-8eae-3a700965397b","year":2023},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.928773Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:01cbf5b3a5d2f44bd5cf7007053ad49d45328c12c3e5a6cfbbaaf0e44627dc75","observation_id":"8cfd7638-7b51-4029-b89f-d3b4623b3371","resolution":{"observed_at":"2026-08-06T11:02:15.796284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:14.933642Z","title":"Vicuna: An open-source chatbot impressing gpt-4 with 90%* chatgpt quality","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.933642Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:078bfd6adf6a32b7cea92ac6c947253fa1d71dd5243aba1558e2b10a9409133d","observation_id":"43c1d343-721e-4c9b-9976-bf266da9df9c","resolution":{"observed_at":"2026-08-06T11:02:14.933642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.767231Z","title":"On the robustness of large multimodal models against image adversarial attacks","venue":null,"work_id":"479cd052-c48a-4e2c-bc97-65c7f47de2af","year":2024},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.938383Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:f98e5ef06f0306c81e232c4a55aaa55197a4c07e7799ae5206c27831fc05c6ef","observation_id":"7da7aae7-cc41-4aad-a373-23eae82ad1ae","resolution":{"observed_at":"2026-08-06T11:02:15.771932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.752201Z","title":"Advdiff: Gener- ating unrestricted adversarial examples using diffusion mod- els","venue":null,"work_id":"e37a9c5a-ce4e-4082-b052-30ca12de96bc","year":2024},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.942989Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:ca624cbfe7405cd282eda5076862c2ef1a92c6cec2369a3aa65cc518bf7c4ff8","observation_id":"ea777a4e-a16d-430e-913a-37b9db5a75a3","resolution":{"observed_at":"2026-08-06T11:02:15.756979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.738078Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"eee9ccd6-840c-4547-a525-9ddc0f7f0cad","year":2009},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.948000Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:6280126fda0f972e0e57404c58e4318d8c92011348954d4aa0927f20000bcb7f","observation_id":"a9e5bb1a-6779-4920-9501-d2b71f216fbf","resolution":{"observed_at":"2026-08-06T11:02:15.742560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.723036Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":"ea6cf73e-c64e-4840-9abc-b47a9f64cbeb","year":null},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.952243Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:6303c3fcf971847107f79656f0d4c706ed69b8bed87b52bfb601c95c5ad518fa","observation_id":"1eff578d-0d10-405b-8c4a-a89b2f974b38","resolution":{"observed_at":"2026-08-06T11:02:15.728424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.707611Z","title":"Boosting adversarial attacks with momentum","venue":null,"work_id":"ffbf08ea-1fa1-44f7-abd0-f9fca12f7c0e","year":2018},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.956655Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:cd5e7b5324d27dc952d22a0b6bbcfd27e7141905c5c8f6ce71c903ad7f3986a7","observation_id":"d39f371d-39c2-4fbd-9777-b201dad081b0","resolution":{"observed_at":"2026-08-06T11:02:15.712765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11751","last_updated":"2023-10-14T12:56:13Z","snapshot_observed_at":"2026-08-10T05:12:13.391312Z","submitted_at":"2023-09-21T03:24:30Z","title":"How Robust is Google's Bard to Adversarial Image Attacks?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11751","snapshot_observed_at":"2026-08-06T11:02:14.960784Z","title":"How robust is Google’s bard to adversarial image attacks? arXiv preprint arXiv:2309.11751, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.960784Z"},"links":{"cited_paper":"/paper/2309.11751","citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:4ca4e156be03a4d09fc229b76c57fa566d2f3722c6ba3cc9a4b0ea87a99b8d1a","observation_id":"b9826d94-4775-43a8-a039-7694b7706696","resolution":{"observed_at":"2026-08-06T11:02:14.960784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.691982Z","title":"Boosting transferability in vision-language attacks via diversification along the intersection region of adversarial trajectory","venue":null,"work_id":"1aa49f1e-2f1e-4a3d-850e-0b3a445ca2a9","year":2024},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.965401Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:7632441c8e0e74263eb506df8020cac476436ec9ece9829dcde82e236546cee2","observation_id":"5e114afd-e268-4d72-9ac3-ab5fad0b6b42","resolution":{"observed_at":"2026-08-06T11:02:15.696870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6572","last_updated":"2015-03-20T20:19:16Z","snapshot_observed_at":"2026-07-06T04:04:16.777653Z","submitted_at":"2014-12-20T01:17:12Z","title":"Explaining and Harnessing Adversarial Examples","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6572","snapshot_observed_at":"2026-08-06T11:02:14.969893Z","title":"Explaining and harnessing adversarial examples","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.969893Z"},"links":{"cited_paper":"/paper/1412.6572","citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:c044e16e13b8d560c684c4ef695480c2c26e6e77c0f1e856b04c5d82fe41636f","observation_id":"9d98356a-7fe0-4169-8c65-0819517a3348","resolution":{"observed_at":"2026-08-06T11:02:14.969893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.677882Z","title":"Countering adversarial images using input transformations","venue":null,"work_id":"262b2f84-a115-4b5c-8932-cecee494b305","year":2018},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.974390Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:2f5614d5bb11c44079f10c897d1798ebe7a66c0994b3f0b18b6abb3fa6030a98","observation_id":"40094e0f-ff89-48d0-9b8b-b0e40e089cca","resolution":{"observed_at":"2026-08-06T11:02:15.682257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.664034Z","title":"Efficient generation of targeted and transferable adversarial examples for vision-language models via diffusion models","venue":null,"work_id":"09b53975-0eaf-4795-93ce-d1ed0e79fd5c","year":2024},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.978534Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:0718c374e1aba559368efdbc0def4ca3f6ef159de2331c481ef3be493a95140f","observation_id":"8f08cde7-e584-4a2b-92af-41595ce571b0","resolution":{"observed_at":"2026-08-06T11:02:15.668808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08718","last_updated":"2022-03-23T19:47:21Z","snapshot_observed_at":"2026-07-06T11:01:02.207193Z","submitted_at":"2021-04-18T05:00:29Z","title":"CLIPScore: A Reference-free Evaluation Metric for Image Captioning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08718","snapshot_observed_at":"2026-08-06T11:02:14.982876Z","title":"Clipscore: A reference-free evaluation metric for image captioning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.982876Z"},"links":{"cited_paper":"/paper/2104.08718","citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:fe7ff68c553d39b221349c13030f92e0e13e9ac42172dc039d7a2a27c7624022","observation_id":"ce8e715b-987c-4036-b6a3-0bdd58c39024","resolution":{"observed_at":"2026-08-06T11:02:14.982876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.650119Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":"150ce434-fe01-4e44-b11a-cf72c9455ffd","year":null},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.987951Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:9654c175920da1647e7f4048dc25546aaccf1ff37f7679678c980b58770b5d3a","observation_id":"cbeb103f-dd5f-447a-9cba-fe9f26260fd9","resolution":{"observed_at":"2026-08-06T11:02:15.654654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.635800Z","title":"Image quality metrics: PSNR vs","venue":null,"work_id":"f8cf883e-b1ef-4826-acf1-4502e224ab6c","year":2010},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.992391Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:9691051a36472241ccc63e36618991ee9a82fc8fa4c3cbf68d3646b76725a6f7","observation_id":"a0fd4630-ad7e-431b-b88f-6d86aa957d1e","resolution":{"observed_at":"2026-08-06T11:02:15.640388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.621993Z","title":"An edit friendly DDPM noise space: Inversion and manipulations","venue":null,"work_id":"09328081-9501-45e9-a52e-186294d37ecf","year":2024},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.996573Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:127e862b2666a383660e8e74af88b6c0f6387e10a3a72f2bc516b87b864af1d8","observation_id":"214fd654-b65c-4003-abec-a7aedbf41fd1","resolution":{"observed_at":"2026-08-06T11:02:15.626446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.608042Z","title":"Adver- sarial examples in the physical world","venue":null,"work_id":"b96e0fb7-0b98-418e-a72a-802ed6bc7f2c","year":null},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.000693Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:6c4f1a705ba2392fb99a753edbbaa5aced6b8cdc21606475d77ce61d7757f85f","observation_id":"408d3b56-bf24-4c99-aaff-e5bc562280d8","resolution":{"observed_at":"2026-08-06T11:02:15.612897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.593733Z","title":"BLIP- 2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":"d50b5dc6-7ca2-4756-831e-3cfa682b501a","year":2023},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.005414Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:0f5c97d44e9517b0d1a3a6c4866999a2eb7a675153fbb2441faec95eb07ed17d","observation_id":"31427e88-15fd-4926-98db-31adef6eef64","resolution":{"observed_at":"2026-08-06T11:02:15.598359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.579506Z","title":"Alleviating exposure bias in diffusion mod- els through sampling with shifted time steps","venue":null,"work_id":"d316026d-09a0-492a-ad0d-1586b92a3025","year":2024},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.009806Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:7bc14f5ec0b2cf05e49f20cac4d393e970ef30be45270efb8f061ca046a8ad85","observation_id":"f1c3f962-7457-467b-b8c6-4ffac2d56bda","resolution":{"observed_at":"2026-08-06T11:02:15.584000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.565475Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":"53a8838c-3a20-4e9c-b68e-4986bfd3f6e4","year":2014},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.014163Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:541bd0e36f2147242effaf125b7fb1d782b26fd2a1cecaadfc2b4d7c9940bb6c","observation_id":"ef11b07c-9782-4cb0-8a28-b5528660f3fc","resolution":{"observed_at":"2026-08-06T11:02:15.569838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.551413Z","title":"Visual instruction tuning","venue":null,"work_id":"f3d41a26-8b88-4fc8-9339-05cd0b6fa0b5","year":2023},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.019017Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:d759d096669dc0c00cc19a551d1ba458dce08e02c98c25ba5648acccf47b5c64","observation_id":"cbbef974-6413-46e9-ba9d-e167a530eea9","resolution":{"observed_at":"2026-08-06T11:02:15.556325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.537597Z","title":"An image is worth 1000 lies: Transferability of adversarial images across prompts on vision-language models","venue":null,"work_id":"12cef416-43c3-4420-8107-3b3241415556","year":null},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.023457Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:b632eafd6d1fdaf11371f970ad5d58c659d2287e9030437cbe37dce620dd0f5e","observation_id":"5c7dc2c4-804f-4b44-9a9b-965a6527b0c3","resolution":{"observed_at":"2026-08-06T11:02:15.542148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.523273Z","title":"Towards deep learning models resistant to adversarial attacks","venue":null,"work_id":"5eefabaa-96a5-4c72-8b3b-bed878602cf6","year":2018},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.028438Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:6f4dd3e64860957226bbf1771c9c1043b90cb07867368da25290867720da6f1e","observation_id":"f4a17c9f-5bb1-4c49-be9b-dce19e67ce83","resolution":{"observed_at":"2026-08-06T11:02:15.527782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.508185Z","title":"Diffusion models for adver- sarial purification","venue":null,"work_id":"44bd6c1f-f000-4053-9a84-71968b3a284e","year":2022},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.033195Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:d8b36bfe21b1b37b44bb788787da05b4904ceec150a17d0a8f65cc928cd964eb","observation_id":"50ea609c-f535-4734-a01c-524e94c74e70","resolution":{"observed_at":"2026-08-06T11:02:15.513080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.492460Z","title":"Elucidating the exposure bias in diffusion models","venue":null,"work_id":"5505adb2-e54c-4d99-aeec-027b793dbd1a","year":2024},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.037541Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:642e9f0ad4b695fb067753d0127e036256682744e7eaee2cb9afeefcd1d941c1","observation_id":"a511cb04-afc6-4ed2-a4ea-1e941ae13228","resolution":{"observed_at":"2026-08-06T11:02:15.497478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.477642Z","title":"Diffusion-based adversarial purification from the perspective of the frequency domain","venue":null,"work_id":"bddb32f2-2187-4c01-bb6f-8197bf808cf7","year":2025},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.042482Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:ca31bf54cd365b2dd273d656ffe46639515c2ef9698e3b3eddca84b87e0a5ab8","observation_id":"1bb54fcc-389b-4a0d-9855-660aba02800d","resolution":{"observed_at":"2026-08-06T11:02:15.482788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.462554Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"0dc96253-7270-422e-9c71-6c3b51e95115","year":2021},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.046817Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:e3925c276db150c599af286ec19a3dac03ce8650a8a45891842c31e7458f062e","observation_id":"727d9050-e03a-4864-b857-6dd747222847","resolution":{"observed_at":"2026-08-06T11:02:15.467217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.446051Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"cb88d703-b2af-4676-9c1e-edf40088e390","year":2022},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.051033Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:0c17fb98b07cc5fd629b7f100500eb5aca81017f059466a6c359301d1e194f94","observation_id":"31e551c4-e73d-466f-b09d-3b1e7e34cac1","resolution":{"observed_at":"2026-08-06T11:02:15.450877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.430727Z","title":"On the adversarial robustness of multi-modal foundation models","venue":null,"work_id":"7901c57d-e162-418b-b12f-4c1ac1645bcb","year":2023},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.055298Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:889511819e6434894278d0bfeaa4bed9663e3ce3a45a233dceb53ac8a1df468f","observation_id":"3bd7ad07-2919-4afa-8849-02fb81a9afe1","resolution":{"observed_at":"2026-08-06T11:02:15.435503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.415767Z","title":"Colorfool: Semantic adversarial colorization","venue":null,"work_id":"b5a22544-f7fd-43de-b5ed-7b648f0faab7","year":2020},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.059455Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:aede7afe9775e6cc2780d042065ee40d35e084376de466757c06527d19cf0b32","observation_id":"1d2d9dd0-1b31-4405-b770-07d3b477b859","resolution":{"observed_at":"2026-08-06T11:02:15.420741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.400348Z","title":"Jail- break in pieces: Compositional adversarial attacks on multi- modal language models","venue":null,"work_id":"aa935947-fd53-4214-bec6-2894a6fd1465","year":2024},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.063593Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:a44f2799138ba0e27c814e14ad21130a25952c0bd01ffb9b1d58980566298499","observation_id":"bc3e488a-5e85-4808-841d-5d189f4a3b79","resolution":{"observed_at":"2026-08-06T11:02:15.405081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.385345Z","title":"Online adver- sarial purification based on self-supervised learning","venue":null,"work_id":"8e2ea892-560d-4309-9493-1c02be3af9b3","year":null},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.067644Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:ab70eb3c24ad689b945fac7c9dfa10cc12b6493971b860d4961dbbbe47f50f2a","observation_id":"bae917c7-7b58-45f1-b9d2-f7f48a7068ad","resolution":{"observed_at":"2026-08-06T11:02:15.390395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.072519Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.072519Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:905d72f66e035c22ae5e250be146bbbbcb1ab08b40d1d85bbb6372a56dc0e1f7","observation_id":"c00f31dc-710f-408c-a5d4-0bc5bacad6cd","resolution":{"observed_at":"2026-08-06T11:02:15.072519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.359948Z","title":"Mimicd- iffusion: Purifying adversarial perturbation via mimicking clean diffusion model","venue":null,"work_id":"31d76221-5080-4d77-ba4d-692d2d599455","year":2024},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.077053Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:22eb4737a8bd5a4b12c3dd6efb21b7fda9c21500b5c4fadb3493dcecfb22d43a","observation_id":"3c2e1d6e-1a51-4457-be0e-0384a7c229e4","resolution":{"observed_at":"2026-08-06T11:02:15.364656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.343808Z","title":"Score-based generative modeling through stochastic differential equations","venue":null,"work_id":"f4abaeec-2d4c-42ab-895b-476001e42881","year":2021},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.081923Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:899f124ab3f09f2374a0df479db1dd3f5d5619bcecb9a89ce51f8d894aec1a75","observation_id":"f65b2e99-3099-4cde-b75c-80ce463fffd3","resolution":{"observed_at":"2026-08-06T11:02:15.348642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T11:02:15.086370Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.086370Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:6658132fe3b2b8b11f3a816333a3c384e98ba787943dbc569f0daa022b2db3af","observation_id":"c98a7ae5-613d-45d5-8ff1-b16b0535429f","resolution":{"observed_at":"2026-08-06T11:02:15.086370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.01886","last_updated":"2024-06-26T03:29:50Z","snapshot_observed_at":"2026-08-03T09:13:22.955433Z","submitted_at":"2023-12-04T13:40:05Z","title":"InstructTA: Instruction-Tuned Targeted Attack for Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.01886","snapshot_observed_at":"2026-08-06T11:02:15.091090Z","title":"Instructta: Instruction-tuned targeted attack for large vision-language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.091090Z"},"links":{"cited_paper":"/paper/2312.01886","citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:fe740cf94afb50fe085990f27a5ceb1a93193dba5db8a4947db5d67fef7e33be","observation_id":"14958a04-56bc-472c-8388-e05fc11b603e","resolution":{"observed_at":"2026-08-06T11:02:15.091090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.329004Z","title":"Image quality assessment: from error visibility to structural similarity","venue":null,"work_id":"2d8447d4-5daa-42a6-9c99-0192312bd10c","year":2004},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.095902Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:a48b6088431c02bdec35b17cd5b4218c830a7feee4beb74cfefb529c3007f76e","observation_id":"33d31752-896c-474b-95cd-dfce17e8229b","resolution":{"observed_at":"2026-08-06T11:02:15.333637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.314475Z","title":"Mitigating adversarial effects through random- ization","venue":null,"work_id":"ef43c7dc-b1ee-4043-94d0-894f7f94b660","year":2018},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.100361Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:550c3d7fb1aa019eab233c96d70701359c480a051d064f6074acbaa868b2b164","observation_id":"bc8304a8-8afa-4303-aa18-e2cdd28a4522","resolution":{"observed_at":"2026-08-06T11:02:15.319280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.299734Z","title":"Chain of attack: On the robustness of vision-language models against transfer-based adversarial attacks","venue":null,"work_id":"e67d48fe-73cc-417e-92fd-1711b19489b1","year":2025},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.104925Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:963785b1dc35aecf81d57f4414812a76e7073d8efab7fe12e69b0a2884faae2a","observation_id":"5d5a302d-2b00-4e73-a96b-f4b036e5c619","resolution":{"observed_at":"2026-08-06T11:02:15.304421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.284827Z","title":"Natural color fool: Towards boosting black-box unrestricted attacks","venue":null,"work_id":"98f1b97b-7d21-4e44-96b2-d2fe9ceee135","year":null},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.109240Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:83e9497aa4dc120f0e98f8215108b1d057cf6fc13ba350c6b317537bfc60e359","observation_id":"82f6430f-0593-4b79-bf21-46030dd5cbf3","resolution":{"observed_at":"2026-08-06T11:02:15.289407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.113841Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.113841Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:2cb70934ebeb6601ca8b532b6346adbf97aeea5993738854e66dd5944b13580a","observation_id":"d4166f59-ccd9-45ee-b60e-297ded55cfd8","resolution":{"observed_at":"2026-08-06T11:02:15.113841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.259088Z","title":"On evaluating adversarial robustness of large vision-language models","venue":null,"work_id":"7c40259f-8819-4976-89fb-dc351dd2f5b6","year":2023},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.118427Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:787015d85d418097675bb0b35287ae48d7cc59acd56de9f3ef126299b69dac34","observation_id":"3fa3b325-939b-4483-95ea-83374ebd26af","resolution":{"observed_at":"2026-08-06T11:02:15.265738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-06T11:02:15.122716Z","title":"Minigpt-4: Enhancing vision-language understanding with advanced large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.122716Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:54af398ad110b964267a34c61e53cb58dbb67c2f0016cd37ce44126865ab4f6a","observation_id":"dcbb0c16-2e8a-4ace-a906-50d3e31250c2","resolution":{"observed_at":"2026-08-06T11:02:15.122716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":37},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 1 inbound Pith citation observation for arXiv:2507.23202."}