{"as_of":"2026-08-15T04:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b68af3cd6445f28c90b831c5aba7557d36a06e75e3ec4d80a7019a9b6a3bf10d","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:35:56.832563Z","state":"measured"},{"denominator":80,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":80,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":13,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:58:51.899166Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-09T12:56:14.862810Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21494","snapshot_observed_at":"2026-08-06T20:58:51.899166Z","title":"Adversarial attacks against closed-source mllms via fea- ture optimal alignment","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01367","last_updated":"2025-08-13T01:55:06Z","snapshot_observed_at":"2026-08-10T10:25:09.441710Z","submitted_at":"2025-07-02T05:10:16Z","title":"3D Gaussian Splatting Driven Multi-View Robust Physical Adversarial Camouflage Generation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:58:51.899166Z"},"links":{"cited_paper":"/paper/2505.21494","citing_paper":"/paper/2507.01367"},"observation_digest":"sha256:ab7b5ce5f7c925c8c523ae4ba91f9b8a8e0e9aca46c6879954a32816d0dfc7e2","observation_id":"a035745a-d293-41b7-8b98-5a9cef997ecb","resolution":{"observed_at":"2026-08-06T20:58:51.899166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21494","snapshot_observed_at":"2026-08-05T16:15:27.911200Z","title":"Adversarial Attacks Against Closed-Source MLLMs via Fea- ture Optimal Alignment","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.18805","last_updated":"2025-08-26T08:40:22Z","snapshot_observed_at":"2026-08-08T01:12:52.353250Z","submitted_at":"2025-08-26T08:40:22Z","title":"Hidden Tail: Adversarial Image Causing Stealthy Resource Consumption in Vision-Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T16:15:27.911200Z"},"links":{"cited_paper":"/paper/2505.21494","citing_paper":"/paper/2508.18805"},"observation_digest":"sha256:70701fc6c70bfed2cb1250319b2f93085688e90edcca7b827bb1bb38f89df701","observation_id":"52dcbe22-e334-4464-890f-9786224efb40","resolution":{"observed_at":"2026-08-05T16:15:27.911200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21494","snapshot_observed_at":"2026-08-03T07:47:37.534486Z","title":"Adversarial attacks against closed-source mllms via feature optimal alignment.arXiv preprint arXiv:2505.21494,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.19210","last_updated":"2026-06-09T16:01:52Z","snapshot_observed_at":"2026-08-06T16:38:35.610168Z","submitted_at":"2026-01-27T05:24:45Z","title":"Contrastive Spectral Rectification: Test-Time Defense towards Zero-shot Adversarial Robustness of CLIP","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-03T07:47:37.534486Z"},"links":{"cited_paper":"/paper/2505.21494","citing_paper":"/paper/2601.19210"},"observation_digest":"sha256:2653622b5dbb3c5cf8d4d3c5ae00406fd5b8e5b7083ed438a1a42868ba74ee56","observation_id":"49bd0555-2734-4236-a374-51874690cb3c","resolution":{"observed_at":"2026-08-03T07:47:37.534486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"cited_work":{"arxiv_id":"2505.21494","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.21494","snapshot_observed_at":"2026-07-09T12:56:14.862810Z","title":"Adversarial attacks against closed-source mllms via feature optimal alignment","venue":"cs.CV","work_id":"e1920300-ede7-411f-bd86-745faa09b9b0","year":2025},"citing_paper":{"arxiv_id":"2601.23179","last_updated":"2026-04-20T06:15:25Z","snapshot_observed_at":"2026-08-09T08:54:54.090902Z","submitted_at":"2026-01-30T17:03:24Z","title":"Universal Adversarial Attacks against Closed-Source MLLMs via Target-View Routed Meta Optimization","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T09:26:14.799360Z"},"links":{"cited_paper":"/paper/2505.21494","citing_paper":"/paper/2601.23179"},"observation_digest":"sha256:3c17a38b8badb75391ff05299c59f3c230497c309a2fac83685c3466e02dce19","observation_id":"8a86ff78-7cc6-4025-aba1-4b0d1c0c270c","resolution":{"observed_at":"2026-05-16T09:27:40.973099Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"cited_work":{"arxiv_id":"2505.21494","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.21494","snapshot_observed_at":"2026-07-09T12:56:14.862810Z","title":"Adversarial attacks against closed-source mllms via feature optimal alignment","venue":"cs.CV","work_id":"e1920300-ede7-411f-bd86-745faa09b9b0","year":2025},"citing_paper":{"arxiv_id":"2604.09253","last_updated":"2026-04-10T12:09:06Z","snapshot_observed_at":"2026-07-06T22:58:12.847181Z","submitted_at":"2026-04-10T12:09:06Z","title":"Mosaic: Multimodal Jailbreak against Closed-Source VLMs via Multi-View Ensemble Optimization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T18:03:36.805784Z"},"links":{"cited_paper":"/paper/2505.21494","citing_paper":"/paper/2604.09253"},"observation_digest":"sha256:b9e6262a7600d0e994b8fb7896dfe8e6cd5fe27273285284bf00c011b9c08a96","observation_id":"b7cf3046-9cbb-4aa6-969c-a972b9a70890","resolution":{"observed_at":"2026-05-11T05:35:59.178907Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"cited_work":{"arxiv_id":"2505.21494","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.21494","snapshot_observed_at":"2026-07-09T12:56:14.862810Z","title":"Adversarial attacks against closed-source mllms via feature optimal alignment","venue":"cs.CV","work_id":"e1920300-ede7-411f-bd86-745faa09b9b0","year":2025},"citing_paper":{"arxiv_id":"2605.09902","last_updated":"2026-05-11T02:45:48Z","snapshot_observed_at":"2026-08-14T06:15:36.974584Z","submitted_at":"2026-05-11T02:45:48Z","title":"Adversarial Attacks Against MLLMs via Progressive Resolution Processing and Adaptive Feature Alignment","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:31.570783Z"},"links":{"cited_paper":"/paper/2505.21494","citing_paper":"/paper/2605.09902"},"observation_digest":"sha256:7aca26e3be775dd610ff23b221da3be741f354ea02830e3682e80c92a4216656","observation_id":"50504f78-419d-4279-a532-7846a7ccc129","resolution":{"observed_at":"2026-05-12T06:21:27.955839Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"cited_work":{"arxiv_id":"2505.21494","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.21494","snapshot_observed_at":"2026-07-09T12:56:14.862810Z","title":"Adversarial attacks against closed-source mllms via feature optimal alignment","venue":"cs.CV","work_id":"e1920300-ede7-411f-bd86-745faa09b9b0","year":2025},"citing_paper":{"arxiv_id":"2605.18868","last_updated":"2026-05-15T12:28:16Z","snapshot_observed_at":"2026-08-02T22:00:15.007211Z","submitted_at":"2026-05-15T12:28:16Z","title":"DarkLLM: Learning Language-Driven Adversarial Attacks with Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-20T18:31:48.770507Z"},"links":{"cited_paper":"/paper/2505.21494","citing_paper":"/paper/2605.18868"},"observation_digest":"sha256:e63d72575fa3e64f22337ac29853cb1eeac884d74cfa5f1a6ec110f9e716cfc7","observation_id":"b6f53335-55b6-46a9-9415-5f5118429e7c","resolution":{"observed_at":"2026-05-20T18:33:37.919303Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"cited_work":{"arxiv_id":"2505.21494","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.21494","snapshot_observed_at":"2026-07-09T12:56:14.862810Z","title":"Adversarial attacks against closed-source mllms via feature optimal alignment","venue":"cs.CV","work_id":"e1920300-ede7-411f-bd86-745faa09b9b0","year":2025},"citing_paper":{"arxiv_id":"2605.29602","last_updated":"2026-05-28T08:40:34Z","snapshot_observed_at":"2026-08-13T21:27:00.744752Z","submitted_at":"2026-05-28T08:40:34Z","title":"CogniVerse: Revolutionizing Multi-Modal Retrieval-Augmented Generation with Cognitive Reflection and Geometric Reasoning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-29T08:14:20.558527Z"},"links":{"cited_paper":"/paper/2505.21494","citing_paper":"/paper/2605.29602"},"observation_digest":"sha256:2b5b3bf0347446136a94281d42e2f0fc81725185f3818a5df5ba9414bc4a8c89","observation_id":"c77dc30e-d393-4c5b-91c3-47d074ce88e6","resolution":{"observed_at":"2026-06-29T08:23:15.763386Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"cited_work":{"arxiv_id":"2505.21494","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.21494","snapshot_observed_at":"2026-07-09T12:56:14.862810Z","title":"Adversarial attacks against closed-source mllms via feature optimal alignment","venue":"cs.CV","work_id":"e1920300-ede7-411f-bd86-745faa09b9b0","year":2025},"citing_paper":{"arxiv_id":"2606.23892","last_updated":"2026-06-22T19:41:57Z","snapshot_observed_at":"2026-08-06T14:11:51.998297Z","submitted_at":"2026-06-22T19:41:57Z","title":"REALM: A Unified Red-Teaming Benchmark for Physical-World VLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T08:44:45.853401Z"},"links":{"cited_paper":"/paper/2505.21494","citing_paper":"/paper/2606.23892"},"observation_digest":"sha256:6cb92e482b99ef93e505926799c342fb96067b2e4e3afabbb9106eedb7cca74c","observation_id":"66e48b9e-d251-4a04-ac7d-ecc359911ffe","resolution":{"observed_at":"2026-07-04T10:29:45.732836Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"cited_work":{"arxiv_id":"2505.21494","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.21494","snapshot_observed_at":"2026-07-09T12:56:14.862810Z","title":"Adversarial attacks against closed-source mllms via feature optimal alignment","venue":"cs.CV","work_id":"e1920300-ede7-411f-bd86-745faa09b9b0","year":2025},"citing_paper":{"arxiv_id":"2606.26199","last_updated":"2026-06-26T02:47:28Z","snapshot_observed_at":"2026-08-13T00:33:15.607177Z","submitted_at":"2026-06-24T16:23:10Z","title":"MIRAGE: Protecting against Malicious Image Editing via False Moderation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-26T01:52:12.291420Z"},"links":{"cited_paper":"/paper/2505.21494","citing_paper":"/paper/2606.26199"},"observation_digest":"sha256:662cdf6782c4bec05e7f1a3210d5dfc14d930766f2517a7ee9ea4e83e62062d2","observation_id":"aa01307b-df84-46ea-bef2-bf5abc3ae45a","resolution":{"observed_at":"2026-07-04T15:09:54.649235Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"cited_work":{"arxiv_id":"2505.21494","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.21494","snapshot_observed_at":"2026-07-09T12:56:14.862810Z","title":"Adversarial attacks against closed-source mllms via feature optimal alignment","venue":"cs.CV","work_id":"e1920300-ede7-411f-bd86-745faa09b9b0","year":2025},"citing_paper":{"arxiv_id":"2606.26199","last_updated":"2026-06-26T02:47:28Z","snapshot_observed_at":"2026-08-13T00:33:15.607177Z","submitted_at":"2026-06-24T16:23:10Z","title":"MIRAGE: Protecting against Malicious Image Editing via False Moderation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-29T04:46:56.552601Z"},"links":{"cited_paper":"/paper/2505.21494","citing_paper":"/paper/2606.26199"},"observation_digest":"sha256:45b936ff0e19cfec13a1a63245e62248a4890210fd8203f7dd07e4249193d2eb","observation_id":"9268db2d-a89a-4bb6-9779-924540dce770","resolution":{"observed_at":"2026-06-29T19:13:53.523673Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21494","snapshot_observed_at":"2026-07-12T01:35:43.979206Z","title":"Adversarial attacks against closed-source mllms via feature optimal alignment, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03562","last_updated":"2026-07-03T18:52:42Z","snapshot_observed_at":"2026-08-13T08:23:41.034688Z","submitted_at":"2026-07-03T18:52:42Z","title":"XPlainVerse: A Million-Scale Benchmark for Explainable Deepfake Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-12T01:35:43.979206Z"},"links":{"cited_paper":"/paper/2505.21494","citing_paper":"/paper/2607.03562"},"observation_digest":"sha256:7af3591806237e9d172ed0ef73c29dc41506a16a6a2e1e769992768e9a463237","observation_id":"56724a41-4eb3-4444-bf07-4892ab00bc0f","resolution":{"observed_at":"2026-07-12T01:35:43.979206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"cited_work":{"arxiv_id":"2505.21494","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.21494","snapshot_observed_at":"2026-07-09T12:56:14.862810Z","title":"Adversarial attacks against closed-source mllms via feature optimal alignment","venue":"cs.CV","work_id":"e1920300-ede7-411f-bd86-745faa09b9b0","year":2025},"citing_paper":{"arxiv_id":"2607.07375","last_updated":"2026-07-08T13:06:20Z","snapshot_observed_at":"2026-08-03T20:22:35.302558Z","submitted_at":"2026-07-08T13:06:20Z","title":"On Adversarial Vulnerability of Vision-Language Models through the Lens of Intermediate Spectral Subspaces","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-09T12:55:34.631248Z"},"links":{"cited_paper":"/paper/2505.21494","citing_paper":"/paper/2607.07375"},"observation_digest":"sha256:aaf7ddfb4f0775a2c1242d49002b72755776a992b7fe4bb19a16d332de82cdbf","observation_id":"02808c47-6ced-4729-bbde-4aaa411a6f22","resolution":{"observed_at":"2026-07-09T12:56:14.864124Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.21494/citation-record","integrity":"/paper/2505.21494/integrity","json":"/paper/2505.21494/citation-record.json","paper":"/paper/2505.21494"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T13:35:49.458315Z","title":"Gpt-4 technical report.arXiv preprint arXiv:2303.08774, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:49.458315Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:fde45feb536ec93df40789959a9aee032a69b5167ba7e62f37eebd720ada1566","observation_id":"d6d6c590-42d6-41b0-822e-10ef275b5588","resolution":{"observed_at":"2026-08-07T13:35:49.458315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:49.567080Z","title":"Flamingo: a visual language model for few-shot learning.Advances in Neural Information Processing Systems, 35: 23716–23736, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:49.567080Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:955f934bc25dd6831478033b19a68636237c549382ac9edafa16dfaa039b96c3","observation_id":"53aba7bc-ad04-4371-a30b-c53603628214","resolution":{"observed_at":"2026-08-07T13:35:49.567080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10403","snapshot_observed_at":"2026-08-07T13:35:49.671246Z","title":"Palm 2 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:49.671246Z"},"links":{"cited_paper":"/paper/2305.10403","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:40cab077814a2978ad911d04d60d15ef125a55b6e99f4b1a9d1da75a3928cbd9","observation_id":"debd7b32-c2c1-4a71-b9b7-6aa7a6b85f88","resolution":{"observed_at":"2026-08-07T13:35:49.671246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00236","last_updated":"2024-09-17T19:56:09Z","snapshot_observed_at":"2026-08-13T10:22:53.233546Z","submitted_at":"2023-09-01T03:53:40Z","title":"Image Hijacks: Adversarial Images can Control Generative Models at Runtime","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00236","snapshot_observed_at":"2026-08-07T13:35:49.779331Z","title":"Image hijacks: Adversarial images can control generative models at runtime.arXiv preprint arXiv:2309.00236, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:49.779331Z"},"links":{"cited_paper":"/paper/2309.00236","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:20a0a9c08c379679fdb938584a845599733a88650cc31be5010265b155327281","observation_id":"4039150c-a3ae-444f-a8b0-24972fc7bc92","resolution":{"observed_at":"2026-08-07T13:35:49.779331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:59.935321Z","title":"Improv- ing the transferability of targeted adversarial examples through object-based diverse input","venue":null,"work_id":"2e917e98-0098-4082-b4b3-66bad67d488f","year":2022},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:49.904749Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:557fdfb520d3d36d9e3e4143822bb40709fb3ceb63c9c9b6cbf3066bdd696a78","observation_id":"f873176d-2936-4a92-920e-f26e041679cc","resolution":{"observed_at":"2026-08-07T13:36:00.005359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:50.024648Z","title":"Towards evaluating the robustness of neural networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:50.024648Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:14341551ba7b0fddfee7d4e34070746bcdfc99ca85ae92989eb28f111108c981","observation_id":"d50c7d2c-baf9-477d-b570-0939cca85bf2","resolution":{"observed_at":"2026-08-07T13:35:50.024648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15447","last_updated":"2024-05-06T06:36:24Z","snapshot_observed_at":"2026-08-13T11:09:05.288379Z","submitted_at":"2023-06-26T17:18:44Z","title":"Are aligned neural networks adversarially aligned?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15447","snapshot_observed_at":"2026-08-07T13:35:50.164811Z","title":"Are aligned neural networks adversarially aligned?arXiv preprint arXiv:2306.15447, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:50.164811Z"},"links":{"cited_paper":"/paper/2306.15447","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:ee6e235a920ba6dfee8a8bbccf529477df1cabb5ef116c005425f5289abc573e","observation_id":"77e1130e-de80-4e79-896e-53283f08cf13","resolution":{"observed_at":"2026-08-07T13:35:50.164811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09105","last_updated":"2024-03-04T11:30:06Z","snapshot_observed_at":"2026-08-13T12:23:37.203488Z","submitted_at":"2023-03-16T06:37:16Z","title":"Rethinking Model Ensemble in Transfer-based Adversarial Attacks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09105","snapshot_observed_at":"2026-08-07T13:35:50.302743Z","title":"Rethinking model ensemble in transfer-based adversarial attacks.arXiv preprint arXiv:2303.09105, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:50.302743Z"},"links":{"cited_paper":"/paper/2303.09105","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:fdd438b4bc663bb9ff78f735441d93164dd872b8edad84216d0cd3f8b1a35980","observation_id":"cf1d090e-49ae-4a2f-8ac1-d4e618751a4b","resolution":{"observed_at":"2026-08-07T13:35:50.302743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:59.650163Z","title":"Palm: Scaling language modeling with pathways.Journal of Machine Learning Research, 24(240): 1–113, 2023","venue":null,"work_id":"68d7e235-dd95-4966-8cdf-f32ac69b3599","year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:50.455824Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:b790a8f0b284e6c0875294e1e73639d016ba5a237d0def6f00176fac42f71757","observation_id":"1f2b4431-a890-4e58-93da-2020e2a032a6","resolution":{"observed_at":"2026-08-07T13:35:59.801185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:59.377093Z","title":"A survey on multimodal large language models for autonomous driving","venue":null,"work_id":"4ac989b1-6035-4403-8fd8-b2baeec73f45","year":2024},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:50.612019Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:2c74002c2a381b08cd2768b68d27d85f759d671c366aeb13a1602ce63162e35e","observation_id":"f09c250d-f3f8-40b9-944f-7b788bbe851c","resolution":{"observed_at":"2026-08-07T13:35:59.528956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:50.689362Z","title":"Sinkhorn distances: Lightspeed computation of optimal transport.Advances in neural information processing systems, 26, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:50.689362Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:81b8e4889b36737474d6180187a89add3295d88089b80aa0e689699ba7e4ab6f","observation_id":"533f328e-9d98-4975-9baf-de628077d6f1","resolution":{"observed_at":"2026-08-07T13:35:50.689362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.07623","last_updated":"2019-02-20T16:18:37Z","snapshot_observed_at":"2026-08-14T17:13:45.514738Z","submitted_at":"2019-02-20T16:18:37Z","title":"advertorch v0.1: An Adversarial Robustness Toolbox based on PyTorch","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.07623","snapshot_observed_at":"2026-08-07T13:35:50.841588Z","title":"AdverTorch v0.1: An adversarial robustness toolbox based on pytorch.arXiv preprint arXiv:1902.07623, 2019","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:50.841588Z"},"links":{"cited_paper":"/paper/1902.07623","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:d1ff1fedb0c9a9f744053d45cae19f1e1176ad44eddc064a2aa186e4cfb1962b","observation_id":"73af7a46-2e2e-4348-8f04-7932ad257400","resolution":{"observed_at":"2026-08-07T13:35:50.841588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11751","last_updated":"2023-10-14T12:56:13Z","snapshot_observed_at":"2026-08-13T10:08:46.576666Z","submitted_at":"2023-09-21T03:24:30Z","title":"How Robust is Google's Bard to Adversarial Image Attacks?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11751","snapshot_observed_at":"2026-08-07T13:35:50.982242Z","title":"How robust is google’s bard to adversarial image attacks?arXiv preprint arXiv:2309.11751, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:50.982242Z"},"links":{"cited_paper":"/paper/2309.11751","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:b70782382752210dc187f69c2d4981ef55f81fc9ce3cd535a058f75828002431","observation_id":"fab8b3b2-4a32-4dcf-b09c-6f8515aa05db","resolution":{"observed_at":"2026-08-07T13:35:50.982242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-13T14:19:26.598265Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T13:35:51.083696Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale.arXiv preprint arXiv:2010.11929, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:51.083696Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:04acb5be25e054b4d2efd16e75560a49c1c7a5510a7df4e1f2a7671b877677f3","observation_id":"373cb766-e746-4356-b191-4ad9c4dd6ed6","resolution":{"observed_at":"2026-08-07T13:35:51.083696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07858","last_updated":"2022-11-22T19:12:57Z","snapshot_observed_at":"2026-08-13T10:17:00.791443Z","submitted_at":"2022-08-23T23:37:14Z","title":"Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.07858","snapshot_observed_at":"2026-08-07T13:35:51.204470Z","title":"Red teaming language models to reduce harms: Methods, scaling behaviors, and lessons learned.arXiv preprint arXiv:2209.07858, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:51.204470Z"},"links":{"cited_paper":"/paper/2209.07858","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:00846f4efc180d9e20a25a7f3d8f94c8f47b350622cec221c0945c86a1fb6e4b","observation_id":"133529ae-b798-4bbb-ba8c-501f3debd4f7","resolution":{"observed_at":"2026-08-07T13:35:51.204470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.15010","last_updated":"2023-04-28T17:59:25Z","snapshot_observed_at":"2026-08-12T23:40:42.885633Z","submitted_at":"2023-04-28T17:59:25Z","title":"LLaMA-Adapter V2: Parameter-Efficient Visual Instruction Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.15010","snapshot_observed_at":"2026-08-07T13:35:51.324640Z","title":"Llama-adapter v2: Parameter-efficient visual instruction model.arXiv preprint arXiv:2304.15010, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:51.324640Z"},"links":{"cited_paper":"/paper/2304.15010","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:ae8bdbdded29b46bc653f1ecda3acbda2b20416538ba353d2886cb8b0c3cc6ac","observation_id":"a5c23d5b-6673-41d0-a413-8aa5f2620c32","resolution":{"observed_at":"2026-08-07T13:35:51.324640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12445","last_updated":"2024-07-14T15:58:57Z","snapshot_observed_at":"2026-08-13T00:50:39.170180Z","submitted_at":"2024-03-19T05:10:10Z","title":"Boosting Transferability in Vision-Language Attacks via Diversification along the Intersection Region of Adversarial Trajectory","version":3},"cited_work":{"arxiv_id":"2403.12445","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.12445","snapshot_observed_at":"2026-08-07T13:35:57.483912Z","title":"Boosting Transferability in Vision-Language Attacks via Diversification along the Intersection Region of Adversarial Trajectory","venue":"cs.CV","work_id":"88104173-cb07-44f7-ac78-2bacd2359c4a","year":2024},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:51.426223Z"},"links":{"cited_paper":"/paper/2403.12445","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:403e95b2e0a67e9a407f74b7c2896f32ab765a47c389f00b220ca45f4a251337","observation_id":"87b55f07-3992-464a-b753-76803431ec0f","resolution":{"observed_at":"2026-08-07T13:35:57.575067Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6572","last_updated":"2015-03-20T20:19:16Z","snapshot_observed_at":"2026-08-12T17:13:46.394331Z","submitted_at":"2014-12-20T01:17:12Z","title":"Explaining and Harnessing Adversarial Examples","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6572","snapshot_observed_at":"2026-08-07T13:35:51.600167Z","title":"Goodfellow, Jonathon Shlens, and Christian Szegedy","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:51.600167Z"},"links":{"cited_paper":"/paper/1412.6572","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:9ff3138ee91049efa17887fa2fda99d74fcb773164bf406b04e2bed4104dfcf6","observation_id":"921febc2-46c8-4fdd-9ae1-3829b94e1aec","resolution":{"observed_at":"2026-08-07T13:35:51.600167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:59.165234Z","title":"Agent smith: A single image can jailbreak one million multimodal llm agents exponentially fast","venue":null,"work_id":"8709fdc3-573c-4de2-b170-f0780520945a","year":2024},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:51.708519Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:0aff2d37bc410049b1cd196e234b2ff86817244eb25b5e49cd18b0082e792b3b","observation_id":"a67fab29-5b17-4fa7-8ecb-2d2a3aa6c4e2","resolution":{"observed_at":"2026-08-07T13:35:59.227279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.00117","last_updated":"2018-01-25T19:04:48Z","snapshot_observed_at":"2026-08-14T20:18:12.840327Z","submitted_at":"2017-10-31T21:22:16Z","title":"Countering Adversarial Images using Input Transformations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.00117","snapshot_observed_at":"2026-08-07T13:35:51.819305Z","title":"Countering adversarial images using input transformations.arXiv preprint arXiv:1711.00117, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:51.819305Z"},"links":{"cited_paper":"/paper/1711.00117","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:6d6c81e2da899e1ab20a33feb9a72486e97290b59cdd694058f4c1e8b989727b","observation_id":"eaea06a7-6d6a-4179-bcd4-d5652491a65b","resolution":{"observed_at":"2026-08-07T13:35:51.819305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:51.945845Z","title":"Efficient generation of targeted and transferable adversarial examples for vision-language models via diffusion models.IEEE Transactions on Information Forensics and Security, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:51.945845Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:517e82089fc2eca2ece06c3f436b8539ccf8f4dd0837cbc6f587b08520f79e63","observation_id":"e4e90e0d-4279-4e19-9fd2-1ff88e579ba3","resolution":{"observed_at":"2026-08-07T13:35:51.945845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04403","last_updated":"2023-12-07T16:16:50Z","snapshot_observed_at":"2026-08-13T05:07:51.721453Z","submitted_at":"2023-12-07T16:16:50Z","title":"OT-Attack: Enhancing Adversarial Transferability of Vision-Language Models via Optimal Transport Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.04403","snapshot_observed_at":"2026-08-07T13:35:52.106307Z","title":"Ot-attack: En- hancing adversarial transferability of vision-language models via optimal transport optimization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:52.106307Z"},"links":{"cited_paper":"/paper/2312.04403","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:6898ec433abf484ed5a010a6f671619376544282c75481fe12d18cd278a7fd7b","observation_id":"298d6280-0ced-4e25-beb5-41c086266e93","resolution":{"observed_at":"2026-08-07T13:35:52.106307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04913","last_updated":"2023-12-08T09:08:50Z","snapshot_observed_at":"2026-08-13T05:07:22.505099Z","submitted_at":"2023-12-08T09:08:50Z","title":"SA-Attack: Improving Adversarial Transferability of Vision-Language Pre-training Models via Self-Augmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.04913","snapshot_observed_at":"2026-08-07T13:35:52.215725Z","title":"Sa- attack: Improving adversarial transferability of vision-language pre-training models via self- augmentation.arXiv preprint arXiv:2312.04913, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:52.215725Z"},"links":{"cited_paper":"/paper/2312.04913","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:bf999e5d8f87f358d062d645f28135e17b6eb11ce2ae01fd487a5722ac7ac4ba","observation_id":"ecdbbe7a-cca9-4aa1-9760-674bf2d4c7be","resolution":{"observed_at":"2026-08-07T13:35:52.215725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.14045","last_updated":"2023-03-01T11:04:51Z","snapshot_observed_at":"2026-08-08T05:52:17.343895Z","submitted_at":"2023-02-27T18:55:27Z","title":"Language Is Not All You Need: Aligning Perception with Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.14045","snapshot_observed_at":"2026-08-07T13:35:52.279416Z","title":"Language is not all you need: Aligning perception with language models.arXiv preprint arXiv:2302.14045, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:52.279416Z"},"links":{"cited_paper":"/paper/2302.14045","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:e636dab714696ae627d8d2d79ec58c04a11f3521f746479649006e58e25c3da4","observation_id":"a65dbc69-8253-457c-8d16-faa8cab41031","resolution":{"observed_at":"2026-08-07T13:35:52.279416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06749","last_updated":"2026-02-28T21:10:52Z","snapshot_observed_at":"2026-08-07T18:44:26.813869Z","submitted_at":"2025-03-09T20:06:45Z","title":"Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06749","snapshot_observed_at":"2026-08-07T13:35:52.404988Z","title":"Vision-r1: Incentivizing reasoning capability in multimodal large language models.arXiv preprint arXiv:2503.06749, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:52.404988Z"},"links":{"cited_paper":"/paper/2503.06749","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:5548c80ea2cb67ade6606d884ee27326532b9be91d97850a2990cdfdc38c67d3","observation_id":"a5854e17-ed80-4b06-9ea0-d8fe21ed1b1f","resolution":{"observed_at":"2026-08-07T13:35:52.404988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:58.974241Z","title":"Comdefend: An efficient image compression model to defend adversarial examples","venue":null,"work_id":"d696f330-7e0a-42b1-9797-6fb9711e5392","year":2019},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:52.527419Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:e48e65628e3cbd54f18394d50b10215d76ccd23f010d0f249178e1544869e070","observation_id":"58a8fe99-1638-4ad1-ad42-378876adc7ce","resolution":{"observed_at":"2026-08-07T13:35:59.077875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:52.599556Z","title":"Natural language understanding and inference with mllm in visual question answering: A survey.ACM Computing Surveys, 57(8):1–36, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:52.599556Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:b49645d695af9f46592c624753c9efdc71ebef49c9c022e256022301df1c7e22","observation_id":"61b1cab7-2e3e-4b9b-b51b-1b94c1248c2b","resolution":{"observed_at":"2026-08-07T13:35:52.599556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12597","last_updated":"2023-06-15T07:57:29Z","snapshot_observed_at":"2026-08-12T12:01:54.105712Z","submitted_at":"2023-01-30T00:56:51Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12597","snapshot_observed_at":"2026-08-07T13:35:52.680342Z","title":"Blip-2: Bootstrapping language- image pre-training with frozen image encoders and large language models.arXiv preprint arXiv:2301.12597, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:52.680342Z"},"links":{"cited_paper":"/paper/2301.12597","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:ee4bafe6776c748f78c7f86cb93a5bda1d0d3cb1a780952122ecc9e5023537b4","observation_id":"6a34e8f0-e763-46c1-86b4-a2962d01d0e2","resolution":{"observed_at":"2026-08-07T13:35:52.680342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06355","last_updated":"2024-01-04T02:06:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-10T17:59:04Z","title":"VideoChat: Chat-Centric Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06355","snapshot_observed_at":"2026-08-07T13:35:52.839627Z","title":"Videochat: Chat-centric video understanding.arXiv preprint arXiv:2305.06355, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:52.839627Z"},"links":{"cited_paper":"/paper/2305.06355","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:70d8fabd95b430d8cfd608729f98b58a9210811101e334055d4e3be60e6a1b40","observation_id":"23b3972f-bd30-42bf-b519-bc4af4101549","resolution":{"observed_at":"2026-08-07T13:35:52.839627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:58.810833Z","title":"Improving context understanding in multimodal large language models via multimodal composition learning","venue":null,"work_id":"81cb0193-c2db-4475-acec-d8ecce1f3bc7","year":2024},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:52.951027Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:1fefc7f79c5b956ab31ba4d4a2f714d537a8eeacce3d8887275724247fcc6a14","observation_id":"b1e487e3-63f5-4fad-a7f3-e0ebddded0ca","resolution":{"observed_at":"2026-08-07T13:35:58.883171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:53.099184Z","title":"A frustratingly simple yet highly effective attack baseline: Over 90% success rate against the strong black-box models of gpt-4.5/4o/o1.arXiv preprint arXiv:2503.10635, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:53.099184Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:5f59a37add67f98b3a29bdc7fc5709f927b12855585c141bd68c727172db974b","observation_id":"67fd2408-7657-47dc-80fd-02e433a518b1","resolution":{"observed_at":"2026-08-07T13:35:53.099184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13980","last_updated":"2024-09-21T02:10:19Z","snapshot_observed_at":"2026-08-14T08:31:22.142658Z","submitted_at":"2024-09-21T02:10:19Z","title":"Enhancing Advanced Visual Reasoning Ability of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13980","snapshot_observed_at":"2026-08-07T13:35:53.235556Z","title":"Enhancing advanced visual reasoning ability of large language models.arXiv preprint arXiv:2409.13980, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:53.235556Z"},"links":{"cited_paper":"/paper/2409.13980","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:9edffb0116bd8fc865bb13b35a370bdb35940b718c442691e7e24d7838167faa","observation_id":"3787a6af-926e-4f33-a16f-c8057a359b74","resolution":{"observed_at":"2026-08-07T13:35:53.235556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:53.358879Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:53.358879Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:ceb1e7460cb5b1a89ac8fc515695a15b39c18b2ddea044e087a72adc8c33f1de","observation_id":"d06aba4f-4b63-4865-833a-368c781dd20f","resolution":{"observed_at":"2026-08-07T13:35:53.358879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-07T13:35:53.444061Z","title":"Visual instruction tuning.arXiv preprint arXiv:2304.08485, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:53.444061Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:145b0ae305d2cec8beeab84a2963c05fdffd327187bb9dec79096352d7364b9c","observation_id":"d4c1560e-d017-4d83-9100-354e2efb8419","resolution":{"observed_at":"2026-08-07T13:35:53.444061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:53.528417Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:53.528417Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:5aadb0711f2f3066fd00ffa54c35005d4f2c27b3d68c96777db5542e6879b584","observation_id":"df524861-71a2-4380-9ea3-11c54cc2b1ef","resolution":{"observed_at":"2026-08-07T13:35:53.528417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00357","last_updated":"2024-06-20T15:06:10Z","snapshot_observed_at":"2026-08-14T06:02:46.817686Z","submitted_at":"2024-02-01T05:57:10Z","title":"Safety of Multimodal Large Language Models on Images and Texts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00357","snapshot_observed_at":"2026-08-07T13:35:53.646908Z","title":"Safety of multimodal large language models on images and text.arXiv preprint arXiv:2402.00357, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:53.646908Z"},"links":{"cited_paper":"/paper/2402.00357","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:c8127769c5d320f9206286d86e794d9867db4f6b4ba716f60fb07041cb00e245","observation_id":"cccdc95a-89aa-4648-9e47-aaf4bb2cc0e4","resolution":{"observed_at":"2026-08-07T13:35:53.646908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13860","last_updated":"2024-03-10T13:58:08Z","snapshot_observed_at":"2026-07-06T15:31:18.144952Z","submitted_at":"2023-05-23T09:33:38Z","title":"Jailbreaking ChatGPT via Prompt Engineering: An Empirical Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13860","snapshot_observed_at":"2026-08-07T13:35:53.728471Z","title":"Jailbreaking chatgpt via prompt engineering: An empirical study.arXiv preprint arXiv:2305.13860, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:53.728471Z"},"links":{"cited_paper":"/paper/2305.13860","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:bcade5c22d97075e734d49335bd14abdd62662e64f62c663cebb05f426551f0e","observation_id":"7730ddf2-4184-494a-a4b0-0763b5c50bca","resolution":{"observed_at":"2026-08-07T13:35:53.728471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:53.862054Z","title":"Frequency domain model augmentation for adversarial attack","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:53.862054Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:b3ecf36fef8f68bd4e55928fd0d0e3d15a775fd21ff0e2eecc9893356f1c0388","observation_id":"30817079-a523-4f02-92f4-a08dc790a7db","resolution":{"observed_at":"2026-08-07T13:35:53.862054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:58.696038Z","title":"Questioning, answering, and captioning for zero-shot detailed image caption","venue":null,"work_id":"1a484115-29eb-4e71-850f-3ce3e449e634","year":2024},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:53.960674Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:c6baf44215336a68dc3a4f7fd877d74d5649cdd2e6653c67d963cd600529967a","observation_id":"7a66557e-295c-44d8-a4b5-c70850689098","resolution":{"observed_at":"2026-08-07T13:35:58.732394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05424","last_updated":"2024-06-10T01:36:53Z","snapshot_observed_at":"2026-07-06T15:40:24.127663Z","submitted_at":"2023-06-08T17:59:56Z","title":"Video-ChatGPT: Towards Detailed Video Understanding via Large Vision and Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05424","snapshot_observed_at":"2026-08-07T13:35:54.066433Z","title":"Video-chatgpt: Towards detailed video understanding via large vision and language models.arXiv preprint arXiv:2306.05424, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:54.066433Z"},"links":{"cited_paper":"/paper/2306.05424","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:f5af845acbcfc6d894667abe0a6a32580e946fc91b9ce48eab540e84b2db4834","observation_id":"051b4a18-41c9-48cb-afad-412c5ced3412","resolution":{"observed_at":"2026-08-07T13:35:54.066433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.06083","last_updated":"2019-09-04T18:53:10Z","snapshot_observed_at":"2026-08-07T14:27:46.872660Z","submitted_at":"2017-06-19T17:53:11Z","title":"Towards Deep Learning Models Resistant to Adversarial Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.06083","snapshot_observed_at":"2026-08-07T13:35:54.172351Z","title":"Towards deep learning models resistant to adversarial attacks.arXiv preprint arXiv:1706.06083, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:54.172351Z"},"links":{"cited_paper":"/paper/1706.06083","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:9f8ee32d0768a118296212c4b68ca872e02ccedf8a93901ec7ae54a0144b2931","observation_id":"d82267be-1595-454c-b0c4-e8fdd0f97725","resolution":{"observed_at":"2026-08-07T13:35:54.172351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:54.277385Z","title":"Training language models to follow instructions with human feedback.Advances in Neural Information Processing Systems, 35:27730–27744, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:54.277385Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:0a571180945ecec01298deb08419b224e088684b9639fd3c39e5400d3cfab712","observation_id":"046113fe-17c2-41ff-af41-47069a38b3b9","resolution":{"observed_at":"2026-08-07T13:35:54.277385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.03286","last_updated":"2022-02-07T15:22:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-02-07T15:22:17Z","title":"Red Teaming Language Models with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.03286","snapshot_observed_at":"2026-08-07T13:35:54.349572Z","title":"Red teaming language models with language models.arXiv preprint arXiv:2202.03286, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:54.349572Z"},"links":{"cited_paper":"/paper/2202.03286","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:1fb99f8fe5633de560b756956990341b573b516d2de93b5dfeec78dccd924b32","observation_id":"b82bf650-0879-43e3-8872-4fd8ccc39a5f","resolution":{"observed_at":"2026-08-07T13:35:54.349572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:54.443770Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:54.443770Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:70e94bdce911b631aaf93d4da67181b93da14d72824d30b46e9a1f1c2282750a","observation_id":"b6913d6d-2efe-4ffd-8948-bf8520245544","resolution":{"observed_at":"2026-08-07T13:35:54.443770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14604","last_updated":"2025-05-30T14:11:25Z","snapshot_observed_at":"2026-08-15T00:05:55.328034Z","submitted_at":"2025-03-18T18:03:56Z","title":"Image Captioning Evaluation in the Age of Multimodal LLMs: Challenges and Future Perspectives","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14604","snapshot_observed_at":"2026-08-07T13:35:54.549170Z","title":"Image captioning evaluation in the age of multimodal llms: Challenges and future perspectives.arXiv preprint arXiv:2503.14604, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:54.549170Z"},"links":{"cited_paper":"/paper/2503.14604","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:fd00ad52b664c949c20f6e511cb914f94137bd1f575808d2777abb673c4ded64","observation_id":"184826b5-a3fe-4e46-b094-04f2eb32be00","resolution":{"observed_at":"2026-08-07T13:35:54.549170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.05100","last_updated":"2023-06-27T09:57:58Z","snapshot_observed_at":"2026-08-04T18:56:03.233715Z","submitted_at":"2022-11-09T18:48:09Z","title":"BLOOM: A 176B-Parameter Open-Access Multilingual Language Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.05100","snapshot_observed_at":"2026-08-07T13:35:54.659888Z","title":"Bloom: A 176b-parameter open-access multilingual language model.arXiv preprint arXiv:2211.05100, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:54.659888Z"},"links":{"cited_paper":"/paper/2211.05100","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:1d86b08fdebb5e8e5d5efaae82c42babd3e4b55f76e66e3442a87216cd3ec1a4","observation_id":"6f82d06b-9593-4a8f-b71d-ef1caed492b3","resolution":{"observed_at":"2026-08-07T13:35:54.659888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:54.845752Z","title":"On the adversarial robustness of multi-modal founda- tion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:54.845752Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:d11f9eea846a98f2b947818c770619747a8b61b208fa719265321cb75243b0f7","observation_id":"07540c05-12cb-4f1c-b301-a6e7051a9fe8","resolution":{"observed_at":"2026-08-07T13:35:54.845752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16355","last_updated":"2023-05-25T04:16:07Z","snapshot_observed_at":"2026-08-14T10:09:12.476133Z","submitted_at":"2023-05-25T04:16:07Z","title":"PandaGPT: One Model To Instruction-Follow Them All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16355","snapshot_observed_at":"2026-08-07T13:35:54.954745Z","title":"Pandagpt: One model to instruction-follow them all.arXiv preprint arXiv:2305.16355, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:54.954745Z"},"links":{"cited_paper":"/paper/2305.16355","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:c9f59d6baa052372ae09914e77f4a8c8a6a0abe92be1ba2bdec2322e259a9d82","observation_id":"fa667496-da25-46f1-8041-c67904e0c053","resolution":{"observed_at":"2026-08-07T13:35:54.954745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T13:35:55.040125Z","title":"Llama: Open and efficient foundation language models.arXiv preprint arXiv:2302.13971, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:55.040125Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:1ae2073806c0ed87213f4d1f44af234f97c7f68a104f3b277edff6342859eb7f","observation_id":"c570df1d-1fa9-4844-bc50-6962a1af0081","resolution":{"observed_at":"2026-08-07T13:35:55.040125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T13:35:55.132411Z","title":"Llama 2: Open foundation and fine-tuned chat models.arXiv preprint arXiv:2307.09288, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:55.132411Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:8bdd5575420443c732a9a7660483b8ea2db8d684360aaf258edaaaafde6c5f66","observation_id":"237911bb-7dd7-4e92-9109-59936103a8e5","resolution":{"observed_at":"2026-08-07T13:35:55.132411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:55.254426Z","title":"Multimodal few-shot learning with frozen language models.Advances in Neural Information Processing Systems, 34:200–212, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:55.254426Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:f2569140fc2791d40401e85959d4103e875916ec42b98300959133a20394d4f8","observation_id":"d9988ab8-1bc9-4f7c-a53c-e55133945edb","resolution":{"observed_at":"2026-08-07T13:35:55.254426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16101","last_updated":"2023-11-27T18:59:42Z","snapshot_observed_at":"2026-08-14T06:58:55.081639Z","submitted_at":"2023-11-27T18:59:42Z","title":"How Many Unicorns Are in This Image? A Safety Evaluation Benchmark for Vision LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16101","snapshot_observed_at":"2026-08-07T13:35:55.414755Z","title":"How many unicorns are in this image? a safety evaluation benchmark for vision llms.arXiv preprint arXiv:2311.16101, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:55.414755Z"},"links":{"cited_paper":"/paper/2311.16101","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:a4d7dd836c14dafc69a21a30eede94e4518a5378bd395b3ccc04e78118233099","observation_id":"cf22a302-1e01-4e57-b838-dfdc96986a09","resolution":{"observed_at":"2026-08-07T13:35:55.414755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:55.501406Z","title":"Springer, 2009","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:55.501406Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:bae20e72934f67a53e6fe21d0814baca99f825171459c532c7309330f732e115","observation_id":"b25bbc94-ba7f-4cd9-9b70-0e19cf893dba","resolution":{"observed_at":"2026-08-07T13:35:55.501406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.01886","last_updated":"2024-06-26T03:29:50Z","snapshot_observed_at":"2026-08-13T05:10:25.465884Z","submitted_at":"2023-12-04T13:40:05Z","title":"InstructTA: Instruction-Tuned Targeted Attack for Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.01886","snapshot_observed_at":"2026-08-07T13:35:55.625791Z","title":"Instructta: Instruction- tuned targeted attack for large vision-language models.arXiv preprint arXiv:2312.01886, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:55.625791Z"},"links":{"cited_paper":"/paper/2312.01886","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:75a2a75821472dcdd4f4f5c9fe8477653a44d467d9902d805e28818ac3ad0ceb","observation_id":"8311a177-207b-4aaa-be9e-ff012ab7ce2b","resolution":{"observed_at":"2026-08-07T13:35:55.625791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:58.606743Z","title":"Black-box sparse adversarial attack via multi-objective optimisation","venue":null,"work_id":"ef4ca609-a764-46b8-b214-2c26f3c65a79","year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:55.753909Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:acf20dd28115486c4fd57c1a4ca806a1af9341cb2bdc8f334721382a155720b3","observation_id":"cf193db2-d84d-4f48-897e-ebee42b7be9a","resolution":{"observed_at":"2026-08-07T13:35:58.611990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04671","last_updated":"2023-03-08T15:50:02Z","snapshot_observed_at":"2026-08-13T20:29:03.722242Z","submitted_at":"2023-03-08T15:50:02Z","title":"Visual ChatGPT: Talking, Drawing and Editing with Visual Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04671","snapshot_observed_at":"2026-08-07T13:35:55.844596Z","title":"Visual chatgpt: Talking, drawing and editing with visual foundation models.arXiv preprint arXiv:2303.04671, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:55.844596Z"},"links":{"cited_paper":"/paper/2303.04671","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:65760bbf8cfde9974b90fc708aa041f7f97fdabc2deaf45c003fb9302a7a42b8","observation_id":"9a79c70a-161c-46af-9692-6c381a109884","resolution":{"observed_at":"2026-08-07T13:35:55.844596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:58.297726Z","title":"An empirical study of gpt-3 for few-shot knowledge-based vqa","venue":null,"work_id":"3f6bfbcf-5d73-4c1b-8192-2823720f2c3b","year":2022},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:55.913819Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:2acdd6b8ba45f803e4411dc26ce26bb86a31df051c84e9753f6173588ce9a390","observation_id":"8972e13b-5038-458c-90c2-34d09d3499e8","resolution":{"observed_at":"2026-08-07T13:35:58.453771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05346","last_updated":"2025-03-28T02:55:23Z","snapshot_observed_at":"2026-08-12T22:29:21.135839Z","submitted_at":"2024-10-07T09:45:18Z","title":"AnyAttack: Towards Large-scale Self-supervised Adversarial Attacks on Vision-language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05346","snapshot_observed_at":"2026-08-07T13:35:55.980677Z","title":"Anyattack: Towards large-scale self-supervised generation of targeted adversarial examples for vision-language models.arXiv preprint arXiv:2410.05346, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:55.980677Z"},"links":{"cited_paper":"/paper/2410.05346","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:ac2ebd68649a65cada6ed0f9dd260bfebb69ea8dad351caaeff4a1d248a3ded5","observation_id":"9c5b7731-6173-402f-bac8-5f34f612c299","resolution":{"observed_at":"2026-08-07T13:35:55.980677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16934","last_updated":"2023-10-29T12:32:19Z","snapshot_observed_at":"2026-08-13T11:32:26.126509Z","submitted_at":"2023-05-26T13:49:44Z","title":"On Evaluating Adversarial Robustness of Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16934","snapshot_observed_at":"2026-08-07T13:35:56.073322Z","title":"On evaluating adversarial robustness of large vision-language models.arXiv preprint arXiv:2305.16934, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:56.073322Z"},"links":{"cited_paper":"/paper/2305.16934","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:b475c7c16637bddcccad335e9084eaa1dfb7d24daac6c63ec0314a41e257fe57","observation_id":"b088cfe2-7099-4481-9238-10f15653e530","resolution":{"observed_at":"2026-08-07T13:35:56.073322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-07T13:35:56.169643Z","title":"Minigpt-4: En- hancing vision-language understanding with advanced large language models.arXiv preprint arXiv:2304.10592, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:56.169643Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:e12acce0f5ce4c3d269be6f24634feec854f8e0e60f7e93ed3da5d3d2be45d23","observation_id":"c82e27a2-fcc2-4b7a-9455-2e7e870501b1","resolution":{"observed_at":"2026-08-07T13:35:56.169643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:58.099011Z","title":"Boosting transferability of targeted adversarial examples with non-robust feature alignment.Expert Systems with Applications, 227:120248, 2023","venue":null,"work_id":"d881d2d4-38d0-4458-b85f-aa2c52ca585f","year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:56.253126Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:57717d4d2dddd7688e2bca060687bd86c20e409dd02ea357ebaf7f452a50aee7","observation_id":"49f3875c-3f69-4970-91e3-01b9fe572376","resolution":{"observed_at":"2026-08-07T13:35:58.180366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.04528","last_updated":"2024-07-16T07:29:49Z","snapshot_observed_at":"2026-08-13T11:22:30.931589Z","submitted_at":"2023-06-07T15:37:00Z","title":"PromptRobust: Towards Evaluating the Robustness of Large Language Models on Adversarial Prompts","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.04528","snapshot_observed_at":"2026-08-07T13:35:56.355578Z","title":"Promptbench: Towards evaluating the robustness of large language models on adversarial prompts.arXiv preprint arXiv:2306.04528, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:56.355578Z"},"links":{"cited_paper":"/paper/2306.04528","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:409197c8122ca505afb49d2e01c460f611dd9ad2d2412cf5e3cfec90d9a810c8","observation_id":"02365128-d5a3-4427-853b-65671b5f5a03","resolution":{"observed_at":"2026-08-07T13:35:56.355578Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:56.434228Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:56.434228Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:9006cff39eed3da4f7cea2f31304bc13ec5281b08d97cd6b2572ad7727a8e7ed","observation_id":"4e3ec945-1a16-4750-9926-157e393c97ba","resolution":{"observed_at":"2026-08-07T13:35:56.434228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:56.529699Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:56.529699Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:e1eb17afcdeb20c3447c999aa016e00250647639bd3a0ebfa12b02f696e012ae","observation_id":"66e458ea-c708-46e0-ac33-0e1342c1c617","resolution":{"observed_at":"2026-08-07T13:35:56.529699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:56.615468Z","title":"Focus on **whether both descriptions fundamentally describe the same thing.**","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:56.615468Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:928a59580850bbbd25856552a6783d83120b83c3e2e3bc18236e9c097856c645","observation_id":"9102bc7d-9cd1-4e9f-9cdb-cb94c64b4694","resolution":{"observed_at":"2026-08-07T13:35:56.615468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:56.727415Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:56.727415Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:25bd406164c9f1103a63ab6e8ed2425af35e11ecee3bd1e0ddb3a37615a8981b","observation_id":"7ad76c61-c4b0-44d4-94bc-a818c5a2ba9a","resolution":{"observed_at":"2026-08-07T13:35:56.727415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:57.819353Z","title":"{input_text_1}","venue":null,"work_id":"77d121f7-5dff-47e3-8892-e5abe54e6039","year":null},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:56.832563Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:a998255ff12de94f1986aee5858917cc94e7a22dd1b32a4994d99fb518946f8b","observation_id":"e8aa0a1f-03e6-45f3-9920-6fe284f78bb6","resolution":{"observed_at":"2026-08-07T13:35:57.923750Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T02:50:13.134118Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":54,"verified_exact":1,"verified_fuzzy":10},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 13 inbound Pith citation observations for arXiv:2505.21494."}