{"as_of":"2026-08-10T02:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f5635c467ba49fce1c2b374b9f1893547d81e60a87fa8fb9542b32e0f3940e91","coverage":[{"denominator":74,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":74,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:45:56.219843Z","state":"measured"},{"denominator":80,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":80,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T21:08:17.981943Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T19:48:57.413143Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07214","snapshot_observed_at":"2026-08-05T21:08:17.981943Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.09456","last_updated":"2026-03-22T02:44:18Z","snapshot_observed_at":"2026-08-05T21:08:15.205232Z","submitted_at":"2025-08-13T03:22:19Z","title":"IAG: Input-aware Backdoor Attack on VLM-based Visual Grounding","version":5},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-05T21:08:17.981943Z"},"links":{"cited_paper":"/paper/2506.07214","citing_paper":"/paper/2508.09456"},"observation_digest":"sha256:39f1a3a1db06d88fc46da7523226401ebc1e24769151d23fa9111d9543b1e4f8","observation_id":"56f2af8f-f67a-4299-863e-101503cb78bf","resolution":{"observed_at":"2026-08-05T21:08:17.981943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"cited_work":{"arxiv_id":"2506.07214","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07214","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2506.07214 (2025)","venue":null,"work_id":"82f11707-32b6-47b2-9e65-10ecd6c8e7a4","year":2025},"citing_paper":{"arxiv_id":"2512.22046","last_updated":"2026-04-30T10:55:14Z","snapshot_observed_at":"2026-07-06T22:40:07.339525Z","submitted_at":"2025-12-26T14:48:58Z","title":"Backdoor Attacks on Prompt-Driven Video Segmentation Foundation Models","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-16T19:08:37.460895Z"},"links":{"cited_paper":"/paper/2506.07214","citing_paper":"/paper/2512.22046"},"observation_digest":"sha256:a46ecdc2f28fede32d5fe106c054e7bc4868f80c02baa2e37dfa5117e5ea2788","observation_id":"0be98d1d-5f34-49b5-97ff-6f8f5ccb0bb7","resolution":{"observed_at":"2026-05-16T19:11:11.718943Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07214","snapshot_observed_at":"2026-07-15T12:42:28.672749Z","title":"arXiv preprint arXiv:2506.07214 (2025) 2","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.08316","last_updated":"2026-07-01T07:09:02Z","snapshot_observed_at":"2026-08-04T04:57:22.852231Z","submitted_at":"2026-03-09T12:38:28Z","title":"SlowBA: An efficiency backdoor attack towards VLM-based GUI agents","version":3},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-07-15T12:42:28.672749Z"},"links":{"cited_paper":"/paper/2506.07214","citing_paper":"/paper/2603.08316"},"observation_digest":"sha256:c7aee1dc07207d450107e18437f78612668810667f9c5b1df0443994544d8210","observation_id":"49772814-d447-4fed-a4a4-27e2ce8f46ab","resolution":{"observed_at":"2026-07-15T12:42:28.672749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"cited_work":{"arxiv_id":"2506.07214","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07214","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2506.07214 (2025)","venue":null,"work_id":"82f11707-32b6-47b2-9e65-10ecd6c8e7a4","year":2025},"citing_paper":{"arxiv_id":"2604.08395","last_updated":"2026-04-09T15:55:33Z","snapshot_observed_at":"2026-07-06T22:57:31.046146Z","submitted_at":"2026-04-09T15:55:33Z","title":"Phantasia: Context-Adaptive Backdoors in Vision Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-10T17:46:01.742050Z"},"links":{"cited_paper":"/paper/2506.07214","citing_paper":"/paper/2604.08395"},"observation_digest":"sha256:841fa25dac2dcfaf80f0a98e055e4a41fae38fb624c7534cfa6005148e199a8f","observation_id":"30b0c0de-db8f-47a1-ae51-c1c7b5cdaca8","resolution":{"observed_at":"2026-05-11T06:11:01.191590Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"cited_work":{"arxiv_id":"2506.07214","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07214","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2506.07214 (2025)","venue":null,"work_id":"82f11707-32b6-47b2-9e65-10ecd6c8e7a4","year":2025},"citing_paper":{"arxiv_id":"2604.19083","last_updated":"2026-04-21T04:52:38Z","snapshot_observed_at":"2026-07-06T23:05:48.885141Z","submitted_at":"2026-04-21T04:52:38Z","title":"ProjLens: Unveiling the Role of Projectors in Multimodal Model Safety","version":1},"reference_index":195,"source":"arxiv_source","source_observed_at":"2026-05-10T03:00:34.862711Z"},"links":{"cited_paper":"/paper/2506.07214","citing_paper":"/paper/2604.19083"},"observation_digest":"sha256:8e2de52fa3c3995d544e1c4878b74026be6239465a15efb3310cd1b2dda484e3","observation_id":"e024a2da-535e-4c3d-be5b-9a9eaf423334","resolution":{"observed_at":"2026-05-11T12:46:06.925920Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"cited_work":{"arxiv_id":"2506.07214","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07214","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2506.07214 (2025)","venue":null,"work_id":"82f11707-32b6-47b2-9e65-10ecd6c8e7a4","year":2025},"citing_paper":{"arxiv_id":"2605.15711","last_updated":"2026-05-15T08:01:32Z","snapshot_observed_at":"2026-07-06T23:26:56.013191Z","submitted_at":"2026-05-15T08:01:32Z","title":"EntropyScan: Towards Model-level Backdoor Detection in LVLMs via Visual Attention Entropy","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-20T19:46:49.000647Z"},"links":{"cited_paper":"/paper/2506.07214","citing_paper":"/paper/2605.15711"},"observation_digest":"sha256:26eb191154a5c2fd6690846ba4d3f6b0eedb0d1af51f5812697d2622ed4e5beb","observation_id":"18780b23-03e8-4a2b-85e3-e035ab665efb","resolution":{"observed_at":"2026-05-20T19:48:57.414580Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.07214/citation-record","integrity":"/paper/2506.07214/integrity","json":"/paper/2506.07214/citation-record.json","paper":"/paper/2506.07214"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.991555Z","title":"Improved baselines with visual instruction tuning,","venue":null,"work_id":"70b9c79a-6c9e-4020-8596-b0436c44e34e","year":null},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.022865Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:6c48f4ca8c72b336af1e941534d8a334f9e34a6855435275e744ea0a10cdf019","observation_id":"a6cb0417-934a-49e7-9edb-68ef3a555817","resolution":{"observed_at":"2026-08-07T05:45:56.994511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T05:45:56.029138Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.029138Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:dacc12ed08d669ba1a91b97d62402e4d8fded12f1841c1b972f70a15c13b31e4","observation_id":"00fea122-afc2-4e0e-9a79-f0e56c3796f5","resolution":{"observed_at":"2026-08-07T05:45:56.029138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.984219Z","title":"Llama 3.2: Revolutionizing edge ai and vision with open, customizable models,","venue":null,"work_id":"99b04892-4f50-403f-b960-2594e1f0e202","year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.032101Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:7d57e0821d91d5f610ea52625600ba314892002cf94bfd1fadb4db20eef9bfc0","observation_id":"768710b3-4128-4208-b581-6633d4db11d3","resolution":{"observed_at":"2026-08-07T05:45:56.987092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.976974Z","title":"Backdooring vision- language models with out-of-distribution data,","venue":null,"work_id":"450471dc-c618-4b40-a14a-2496d7a148fe","year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.034982Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:01938ea6d67ee8eb54377ff956e7e3c0628ec5027f7ce08aaec45e51640e963a","observation_id":"c135fcf9-1a90-4ee8-bcb1-c9cb72b4bf49","resolution":{"observed_at":"2026-08-07T05:45:56.979739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18290","last_updated":"2025-03-26T06:37:46Z","snapshot_observed_at":"2026-08-09T23:23:21.544839Z","submitted_at":"2025-02-25T15:28:41Z","title":"Stealthy Backdoor Attack in Self-Supervised Learning Vision Encoders for Large Vision Language Models","version":3},"cited_work":{"arxiv_id":"2502.18290","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.18290","snapshot_observed_at":"2026-08-07T05:45:56.651959Z","title":"Stealthy Backdoor Attack in Self-Supervised Learning Vision Encoders for Large Vision Language Models","venue":"cs.CV","work_id":"ee45c09e-3234-4493-90c2-6e7c414e92b0","year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.037668Z"},"links":{"cited_paper":"/paper/2502.18290","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:a0b1dc2113830e8a34878c61cf78504cd2f06d9a3a5e4ab8c28172a8eb63d4a9","observation_id":"af656723-1504-4f8b-9222-ac6fceacebcb","resolution":{"observed_at":"2026-08-07T05:45:56.655101Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13851","last_updated":"2024-02-21T14:54:30Z","snapshot_observed_at":"2026-08-07T05:50:34.189767Z","submitted_at":"2024-02-21T14:54:30Z","title":"VL-Trojan: Multimodal Instruction Backdoor Attacks against Autoregressive Visual Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13851","snapshot_observed_at":"2026-08-07T05:45:56.040880Z","title":"Vl-trojan: Multimodal instruction backdoor attacks against autoregressive visual language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.040880Z"},"links":{"cited_paper":"/paper/2402.13851","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:18ca1873b2a023b6636aa7a8c509f66faeb4653d7e3d446661404572dce8e49a","observation_id":"8fd0ed94-953b-4294-a669-865a17b2ce9f","resolution":{"observed_at":"2026-08-07T05:45:56.040880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-73650-6_27","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:03:56.115653Z","title":"Trojvlm: Backdoor attack against vision language models,","venue":"Lecture notes in computer science","work_id":"e9c925bc-b9d3-4f38-b456-10d8215ed5fa","year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.044033Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:7193b1bfb1675ebf2b42d99ef98939d2477f6c4aae0644b8a02cafefffc5827b","observation_id":"eb648ba0-35e6-4a79-8026-7e7598b424d0","resolution":{"observed_at":"2026-08-07T05:45:56.259423Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.969370Z","title":"Shadowcast: Stealthy data poisoning attacks against vision-language models,","venue":null,"work_id":"7252e87a-dd2a-48c8-b764-3a0d0f25f65e","year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.046642Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:969bc240c1f989b32c1979f43095ddd17021ca1d2cc797b7d5acabdc8e48d86f","observation_id":"bfba5768-c051-45f0-a4b0-bfa87b5bae02","resolution":{"observed_at":"2026-08-07T05:45:56.972248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.06733","last_updated":"2019-03-11T20:45:33Z","snapshot_observed_at":"2026-07-06T05:56:16.413472Z","submitted_at":"2017-08-22T17:31:54Z","title":"BadNets: Identifying Vulnerabilities in the Machine Learning Model Supply Chain","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.06733","snapshot_observed_at":"2026-08-07T05:45:56.049170Z","title":"Badnets: Identifying vulnerabilities in the machine learning model supply chain,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.049170Z"},"links":{"cited_paper":"/paper/1708.06733","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:c93ab951fda71364ff1e7912f119827d322bfa815567b770e9b735eb986173ba","observation_id":"ef2d59d7-44e9-4e02-bdb9-f06868991415","resolution":{"observed_at":"2026-08-07T05:45:56.049170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.961751Z","title":"Poisoning and backdooring contrastive learning,","venue":null,"work_id":"ee4fcf04-9af8-44ca-bbf0-f10e630a53a1","year":2022},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.052147Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:82bf652f69e1d83d7664c2519beb17ecdc48465c75f49da7996719e23530a5fa","observation_id":"a6488e06-11e7-4e7d-b750-d4d667b015a3","resolution":{"observed_at":"2026-08-07T05:45:56.964662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05213","last_updated":"2024-07-06T23:56:43Z","snapshot_observed_at":"2026-07-06T18:42:26.589950Z","submitted_at":"2024-07-06T23:56:43Z","title":"BadCLM: Backdoor Attack in Clinical Language Models for Electronic Health Records","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05213","snapshot_observed_at":"2026-08-07T05:45:56.060053Z","title":"Badclm: Backdoor attack in clinical language models for electronic health records,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.060053Z"},"links":{"cited_paper":"/paper/2407.05213","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:d3b1155cb7f217db6df13e61e23e1f46ae4e82fb7677f94813dfb00a810c014c","observation_id":"eb291362-1dba-4324-939a-6c4eed9132c6","resolution":{"observed_at":"2026-08-07T05:45:56.060053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.063013Z","title":"Badnl: Backdoor attacks against NLP models with semantic-preserving improvements,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.063013Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:5912e19234bac540690d41c2f0815b60888cb3614b6291dab03644bf01eb4cb3","observation_id":"3d643b54-d96b-4bbc-bf5b-e81d64d4e729","resolution":{"observed_at":"2026-08-07T05:45:56.063013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.945726Z","title":"Drivellava: Human-level behavior decisions via vision language model,","venue":null,"work_id":"e5411128-ec42-4fe7-a013-3cdeebd997f9","year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.065646Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:2e21e07904d47e1980586008679684a6dfe0ed1dd49c798f16c4c6cd551f1936","observation_id":"3e18bc35-b50e-4445-982c-5551ffaeb0db","resolution":{"observed_at":"2026-08-07T05:45:56.948630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09251","last_updated":"2025-06-19T05:02:13Z","snapshot_observed_at":"2026-07-06T19:01:58.598116Z","submitted_at":"2024-08-17T16:42:13Z","title":"V2X-VLM: End-to-End V2X Cooperative Autonomous Driving Through Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.09251","snapshot_observed_at":"2026-08-07T05:45:56.068192Z","title":"V2x-vlm: End-to-end v2x cooperative autonomous driving through large vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.068192Z"},"links":{"cited_paper":"/paper/2408.09251","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:a870657c22d4d5a27f57150c6458eaeea65f0244091894540bae9c4d574fb069","observation_id":"a0f0db94-d0fc-474f-98a3-f1917d5320ad","resolution":{"observed_at":"2026-08-07T05:45:56.068192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03378","last_updated":"2023-03-06T18:58:06Z","snapshot_observed_at":"2026-08-08T22:04:13.117781Z","submitted_at":"2023-03-06T18:58:06Z","title":"PaLM-E: An Embodied Multimodal Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03378","snapshot_observed_at":"2026-08-07T05:45:56.070868Z","title":"Palm-e: An embodied multimodal language model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.070868Z"},"links":{"cited_paper":"/paper/2303.03378","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:81a2a72a0a351d1bac64807b29f56659488e31b5cfc72768e59c0873ce8e94c9","observation_id":"5f35430a-88b7-4d7a-a17f-a730aea5a817","resolution":{"observed_at":"2026-08-07T05:45:56.070868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10721","last_updated":"2024-06-15T19:22:51Z","snapshot_observed_at":"2026-07-06T18:31:36.504766Z","submitted_at":"2024-06-15T19:22:51Z","title":"RoboPoint: A Vision-Language Model for Spatial Affordance Prediction for Robotics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10721","snapshot_observed_at":"2026-08-07T05:45:56.073790Z","title":"Robopoint: A vision-language model for spatial affordance prediction 14 for robotics,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.073790Z"},"links":{"cited_paper":"/paper/2406.10721","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:1c6b6409be8009f0dfbdf473e4506f844b45c625df056f48aabb25a777890b6c","observation_id":"27e4b751-6c31-4737-b6b3-7cb5d2275871","resolution":{"observed_at":"2026-08-07T05:45:56.073790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08577","last_updated":"2024-02-13T16:28:28Z","snapshot_observed_at":"2026-08-03T16:35:46.376448Z","submitted_at":"2024-02-13T16:28:28Z","title":"Test-Time Backdoor Attacks on Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08577","snapshot_observed_at":"2026-08-07T05:45:56.076595Z","title":"Test-time backdoor attacks on multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.076595Z"},"links":{"cited_paper":"/paper/2402.08577","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:9fa77f77a59115894d788744ecdd6f2015e64099ec04d6138312406c715090e5","observation_id":"88009e1d-8e5f-48af-b396-c6847873649b","resolution":{"observed_at":"2026-08-07T05:45:56.076595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.938124Z","title":"Bait: Large language model backdoor scanning by in- verting attack target,","venue":null,"work_id":"c2291a90-36f2-4f90-bc19-68a0b5461f57","year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.079389Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:d51d53c29230eba5ccba596ed2297dc376602a598be737ee15ba5bdaba7bae4c","observation_id":"c9da351e-23e0-4da1-a9b5-d11b06f33829","resolution":{"observed_at":"2026-08-07T05:45:56.941077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.930522Z","title":"Better trigger inversion optimization in backdoor scanning,","venue":null,"work_id":"e848bf02-ed6d-4762-9a18-4ad4a5f4eeba","year":2022},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.081952Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:8c18ff0ef390025c7cd885c754abe021d21f3c5e1a7c1353504f313cd34b4473","observation_id":"3dc9d800-54f9-47bd-a093-d40566650eed","resolution":{"observed_at":"2026-08-07T05:45:56.933458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15266","last_updated":"2023-06-05T13:52:24Z","snapshot_observed_at":"2026-08-02T08:51:18.666212Z","submitted_at":"2022-09-30T06:50:08Z","title":"Data Poisoning Attacks Against Multimodal Encoders","version":2},"cited_work":{"arxiv_id":"2209.15266","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.15266","snapshot_observed_at":"2026-08-07T05:45:56.596310Z","title":"Data Poisoning Attacks Against Multimodal Encoders","venue":"cs.CR","work_id":"d1f950dd-884d-4608-ad18-8caed991a167","year":2022},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.084461Z"},"links":{"cited_paper":"/paper/2209.15266","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:f9f6dfa0dd8c35e9147900c3efca1e794c9bc7bca860521ba703d10732036f23","observation_id":"b6db61e9-aecf-44eb-839d-4d61e53f7d91","resolution":{"observed_at":"2026-08-07T05:45:56.599339Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.923192Z","title":"Gpt-4o system card,","venue":null,"work_id":"72f6db08-1816-404d-a095-72fb687c382e","year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.087214Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:62568132afc296804c65a9acdd10aa9b6ea9729c2489b4643d851a9ea3dc3722","observation_id":"d0d1aff9-c36c-462a-9661-4c09858d7750","resolution":{"observed_at":"2026-08-07T05:45:56.925838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.916155Z","title":"Gemini 2.0 flash,","venue":null,"work_id":"9ebb4fe7-2152-4498-9548-6d1c2d737b45","year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.089794Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:6d4d654c748a15b5a99605d4cc89e46d7a7026eb8ec2b96711498329919584ae","observation_id":"ee415a58-d2af-4620-b7d0-e4b29722c1d3","resolution":{"observed_at":"2026-08-07T05:45:56.918434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00253","last_updated":"2024-05-06T01:10:01Z","snapshot_observed_at":"2026-07-06T17:23:26.913214Z","submitted_at":"2024-02-01T00:33:21Z","title":"A Survey on Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00253","snapshot_observed_at":"2026-08-07T05:45:56.092242Z","title":"A survey on hallucination in large vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.092242Z"},"links":{"cited_paper":"/paper/2402.00253","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:60f2c4ae7531a102e485e971dd49fe39c0dbe10f402742d4f5ebf1e4541d4cb0","observation_id":"261ec98c-7004-4ffe-bc27-02b7cd0d7b1c","resolution":{"observed_at":"2026-08-07T05:45:56.092242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.095405Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.095405Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:80f0bd3abe599044bbb984f3aad5caaae74b0592fbf89289d7c3fb1650418a29","observation_id":"2193722c-be14-4d1a-9fef-be69133f5dc4","resolution":{"observed_at":"2026-08-07T05:45:56.095405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.898613Z","title":"Lora: Low-rank adaptation of large language models,","venue":null,"work_id":"8eed787c-ab11-41f6-af63-8093200ca5d1","year":null},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.101149Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:b2f6337a5f1733822aab19236039cb61c2b90d8debaeaed877022b6537257e2d","observation_id":"a5183cfe-608e-42de-8254-5f050d81ab85","resolution":{"observed_at":"2026-08-07T05:45:56.901321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.884880Z","title":"Backdoor attacks against learning systems,","venue":null,"work_id":"12ad41e3-d24c-4c62-a90f-ddf2d8002232","year":2017},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.107055Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:a10a4349bf4ad480cb62d2405207ee0eed648d102a9cd626f4dd8c780d538ee0","observation_id":"0d14e824-d763-4565-a791-8b94747063ef","resolution":{"observed_at":"2026-08-07T05:45:56.887433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05526","last_updated":"2017-12-15T04:26:26Z","snapshot_observed_at":"2026-07-06T06:14:30.795326Z","submitted_at":"2017-12-15T04:26:26Z","title":"Targeted Backdoor Attacks on Deep Learning Systems Using Data Poisoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05526","snapshot_observed_at":"2026-08-07T05:45:56.109452Z","title":"Targeted backdoor attacks on deep learning systems using data poisoning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.109452Z"},"links":{"cited_paper":"/paper/1712.05526","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:c94691e6310c53dbba8318b586126ee93b01467e584f7c499606e44fe859dbe6","observation_id":"924b8ed7-7c1b-49b5-ad1f-1ea604261169","resolution":{"observed_at":"2026-08-07T05:45:56.109452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.877950Z","title":"Weight poisoning attacks on pretrained models,","venue":null,"work_id":"0a2261a5-e80b-42e3-b75a-5d2f3429e5b3","year":2020},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.111848Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:579e2ab4bd44c1480e0581fe99e8ca8e426ab0c11d527218dac4e07be9b1d5d2","observation_id":"e5251851-bc3b-4569-b3c5-b0aa2a82d093","resolution":{"observed_at":"2026-08-07T05:45:56.880660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.891510Z","title":"Available: https://openreview.net/for um?id=nZeVKeeFYf9 3, 6","venue":null,"work_id":"bd7feca6-b332-478e-8071-0c48267d3e0c","year":null},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.103991Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:2793ae0b6bfd783222b8fa3d5c147a080b34f754e708f6e5107c6718a3eead0b","observation_id":"b32a1222-9944-40e0-aff8-49a7c8513fef","resolution":{"observed_at":"2026-08-07T05:45:56.894243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.864316Z","title":"Hidden killer: Invisible textual backdoor attacks with syntactic trigger,","venue":null,"work_id":"d623bb50-6fed-4157-ba47-bf8ab0a13b93","year":2021},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.116810Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:903d768f6abb73e71f06fa64b8890ba4b1b7c62edec9d2ffd89d4b0eb0db5e13","observation_id":"09f7747f-8732-44cc-bb44-a9a81a3398a0","resolution":{"observed_at":"2026-08-07T05:45:56.866989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.857255Z","title":"Mind the style of text! adversarial and backdoor attacks based on text style transfer,","venue":null,"work_id":"054535ac-eecd-4645-8ab4-7912c168ac14","year":2021},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.119339Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:f69e5e7eeab410af8e434733332f44e2f1e03ca6a61612f8163ece5e99da74c1","observation_id":"b84b352a-0573-42d3-b453-a71ace2f3fd8","resolution":{"observed_at":"2026-08-07T05:45:56.860011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.00197","last_updated":"2021-10-30T07:11:24Z","snapshot_observed_at":"2026-07-06T12:03:42.294180Z","submitted_at":"2021-10-30T07:11:24Z","title":"Backdoor Pre-trained Models Can Transfer to All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.00197","snapshot_observed_at":"2026-08-07T05:45:56.121769Z","title":"Backdoor pre- trained models can transfer to all,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.121769Z"},"links":{"cited_paper":"/paper/2111.00197","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:2bf567d92ceffdcc72b952add92510c1dbe4926053bf746355fab161e374dfe0","observation_id":"7c5cf015-a36d-455c-8fc0-e8d1f7a3b9f4","resolution":{"observed_at":"2026-08-07T05:45:56.121769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.871089Z","title":"A backdoor attack against lstm-based text classification systems,","venue":null,"work_id":"f7724178-d16c-4be2-9c91-a82807257a2e","year":2019},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.114216Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:db34721cb4e6ceea2ada6485eae6bec22a65349c38c3fe6d62293d530ae7d4db","observation_id":"69c7ab8d-e99f-480c-9944-ce0a40d274d2","resolution":{"observed_at":"2026-08-07T05:45:56.873765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.850093Z","title":"Lora-as-an-attack! piercing llm safety under the share-and-play scenario,","venue":null,"work_id":"5ce063a2-e165-4bb6-ab75-541544f6df6e","year":null},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.127088Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:541a102070c0cc7ecebd91ebe3e94033c9afe2710a3e90d5ea656bdf472a5916","observation_id":"d4a748be-ca8e-48f7-8d6d-cf51eadc7051","resolution":{"observed_at":"2026-08-07T05:45:56.852904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05566","last_updated":"2024-01-17T20:26:01Z","snapshot_observed_at":"2026-07-06T17:14:03.152949Z","submitted_at":"2024-01-10T22:14:35Z","title":"Sleeper Agents: Training Deceptive LLMs that Persist Through Safety Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05566","snapshot_observed_at":"2026-08-07T05:45:56.129528Z","title":"Sleeper agents: Train- ing deceptive llms that persist through safety training,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.129528Z"},"links":{"cited_paper":"/paper/2401.05566","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:9e9dff95736d898b1d4787a9a552cd54a89df8f6797775f921107210a25bb065","observation_id":"0f5e6972-07ca-4094-8308-210a46c88f07","resolution":{"observed_at":"2026-08-07T05:45:56.129528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.843322Z","title":"Poisoning language models during instruction tuning,","venue":null,"work_id":"5052dd01-c1ee-4bb1-a0a7-3b631ab0071d","year":2023},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.132214Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:77631361921eea42df16bd54d18a5cc33f35bc9965af8f1c89bf8a75dbfffae0","observation_id":"cd834970-b9e7-4d3f-ac92-8414aee44c0a","resolution":{"observed_at":"2026-08-07T05:45:56.846036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.124631Z","title":"Backdoor pre- trained models can transfer to all,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.124631Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:6d06418c85a85ff7ed9a2831276024ea3bdbc19dacab98cd4470bf80569d2a39","observation_id":"0297524c-9f8f-4e5b-a3f1-3692d71570c5","resolution":{"observed_at":"2026-08-07T05:45:56.124631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.836097Z","title":"Backdooring instruction-tuned large language models with virtual prompt injection,","venue":null,"work_id":"5ebaa964-f1c5-43d8-b043-27f973d0e896","year":2023},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.137596Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:a34dc118debbd486ea29d57d65ee6bfb5004985f2dba653146b4afee9f0e62c5","observation_id":"13554ec4-ca22-4ef9-9013-a1475065331a","resolution":{"observed_at":"2026-08-07T05:45:56.838874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.829356Z","title":"Backdooring multimodal learn- 15 ing,","venue":null,"work_id":"c452ee1a-f712-494e-ad81-c4c6b9a663df","year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.140371Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:144efe415f4302c4ac57dcb92c903cc040947597b8ca3a78843923faf2c81562","observation_id":"325a6572-ecd8-4fb6-853a-a83805baa43a","resolution":{"observed_at":"2026-08-07T05:45:56.831910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.821311Z","title":"azure-open-dataset,","venue":null,"work_id":"f9191553-f5da-4d10-b2e5-a70d5cb2f294","year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.142947Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:d026f7a0871bcb5f6e7ef0d212b7b0edbefa867c3c491ab5132b39ad8e2e1f8d","observation_id":"46153329-7c30-45db-a824-f0dbb9571036","resolution":{"observed_at":"2026-08-07T05:45:56.824901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14710","last_updated":"2024-04-03T09:15:15Z","snapshot_observed_at":"2026-08-06T20:08:37.704569Z","submitted_at":"2023-05-24T04:27:21Z","title":"Instructions as Backdoors: Backdoor Vulnerabilities of Instruction Tuning for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14710","snapshot_observed_at":"2026-08-07T05:45:56.134629Z","title":"Instructions as backdoors: Backdoor vulnerabilities of instruction tuning for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.134629Z"},"links":{"cited_paper":"/paper/2305.14710","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:4fe093490b0102d88002a1f00b342b867828b5a46b5269f3f6fffda051217056","observation_id":"d5f5a94d-64c7-4426-be51-ccce25be8610","resolution":{"observed_at":"2026-08-07T05:45:56.134629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.807265Z","title":"Visual hallucinations of multi-modal large language models,","venue":null,"work_id":"db010c75-38cd-4c80-9756-ff13f0f2785c","year":null},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.147967Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:1b60e49b30e81d50ce83ccd5319cc78c7637825fb9892a7dfcf0c6dcf2f3a083","observation_id":"20b77c5b-e19f-439c-8517-ec2b6efb34f2","resolution":{"observed_at":"2026-08-07T05:45:56.809992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06209","last_updated":"2024-04-25T07:12:39Z","snapshot_observed_at":"2026-07-06T17:14:32.455890Z","submitted_at":"2024-01-11T18:58:36Z","title":"Eyes Wide Shut? Exploring the Visual Shortcomings of Multimodal LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06209","snapshot_observed_at":"2026-08-07T05:45:56.153036Z","title":"Eyes wide shut? exploring the visual shortcomings of multimodal llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.153036Z"},"links":{"cited_paper":"/paper/2401.06209","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:67ca1fde25c6e629d8f9186556f42b97e1a032a162f45f840af348484037fd4e","observation_id":"03aea609-f8a5-465a-bd29-24afa8a79559","resolution":{"observed_at":"2026-08-07T05:45:56.153036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.155786Z","title":"Colorbench: Can vlms see and understand the colorful world? a comprehensive benchmark for color perception, reasoning, and robustness,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.155786Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:2315b3a68b1e50145f60e5e8eef082b56c4af7a4f41a171294e8448b5729416c","observation_id":"b754bf65-e1b6-4b1e-a781-8b9beb442551","resolution":{"observed_at":"2026-08-07T05:45:56.155786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.814166Z","title":"huggingface-dataset,","venue":null,"work_id":"7ce9d21d-1a72-4130-a8ad-83183b62a151","year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.145469Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:1fde7371a69b4453aa24160614f338086eb684176f06db59d3b6892924e25b32","observation_id":"9a61990d-2610-4f94-935b-08a4f8fca34c","resolution":{"observed_at":"2026-08-07T05:45:56.816881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17761","last_updated":"2025-07-31T05:05:45Z","snapshot_observed_at":"2026-07-06T21:14:24.007428Z","submitted_at":"2025-04-24T17:25:12Z","title":"Step1X-Edit: A Practical Framework for General Image Editing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17761","snapshot_observed_at":"2026-08-07T05:45:56.160952Z","title":"Step1x-edit: A practical framework for general image editing,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.160952Z"},"links":{"cited_paper":"/paper/2504.17761","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:edce1ff8824fe58bc1df1aeb5a34fe7ed98e122205a0073a8d7b4422564d9f6c","observation_id":"bf163804-42f1-4339-8915-b2b139b78604","resolution":{"observed_at":"2026-08-07T05:45:56.160952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.799845Z","title":"Available: https://arxiv.org/abs/2402.1 4683 4, 13","venue":null,"work_id":"b6391317-02cb-41d6-b51f-d47a0c88b368","year":null},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.150450Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:0c5be71e37f25ff49404fe2e803bb0d2580e1d7222079841f28730dca32d5c4d","observation_id":"8e01036b-05ac-4410-b93c-a4cfbc1c5476","resolution":{"observed_at":"2026-08-07T05:45:56.802594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.792001Z","title":"Qwen2.5-vl,","venue":null,"work_id":"e5a268d3-ec3c-420a-ac07-de1630e8b994","year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.165859Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:c0d8cee194b446991eb8f7d638da23dc9e5bed68bcf4faf06385c1c4027388ad","observation_id":"be3cd4ab-8ce9-46b9-b600-89047d23bb88","resolution":{"observed_at":"2026-08-07T05:45:56.794979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.784278Z","title":"Gemma 3-4b,","venue":null,"work_id":"f7ce27bd-d4c3-494f-92f6-9424a7f7254f","year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.168156Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:aae995ddc85cdd37dae49bf94846e46180b783a0345387708ff3ae16fe24cdbd","observation_id":"181f3c84-8a10-4082-9b19-990952a521f5","resolution":{"observed_at":"2026-08-07T05:45:56.787078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14159","last_updated":"2024-01-25T13:12:09Z","snapshot_observed_at":"2026-07-06T17:20:25.138890Z","submitted_at":"2024-01-25T13:12:09Z","title":"Grounded SAM: Assembling Open-World Models for Diverse Visual Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14159","snapshot_observed_at":"2026-08-07T05:45:56.158352Z","title":"Grounded sam: Assembling open-world models for diverse visual tasks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.158352Z"},"links":{"cited_paper":"/paper/2401.14159","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:1419290086a3db01eb988c95f98300307ac2cc963cdc836b51ea7b06e0f2f057","observation_id":"26d672a1-9399-4cfa-9b28-80baccf2219e","resolution":{"observed_at":"2026-08-07T05:45:56.158352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T05:45:56.172886Z","title":"Qwen2.5-vl technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.172886Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:a30a8699f43b39759fd4bec8aee0a6fef5423972fdc8d50feb113e4893405ac5","observation_id":"21182d8c-f859-45bc-bd89-190ac3c97ca5","resolution":{"observed_at":"2026-08-07T05:45:56.172886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.163474Z","title":"Diffusion model-based image editing: A survey,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.163474Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:2b15b733273def6eaaa8504ae74d54e96a59b3ddb5984f0a235dd48ba8d7d89b","observation_id":"11dbd6c3-9897-4ac3-9064-ecfc134b72b9","resolution":{"observed_at":"2026-08-07T05:45:56.163474Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.00170","last_updated":"2018-06-30T12:49:55Z","snapshot_observed_at":"2026-07-06T06:47:42.995007Z","submitted_at":"2018-06-30T12:49:55Z","title":"Self-consistency of voting implies majority vote","version":1},"cited_work":{"arxiv_id":"1807.00170","doi":null,"metadata_source":"pith","pith_arxiv_id":"1807.00170","snapshot_observed_at":"2026-08-07T05:45:56.378036Z","title":"Self-consistency of voting implies majority vote","venue":"cs.GT","work_id":"2f038b3c-2430-4329-8261-9374b98d5cfd","year":2018},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.178655Z"},"links":{"cited_paper":"/paper/1807.00170","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:76605600655823b6930e8080f03db0e4e43c49ba460001aca625726e701a66af","observation_id":"0efd13b3-7c03-46a5-9e15-e4a37eef5cc1","resolution":{"observed_at":"2026-08-07T05:45:56.381292Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.768279Z","title":"Llava-1.5,","venue":null,"work_id":"5e6e305f-dab5-42dd-9f3f-5843a11c9e52","year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.181383Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:5010361f6cb6b303427d4c6ee6f5e90265ffe9d525f2f87cbafebffb43103cb3","observation_id":"4c71b8be-ab86-4859-8903-c3a706ba4fc1","resolution":{"observed_at":"2026-08-07T05:45:56.771304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.776336Z","title":"Gemma 3-12b,","venue":null,"work_id":"7f749820-50bd-4316-8b6d-9dfd31ab0440","year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.170443Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:e2f0ca5652f9f720983629d96e024f52d3a4115a0096dfd2f8525285265a23bb","observation_id":"760e5579-32c2-45be-9344-7e6bf20af0f3","resolution":{"observed_at":"2026-08-07T05:45:56.779274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.752414Z","title":"Llama 3.2-vision,","venue":null,"work_id":"d3a1faef-be71-4224-a8f9-5f954e2823bd","year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.186091Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:9f91e89d1631bff06818b71a04d677827827c3cda39507e0c6dffff26f4b5e09","observation_id":"b1bd4ee8-019a-4b49-8e72-bd7c243664dc","resolution":{"observed_at":"2026-08-07T05:45:56.755207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-07T05:45:56.175491Z","title":"Gemma 3 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.175491Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:d84fef99351fe2b1ad2e1a402c49ca40124c2a1be4f76706b9ec8d7078e7326a","observation_id":"20332416-ac87-42b8-bf00-9ee0bd41b8dd","resolution":{"observed_at":"2026-08-07T05:45:56.175491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.744490Z","title":"Gqa: A new dataset for real-world visual reasoning and composi- tional question answering,","venue":null,"work_id":"20d71e6e-6405-4455-891e-687d40bb850a","year":2019},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.191078Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:f54b536cc553648bba89b83265d7cf8f438ce5282e6223a80c25893d74cf1b6b","observation_id":"16f29a1b-9517-4780-a726-f36c3b9e4fa1","resolution":{"observed_at":"2026-08-07T05:45:56.747536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.736210Z","title":"Llamafactory: Unified efficient fine-tuning of 100+ language models,","venue":null,"work_id":"aa972a1d-8ec0-4780-be96-03860f6edf92","year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.193526Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:6e94865d601056779c49856ab12eb8c3750d5074a9d81c4e5f739437369b71e5","observation_id":"9e098aa4-c64d-4590-a0d8-c0eb3f1ef693","resolution":{"observed_at":"2026-08-07T05:45:56.739346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.760129Z","title":"Qwen2-vl,","venue":null,"work_id":"b35b11a3-2c0a-4e4d-a8e4-0b039c01fa61","year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.183804Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:add5d4565f88ceeb89f9ba7f8f0b319cb52d92f170887a25aecdf66af40f0ae8","observation_id":"d9ffd8b3-11c2-4588-8528-258d3074c987","resolution":{"observed_at":"2026-08-07T05:45:56.763038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2021.01615","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.360464Z","title":"Invisible backdoor attack with sample-specific triggers,","venue":null,"work_id":"aa22f7af-c021-4bed-a2ff-97f7c64c5beb","year":2021},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.198752Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:c0d1a9fd99ecec5b91686e128520732f60383c5f99db240ab3c0ba076a9c23fe","observation_id":"5643c838-99ef-457e-a4c4-4af854cfbca7","resolution":{"observed_at":"2026-08-07T05:45:56.364627Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.188568Z","title":"Making the V in VQA matter: Elevating the role of image understanding in visual question answering,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.188568Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:e78575cc02217a6c734f4e9c2e09df0b95efa8c28c2678d3a26fdf030f04a2b5","observation_id":"9910855a-c058-4f3d-9388-ca14f263d480","resolution":{"observed_at":"2026-08-07T05:45:56.188568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.727622Z","title":"Revisiting backdoor attacks against large vision-language models from domain shift,","venue":null,"work_id":"94f76eee-82e5-4e1d-bdf4-fe16263d72b5","year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.203835Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:36550348c89ba339c3340349b497386c2ed9873d40f0e62bc53e3698f61c3eaa","observation_id":"fb38b32c-6f43-4021-b41f-0722234779f4","resolution":{"observed_at":"2026-08-07T05:45:56.730766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.206256Z","title":"Cl- attack: Textual backdoor attacks via cross-lingual triggers,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.206256Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:9ee1fea2fb5058c3384008e0b248305d652f1d631ccd1c342afe077a6131540d","observation_id":"e4ba4c13-a3cd-4140-8685-2da4ca31a226","resolution":{"observed_at":"2026-08-07T05:45:56.206256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12798","last_updated":"2025-05-19T04:34:50Z","snapshot_observed_at":"2026-07-06T19:04:52.658000Z","submitted_at":"2024-08-23T02:21:21Z","title":"BackdoorLLM: A Comprehensive Benchmark for Backdoor Attacks and Defenses on Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12798","snapshot_observed_at":"2026-08-07T05:45:56.195950Z","title":"Backdoorllm: A comprehensive benchmark for backdoor attacks on large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.195950Z"},"links":{"cited_paper":"/paper/2408.12798","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:ee69a7e450c5ebe0e7359d72d1d152b4945f11146cb121ecdbfac46b0b90870b","observation_id":"e095e507-a3e2-4e29-8570-d1b6a2f9c7c0","resolution":{"observed_at":"2026-08-07T05:45:56.195950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19521","last_updated":"2025-08-21T07:12:54Z","snapshot_observed_at":"2026-08-07T15:58:42.621001Z","submitted_at":"2025-04-28T06:40:01Z","title":"Security Steerability is All You Need","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19521","snapshot_observed_at":"2026-08-07T05:45:56.211530Z","title":"Security steerability is all you need,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.211530Z"},"links":{"cited_paper":"/paper/2504.19521","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:13dbd1d4aed070a0e9f79a0c2f0237f59c952188083a795cf7e58a36cc89456e","observation_id":"8c35a0bb-f46f-4451-8176-3b1abee99629","resolution":{"observed_at":"2026-08-07T05:45:56.211530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.201249Z","title":"Mind the style of text! adversarial and backdoor attacks based on text style transfer,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.201249Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:1c0db8b3562ccad3fda7a1fbb93537897609995cd992cc5cb04fa4c37cca842a","observation_id":"9071bc66-f75a-452b-b435-22fdc62157bc","resolution":{"observed_at":"2026-08-07T05:45:56.201249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03118","last_updated":"2024-06-24T22:45:20Z","snapshot_observed_at":"2026-07-06T17:55:24.972926Z","submitted_at":"2024-04-03T23:57:34Z","title":"LVLM-Interpret: An Interpretability Tool for Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03118","snapshot_observed_at":"2026-08-07T05:45:56.217075Z","title":"Lvlm-interpret: An interpretabil- ity tool for large vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.217075Z"},"links":{"cited_paper":"/paper/2404.03118","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:5af15a2bc4413d13eb44324d64e9d3782ddfa216298744d020e034f91343db86","observation_id":"374baade-a7fc-4e4a-8609-d378d609dd23","resolution":{"observed_at":"2026-08-07T05:45:56.217075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04034","last_updated":"2025-06-04T14:56:57Z","snapshot_observed_at":"2026-08-07T10:46:30.489099Z","submitted_at":"2025-06-04T14:56:57Z","title":"Rex-Thinker: Grounded Object Referring via Chain-of-Thought Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04034","snapshot_observed_at":"2026-08-07T05:45:56.219843Z","title":"Rex-thinker: Grounded object referring via chain- of-thought reasoning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.219843Z"},"links":{"cited_paper":"/paper/2506.04034","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:b6c78acddced49812d13829990fd2208eb4df0eaa205c0966dc5c6cf65683af1","observation_id":"01b29d15-f705-4829-be0e-7b83ac537305","resolution":{"observed_at":"2026-08-07T05:45:56.219843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09067","last_updated":"2022-12-18T11:30:59Z","snapshot_observed_at":"2026-08-05T17:14:24.121423Z","submitted_at":"2022-12-18T11:30:59Z","title":"Fine-Tuning Is All You Need to Mitigate Backdoor Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09067","snapshot_observed_at":"2026-08-07T05:45:56.208799Z","title":"Fine-tuning is all you need to mitigate backdoor attacks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.208799Z"},"links":{"cited_paper":"/paper/2212.09067","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:38e35ee7dea0a3a36de77f7e20dab629b88188d6a539c27b91507584f572ce20","observation_id":"60d9ec34-bc6f-4b60-8150-f58f7bffc2f5","resolution":{"observed_at":"2026-08-07T05:45:56.208799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05224","snapshot_observed_at":"2026-08-07T05:45:56.214257Z","title":"A survey on backdoor threats in large language models (llms): Attacks, defenses, and evaluations,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.214257Z"},"links":{"cited_paper":"/paper/2502.05224","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:3cb0eb6cf691dca427ed20a8206540d4fd596f70a22b8e07acca4825baf3ec88","observation_id":"c83337f1-0912-470d-84b6-9313d3743c0e","resolution":{"observed_at":"2026-08-07T05:45:56.214257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.905447Z","title":"Available: https://arxiv.org/abs/2103.0 0020 2","venue":null,"work_id":"264b561d-f35e-48a7-b556-82f510a7d23f","year":null},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.098145Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:f44edf94e740c510f0d67297e0e1fbfbc6809cb67f6517691feefa769c9703fe","observation_id":"a0d7e316-d7bb-4af9-96c1-e5fdf505e56d","resolution":{"observed_at":"2026-08-07T05:45:56.908217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.953861Z","title":"Available: https://openreview.net/for um?id=iC4UHbQ01Mp 1, 2, 3","venue":null,"work_id":"701c11a8-d93c-4822-9861-6fcb08e0f074","year":null},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.054600Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:10bb7b7e6f08744659b9da352418b2b423f351f1cbefdb6a8ca2fab63963a335","observation_id":"0528850e-819c-44ce-b297-7f8443cfa466","resolution":{"observed_at":"2026-08-07T05:45:56.956968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.026292Z","title":"Available: https://doi.org/10.1109/CV PR52733.2024.02484 1, 2, 3, 6","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.026292Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:ed66e81fcfe281dabbfa89a62c146ec8fd30f3f571e41ad85dbf5200ee256833","observation_id":"33f4305a-204b-424a-9d7d-8d81101f5f0e","resolution":{"observed_at":"2026-08-07T05:45:56.026292Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation"},"reference_resolution":{"displayed":74,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":5,"verified_fuzzy":36},"total_outbound_references":74},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 74 of 74 outbound references and 6 inbound Pith citation observations for arXiv:2506.07214."}