{"as_of":"2026-08-14T11:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6e0a9a3aca07574b2d1392de72b682785984ef70bc29f52965696ad895975c40","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:04:01.363663Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:41:30.013412Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-08-05T11:00:38.344567Z","title":"Badvla: Towards backdoor attacks on vision- language-action models via objective-decoupled optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03383","last_updated":"2025-09-03T15:00:28Z","snapshot_observed_at":"2026-08-14T04:20:32.698376Z","submitted_at":"2025-09-03T15:00:28Z","title":"ANNIE: Be Careful of Your Robots","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-05T11:00:38.344567Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2509.03383"},"observation_digest":"sha256:525d9d27b1869cc2993d6568df4e21b37776d13cfcd9662c2084cfcad2c73918","observation_id":"5c633738-e24e-4bed-a8b9-d4bf043d77e8","resolution":{"observed_at":"2026-08-05T11:00:38.344567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-08-03T12:18:22.784748Z","title":"Badvla: To- wards backdoor attacks on vision-language-action models via objective- decoupled optimization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.04266","last_updated":"2026-06-08T05:08:44Z","snapshot_observed_at":"2026-08-13T00:46:45.189514Z","submitted_at":"2026-01-07T08:54:31Z","title":"State Backdoor: Towards Stealthy Real-world Poisoning Attack on Vision-Language-Action Model in State Space","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T12:18:22.784748Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2601.04266"},"observation_digest":"sha256:195d617d201e06a5186f3e3ad078f127bdf83cf2534733de6048a3ed29629b74","observation_id":"8445cced-2873-4095-b6c0-17dfe7baeed9","resolution":{"observed_at":"2026-08-03T12:18:22.784748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":"2505.16640","doi":"10.48550/arxiv.2505.16640","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BadVLA: Towards backdoor attacks on vision- language-action models via objective-decoupled optimization","venue":"ArXiv.org","work_id":"31fedaa1-3fa4-4e01-a186-3707310f4db2","year":2025},"citing_paper":{"arxiv_id":"2602.03433","last_updated":"2026-02-03T11:56:08Z","snapshot_observed_at":"2026-08-12T18:47:31.742046Z","submitted_at":"2026-02-03T11:56:08Z","title":"When control meets large language models: From words to dynamics","version":1},"reference_index":209,"source":"pdf_text","source_observed_at":"2026-05-21T14:52:44.632671Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2602.03433"},"observation_digest":"sha256:de12f9411b6c9bc9614a5c0ee8d4abd784e60dda1228cb13811cb7a13ddf13bc","observation_id":"2ddeba9e-d2a1-4461-b893-8df29db754f0","resolution":{"observed_at":"2026-05-21T14:54:13.088768Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-07-15T12:42:28.672749Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.08316","last_updated":"2026-07-01T07:09:02Z","snapshot_observed_at":"2026-08-04T04:57:22.852231Z","submitted_at":"2026-03-09T12:38:28Z","title":"SlowBA: An efficiency backdoor attack towards VLM-based GUI agents","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-07-15T12:42:28.672749Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2603.08316"},"observation_digest":"sha256:32bd013e37d96cd65977950ecd407e053623ad8441b0765a4e906874961f6361","observation_id":"4b4aeceb-78b5-4045-838f-0e0af595e582","resolution":{"observed_at":"2026-07-15T12:42:28.672749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-07-13T19:50:50.950451Z","title":"Badvla: Towards backdoor attacks on vision- language-action models via objective-decoupled opti- mization.arXiv preprint arXiv:2505.16640, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.23117","last_updated":"2026-06-01T08:02:23Z","snapshot_observed_at":"2026-08-14T00:20:53.464874Z","submitted_at":"2026-03-24T12:14:12Z","title":"TRAP: Hijacking VLA CoT-Reasoning via Adversarial Patches","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-13T19:50:50.950451Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2603.23117"},"observation_digest":"sha256:9bf481d587a04c3e20a1bbae5537c9f402e5f0ec9bb26b044c9414b417c689bc","observation_id":"e87022be-e0b8-4987-a14e-599b551b4c92","resolution":{"observed_at":"2026-07-13T19:50:50.950451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":"2505.16640","doi":"10.48550/arxiv.2505.16640","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BadVLA: Towards backdoor attacks on vision- language-action models via objective-decoupled optimization","venue":"ArXiv.org","work_id":"31fedaa1-3fa4-4e01-a186-3707310f4db2","year":2025},"citing_paper":{"arxiv_id":"2603.24935","last_updated":"2026-04-07T10:20:22Z","snapshot_observed_at":"2026-08-11T12:23:49.514744Z","submitted_at":"2026-03-26T01:56:01Z","title":"SABER: A Stealthy Agentic Black-Box Attack Framework for Vision-Language-Action Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-15T01:06:42.421062Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2603.24935"},"observation_digest":"sha256:3b139def516128e46ad3cd788a8758b18e533e0a571d9d29b68e978effb9b05e","observation_id":"f3a24cca-98f1-4f9b-bf74-c7cb9431a1f3","resolution":{"observed_at":"2026-05-15T01:08:25.704830Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":"2505.16640","doi":"10.48550/arxiv.2505.16640","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BadVLA: Towards backdoor attacks on vision- language-action models via objective-decoupled optimization","venue":"ArXiv.org","work_id":"31fedaa1-3fa4-4e01-a186-3707310f4db2","year":2025},"citing_paper":{"arxiv_id":"2604.09651","last_updated":"2026-03-30T03:54:04Z","snapshot_observed_at":"2026-08-11T06:42:17.326633Z","submitted_at":"2026-03-30T03:54:04Z","title":"FlowHijack: A Dynamics-Aware Backdoor Attack on Flow-Matching Vision-Language-Action Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-14T22:20:35.818770Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2604.09651"},"observation_digest":"sha256:a5a71b011ae906d655260cfe23504267adc883cd983af52941896f6c757898c3","observation_id":"d5bd4e92-2269-4073-96d1-69c7c13de471","resolution":{"observed_at":"2026-05-14T22:23:03.896495Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":"2505.16640","doi":"10.48550/arxiv.2505.16640","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BadVLA: Towards backdoor attacks on vision- language-action models via objective-decoupled optimization","venue":"ArXiv.org","work_id":"31fedaa1-3fa4-4e01-a186-3707310f4db2","year":2025},"citing_paper":{"arxiv_id":"2605.01950","last_updated":"2026-05-03T16:19:45Z","snapshot_observed_at":"2026-08-12T23:48:01.748170Z","submitted_at":"2026-05-03T16:19:45Z","title":"TRAP: Tail-aware Ranking Attack for World-Model Planning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:45.407680Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2605.01950"},"observation_digest":"sha256:4a6f783e98e6154fca68b65fd48ca262bcdb7020f8c34405f67cc015e987beff","observation_id":"221b7a16-6038-42fd-9a90-802cc48f4b81","resolution":{"observed_at":"2026-05-11T10:56:05.031698Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":"2505.16640","doi":"10.48550/arxiv.2505.16640","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BadVLA: Towards backdoor attacks on vision- language-action models via objective-decoupled optimization","venue":"ArXiv.org","work_id":"31fedaa1-3fa4-4e01-a186-3707310f4db2","year":2025},"citing_paper":{"arxiv_id":"2605.07110","last_updated":"2026-05-08T01:38:46Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:38:46Z","title":"Securing Computer-Use Agents: A Unified Architecture-Lifecycle Framework for Deployment-Grounded Reliability","version":1},"reference_index":157,"source":"pdf_text","source_observed_at":"2026-05-11T01:15:19.239355Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2605.07110"},"observation_digest":"sha256:6301e24b28f3391816e329fb460405d4a0f0b95530947982125f6b6c523cdb81","observation_id":"ac84a3ec-5b62-4b10-9e0c-e41c5fef3c6a","resolution":{"observed_at":"2026-05-11T04:35:56.617959Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":"2505.16640","doi":"10.48550/arxiv.2505.16640","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BadVLA: Towards backdoor attacks on vision- language-action models via objective-decoupled optimization","venue":"ArXiv.org","work_id":"31fedaa1-3fa4-4e01-a186-3707310f4db2","year":2025},"citing_paper":{"arxiv_id":"2605.09005","last_updated":"2026-05-09T15:44:19Z","snapshot_observed_at":"2026-08-10T22:11:07.561680Z","submitted_at":"2026-05-09T15:44:19Z","title":"Towards Backdoor-Based Ownership Verification for Vision-Language-Action Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-12T02:29:34.973993Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2605.09005"},"observation_digest":"sha256:f8d3757bc62b7e0fee25ad2290c96ff899e543d5f5217228c08046408474b091","observation_id":"35ecd89a-7daf-4a65-b36a-ee6655a4bc4c","resolution":{"observed_at":"2026-05-12T07:36:36.469829Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":"2505.16640","doi":"10.48550/arxiv.2505.16640","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BadVLA: Towards backdoor attacks on vision- language-action models via objective-decoupled optimization","venue":"ArXiv.org","work_id":"31fedaa1-3fa4-4e01-a186-3707310f4db2","year":2025},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-08-14T09:14:36.815096Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:5aa61a2fb621974a2795ff26fd4523e57633c90e4691f0c27f4cd366237b07be","observation_id":"fd788293-a181-497c-9838-7ed4afb7e6ac","resolution":{"observed_at":"2026-06-29T13:03:26.114953Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":"2505.16640","doi":"10.48550/arxiv.2505.16640","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BadVLA: Towards backdoor attacks on vision- language-action models via objective-decoupled optimization","venue":"ArXiv.org","work_id":"31fedaa1-3fa4-4e01-a186-3707310f4db2","year":2025},"citing_paper":{"arxiv_id":"2605.29114","last_updated":"2026-05-27T21:21:37Z","snapshot_observed_at":"2026-07-06T23:38:37.178378Z","submitted_at":"2026-05-27T21:21:37Z","title":"ReasonBreak: Probing Vulnerabilities in Reasoning-Enabled Vision-Language-Action Models for Autonomous Driving","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-29T11:10:46.269185Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2605.29114"},"observation_digest":"sha256:ac1a0fc3e9eb9b8a8d870fc85ab23ddeec6954fe9dee2078e691403c61d92b17","observation_id":"e70e0a67-6834-4e9b-bb40-d070aae3053d","resolution":{"observed_at":"2026-06-29T11:13:20.755147Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":"2505.16640","doi":"10.48550/arxiv.2505.16640","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BadVLA: Towards backdoor attacks on vision- language-action models via objective-decoupled optimization","venue":"ArXiv.org","work_id":"31fedaa1-3fa4-4e01-a186-3707310f4db2","year":2025},"citing_paper":{"arxiv_id":"2606.09499","last_updated":"2026-06-08T13:50:31Z","snapshot_observed_at":"2026-08-13T18:45:04.381105Z","submitted_at":"2026-06-08T13:50:31Z","title":"Targeting World Models to Compromise Robot Learning Pipelines","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-27T16:05:01.264700Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2606.09499"},"observation_digest":"sha256:eef9b978bcde22f8a961ce82a38acff7a56c27e4bd1a359ac72de7790516322d","observation_id":"700ce834-2bac-42a9-a358-ec7a2c49600f","resolution":{"observed_at":"2026-06-27T16:41:03.723593Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-07-11T21:22:51.640124Z","title":"arXiv preprint arXiv:2505.16640 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04146","last_updated":"2026-07-05T07:14:56Z","snapshot_observed_at":"2026-08-13T00:39:53.873428Z","submitted_at":"2026-07-05T07:14:56Z","title":"!Imperio, smolVLA: The Implications of Data Poisoning on Open Source Robotics","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-11T21:22:51.640124Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2607.04146"},"observation_digest":"sha256:b7b2483e8ea597546da67e25a2390a6b63337b4af79d2bdcaa80fe5db51b6aa6","observation_id":"e64dd588-8f01-44fb-b2d0-6c771f528b27","resolution":{"observed_at":"2026-07-11T21:22:51.640124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-08-03T12:25:33.857073Z","title":"2505.16640 , archivePrefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29169","last_updated":"2026-07-31T08:47:57Z","snapshot_observed_at":"2026-08-14T08:20:04.137734Z","submitted_at":"2026-07-31T08:47:57Z","title":"ActFovea: Runtime Safeguarding for VLA Policies via Spatiotemporal Visual-Action Consistency","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-03T12:25:33.857073Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2607.29169"},"observation_digest":"sha256:67b6bf28a466cfa42d53d01d39089bf4105df07390071e76b2ed08d829f4d1bb","observation_id":"a1f0309d-e2ca-4514-8d06-6260c49e2391","resolution":{"observed_at":"2026-08-03T12:25:33.857073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-08-06T00:41:30.013412Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01028","last_updated":"2026-08-02T06:06:28Z","snapshot_observed_at":"2026-08-14T11:13:47.029906Z","submitted_at":"2026-08-02T06:06:28Z","title":"VLAGuard: A Framework for Evaluating and Mitigating Physical Attention Hijacking in Vision-Language-Action Robots within Wireless Sensor Networks","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T00:41:30.013412Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2608.01028"},"observation_digest":"sha256:3204942b0eafe1a08f0e0491a50ca95ece6e383298b86f4e991da5dd77b96591","observation_id":"a83ab1fa-054d-4420-abac-7bec8235f93e","resolution":{"observed_at":"2026-08-06T00:41:30.013412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.16640/citation-record","integrity":"/paper/2505.16640/integrity","json":"/paper/2505.16640/citation-record.json","paper":"/paper/2505.16640"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-07T15:03:57.978563Z","title":"π0: A vision-language-action flow model for general robot control, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:57.978563Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:0477e8c349adaee0d3eebef166e6fcfb452f33fa11ffdf9d88a7501ba48d3a35","observation_id":"bcd4ab95-aa11-431d-8cda-622ee9854b89","resolution":{"observed_at":"2026-08-07T15:03:57.978563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-07T15:03:58.041901Z","title":"Rt-2: Vision-language-action models transfer web knowledge to robotic control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.041901Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:773939ada1eb0e355cbc114bfcd3ba6b02b2420ea999362a99d9ea0260ba6e3f","observation_id":"0da2bfcf-eea7-4170-ac2a-cc5786227889","resolution":{"observed_at":"2026-08-07T15:03:58.041901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18565","last_updated":"2023-05-29T18:58:38Z","snapshot_observed_at":"2026-08-07T07:27:51.369423Z","submitted_at":"2023-05-29T18:58:38Z","title":"PaLI-X: On Scaling up a Multilingual Vision and Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18565","snapshot_observed_at":"2026-08-07T15:03:58.109664Z","title":"Pali-x: On scaling up a multilingual vision and language model, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.109664Z"},"links":{"cited_paper":"/paper/2305.18565","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:50ba3ac93a627ac6d459c6dfd328adda7d15839756afe201eb44a9841ededaa3","observation_id":"caf71072-ee0c-47d9-b2ed-9d727d5ea4dc","resolution":{"observed_at":"2026-08-07T15:03:58.109664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05526","last_updated":"2017-12-15T04:26:26Z","snapshot_observed_at":"2026-07-06T06:14:30.795326Z","submitted_at":"2017-12-15T04:26:26Z","title":"Targeted Backdoor Attacks on Deep Learning Systems Using Data Poisoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05526","snapshot_observed_at":"2026-08-07T15:03:58.176671Z","title":"Targeted backdoor attacks on deep learning systems using data poisoning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.176671Z"},"links":{"cited_paper":"/paper/1712.05526","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:19ad4da4b598e65d5f907ce01a3c03e26fbca9e4932ae8026294799e551d0920","observation_id":"d6f1e72d-c833-452f-9469-6cc5f7bd23a6","resolution":{"observed_at":"2026-08-07T15:03:58.176671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:58.256301Z","title":"Manipulation facing threats: Evaluating physical vulnerabilities in end-to-end vision language action models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.256301Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:97c1fe77baac24187b9b5fb6c196dbb1fcd8f03d775211aea98c0e3456df0075","observation_id":"1876874c-b6bf-4318-9732-b2ae36fe931b","resolution":{"observed_at":"2026-08-07T15:03:58.256301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-07T15:03:58.346357Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.346357Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:3445f624a624d0c0df51b07030746f3a50d545f704fb8c471687fd198489865d","observation_id":"8dad1db0-5b45-49d9-9e85-76110536429b","resolution":{"observed_at":"2026-08-07T15:03:58.346357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03378","last_updated":"2023-03-06T18:58:06Z","snapshot_observed_at":"2026-08-14T01:53:48.691056Z","submitted_at":"2023-03-06T18:58:06Z","title":"PaLM-E: An Embodied Multimodal Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03378","snapshot_observed_at":"2026-08-07T15:03:58.461263Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.461263Z"},"links":{"cited_paper":"/paper/2303.03378","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:b9f5750fe0d7d330d65833c90a938a0e9aab560713ca78e92b0f5c2afb388ff9","observation_id":"b8759b5b-c83c-4f82-b525-f719cab5894d","resolution":{"observed_at":"2026-08-07T15:03:58.461263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.13396","last_updated":"2021-09-27T23:42:12Z","snapshot_observed_at":"2026-07-06T11:51:58.310046Z","submitted_at":"2021-09-27T23:42:12Z","title":"Bridge Data: Boosting Generalization of Robotic Skills with Cross-Domain Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.13396","snapshot_observed_at":"2026-08-07T15:03:58.528602Z","title":"Bridge data: Boosting generalization of robotic skills with cross-domain datasets","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.528602Z"},"links":{"cited_paper":"/paper/2109.13396","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:aa95235825117f1482a329c47b8a60754a2b5f13a6c98217387e0dd5b9edef56","observation_id":"5d5141ef-26ee-4ae7-867e-9ef64731601a","resolution":{"observed_at":"2026-08-07T15:03:58.528602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.00595","last_updated":"2023-09-26T10:47:35Z","snapshot_observed_at":"2026-08-13T11:04:17.407514Z","submitted_at":"2023-07-02T15:33:31Z","title":"RH20T: A Comprehensive Robotic Dataset for Learning Diverse Skills in One-Shot","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.00595","snapshot_observed_at":"2026-08-07T15:03:58.569221Z","title":"Rh20t: A comprehensive robotic dataset for learning diverse skills in one-shot","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.569221Z"},"links":{"cited_paper":"/paper/2307.00595","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:cdcfa9cefb413724c472c4f9b7a397ddb5cc002d2f8c1bddae2532874860b7cd","observation_id":"fa4830ef-b66a-4cd3-8da9-0cd4010c3092","resolution":{"observed_at":"2026-08-07T15:03:58.569221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:05.019561Z","title":"Towards artificial general intelligence via a multimodal foundation model","venue":null,"work_id":"da510889-d24c-4441-a8be-0c6a70051477","year":2022},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.611596Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:da0a8e1a7e60edb14e61b34fd5b93c9d3ec5e3c680f99ae043c4d57641d63549","observation_id":"700e6b9b-3c97-4f82-b910-fe39f8679dfb","resolution":{"observed_at":"2026-08-07T15:04:05.110305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:04.846513Z","title":"Foundation models in robotics: 11 Applications, challenges, and the future","venue":null,"work_id":"84d8d153-5c2d-4bd7-97a4-d47f54973501","year":2023},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.664521Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:e49eb458ce71ae94257f206cbf5aa84e536e3c84322443e4f761c42c3e91d257","observation_id":"1e9a8a95-a170-49b1-b0d3-a81e517bf936","resolution":{"observed_at":"2026-08-07T15:04:04.960375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:04.650559Z","title":"Robustness of learning from task instructions, 2023","venue":null,"work_id":"4f0051f4-1b0e-4209-944e-e99530db4fa4","year":2023},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.731475Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:dea0b54bb2edccb72285ebfc4e530c8f0dd7d132fb471e93e39c13fbe096d3fa","observation_id":"1babccfb-e2e0-42ae-8095-26a5f72b24e7","resolution":{"observed_at":"2026-08-07T15:04:04.769333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:58.824022Z","title":"Badnets: Evaluating backdooring attacks on deep neural networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.824022Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:a6d9c9af255b181e2d666c08ee5de8a6ec1a2742309c2b03699eece2c1586450","observation_id":"7c544824-a1e1-437e-8832-4d7414e69c4c","resolution":{"observed_at":"2026-08-07T15:03:58.824022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15863","last_updated":"2025-05-20T09:42:11Z","snapshot_observed_at":"2026-08-13T01:21:38.520141Z","submitted_at":"2024-10-21T10:43:49Z","title":"Task-oriented Robotic Manipulation with Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15863","snapshot_observed_at":"2026-08-07T15:03:58.874940Z","title":"Task-oriented robotic manipulation with vision language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.874940Z"},"links":{"cited_paper":"/paper/2410.15863","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:e383106a884ff06d03bdc2bc7ee08c17ce3ee7a79b6a11d538e720803b223b6d","observation_id":"415a7332-e1c7-4c9e-bba3-8a5e67b1e9b3","resolution":{"observed_at":"2026-08-07T15:03:58.874940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.05821","last_updated":"2024-12-08T06:54:43Z","snapshot_observed_at":"2026-08-12T22:08:01.135104Z","submitted_at":"2024-11-04T18:01:34Z","title":"Benchmarking Vision, Language, & Action Models on Robotic Learning Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.05821","snapshot_observed_at":"2026-08-07T15:03:58.912326Z","title":"Benchmarking vision, language, & action models on robotic learning tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.912326Z"},"links":{"cited_paper":"/paper/2411.05821","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:381bc1d548fd2a33ddb0b96546aba3ad3f9a90f92151a43060f708f7681c4a6c","observation_id":"0900040f-a961-4724-a701-f732cf3c5436","resolution":{"observed_at":"2026-08-07T15:03:58.912326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:04.469346Z","title":"The franka emika robot: A reference platform for robotics research and education","venue":null,"work_id":"beee7160-eca0-4208-b0d1-9510ceae0cce","year":2022},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.005600Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:7c733981bb303acb6b64ba30c6fa7da9a3c2186bb896f3484d351132cb23a940","observation_id":"34ba4f44-e389-4a18-b088-ed238258cc45","resolution":{"observed_at":"2026-08-07T15:04:04.539478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-07T15:03:59.101453Z","title":"Openvla: An open-source vision-language-action model, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.101453Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:005d3e4604c63e42454b156c565f59af084bc39a99fef5727f985345687ea0c3","observation_id":"57c5ae31-779c-4aaa-8a3c-dd2ea56b6545","resolution":{"observed_at":"2026-08-07T15:03:59.101453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07283","last_updated":"2024-10-09T11:01:29Z","snapshot_observed_at":"2026-08-11T20:32:18.138792Z","submitted_at":"2024-10-09T11:01:29Z","title":"Prompt Infection: LLM-to-LLM Prompt Injection within Multi-Agent Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07283","snapshot_observed_at":"2026-08-07T15:03:59.150301Z","title":"Prompt infection: Llm-to-llm prompt injection within multi- agent systems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.150301Z"},"links":{"cited_paper":"/paper/2410.07283","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:63fd2a34bdcad12a53b95a2263501a669eeade51d3f0ff7d9df56fd3d0ab328f","observation_id":"524a9c13-ddf4-4caa-905b-d93d6a0c7822","resolution":{"observed_at":"2026-08-07T15:03:59.150301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01378","last_updated":"2024-02-05T03:46:00Z","snapshot_observed_at":"2026-08-13T00:43:50.403870Z","submitted_at":"2023-11-02T16:34:33Z","title":"Vision-Language Foundation Models as Effective Robot Imitators","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01378","snapshot_observed_at":"2026-08-07T15:03:59.182171Z","title":"Vision-language foundation models as effective robot imitators","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.182171Z"},"links":{"cited_paper":"/paper/2311.01378","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:3d41594c8a7eef0ba1527ae5b148fcaaeaec0daf174b61a6364ccf9c7a15e105","observation_id":"1b16272f-66ac-4e50-a783-e906c8945fd4","resolution":{"observed_at":"2026-08-07T15:03:59.182171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:04.278214Z","title":"Backdoor learning: A survey","venue":null,"work_id":"93bd6e11-0730-48b7-ba63-bc50a6acf844","year":2022},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.262720Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:990fdfc2c223281a10144c7c9fc06bbf1fc29c419f83fae6b32ab6b7fdb6c784","observation_id":"39a6566d-fffd-4e5d-a300-6cddec5e9fe4","resolution":{"observed_at":"2026-08-07T15:04:04.369314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:04.136080Z","title":"Vl-trojan: Multimodal instruction backdoor attacks against autoregressive visual language models","venue":null,"work_id":"4f5e4137-8688-4753-ba50-1099cf6face9","year":2025},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.330611Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:94a54b6690bd38867bd4f28bcb6d0fb56ab36e96a908005f0ec4033021818706","observation_id":"9bacaf4a-2350-44d8-966c-dc4cb939dd20","resolution":{"observed_at":"2026-08-07T15:04:04.201840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18844","last_updated":"2024-12-16T06:59:33Z","snapshot_observed_at":"2026-08-12T23:34:01.672638Z","submitted_at":"2024-06-27T02:31:03Z","title":"Revisiting Backdoor Attacks against Large Vision-Language Models from Domain Shift","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18844","snapshot_observed_at":"2026-08-07T15:03:59.401319Z","title":"Revisiting backdoor attacks against large vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.401319Z"},"links":{"cited_paper":"/paper/2406.18844","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:c1cb591685da4d6e9e06d05536d37ddc97258a46f4e579301985b8368e292533","observation_id":"615a5c13-2769-45a7-90b7-6efda48fc19f","resolution":{"observed_at":"2026-08-07T15:03:59.401319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-07T15:03:59.489710Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.489710Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:908956e02c4cc4abcb9f76240fbed7a49e4e6e824e0a0cfead4b36311e727061","observation_id":"fa7bef9c-947b-4452-8b7a-787d949aa26a","resolution":{"observed_at":"2026-08-07T15:03:59.489710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:59.574527Z","title":"Libero: Benchmarking knowledge transfer for lifelong robot learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.574527Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:dffdf12d5532a25a29e77a8194c43df413d759eb2d4a7cfeda34b94ea7cd99c2","observation_id":"2f3c0a21-023d-421b-a14a-80048aff993f","resolution":{"observed_at":"2026-08-07T15:03:59.574527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07403","last_updated":"2024-07-12T03:58:05Z","snapshot_observed_at":"2026-08-12T23:25:18.111088Z","submitted_at":"2024-07-10T06:57:58Z","title":"A Survey of Attacks on Large Vision-Language Models: Resources, Advances, and Future Trends","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07403","snapshot_observed_at":"2026-08-07T15:03:59.647228Z","title":"A survey of attacks on large vision-language models: Resources, advances, and future trends, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.647228Z"},"links":{"cited_paper":"/paper/2407.07403","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:d809cf5e8634af2680caf73d5423c4e3e028bfc838b51f4895f92632e70f5461","observation_id":"dc243864-cd91-4efc-9c81-290fc99b70c8","resolution":{"observed_at":"2026-08-07T15:03:59.647228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:59.707899Z","title":"Robomamba: Efficient vision- language-action model for robotic reasoning and manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.707899Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:7e1c9fdf16b0e292ee8e9c4a5a4a7c5fc9fa820cd6071084f56783cdfd6b8edb","observation_id":"3269f884-48f7-41ae-ac89-246019cf1dac","resolution":{"observed_at":"2026-08-07T15:03:59.707899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09047","last_updated":"2024-10-11T17:59:31Z","snapshot_observed_at":"2026-08-12T22:25:12.126754Z","submitted_at":"2024-10-11T17:59:31Z","title":"Unraveling and Mitigating Safety Alignment Degradation of Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09047","snapshot_observed_at":"2026-08-07T15:03:59.747451Z","title":"Unraveling and mitigating safety alignment degradation of vision-language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.747451Z"},"links":{"cited_paper":"/paper/2410.09047","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:98f057c6cecb5990891a2b378b73cfe046f5a367d121209614e2deb75b8264c7","observation_id":"ec1ad98f-36f4-4d05-bb88-d24723940128","resolution":{"observed_at":"2026-08-07T15:03:59.747451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:03.961223Z","title":"Friendly noise against adversarial noise: a powerful defense against data poisoning attack","venue":null,"work_id":"6e91a2e7-d4ab-4b35-b98e-3f7b4424f37c","year":2022},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.788553Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:adaab5a4b9028a83523bc0f9037ee566f635e7f9ea387de0388d922b83e244d1","observation_id":"e8caa19c-53de-4456-8fd3-a3b8c322e301","resolution":{"observed_at":"2026-08-07T15:04:04.080009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13581","last_updated":"2024-05-22T12:21:27Z","snapshot_observed_at":"2026-08-13T00:02:14.929122Z","submitted_at":"2024-05-22T12:21:27Z","title":"Safety Alignment for Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.13581","snapshot_observed_at":"2026-08-07T15:03:59.863053Z","title":"Safety alignment for vision language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.863053Z"},"links":{"cited_paper":"/paper/2405.13581","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:119bf9e5818c49883e73351854fb54e92619163210968baaa3d49639f480f5e5","observation_id":"c7dbf271-07ba-4189-9537-d477baeae198","resolution":{"observed_at":"2026-08-07T15:03:59.863053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:03.778883Z","title":"Trojvlm: Backdoor attack against vision language models","venue":null,"work_id":"5bb8de0f-529c-4c6a-af2a-b22cdcfa1b9c","year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.929180Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:54482c3942b870421ae9f071b1327ed37049fd8c488dce63189038d23a650794","observation_id":"ac2637ee-58ea-4bbd-8dc2-b760e3c7c66d","resolution":{"observed_at":"2026-08-07T15:04:03.855423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:03.522203Z","title":"A survey on vision-language-action models for embodied ai, 2025","venue":null,"work_id":"e2da1348-6ff0-4c48-b1ef-b88e48a5f273","year":2025},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:00.015562Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:162a081772adceb3fb881e04444a0fd506982dceb93bd2e6f1f9b2594a5aa955","observation_id":"f2704314-95ca-42b1-9d9c-5ad8d84bda0d","resolution":{"observed_at":"2026-08-07T15:04:03.608176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13034","last_updated":"2024-06-05T21:47:37Z","snapshot_observed_at":"2026-08-13T00:05:47.672499Z","submitted_at":"2024-05-16T14:20:30Z","title":"Autonomous Workflow for Multimodal Fine-Grained Training Assistants Towards Mixed Reality","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.13034","snapshot_observed_at":"2026-08-07T15:04:00.079070Z","title":"Autonomous workflow for multimodal fine-grained training assistants towards mixed reality","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:00.079070Z"},"links":{"cited_paper":"/paper/2405.13034","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:261760c9688d0b8cc29e9b4ffe6a10c9d480cad17337a3f2e7a7399e46b3b697","observation_id":"ba2fa290-d44a-49bc-aab9-5a80cbf82ff6","resolution":{"observed_at":"2026-08-07T15:04:00.079070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15830","last_updated":"2025-05-19T02:40:18Z","snapshot_observed_at":"2026-07-06T20:26:31.558337Z","submitted_at":"2025-01-27T07:34:33Z","title":"SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15830","snapshot_observed_at":"2026-08-07T15:04:00.141487Z","title":"Spatialvla: Exploring spatial representations for visual-language-action model, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:00.141487Z"},"links":{"cited_paper":"/paper/2501.15830","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:04630dc89021dce739b452fa989d3a747987bdbbfb6276f2c4469aa057458822","observation_id":"60cc8b52-68a4-4666-9617-aa661226dc9e","resolution":{"observed_at":"2026-08-07T15:04:00.141487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:03.252688Z","title":"Certified defenses for data poisoning attacks","venue":null,"work_id":"fd6d81a2-394a-4eba-81f2-495cee2a2afe","year":2017},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:00.216614Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:447e4a13c7067bea992199a811c747223546db5203ec2ba6834e1f83ecab5982","observation_id":"cbdcede5-0c6f-473b-a374-a3c41c6ad53a","resolution":{"observed_at":"2026-08-07T15:04:03.348852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12213","last_updated":"2024-05-26T19:55:26Z","snapshot_observed_at":"2026-08-14T08:22:11.295012Z","submitted_at":"2024-05-20T17:57:01Z","title":"Octo: An Open-Source Generalist Robot Policy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12213","snapshot_observed_at":"2026-08-07T15:04:00.287943Z","title":"Octo: An open-source generalist robot policy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:00.287943Z"},"links":{"cited_paper":"/paper/2405.12213","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:392d7309765fdb2e94dd6eb725306baac55fb956ea8ea06ec25aec72b068d27b","observation_id":"b4baf0c2-5b84-42fa-bdc9-284192defb98","resolution":{"observed_at":"2026-08-07T15:04:00.287943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T15:04:00.372988Z","title":"Llama 2: Open foundation and fine-tuned chat models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:00.372988Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:1567f4acf4ae90684df991aae72373420241121438ede35de2a1a9dbb830a1c4","observation_id":"e2bb5bd9-fa9b-417b-9d4d-5bdc2155af29","resolution":{"observed_at":"2026-08-07T15:04:00.372988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:03.078042Z","title":"Exploring the adversarial vulnerabilities of vision-language-action models in robotics, 2025","venue":null,"work_id":"8f8ad386-b874-493b-a547-27d10b9446f6","year":2025},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:00.454391Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:7f920106d166da912f9726562f0aa071c57a00951bfc00d244940e5b1a113b8c","observation_id":"5bc2d187-336b-479d-bbe8-a09b8aaa988f","resolution":{"observed_at":"2026-08-07T15:04:03.176163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:02.867648Z","title":"Invisible black-box backdoor attack against deep cross-modal hashing retrieval","venue":null,"work_id":"ac9a4806-9e96-4a48-9973-3eaedb69afef","year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:00.542534Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:2b5f58fd9ac6a7ccc00192e1bceff7bd36731a99da7e58baa41a869857b7be50","observation_id":"3b51d84d-c8a8-459e-953b-640e488347c7","resolution":{"observed_at":"2026-08-07T15:04:02.959518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:00.592104Z","title":"Trojanrobot: Physical-world backdoor attacks against vlm-based robotic manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:00.592104Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:5000252832b5976da7fd539d9d152a229591c5dd8f1dc5edd69654bfdbd59773","observation_id":"e6a0e3b1-ca48-4bdf-94ea-3d618716c3cf","resolution":{"observed_at":"2026-08-07T15:04:00.592104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.01886","last_updated":"2024-06-26T03:29:50Z","snapshot_observed_at":"2026-08-13T05:10:25.465884Z","submitted_at":"2023-12-04T13:40:05Z","title":"InstructTA: Instruction-Tuned Targeted Attack for Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.01886","snapshot_observed_at":"2026-08-07T15:04:00.652092Z","title":"Instructta: Instruction- tuned targeted attack for large vision-language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:00.652092Z"},"links":{"cited_paper":"/paper/2312.01886","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:63016f0be3d613726c6c3d1722b189c6677d68de00630e5b7b5efc98f7bce0d2","observation_id":"391293fe-2ed3-40e4-a08e-054d6f949b27","resolution":{"observed_at":"2026-08-07T15:04:00.652092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:02.670803Z","title":"Adversarial attacks on multimodal agents","venue":null,"work_id":"1118f210-84c5-4ea9-820a-16aa15ee04d4","year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:00.724979Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:92511c7324c288e86c2539490cc44e143ea322ae0ec0de8c05fe6f5e8e888061","observation_id":"4cd00f41-373c-4196-b055-82c48e1cd5e2","resolution":{"observed_at":"2026-08-07T15:04:02.738757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12814","last_updated":"2025-02-04T20:02:17Z","snapshot_observed_at":"2026-08-12T23:39:51.764962Z","submitted_at":"2024-06-18T17:32:48Z","title":"Dissecting Adversarial Robustness of Multimodal LM Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12814","snapshot_observed_at":"2026-08-07T15:04:00.833689Z","title":"Dissecting adversarial robustness of multimodal lm agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:00.833689Z"},"links":{"cited_paper":"/paper/2406.12814","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:9d6b8e97133028a26acd9e8b6f2052798be7bc03ff46d1d5ffaf4fe44ab603e8","observation_id":"d82ac1d1-7e89-4d3d-98e7-8fdd42d13fa1","resolution":{"observed_at":"2026-08-07T15:04:00.833689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:02.455199Z","title":"Adversarial t-shirt! evading person detectors in a physical world,","venue":null,"work_id":"4f0cd836-2553-4de8-80a2-489fedc361f0","year":null},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:00.927104Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:5ca00f57415667d85bf66b4cfecfcb9fcbb5fe003f0a9aa10c066579323b203c","observation_id":"93a583b2-3863-44a0-a7a1-5a71a206e686","resolution":{"observed_at":"2026-08-07T15:04:02.533337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:02.216913Z","title":"Compression-resistant backdoor attack against deep neural networks","venue":null,"work_id":"9020fc73-6d05-4aaf-9260-56591d468da4","year":2023},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:01.030790Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:602205adcffbd0bed10b462a94a1bdc779020e7c9c0456039709833dee2e4cbe","observation_id":"0772a19f-d6a7-4ed8-9e35-e47d5d8c28e8","resolution":{"observed_at":"2026-08-07T15:04:02.340481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18275","last_updated":"2026-04-21T10:31:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-27T12:09:43Z","title":"Visual Adversarial Attack on Vision-Language Models for Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18275","snapshot_observed_at":"2026-08-07T15:04:01.105850Z","title":"Visual adversarial attack on vision-language models for autonomous driving, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:01.105850Z"},"links":{"cited_paper":"/paper/2411.18275","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:c7e7f802a758e92238f103308ce2356a841b79465c05c07fd191c0cffd902097","observation_id":"247a933f-e852-4bce-9e46-a762242dacaf","resolution":{"observed_at":"2026-08-07T15:04:01.105850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:02.019810Z","title":"Gadei: On scale-up training as a service for deep learning","venue":null,"work_id":"919c5f91-eb4f-478a-832f-e8c3e07ac5bf","year":2017},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:01.184490Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:90269aa44c19e7993f9da901473faf76dd664eb45ebd288b3375b14e05b6a29b","observation_id":"9fbc2bca-cdcd-453c-87f9-3ff02b1be280","resolution":{"observed_at":"2026-08-07T15:04:02.122146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:01.824187Z","title":"Badcm: Invisible backdoor attack against cross-modal learning","venue":null,"work_id":"47e3077a-4855-4f61-b84c-1d2da9f3246d","year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:01.262629Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:8906c3cbba98628d04f7e993d4f13201a7866c3bfa4cd453aa19efcebad86781","observation_id":"672997b2-8d01-46af-b5d2-e2b5ead04af4","resolution":{"observed_at":"2026-08-07T15:04:01.886203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19287","last_updated":"2024-11-12T10:48:21Z","snapshot_observed_at":"2026-08-13T19:14:38.705895Z","submitted_at":"2024-04-30T06:34:21Z","title":"Revisiting the Adversarial Robustness of Vision Language Models: a Multimodal Perspective","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19287","snapshot_observed_at":"2026-08-07T15:04:01.363663Z","title":"Pick up the alphabet soup and place it in the basket","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:01.363663Z"},"links":{"cited_paper":"/paper/2404.19287","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:a5fbcff4f6f837842433decd5e40dee5bb12304e839db61aec4b895efccbfa8a","observation_id":"b9b58612-b4bb-4b69-a49d-d0ceda8543f4","resolution":{"observed_at":"2026-08-07T15:04:01.363663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.11099","last_updated":"2020-07-06T03:06:26Z","snapshot_observed_at":"2026-08-11T01:09:53.555164Z","submitted_at":"2019-10-18T02:20:17Z","title":"Adversarial T-shirt! Evading Person Detectors in A Physical World","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.11099","snapshot_observed_at":"2026-08-07T15:04:00.985364Z","title":null,"venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:00.985364Z"},"links":{"cited_paper":"/paper/1910.11099","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:4b65b1d4652d36e34d01f8c8ae4394de306571575a665a6ecac44bb7015a1548","observation_id":"ce99ff9e-fb9f-4503-8784-e1aa91e03ff7","resolution":{"observed_at":"2026-08-07T15:04:00.985364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":0,"verified_fuzzy":17},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 16 inbound Pith citation observations for arXiv:2505.16640."}