{"as_of":"2026-08-10T20:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f7744cd3e6b06182625d9a13f340575bc984e06eb24d268bdf2054a659d94571","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:55:45.575246Z","state":"measured"},{"denominator":72,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":72,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.23266/citation-record","integrity":"/paper/2505.23266/integrity","json":"/paper/2505.23266/citation-record.json","paper":"/paper/2505.23266"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:57.618314Z","title":"Efficient qos-aware service recommendation for multi-tenant service-based systems in cloud,","venue":null,"work_id":"4e3bae96-fead-4b86-849e-15dd421583c7","year":2017},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:40.989429Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:20983e8eb95bed0f4484320bc8ebff0ad7e1592020cddb6b40665a4f84499b78","observation_id":"43cbb966-dc05-4ee4-93c2-94844c765b72","resolution":{"observed_at":"2026-08-07T12:55:57.705556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:57.425590Z","title":"Edge computing for internet of everything: A survey,","venue":null,"work_id":"a5a42027-b2e7-44b8-8f66-649b64e9ee0d","year":2022},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.064782Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:f7977a26ea50385645d3dd21298632bd00be7a7dc86522df6097680614143abf","observation_id":"020a1040-15ee-4c34-9991-79568735500d","resolution":{"observed_at":"2026-08-07T12:55:57.508740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:57.372228Z","title":"Groupchain: Towards a scalable public blockchain in fog computing of iot services com- puting,","venue":null,"work_id":"f19c71bd-a7a3-4d0b-a136-6e39b47030f2","year":2020},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.141507Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:9e84aad9f36c5814c9ccde44f08d22174da10eae09a096ab8bc4c6e874c6be35","observation_id":"f41b9cf3-2ca0-4544-a1dc-06831aae0294","resolution":{"observed_at":"2026-08-07T12:55:57.405828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:57.180407Z","title":"Vision-and-language navigation: Interpreting visually-grounded navigation instruc- tions in real environments,","venue":null,"work_id":"f8f07010-8144-486d-a929-b6e9fd88ad7e","year":2018},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.178878Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:a05b5ecff82f177c1d7cd62423de0f7a480dc2dccdbc2a71935622d6edd3c7ec","observation_id":"3ad741cf-2845-49b6-848e-19586b3c755e","resolution":{"observed_at":"2026-08-07T12:55:57.257118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:57.035621Z","title":"Transferable representation learning in vision-and- language navigation,","venue":null,"work_id":"1f76f3d6-cdc6-4061-827f-1621e1be277f","year":2019},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.206202Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:9e70b75f237236f69120b850e593c985b466b0d6b9ddb73beb86d394135f5ccb","observation_id":"4792086a-1113-4e75-bf55-e6188292a6d6","resolution":{"observed_at":"2026-08-07T12:55:57.104658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:56.905789Z","title":"Look before you leap: Bridging model-free and model-based reinforcement learning for planned-ahead vision-and-language navigation,","venue":null,"work_id":"c2935b2e-40b4-4b92-8688-3c1ebbd8bedf","year":2018},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.273851Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:00d42f4d2e5447a60b1a591d52623c054f68f21d90a40eb5b8a0b9369b1b6968","observation_id":"1a01e039-e93d-4ba3-bbcd-fb52ee459322","resolution":{"observed_at":"2026-08-07T12:55:56.965674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:56.750715Z","title":"Reinforced cross-modal matching and self-supervised imitation learning for vision-language navi- gation,","venue":null,"work_id":"216440a0-5556-44b5-8b50-3618ad48ac49","year":2019},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.343471Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:b13d86d78ef78a69e378229b78e04a6784d04727439966fc475c54493204e4de","observation_id":"3a42df36-2c7e-48b0-8934-5c47cefdfc33","resolution":{"observed_at":"2026-08-07T12:55:56.834519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:41.380892Z","title":"Lan- guage models are few-shot learners,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.380892Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:d66390c1fa8208cbacd1010e1380f7487c831fd8d68455a7c75604b0787f6c2e","observation_id":"572c89d8-ab0c-4834-9a04-54e869033d7c","resolution":{"observed_at":"2026-08-07T12:55:41.380892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T12:55:41.413755Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.413755Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:1f84eda11271f4425fc745071fe224fac1145375f51ad9266a9e26037cfec62e","observation_id":"0f9d8a55-fb09-412c-b2b6-c696e59251ee","resolution":{"observed_at":"2026-08-07T12:55:41.413755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:56.602449Z","title":"When search engine services meet large language models: visions and challenges,","venue":null,"work_id":"fbd7666a-d76b-47d3-8deb-1d40de8b684a","year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.471334Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:51d173f19d0ec046c2690966322da7818bdca4dc5e70469c8f665ad7c5c40f23","observation_id":"28ce8d90-2a20-4ba1-ac9e-51554da7159d","resolution":{"observed_at":"2026-08-07T12:55:56.648796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:56.460202Z","title":"Learning transfer- able visual models from natural language supervision,","venue":null,"work_id":"2b2a8777-b262-44ea-b6bd-5cd3a29a847f","year":2021},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.568647Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:75d59527347e4af1cb56d2412396f009808be3c2c73da02e6368e5f681fe5d19","observation_id":"e0813451-16e1-44ff-b17e-9f1090c9a394","resolution":{"observed_at":"2026-08-07T12:55:56.518858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:41.606730Z","title":"Visual instruction tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.606730Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:ff117b4eae5ab4a085abf7be62e39f842c86b27d4dd8ae042890d76dd7a0f140","observation_id":"53faae4e-8063-4039-9e1e-2b4087c75830","resolution":{"observed_at":"2026-08-07T12:55:41.606730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:56.382046Z","title":"Jarvis: Joining adversarial training with vision transformers in next-activity prediction,","venue":null,"work_id":"1773161c-587e-4cd8-b28a-425d39d52228","year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.657474Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:bd0e610b2815873bef12b8f70c3a84ceab6a0ba17598d6c6e5579cf6cb42a4f3","observation_id":"8a4b4603-d9b1-4bb1-9eb2-4dbe14e0f693","resolution":{"observed_at":"2026-08-07T12:55:56.390354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11398","last_updated":"2024-08-21T07:45:43Z","snapshot_observed_at":"2026-08-10T10:13:23.130582Z","submitted_at":"2024-08-21T07:45:43Z","title":"Generative AI based Secure Wireless Sensing for ISAC Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11398","snapshot_observed_at":"2026-08-07T12:55:41.724319Z","title":"Generative ai based secure wireless sensing for isac networks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.724319Z"},"links":{"cited_paper":"/paper/2408.11398","citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:8f24670a0ab389247a774d7d4da6902511ad5deca1a8a1e2f096383f677073af","observation_id":"66831869-6fcf-4392-8b6d-3b31b01dc01f","resolution":{"observed_at":"2026-08-07T12:55:41.724319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:56.228254Z","title":"Multi-objective aerial collaborative secure communication opti- mization via generative diffusion model-enabled deep reinforce- ment learning,","venue":null,"work_id":"8d2ccc14-a34f-4de7-92a4-c850d7a6e05e","year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.829216Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:3fcce89cdf4d215365fdcbbae880f4488214d1660c0fc5019eae383ae13f28f4","observation_id":"fd670b19-bf84-4c5a-b124-dfdc57abbc6f","resolution":{"observed_at":"2026-08-07T12:55:56.318593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:56.050566Z","title":"Visual language maps for robot navigation,","venue":null,"work_id":"49b8d678-a6cf-490f-a261-aaf506af4fa9","year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.893056Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:82c88d7aa895b5c7e985201ac6d1a1a029a101b6504b8afc0a16676e0cf8da2a","observation_id":"3a70fc58-9d51-4096-b8a5-5b1d8e686a3b","resolution":{"observed_at":"2026-08-07T12:55:56.128356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:55.900984Z","title":"Cows on pasture: Baselines and benchmarks for language-driven zero-shot object navigation,","venue":null,"work_id":"ad872331-5e6f-4c49-b3d1-46ea539a5c4f","year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.963669Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:deb01d427b7ae4ceefdc6616c4ad3b421b1dbcdfe2e9fe319270f5719cbd4954","observation_id":"7403c7cd-1aba-4d90-a011-ad2ffb058f85","resolution":{"observed_at":"2026-08-07T12:55:55.963687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:55.681416Z","title":"Think, act, and ask: Open- world interactive personalized robot navigation,","venue":null,"work_id":"fc1e3f7c-0f52-4a76-81ce-c285dc9a6acc","year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.041142Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:514a483e6dec46a0a90e7e9c9ca3d1bbf88d9455af0591a0db88d2951ac713f8","observation_id":"265707a8-6def-4b0e-972b-e69a78093d31","resolution":{"observed_at":"2026-08-07T12:55:55.805560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:55.510585Z","title":"CLIP-fields: Weakly supervised semantic fields for robotic mem- ory,","venue":null,"work_id":"d10a1982-c292-48c6-b502-f8383a3b25d9","year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.088066Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:9499561fe7a626c5e79f6932c29b452798c026c1c515322a1df7d738d96334d1","observation_id":"7a496e9f-0874-4b6c-8dea-206ea02060b4","resolution":{"observed_at":"2026-08-07T12:55:55.577706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02385","last_updated":"2024-02-04T07:55:01Z","snapshot_observed_at":"2026-08-04T15:45:08.679135Z","submitted_at":"2024-02-04T07:55:01Z","title":"A Survey on Robotics with Foundation Models: toward Embodied AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02385","snapshot_observed_at":"2026-08-07T12:55:42.152234Z","title":"A survey on robotics with foundation models: toward embodied ai,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.152234Z"},"links":{"cited_paper":"/paper/2402.02385","citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:eacfb45dcca1867584d79b2afc4cd183eb41d12c0e8b8b4e6dbeca5b9b7818f3","observation_id":"c7ec27f7-f820-4853-ad2e-6c7b1915d4e0","resolution":{"observed_at":"2026-08-07T12:55:42.152234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:55.268443Z","title":"Real-world robot applications of foundation models: A review,","venue":null,"work_id":"47f8a9ee-cd1c-43c5-b571-01e2bcfc2fcf","year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.258006Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:4e1abc8befad68449d4c6a53172d3870002e42716174f0c0beedabbfda051dde","observation_id":"000ef238-7809-4a03-b33b-3457c6791212","resolution":{"observed_at":"2026-08-07T12:55:55.390508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:55.003136Z","title":"Velma: Verbalization embodiment of llm agents for vision and language navigation in street view,","venue":null,"work_id":"7a676402-0666-4ae4-82bf-2c8ebef4eef7","year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.334932Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:cb348d315594d873d52fb80f6ca063fbff42c6f96aea60d0d31183213d1abee7","observation_id":"73a7ce84-e4b8-4773-a9d3-81d159ee93f3","resolution":{"observed_at":"2026-08-07T12:55:55.142129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:54.706431Z","title":"Segment anything,","venue":null,"work_id":"60acc20a-2528-497f-8ab4-a0a35196198d","year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.433974Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:f1e46181a414de15c401081e5798c6fac10f06c6eb2a5038b5157a7811f3f00b","observation_id":"6b561261-76a0-4491-8b42-1b9cbe67a195","resolution":{"observed_at":"2026-08-07T12:55:54.832478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:54.428187Z","title":"Defending adversarial attacks via semantic feature manipulation,","venue":null,"work_id":"f07bd325-fafb-47b1-8ebc-0aa88dfcd00a","year":2021},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.488806Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:60742728eabd7adbf84eac13d29a72f173451cba7584a2f426170fe2c2615e09","observation_id":"3e50becc-b616-4c14-a248-274f996eafec","resolution":{"observed_at":"2026-08-07T12:55:54.553165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19802","last_updated":"2024-07-16T14:43:51Z","snapshot_observed_at":"2026-08-10T07:02:34.136868Z","submitted_at":"2024-05-30T08:12:08Z","title":"Exploring the Robustness of Decision-Level Through Adversarial Attacks on LLM-Based Embodied Models","version":3},"cited_work":{"arxiv_id":"2405.19802","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.19802","snapshot_observed_at":"2026-08-07T12:55:46.011292Z","title":"Exploring the Robustness of Decision-Level Through Adversarial Attacks on LLM-Based Embodied Models","venue":"cs.MM","work_id":"1996808b-e270-4711-a687-d4f2211e43f6","year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.538240Z"},"links":{"cited_paper":"/paper/2405.19802","citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:d75dce09fa08eee29e61a5baab83e945ffea106482d4f3f917510486e1cdce80","observation_id":"3f47adb3-e7f8-4e81-b960-ee7118f0f02d","resolution":{"observed_at":"2026-08-07T12:55:46.138149Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16633","last_updated":"2025-08-11T08:29:19Z","snapshot_observed_at":"2026-08-09T12:12:00.898796Z","submitted_at":"2024-12-21T13:58:27Z","title":"POEX: Towards Policy Executable Jailbreak Attacks Against the LLM-based Robots","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16633","snapshot_observed_at":"2026-08-07T12:55:42.577926Z","title":"Poex: Policy executable embodied ai jailbreak attacks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.577926Z"},"links":{"cited_paper":"/paper/2412.16633","citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:f5bd607f5859db26eaacb46226c9663e9b99eaf97631e05b3c702fbe6b570eab","observation_id":"b10d2c34-ab2c-4234-b254-e10cb23343bb","resolution":{"observed_at":"2026-08-07T12:55:42.577926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13587","last_updated":"2025-08-01T03:41:06Z","snapshot_observed_at":"2026-08-08T21:16:02.390062Z","submitted_at":"2024-11-18T01:52:20Z","title":"Exploring the Adversarial Vulnerabilities of Vision-Language-Action Models in Robotics","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13587","snapshot_observed_at":"2026-08-07T12:55:42.620886Z","title":"Exploring the adversarial vulnerabili- ties of vision-language-action models in robotics,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.620886Z"},"links":{"cited_paper":"/paper/2411.13587","citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:286b242d4259de9e4d084787fa4f31c0e8805179a645197c441c20fa32dab298","observation_id":"f4887ff2-dc75-4ae1-8a98-155163198b38","resolution":{"observed_at":"2026-08-07T12:55:42.620886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09546","last_updated":"2025-05-23T04:03:34Z","snapshot_observed_at":"2026-08-06T09:22:08.600405Z","submitted_at":"2024-02-14T19:45:17Z","title":"How Secure Are Large Language Models (LLMs) for Navigation in Urban Environments?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09546","snapshot_observed_at":"2026-08-07T12:55:42.693196Z","title":"How secure are large language models (llms) for navigation in urban environ- ments?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.693196Z"},"links":{"cited_paper":"/paper/2402.09546","citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:58f3f455fd04b5708c0841f51d58d533ceda6d8924e19fbf8f50ed368b9b72fc","observation_id":"e685e762-154f-4f61-8e5d-68c0781ca82a","resolution":{"observed_at":"2026-08-07T12:55:42.693196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-07T12:55:42.770160Z","title":"Universal and transferable adversarial attacks on aligned language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.770160Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:3f50d0be90b6ad02428ee84beebf70a260b63370a338cb32b5cfd23ec6b6c710","observation_id":"bb79b84b-6126-4e70-be40-3c3b4e62f5ca","resolution":{"observed_at":"2026-08-07T12:55:42.770160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:54.234342Z","title":"Accelerating greedy coordinate gradient and general prompt optimization via probe sampling,","venue":null,"work_id":"da5e0408-6c62-4c90-87f3-a798f8af8373","year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.810093Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:66305d7392fc5ebd61196c76af1ffac0bd65c71c5fd84702e928a15a72c362be","observation_id":"eba4eaa4-5414-4c85-97f2-581b2a78ceb0","resolution":{"observed_at":"2026-08-07T12:55:54.309694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:53.938662Z","title":"Jailbreaker: Automated jailbreak across multiple large language model chatbots,","venue":null,"work_id":"063866ae-7385-4604-a278-175a8cd88d8d","year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.848322Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:bc83ef089f2a66a714fdda2ed2b17dccf5153d31c7f4985d94049ab06505f79f","observation_id":"b939b809-3c73-40bf-89af-0352a46c9de7","resolution":{"observed_at":"2026-08-07T12:55:54.059777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:53.652433Z","title":"Tree of attacks: Jailbreaking black- box llms automatically,","venue":null,"work_id":"18b9d515-fce0-4e54-87f8-70b1bd349e4a","year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.904784Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:4a9600b6313f9f1cd480d9b1a43324ef88ae96debbfbcc9bcb6879d6a16ab498","observation_id":"6c3497c3-2667-4860-ae0b-5d3c07acfa37","resolution":{"observed_at":"2026-08-07T12:55:53.771372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:53.480051Z","title":"Adv- clip: Downstream-agnostic adversarial examples in multimodal contrastive learning,","venue":null,"work_id":"aa2682e6-cb59-437f-afa9-54a55acf3f9b","year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.977734Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:9d877dfffbb96e278f354f07e1fe95ee179ac264c5b57cdab70374d91df2cf3d","observation_id":"d06daf9e-cbac-4a77-bf29-05b2f0f23fc3","resolution":{"observed_at":"2026-08-07T12:55:53.559952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:53.269998Z","title":"On evaluating adversarial robustness of large vision- language models,","venue":null,"work_id":"c05d343a-1566-4c3f-95b8-3fc4d25b1652","year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.042855Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:9c61604c88959b1bf8356d1925e8681d687f862f898662997b9577cfe6e7fcfb","observation_id":"b70ca1fa-7d1b-434c-ae57-471068deefce","resolution":{"observed_at":"2026-08-07T12:55:53.377324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:53.035220Z","title":"Spatiotemporal attacks for embodied agents,","venue":null,"work_id":"056823ad-b06e-4f69-80f0-98d5daa2588d","year":2020},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.079773Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:e6b1f120b9b0a75845e6685037c2e5a4ddaaecd67e6cd1291aff0384b27f68b7","observation_id":"d45f4cbe-4cbe-4517-8b39-806856f8f180","resolution":{"observed_at":"2026-08-07T12:55:53.157158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:52.768068Z","title":"Towards transferable targeted 3d adversarial attack in the physical world,","venue":null,"work_id":"1d39b772-4d97-4cf4-9443-0cdb3782ddb9","year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.141251Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:8f6921dc32e3f6530609e6e86f86ea5f578ea061277d06e565406a1e6d273ae2","observation_id":"0b5e5d00-e24e-4823-b469-2cb0320115bd","resolution":{"observed_at":"2026-08-07T12:55:52.885380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-07-06T03:53:32.549552Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-07T12:55:43.213801Z","title":"Very deep convolutional networks for large-scale image recognition,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.213801Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:ac70686c4b55a9ddcaad35d3e9110db783022d87190531cb213169f28cb74256","observation_id":"54c4bf8e-f90f-4cf9-b102-1c859894130d","resolution":{"observed_at":"2026-08-07T12:55:43.213801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:52.554354Z","title":"Mask r-cnn,","venue":null,"work_id":"991037bc-be29-4c5e-83b7-965722e21ac2","year":2017},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.254115Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:007230ce6303422fdc9fa6dfab9879e562f0b1d8acef3898723f5026ec9c7ebe","observation_id":"c41c2683-e34c-4ef9-8dcf-1a25eec59dbd","resolution":{"observed_at":"2026-08-07T12:55:52.655197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:43.299701Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.299701Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:58e267306aa95e8ae3a5a10ef4a8bd74a89a1bd773fb664c9bcba97569db9ccc","observation_id":"049d4d6e-7997-4da6-ac86-239453b711b7","resolution":{"observed_at":"2026-08-07T12:55:43.299701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:43.329973Z","title":"Chain-of-thought prompting elicits reasoning in large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.329973Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:6441dd560dd04ce4ac5988c8b2cb79f9a9cc7c3d64564ff9e3b21c04c1220d0b","observation_id":"4b113e4b-9193-4c90-bd02-426f98effdfe","resolution":{"observed_at":"2026-08-07T12:55:43.329973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:52.261976Z","title":"An embodied generalist agent in 3d world,","venue":null,"work_id":"a32c36ff-d786-422b-b552-a8c261c4be8f","year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.413740Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:244191d1355923b2769c657d9dadc1cd6317f66ebd1cfcf419d89b7d5eebdae8","observation_id":"6101c2e4-985d-4639-a540-359041f7beb2","resolution":{"observed_at":"2026-08-07T12:55:52.353320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:52.075636Z","title":"Llm-planner: Few-shot grounded planning for embodied agents with large language models,","venue":null,"work_id":"9478e5d7-7615-46ad-a0db-6eec05260800","year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.475406Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:8bc93a7ff6fd7dc5147250042cc2810858bd0210b65108b8a66f1954731457ad","observation_id":"94196732-3c77-4fb7-8081-645b92a51efc","resolution":{"observed_at":"2026-08-07T12:55:52.172402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:51.852100Z","title":"Towards learning a generalist model for embodied navigation,","venue":null,"work_id":"b0d6d9ee-83cc-42ab-a703-ec5e63a08604","year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.507083Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:8dace33c95830b6d250a8bd8b8a459b7cd3b4df0b3346901a46f095a40baa1dc","observation_id":"5a38d97f-1031-4632-9261-3d99a168536b","resolution":{"observed_at":"2026-08-07T12:55:51.955381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:51.620214Z","title":"Zson: Zero-shot object-goal navigation using multimodal goal embeddings,","venue":null,"work_id":"da93c3b0-201f-4f19-a8ef-c6089d5b3fda","year":2022},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.542483Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:4f5c89131dffecf72bc4f727cf8d5b0b746e4cbd833034d1be48f374dddac154","observation_id":"e3339324-e279-4ab4-8b2e-8ad73d97f409","resolution":{"observed_at":"2026-08-07T12:55:51.698573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:43.619639Z","title":"A survey on large language model (llm) security and privacy: The good, the bad, and the ugly,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.619639Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:55978638cd1d8ced63c685959385583f2b5e51e85baccd152ee784be4b6ad63b","observation_id":"6e1f70aa-03e2-46cd-b9e0-98b465c43086","resolution":{"observed_at":"2026-08-07T12:55:43.619639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15025","last_updated":"2023-09-26T15:49:23Z","snapshot_observed_at":"2026-07-06T16:23:53.247204Z","submitted_at":"2023-09-26T15:49:23Z","title":"Large Language Model Alignment: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15025","snapshot_observed_at":"2026-08-07T12:55:43.687467Z","title":"Large language model alignment: A survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.687467Z"},"links":{"cited_paper":"/paper/2309.15025","citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:66d23d6c84ac49fd3c7a03db2c190ba7761bfeb4f40ac791c9370cec035379a6","observation_id":"f2b6e47e-684e-43cd-8f17-eb50bbac43dc","resolution":{"observed_at":"2026-08-07T12:55:43.687467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:51.404538Z","title":"Bert-attack: Adversarial attack against bert using bert,","venue":null,"work_id":"ebf515b7-5b28-4b7c-ab38-7427a15f4534","year":2020},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.750501Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:4db5f459ad3fe59d2d5e8e75d2629a0bceb794b9dbdbad30449ca058cb043f88","observation_id":"690ec15c-c341-4483-8717-a6791d5f5e59","resolution":{"observed_at":"2026-08-07T12:55:51.480843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11751","last_updated":"2023-10-14T12:56:13Z","snapshot_observed_at":"2026-08-10T05:12:13.391312Z","submitted_at":"2023-09-21T03:24:30Z","title":"How Robust is Google's Bard to Adversarial Image Attacks?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11751","snapshot_observed_at":"2026-08-07T12:55:43.788243Z","title":"How robust is google’s bard to adversarial image attacks?","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.788243Z"},"links":{"cited_paper":"/paper/2309.11751","citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:c470423498d7743e5f37b5614b0e000788de329ff9485a5f9ac42c58ee5ed167","observation_id":"0c7dfc16-043a-4a3b-bac7-d25029946a27","resolution":{"observed_at":"2026-08-07T12:55:43.788243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:51.178825Z","title":"Re- thinking model ensemble in transfer-based adversarial attacks,","venue":null,"work_id":"fe394e69-f5a8-4205-816e-5cd57da4bc6b","year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.836312Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:bb8fe545b13d5af37b551eadd287bbd5db78316822887fcca29e1bb4d1daabbb","observation_id":"6c17ad81-bf3a-499e-b683-57714f353522","resolution":{"observed_at":"2026-08-07T12:55:51.269759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:50.994804Z","title":"Physical adversarial attack meets computer vision: A decade survey,","venue":null,"work_id":"b20f338a-06b5-4f3d-b556-d995fff0d0de","year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.911357Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:9121fc91a441344a3c6e8df6df668d857e949b5522572800c1ea80d731605946","observation_id":"dddf400e-4eeb-43cb-b918-7e17710112ce","resolution":{"observed_at":"2026-08-07T12:55:51.090746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:50.762941Z","title":"Robust adversarial objects against deep learning models,","venue":null,"work_id":"9e1e8245-b288-4361-b45b-5cc2497139af","year":2020},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.966963Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:9a9bbf44ec9130420979345c4cb18320856d2f1964ada0d598fa1684caeb2a28","observation_id":"ccb39dee-944b-477a-bdce-ace14fc531fb","resolution":{"observed_at":"2026-08-07T12:55:50.874958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:50.482587Z","title":"Pointcloud saliency maps,","venue":null,"work_id":"8d5eeb91-12f6-4c75-a9ee-137f90240761","year":2019},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:44.011713Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:2e8bc92bb02e923203be7b38952e63c769a1f68b519d620ef5dc774b0a565dfe","observation_id":"a0ecc492-b712-4753-8d06-787888df9d0a","resolution":{"observed_at":"2026-08-07T12:55:50.603670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:50.180132Z","title":"Advpc: Transfer- able adversarial perturbations on 3d point clouds,","venue":null,"work_id":"dbb4bb43-089e-4b31-8969-1d4394e57402","year":2020},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:44.068658Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:f9f350fece4087ffb2c1d059a6398a290acf92289a3a9273b7941ccd4ddaff05","observation_id":"0a4742d7-5b70-4677-bb49-f844bb749dbd","resolution":{"observed_at":"2026-08-07T12:55:50.326003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:49.900242Z","title":"Lg-gan: Label guided adversarial network for flexible targeted attack of point cloud based deep networks,","venue":null,"work_id":"91e25b63-37ac-4ff2-962d-4eca779a143c","year":2020},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:44.108820Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:ddcadda972b5cb4df6fdb5a4705947d67469060e9561ae6210b21163afa64098","observation_id":"b19216ee-e960-49de-b48a-5ea4170a11df","resolution":{"observed_at":"2026-08-07T12:55:50.012816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:49.642353Z","title":"Dta: Physical camouflage attacks using differentiable transformation network,","venue":null,"work_id":"ccb4d450-29d8-49f1-bab3-14f4f87ed731","year":2022},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:44.188342Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:e610ff0c1991207a9339c282a1843cc8f3cde4c61e827832ac9484cacb2010b3","observation_id":"e864ea27-76dc-4234-a43d-57a0e4eb4c9e","resolution":{"observed_at":"2026-08-07T12:55:49.772933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:49.398884Z","title":"Active: Towards highly trans- ferable 3d physical camouflage for universal and robust vehicle evasion,","venue":null,"work_id":"98978cb8-14a2-48c4-b590-d74f5695197d","year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:44.308458Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:2f59e25d32adb0adfafefea380a2223fdca2d90805217784d6bf8d4835b9bd1a","observation_id":"371ec765-6a0c-4382-b48b-68d26745c2d9","resolution":{"observed_at":"2026-08-07T12:55:49.514367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:49.242569Z","title":"Learning from simulated and unsupervised images through adversarial training,","venue":null,"work_id":"521d6922-aebd-4f31-8e4c-9482bff94b71","year":2017},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:44.372283Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:a58a448af65153407a5fb07de8979302963ce6e3117d1ac2c92d44ea5973d27f","observation_id":"8542560d-960c-4112-8687-da2556bbe594","resolution":{"observed_at":"2026-08-07T12:55:49.305975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:49.032957Z","title":"Pointnet: Deep learning on point sets for 3d classification and segmentation,","venue":null,"work_id":"addd59b7-7ce0-491b-b77b-7a61c74cfb3f","year":2017},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:44.454090Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:7c71047380a4994c1c7eaf939c0de327cb6455679ea5aba752625eefec6279b1","observation_id":"5928d782-5c66-49f9-abec-12cc6ffcc32b","resolution":{"observed_at":"2026-08-07T12:55:49.138597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:48.815686Z","title":"Pointnet++: Deep hierarchical feature learning on point sets in a metric space,","venue":null,"work_id":"1a495787-ef67-49f2-b672-f46a93bd40ca","year":2017},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:44.542688Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:6f982509b056c9cfe379a69d8b12a17323d55f2cbf9e7721185a063b7f4d921e","observation_id":"fded94e6-74d1-454b-9893-ecc3d24c13f6","resolution":{"observed_at":"2026-08-07T12:55:48.897186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:48.523058Z","title":"Faster r-cnn: Towards real-time object detection with region proposal networks,","venue":null,"work_id":"1a61e12c-6a20-45f2-a7ee-352e1e57666c","year":2016},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:44.624605Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:6c726ec712c9897b7b6a12df496e05a76006ec39fd656243b2dd238e6c152fce","observation_id":"863efbe3-6f0a-4b44-b486-725d7ad17524","resolution":{"observed_at":"2026-08-07T12:55:48.616056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:48.315835Z","title":"You only look once: Unified, real-time object detec- tion,","venue":null,"work_id":"101e5055-12ea-4dd3-b789-dedb66e24510","year":2016},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:44.680234Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:0d09dc5d1db7c6f854c1666e854d7d1c1141b4477fc30af7ba2cdd41f3cce761","observation_id":"f1f1ac9c-209d-46f6-925e-7219b61e6234","resolution":{"observed_at":"2026-08-07T12:55:48.392319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:48.134314Z","title":"Beyond the nav-graph: Vision-and-language navigation in continuous en- vironments,","venue":null,"work_id":"b65819b1-cdfb-4dc6-99e4-386787690776","year":2020},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:44.722317Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:296a4f952ccaa1dcd52b323dcd9eb183b7e7654a8ad4e9d8a63c56ec781a2e61","observation_id":"173bf764-7a4f-45e3-9846-746d7ee839aa","resolution":{"observed_at":"2026-08-07T12:55:48.227370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:47.947641Z","title":"A frontier-based approach for autonomous explo- ration,","venue":null,"work_id":"724aa01e-3ab6-4933-ba0b-d42f381d5dba","year":1997},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:44.815390Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:f748bbf4e9ab694de2ee151e62219cdc08827b4df65a1d121a70d2986a0a6603","observation_id":"853cf257-4941-4c70-bfe1-af63977001c5","resolution":{"observed_at":"2026-08-07T12:55:48.031204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:47.716514Z","title":"Large language models can be easily distracted by irrelevant context,","venue":null,"work_id":"69d2b620-6cd4-4ced-b7a7-6e949239ca57","year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:44.884657Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:cdb61f30d8931bffa15a84ca19a64e686d049e18805ec540bb317496c33cab7f","observation_id":"bd21b96e-1df4-446c-b2ad-759fa287dddb","resolution":{"observed_at":"2026-08-07T12:55:47.787446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:47.523522Z","title":"Ad- versarial camouflage: Hiding physical-world attacks with natural styles,","venue":null,"work_id":"bbfd043f-aac1-4969-acf6-cee859ffa590","year":2020},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:44.955800Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:02c9c679ca5483541eb2ba35496e7ebd0240d78f03e9be7cc8aa5b875ae66404","observation_id":"5301e129-8442-44c0-b9da-2fb38c5b5a37","resolution":{"observed_at":"2026-08-07T12:55:47.614993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:47.359202Z","title":"An overview on 3d printing technology: Technological, materials, and applications,","venue":null,"work_id":"c6f97bbf-64d8-4381-83c2-512c9478acf3","year":2019},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:45.030406Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:efe2da2be80991d0bed92fa80300fe1705dbc2a85212acc3b2319eaf1fd96ad3","observation_id":"c9be45bf-4c05-4f2d-b81d-3407842f4283","resolution":{"observed_at":"2026-08-07T12:55:47.432991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05499","last_updated":"2024-07-19T06:00:41Z","snapshot_observed_at":"2026-07-06T15:00:58.804337Z","submitted_at":"2023-03-09T18:52:16Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05499","snapshot_observed_at":"2026-08-07T12:55:45.073029Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:45.073029Z"},"links":{"cited_paper":"/paper/2303.05499","citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:5557b38e956088e5bbf5a66bdb0ebd0c740f21e8c8f82bd499b15a1303235545","observation_id":"878c1399-a36c-4fd9-a79d-5068cc588f48","resolution":{"observed_at":"2026-08-07T12:55:45.073029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:47.091481Z","title":"A density-based algorithm for discovering clusters in large spatial databases with noise,","venue":null,"work_id":"5e9c6fa9-e22d-4dcb-8431-bf4d25270834","year":1996},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:45.156959Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:dabd19d694ec055b9037b6d220d84e78b33f77ddec27c03851982af061e79f9b","observation_id":"f6879cde-9548-4d49-858a-eaa5b942884b","resolution":{"observed_at":"2026-08-07T12:55:47.278082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:46.977582Z","title":"Matterport3d: Learning from rgb-d data in indoor environments,","venue":null,"work_id":"3cc4c2b1-fc1a-4f2d-bce5-be830ebf223b","year":2017},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:45.255065Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:4cd19a98661ea1f12d90488f2adfd364a7a5533b43c0821f97a17645540b7302","observation_id":"96c6b29b-58ce-440d-ac05-4623eda8e6ec","resolution":{"observed_at":"2026-08-07T12:55:47.024568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:46.756143Z","title":"Language-driven semantic segmentation,","venue":null,"work_id":"442e751f-f9b4-48a2-b3ff-728c93c0053c","year":2022},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:45.307289Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:960cda158708ae0cd4e36fc4ffac5d6bef15dbd4e73631a078539354d047ec5c","observation_id":"d079ba97-2aef-4a90-8cd2-398a3368aa98","resolution":{"observed_at":"2026-08-07T12:55:46.879752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:46.635391Z","title":"Habitat-matterport 3d dataset (HM3d): 1000 large-scale 3d environments for embod- ied AI,","venue":null,"work_id":"bdf01e91-5661-4de5-b727-edaee6f64ee1","year":2021},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:45.407217Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:c8d3dcf503bdabf937fd86cebeed2ba9ccf254a55b5efb77fa2d5480b84020ff","observation_id":"6d103038-079e-4def-9577-c5c6479d23a6","resolution":{"observed_at":"2026-08-07T12:55:46.685475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:46.352888Z","title":"Habitat: A platform for embodied ai research,","venue":null,"work_id":"1a472f9e-1417-4ef1-9cb2-5aba81ed8fb6","year":2019},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:45.575246Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:398ad8941e3329d511fba2bf8f74298d0884bf77e04b0d0a42243114ce0dd79d","observation_id":"6b0c93be-0b9a-40c8-97c9-d12eb49c3501","resolution":{"observed_at":"2026-08-07T12:55:46.506520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-08T23:39:54.555891Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":1,"verified_fuzzy":55},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 0 inbound Pith citation observations for arXiv:2505.23266."}