{"as_of":"2026-08-18T05:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:48dd7a83c070dfb979ef003eb172bbdea8e8f20fce4cae611f0decea1c0898f0","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:09:11.016820Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.05394/citation-record","integrity":"/paper/2506.05394/integrity","json":"/paper/2506.05394/citation-record.json","paper":"/paper/2506.05394"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2106.03734","last_updated":"2021-09-20T11:48:45Z","snapshot_observed_at":"2026-08-16T18:19:02.639800Z","submitted_at":"2021-06-07T15:59:49Z","title":"Reveal of Vision Transformers Robustness against Adversarial Attacks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.03734","snapshot_observed_at":"2026-08-07T11:09:05.480828Z","title":"Reveal of vision transformers robustness against ad- versarial attacks.arXiv preprint arXiv:2106.03734, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:05.480828Z"},"links":{"cited_paper":"/paper/2106.03734","citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:ae023aaa392220ce76c1a12b6e1424efb3edba45dd3ec363707a2e1d580aa99f","observation_id":"7626cca1-6979-4450-a614-393ab109a233","resolution":{"observed_at":"2026-08-07T11:09:05.480828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:17.786505Z","title":"Are transformers more robust than cnns?Advances in neural information processing systems, 34:26831–26843, 2021","venue":null,"work_id":"0d991373-fd0a-48b7-89ab-63ddb3a941dd","year":2021},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:05.545638Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:9cb6036766fb715b1437a5972bb2c4185512ffe17cf2bb135d532fc4dcd9220d","observation_id":"11a91e3a-2a7f-40d2-bb0f-128da3243493","resolution":{"observed_at":"2026-08-07T11:09:17.858926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:17.668844Z","title":"Under- standing robustness of transformers for image classification","venue":null,"work_id":"23068898-7f9f-4edd-8655-b27658cddaf7","year":2021},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:05.648923Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:d53f60c344c2aa7c3db05a0445ada6dfef1ef5321f08ca6cb0b91ba2fde42d1b","observation_id":"58f71eef-9dff-49a9-9b9e-bbd5a686e7ca","resolution":{"observed_at":"2026-08-07T11:09:17.711964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-07T11:09:05.717334Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:05.717334Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:c9b03feb04bd69632dead5f13e43c6d65f92eedbfbb647ccb16d0adcbe5100e6","observation_id":"9daa0784-c5af-4ad8-a668-77c981a75d64","resolution":{"observed_at":"2026-08-07T11:09:05.717334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:17.541895Z","title":"Towards evaluating the robustness of neural networks","venue":null,"work_id":"06789933-63d3-44a7-905a-1a1e90c59959","year":2017},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:05.788881Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:eb09c3509d527d29c1e286eb18d86f9ae6b0dfb3572134e38c07fcd456a2e39d","observation_id":"da802625-2a0f-48fe-80da-a0791c43fc19","resolution":{"observed_at":"2026-08-07T11:09:17.603788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.10149","last_updated":"2024-05-06T06:47:30Z","snapshot_observed_at":"2026-08-16T20:29:13.867012Z","submitted_at":"2023-02-20T18:30:54Z","title":"Poisoning Web-Scale Training Datasets is Practical","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.10149","snapshot_observed_at":"2026-08-07T11:09:05.889610Z","title":"Poisoning web-scale training datasets is practical.arXiv preprint arXiv:2302.10149, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:05.889610Z"},"links":{"cited_paper":"/paper/2302.10149","citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:5ce553cda22b81d9c29cc1496e689dc9850dc907bb8a1e61a30e5d72425b5998","observation_id":"4fc3cd5e-2f00-4856-a911-12e536c0ae9d","resolution":{"observed_at":"2026-08-07T11:09:05.889610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:06.015566Z","title":"Emerg- ing properties in self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:06.015566Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:25da4805ee90b43296aa0dc1432df9f184da39f05ef996215e0f1ae902b0703e","observation_id":"0e37b607-a716-46fc-91d4-2e2a3c05f109","resolution":{"observed_at":"2026-08-07T11:09:06.015566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-07T11:09:06.133020Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding.arXiv preprint arXiv:1810.04805, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:06.133020Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:3ab5027de9d71c1f28864e833530779c9fd2c63d91b7f8478c87e67a8e9961e9","observation_id":"dc601c4f-c72f-44ff-91bb-c0d20fb4fc71","resolution":{"observed_at":"2026-08-07T11:09:06.133020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:17.376103Z","title":"Boosting adversarial at- tacks with momentum","venue":null,"work_id":"ef40ff97-743f-45fd-a88d-adc810e5408c","year":2018},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:06.250022Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:0a154985fa4eee085096d6311df6cd3ec78c18f9fe8c085aada5a5dcef2220b5","observation_id":"2e9d71c7-e312-4234-a5d2-271fd261be2a","resolution":{"observed_at":"2026-08-07T11:09:17.439580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T11:09:06.368933Z","title":"An image is worth 16x16 words: Trans- formers for image recognition at scale.arXiv preprint arXiv:2010.11929, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:06.368933Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:40e9660ea2770b07eb676c477a2d473cb6df76e780adef898ef1142f2da1b153","observation_id":"793f91ff-fa44-43c0-a7d7-f9499318a575","resolution":{"observed_at":"2026-08-07T11:09:06.368933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:17.260302Z","title":"Adversarial examples for the openai clip in its zero-shot classification regime and their semantic gener- alization, 2021","venue":null,"work_id":"c7b310ef-3caa-4afd-82db-a48281f0964c","year":2021},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:06.470107Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:b1ef45ac514d9c0b523efbc6720d8b58e1f041cb19453977de7d9413ce8252f0","observation_id":"56bb9b5a-5e2c-4e93-b17b-69f6e8bfe76e","resolution":{"observed_at":"2026-08-07T11:09:17.304895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:17.135402Z","title":"Pixels still beat text: Attacking the openai clip model with text patches and adversarial pixel perturbations,","venue":null,"work_id":"a835653e-ddca-4dbc-a10e-7b6b5e686065","year":null},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:06.574033Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:70cfbfe2f86c7183ee6459b81abfb33a9305839e9751446e1c043bb40db64608","observation_id":"f081d8eb-f314-4e95-a9ad-4cdba02ff7d0","resolution":{"observed_at":"2026-08-07T11:09:17.199529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.08392","last_updated":"2025-01-04T03:37:30Z","snapshot_observed_at":"2026-08-16T17:14:12.867974Z","submitted_at":"2022-03-16T04:45:59Z","title":"Patch-Fool: Are Vision Transformers Always Robust Against Adversarial Perturbations?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.08392","snapshot_observed_at":"2026-08-07T11:09:06.657206Z","title":"Patch-fool: Are vision transformers always robust against adversarial perturbations?arXiv preprint arXiv:2203.08392, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:06.657206Z"},"links":{"cited_paper":"/paper/2203.08392","citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:cf80144c6e5f2165750db2a9b1c875867b63db3519bb3dca5338d96a42a4e704","observation_id":"5f77670b-aeb1-450d-814a-3b8be080d24f","resolution":{"observed_at":"2026-08-07T11:09:06.657206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6572","last_updated":"2015-03-20T20:19:16Z","snapshot_observed_at":"2026-08-12T17:13:46.394331Z","submitted_at":"2014-12-20T01:17:12Z","title":"Explaining and Harnessing Adversarial Examples","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6572","snapshot_observed_at":"2026-08-07T11:09:06.757462Z","title":"Explaining and harnessing adversarial examples.arXiv preprint arXiv:1412.6572, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:06.757462Z"},"links":{"cited_paper":"/paper/1412.6572","citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:db1be0ab2dccadf579a46dc8be5a99fb2e36f23861828a8555d51951dbc28c3e","observation_id":"00ef6cb9-51bf-409e-903a-0f7fd95a8826","resolution":{"observed_at":"2026-08-07T11:09:06.757462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:17.016343Z","title":"Are vision trans- formers robust to patch perturbations? InEuropean Con- ference on Computer Vision, pages 404–421","venue":null,"work_id":"0ac11dc1-9275-4f22-84b1-fb7eef0d341d","year":2022},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:06.800977Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:af945df4d780a9217bcb8bb057ac72af58a132ed716ea91ca66389b6a2d9acd7","observation_id":"a933c4c3-6ee2-4534-bf22-366d31a37579","resolution":{"observed_at":"2026-08-07T11:09:17.064309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04913","last_updated":"2023-12-08T09:08:50Z","snapshot_observed_at":"2026-08-16T14:36:35.179316Z","submitted_at":"2023-12-08T09:08:50Z","title":"SA-Attack: Improving Adversarial Transferability of Vision-Language Pre-training Models via Self-Augmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.04913","snapshot_observed_at":"2026-08-07T11:09:06.917630Z","title":"Sa-attack: Improving adversar- ial transferability of vision-language pre-training models via self-augmentation.arXiv preprint arXiv:2312.04913, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:06.917630Z"},"links":{"cited_paper":"/paper/2312.04913","citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:ead1e09276ca6faf7d646ee9574757e5f4cb4d4ef34488dba945410532d63db4","observation_id":"23f999c7-dc3c-40cf-a482-00828550a3bc","resolution":{"observed_at":"2026-08-07T11:09:06.917630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:15.209295Z","title":"Black-box adversarial attacks with limited queries and information","venue":null,"work_id":"687a0f3c-3bd5-4c9a-806a-87caa7ce8e05","year":2018},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:06.984387Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:690643f9c299526d2b8c7187f56fa02c9a292e35c4c8efc18a456dea82329e0f","observation_id":"1dd8f011-0023-44fa-82e6-9b7d06bbcbfd","resolution":{"observed_at":"2026-08-07T11:09:16.927343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:14.752577Z","title":"Scal- ing up vision-language pretraining","venue":null,"work_id":"e63875d3-b730-45d9-8686-3aef8672d1c9","year":2021},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:07.099614Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:f4ea387531ff6cb38aa5725eb420feea1120584cf5bfc6ba670f9ab968958a9e","observation_id":"6065268d-1d4a-47f2-bc12-2f7a41243596","resolution":{"observed_at":"2026-08-07T11:09:14.846145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.09602","last_updated":"2023-12-15T18:41:43Z","snapshot_observed_at":"2026-08-16T16:38:03.039203Z","submitted_at":"2022-08-20T04:14:27Z","title":"Exploring Adversarial Robustness of Vision Transformers in the Spectral Perspective","version":2},"cited_work":{"arxiv_id":"2208.09602","doi":null,"metadata_source":"pith","pith_arxiv_id":"2208.09602","snapshot_observed_at":"2026-08-07T11:09:11.778754Z","title":"Exploring Adversarial Robustness of Vision Transformers in the Spectral Perspective","venue":"cs.CV","work_id":"b2ff536a-ac41-4d86-88f6-8bd432f664e6","year":2022},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:07.214381Z"},"links":{"cited_paper":"/paper/2208.09602","citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:ddc4c84f7ae2f75390b5d9f8ed57b269a1423f42fa816b581b3739509440400a","observation_id":"d1ce4c97-b8b6-4eee-b007-69eb45138b1e","resolution":{"observed_at":"2026-08-07T11:09:11.913022Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:14.660899Z","title":"Curved representation space of vision transformers","venue":null,"work_id":"2b67012a-3dc8-472d-ba50-1f470c436cfc","year":2024},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:07.370476Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:6f7c4636d38fe13ee520a10f169f1b79926df6a9f3731103c5984e10964fc0f0","observation_id":"b3972a62-6d42-458f-b5e3-c7f924e66c48","resolution":{"observed_at":"2026-08-07T11:09:14.694350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:07.484958Z","title":"Segment any- thing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:07.484958Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:87e96b7a855dce09bc37a09a69c32581c58572d9f225917609871f1665478ced","observation_id":"19adec9a-1c90-4a35-b8e9-1db62793f1f8","resolution":{"observed_at":"2026-08-07T11:09:07.484958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12588","last_updated":"2024-07-18T06:55:33Z","snapshot_observed_at":"2026-08-16T13:33:25.542015Z","submitted_at":"2024-07-17T14:12:34Z","title":"Benchmarking Robust Self-Supervised Learning Across Diverse Downstream Tasks","version":2},"cited_work":{"arxiv_id":"2407.12588","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.12588","snapshot_observed_at":"2026-08-07T11:09:11.483755Z","title":"Benchmarking Robust Self-Supervised Learning Across Diverse Downstream Tasks","venue":"cs.CV","work_id":"c3d4e95e-b9dd-4f33-a788-9927249ccd3e","year":2024},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:07.644839Z"},"links":{"cited_paper":"/paper/2407.12588","citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:cce945cc05ef697b8d454987326cb0be1545c35b04e1a3b29877073891e986d3","observation_id":"65b4dde8-9768-407c-bf85-28772a52246f","resolution":{"observed_at":"2026-08-07T11:09:11.626309Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:14.482462Z","title":"Ad- versarial examples in the physical world","venue":null,"work_id":"07c83805-3046-457c-b9aa-e3c2f7502866","year":2018},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:07.756757Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:931561f224b4fb4ad9ae30c5b2b6efe65c2e7869ca02af7a5c062e3bccbc2abb","observation_id":"3b7f22b2-8c01-4754-a1e4-c2c1e0d49ad8","resolution":{"observed_at":"2026-08-07T11:09:14.579557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:07.862211Z","title":"Align before fuse: Vision and language representation learn- ing with momentum distillation.Advances in neural infor- mation processing systems, 34:9694–9705, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:07.862211Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:9eec289dc8db204e31e011ab944e3975f8d3b583551b4f7f64a96a661048c18a","observation_id":"0cd27d75-3b19-4e1d-aeb8-efd5757a6cba","resolution":{"observed_at":"2026-08-07T11:09:07.862211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:14.321740Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":"52b1882e-e929-4ca8-a3db-f47bb5ce1cc8","year":2023},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:07.989291Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:c97528b23ce11fca1c699d0402d709e702cbd71d94bac5e1fe0866073b54ace9","observation_id":"9def767f-cd28-4f41-859c-5c79e7bb5712","resolution":{"observed_at":"2026-08-07T11:09:14.369842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:14.192765Z","title":"Lawrence Zitnick, and Piotr Doll ´ar","venue":null,"work_id":"a9326ccf-2cda-4473-9103-a939013f9228","year":2015},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:08.135547Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:46afe8151f9192753b6545be2c3d7262049407026457148ddca7f9f9cdb7e411","observation_id":"eb46ec7c-4558-43b0-8573-cd926db7b156","resolution":{"observed_at":"2026-08-07T11:09:14.253854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14105","last_updated":"2023-03-10T10:24:50Z","snapshot_observed_at":"2026-08-16T16:29:14.722988Z","submitted_at":"2022-09-28T13:55:28Z","title":"Exploring the Relationship between Architecture and Adversarially Robust Generalization","version":2},"cited_work":{"arxiv_id":"2209.14105","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.14105","snapshot_observed_at":"2026-08-07T11:09:11.286993Z","title":"Exploring the Relationship between Architecture and Adversarially Robust Generalization","venue":"cs.LG","work_id":"298ed9a0-7496-48ec-8f88-749067c3c122","year":2022},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:08.269622Z"},"links":{"cited_paper":"/paper/2209.14105","citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:ed694e4fd16b40fe84757afe6e09873c4c8b0ddfa18563eb0c1224d884ada768","observation_id":"3eec59fc-367e-440a-9f6d-fc1d0caa59c7","resolution":{"observed_at":"2026-08-07T11:09:11.366802Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-07T11:09:08.339731Z","title":"Decoupled weight decay regularization.arXiv preprint arXiv:1711.05101, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:08.339731Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:9a2f6f83bb63c8d95284d847b4aaa9eac9d90575fec1d96527735deea151df39","observation_id":"a5b6df67-9b01-44d6-99dc-aa2bf7619cd8","resolution":{"observed_at":"2026-08-07T11:09:08.339731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:14.011373Z","title":"Set-level guidance at- tack: Boosting adversarial transferability of vision-language pre-training models","venue":null,"work_id":"423f9d81-804e-4e28-918a-09110b758201","year":null},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:08.441542Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:bdb6ad9d3bcf9d981c2ce016069a9517fd842165eeceaceac0045079e3bbd640","observation_id":"570045b7-57d0-4948-8de4-394c01ea87f5","resolution":{"observed_at":"2026-08-07T11:09:14.084024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.06083","last_updated":"2019-09-04T18:53:10Z","snapshot_observed_at":"2026-08-07T14:27:46.872660Z","submitted_at":"2017-06-19T17:53:11Z","title":"Towards Deep Learning Models Resistant to Adversarial Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.06083","snapshot_observed_at":"2026-08-07T11:09:08.504906Z","title":"Towards deep learn- ing models resistant to adversarial attacks.arXiv preprint arXiv:1706.06083, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:08.504906Z"},"links":{"cited_paper":"/paper/1706.06083","citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:fb93ab69e82444e262ebf1feb1e36fb6a15fe2d16d162f1227fbe4dacb4afdca","observation_id":"8a34c410-6879-4e31-be9f-e0f7221af839","resolution":{"observed_at":"2026-08-07T11:09:08.504906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:13.888161Z","title":"On the robustness of vision transformers to adversarial ex- amples","venue":null,"work_id":"ea8167ac-7902-48ab-8f25-6ef660ebd8bd","year":2021},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:08.569013Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:e5bdfe5540f4fe7e067cf5112677ca89b183f23f77160c4bcff9966ecd702336","observation_id":"15af41e3-c67d-4f51-bbc2-dec40723f232","resolution":{"observed_at":"2026-08-07T11:09:13.940599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:13.761848Z","title":"Deepfool: a simple and accurate method to fool deep neural networks","venue":null,"work_id":"7cd56448-de2a-43ed-a904-6552e42a5509","year":2016},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:08.629534Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:7dd424a6777d864973b01729ba78368e8e6dd784fd4562711d5e3b5667b2b8fa","observation_id":"99ebc7d0-63ff-4303-8ca3-64ce3971cc23","resolution":{"observed_at":"2026-08-07T11:09:13.814685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.04169","last_updated":"2022-03-03T12:08:18Z","snapshot_observed_at":"2026-08-18T01:04:33.026640Z","submitted_at":"2021-06-08T08:20:38Z","title":"On Improving Adversarial Transferability of Vision Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.04169","snapshot_observed_at":"2026-08-07T11:09:08.714579Z","title":"On improving adversarial transferability of vision transformers.arXiv preprint arXiv:2106.04169, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:08.714579Z"},"links":{"cited_paper":"/paper/2106.04169","citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:11804bd3b1826df45554034a3ba0dac9455b355d15e1e75038d13aa12495ccde","observation_id":"219af90e-baa5-4099-8c92-86ddd3e2877b","resolution":{"observed_at":"2026-08-07T11:09:08.714579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.10480","last_updated":"2021-03-18T18:56:51Z","snapshot_observed_at":"2026-08-16T18:37:54.226322Z","submitted_at":"2021-03-18T18:56:51Z","title":"Reading Isn't Believing: Adversarial Attacks On Multi-Modal Neurons","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.10480","snapshot_observed_at":"2026-08-07T11:09:08.838443Z","title":"Reading isn’t believing: Adversarial attacks on multi-modal neurons","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:08.838443Z"},"links":{"cited_paper":"/paper/2103.10480","citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:82fd3653fd577d32c3ddb06677442b9653e97eefd93cb1f945209091b5fe51d3","observation_id":"cca0f566-c49a-43eb-9a85-eafc77709927","resolution":{"observed_at":"2026-08-07T11:09:08.838443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-17T13:03:40.359628Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-07T11:09:08.953482Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:08.953482Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:2e351792913bb170c796e86cfa114dbda450ac5f55af2dcb7b56a3a04bb7e4a8","observation_id":"2b21263d-29d1-49a5-989e-b8ef3b6a3c7e","resolution":{"observed_at":"2026-08-07T11:09:08.953482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:09.044655Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:09.044655Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:891a81a96fa7c5dcd6465e287eef766d4498cb9cc8e09a09cf35a367d09a6ee2","observation_id":"1dc4e3fc-2f26-4774-bf11-7723d3ed1b10","resolution":{"observed_at":"2026-08-07T11:09:09.044655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:13.577020Z","title":"Berg, and Li Fei-Fei","venue":null,"work_id":"96baaccb-b640-4ed0-b9ea-e1ecac757fa2","year":2015},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:09.142432Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:c216876bab28934ffeda56a6e05b4ffff42a35ff64ac6d8c8c1e26667dd2eeb5","observation_id":"7836ddf6-d117-48ed-8c01-03583104991e","resolution":{"observed_at":"2026-08-07T11:09:13.652122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.15670","last_updated":"2022-11-02T18:57:19Z","snapshot_observed_at":"2026-08-16T18:35:32.599593Z","submitted_at":"2021-03-29T14:48:24Z","title":"On the Adversarial Robustness of Vision Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.15670","snapshot_observed_at":"2026-08-07T11:09:09.256860Z","title":"On the adversarial robustness of vision trans- formers.arXiv preprint arXiv:2103.15670, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:09.256860Z"},"links":{"cited_paper":"/paper/2103.15670","citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:c4746e9c1a70bac70768e77944e2ff2e1220b0666f16a23aae2ebee9e25c4f80","observation_id":"a32c214e-383b-4d0b-966d-24e3e07131ed","resolution":{"observed_at":"2026-08-07T11:09:09.256860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:13.465497Z","title":"Cnn features off-the-shelf: an astound- ing baseline for recognition","venue":null,"work_id":"0fbfd1ea-74ac-41f6-acd3-c8c663da700a","year":2014},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:09.322501Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:c7a8262b7d058756112562bdd24cb4bb4e1a5da0c1925c160c8190f8e02eff9f","observation_id":"a41a1064-c7b9-4c32-8ae1-1d44d16c9951","resolution":{"observed_at":"2026-08-07T11:09:13.506985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:09.434559Z","title":"Indoor segmentation and support inference from rgbd images","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:09.434559Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:232abf16d3535e558a82cd944c63fec49afe13298201ebcc7a7e1b4abc9ca4d6","observation_id":"1334a06e-528a-4dad-a39e-23c81955865b","resolution":{"observed_at":"2026-08-07T11:09:09.434559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:13.275478Z","title":"Adversarial risk and the dangers of eval- uating against weak attacks","venue":null,"work_id":"ff1b3322-69e4-4135-8ad4-1d63a39a7dc7","year":2018},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:09.768074Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:9956e3eff9c3f54911a8f2f714275f0217e27e375e61e2a6788ac587c8467f4f","observation_id":"1c1b17c9-ed47-4260-a236-d6b38c21b7b5","resolution":{"observed_at":"2026-08-07T11:09:13.358632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10499","last_updated":"2024-03-15T17:33:49Z","snapshot_observed_at":"2026-08-16T14:09:21.989511Z","submitted_at":"2024-03-15T17:33:49Z","title":"Benchmarking Zero-Shot Robustness of Multimodal Foundation Models: A Pilot Study","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.10499","snapshot_observed_at":"2026-08-07T11:09:09.880055Z","title":"Benchmarking zero-shot robustness of multimodal founda- tion models: A pilot study.arXiv preprint arXiv:2403.10499,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:09.880055Z"},"links":{"cited_paper":"/paper/2403.10499","citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:48d87e18b2ea5618368a2fa782bac18eec71461923fade2b4154da4aa4cb61b9","observation_id":"2d089d22-30f3-447c-8fee-1fb4346a9d3e","resolution":{"observed_at":"2026-08-07T11:09:09.880055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12636","last_updated":"2025-06-02T08:14:09Z","snapshot_observed_at":"2026-08-16T15:06:09.381269Z","submitted_at":"2023-08-24T08:22:21Z","title":"Exploring Transferability of Multimodal Adversarial Samples for Vision-Language Pre-training Models with Contrastive Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12636","snapshot_observed_at":"2026-08-07T11:09:10.053287Z","title":"Exploring transferability of multimodal adversarial sam- ples for vision-language pre-training models with contrastive learning.arXiv preprint arXiv:2308.12636, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:10.053287Z"},"links":{"cited_paper":"/paper/2308.12636","citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:39d6cffed10b382811b2d928e7e0df65dbccf5456ef339be6fe1f7ffa52c950e","observation_id":"ef17e8f2-5678-412c-bee2-392281cda67e","resolution":{"observed_at":"2026-08-07T11:09:10.053287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:12.999385Z","title":"Towards transferable adversarial attacks on vision transformers","venue":null,"work_id":"e47b1dee-c1b7-4940-9867-94b7c6e68576","year":2022},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:10.169412Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:48a7c0581486423c74b808cc39f4c1d403b7e50588f372871dbd5b08ef720823","observation_id":"898cbbed-85a9-4753-a446-6d3e1550fe1e","resolution":{"observed_at":"2026-08-07T11:09:13.118082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:10.272598Z","title":"Vision-language pre-training with triple contrastive learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:10.272598Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:f0e1766854ddbb8f6ef695764740788f18e18e21f465a64cb381bdbfbbfa8043","observation_id":"e32fa98f-c5cb-40ef-accf-bc3e9b043359","resolution":{"observed_at":"2026-08-07T11:09:10.272598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:12.873101Z","title":null,"venue":null,"work_id":"648ce03b-552a-4f7a-9735-7987744c9260","year":2014},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:10.384701Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:e6a9a7512ef0f29fc9fea3ebf708f8883750f900fcab37be9851f59ca897f609","observation_id":"477ba9fa-9e72-480d-b95d-fef085abb6a7","resolution":{"observed_at":"2026-08-07T11:09:12.936539Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.11432","last_updated":"2021-11-22T18:59:55Z","snapshot_observed_at":"2026-07-06T12:11:02.119174Z","submitted_at":"2021-11-22T18:59:55Z","title":"Florence: A New Foundation Model for Computer Vision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.11432","snapshot_observed_at":"2026-08-07T11:09:10.491227Z","title":"Florence: A new foundation model for computer vision.arXiv preprint arXiv:2111.11432, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:10.491227Z"},"links":{"cited_paper":"/paper/2111.11432","citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:c243ae0a05c0c10e5da3587283c4d5a9f7af213b9f21f29ffa5bdf8e473275bd","observation_id":"5d6e5fc0-836a-4f7c-a1c4-e3a3eb9f92e0","resolution":{"observed_at":"2026-08-07T11:09:10.491227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:12.722464Z","title":"Towards adversarial attack on vision-language pre-training models","venue":null,"work_id":"cdd2f2d9-8f09-4e14-88e3-e63f6ac37ec0","year":2022},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:10.669164Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:6dcd3cf7cd1408284f4c3323bd8b3ee149bd946862a549252c5629aaf29c9d1a","observation_id":"a43ef118-b3ca-41f4-bca2-47451371908a","resolution":{"observed_at":"2026-08-07T11:09:12.772569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:12.531914Z","title":"Transferable adversarial attacks on vision transform- ers with token gradient regularization","venue":null,"work_id":"16bc91ad-d195-4b50-be32-a74e17d8b923","year":2023},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:10.768596Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:97dc919a0c36fc79e79dc26ac07d1c3291efa2290521617bb9df2b3a5ef92e3b","observation_id":"849749a2-0af8-4f96-897b-6277acf5c793","resolution":{"observed_at":"2026-08-07T11:09:12.638607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:12.307236Z","title":"Univer- sal adversarial perturbations for vision-language pre-trained models","venue":null,"work_id":"653cd9bf-6708-4bb6-b3a5-6a3f8a5843c7","year":2024},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:10.895374Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:b453bbd900ffebcda94170d7915a0afe80a27c7eb76917c5c704704cdc2a39c8","observation_id":"52842260-ca10-41b0-b35b-da2dc2307af3","resolution":{"observed_at":"2026-08-07T11:09:12.387400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:09:12.147476Z","title":"Semantic under- standing of scenes through the ade20k dataset.International Journal of Computer Vision, 127(3):302–321, 2019","venue":null,"work_id":"5efdccee-e41b-4f60-a43b-3783cc115e95","year":2019},"citing_paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:11.016820Z"},"links":{"citing_paper":"/paper/2506.05394"},"observation_digest":"sha256:5fb50e1cbe193ce3f7e1d7b38ac25da87357bdaa149b85661ca5734a939b6f4a","observation_id":"2a16dad9-7676-4d23-94b8-a4dffcf7dbec","resolution":{"observed_at":"2026-08-07T11:09:12.194890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.05394","last_updated":"2025-09-12T16:12:48Z","latest_version":3,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-09T05:43:52.010041Z","submitted_at":"2025-06-03T19:42:48Z","title":"Attacking Attention of Foundation Models Disrupts Downstream Tasks"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":3,"verified_fuzzy":24},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 0 inbound Pith citation observations for arXiv:2506.05394."}