{"as_of":"2026-08-22T16:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:55c68a90a511b5ff5ccc9557975dec5d84dfbeaecae1f032be51a52caa1fd406","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T16:52:27.844180Z","state":"measured"},{"denominator":66,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":66,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.13136/citation-record","integrity":"/paper/2411.13136/integrity","json":"/paper/2411.13136/citation-record.json","paper":"/paper/2411.13136"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.605108Z","title":"Align your prompts: Test-time prompting with distribution align- ment for zero-shot generalization","venue":null,"work_id":"5cb3bb6c-4958-4705-b46a-7d0eeaf71c7f","year":2024},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.601767Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:ee358be8e45941d6951d74d8420e90a656a70012f6edf2f8dff15a539fe2584f","observation_id":"a67bfdc0-bb18-47cf-b57c-f74cd3ee028e","resolution":{"observed_at":"2026-08-12T16:52:28.609305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-12T16:52:27.606350Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.606350Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:cfecc3d4dfd7752dad2829f99a8dbd22f18e3cef066cb8bb98f89deb0e8d9106","observation_id":"518df696-ba5f-48be-82fe-8123e754af2d","resolution":{"observed_at":"2026-08-12T16:52:27.606350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.01691","last_updated":"2022-08-16T16:06:33Z","snapshot_observed_at":"2026-08-18T11:44:22.813405Z","submitted_at":"2022-04-04T17:57:11Z","title":"Do As I Can, Not As I Say: Grounding Language in Robotic Affordances","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.01691","snapshot_observed_at":"2026-08-12T16:52:27.610565Z","title":"Do as i can, not as i say: Grounding language in robotic affordances","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.610565Z"},"links":{"cited_paper":"/paper/2204.01691","citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:ce73a02e6e76d2f3ddf9a84f0b14e65c1388e810649bc41503b8ccb51d753b81","observation_id":"651d3ff6-fbbf-44bb-9dc3-3c9d669a8112","resolution":{"observed_at":"2026-08-12T16:52:27.610565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.594497Z","title":"Agreement-on-the-line: Predicting the performance of neural networks under distribution shift","venue":null,"work_id":"a7e13ee8-e8f5-4afe-891d-ec0b7871ff6d","year":null},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.615177Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:7d822fddf199568c583a4660aa579100a169d34a104fa1d02efd66ce0ff8aa99","observation_id":"6a910d48-3f98-4d7b-ae50-3cabe55e4bc7","resolution":{"observed_at":"2026-08-12T16:52:28.598294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17274","last_updated":"2022-06-03T17:52:04Z","snapshot_observed_at":"2026-08-18T15:22:56.094984Z","submitted_at":"2022-03-31T17:59:30Z","title":"Exploring Visual Prompts for Adapting Large-Scale Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17274","snapshot_observed_at":"2026-08-12T16:52:27.619224Z","title":"Exploring visual prompts for adapting large- scale models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.619224Z"},"links":{"cited_paper":"/paper/2203.17274","citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:29483b501ebcb3b9ed8d0724a7451ba0b53458e31ad54e2a21338005d1d01d17","observation_id":"8d7aa66b-5300-4825-8282-f41aa7eb22ca","resolution":{"observed_at":"2026-08-12T16:52:27.619224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:27.623476Z","title":"Food-101–mining discriminative components with random forests","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.623476Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:f3101b00d8049e356cef88ee0f9175de581b9b29efc1765070be5efe646f7cc9","observation_id":"b26e17d1-b382-418a-9f38-0b174356dffd","resolution":{"observed_at":"2026-08-12T16:52:27.623476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.577129Z","title":"Describing textures in the wild","venue":null,"work_id":"3750e528-eef7-4335-ad9a-b870e9642286","year":2014},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.627220Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:d2617d16d6a9fe10bad317701d20411b9e324e1c5079aa810e12e1d1cf810e57","observation_id":"574c6f45-62c4-4bf5-8e74-ce4e1fea7467","resolution":{"observed_at":"2026-08-12T16:52:28.580641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.565803Z","title":"Reliable evalua- tion of adversarial robustness with an ensemble of diverse parameter-free attacks","venue":null,"work_id":"54cd5dd3-88fc-46ae-b730-d741be022012","year":2020},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.631175Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:ccb05513e11aecc22ee6c244aec13173b12adfb7df44dcfa19c73bc9e4f69905","observation_id":"6ee214d9-ad4f-401e-b09c-3c6bdd443200","resolution":{"observed_at":"2026-08-12T16:52:28.569826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.554378Z","title":"Boosting adversarial at- tacks with momentum","venue":null,"work_id":"c0a11312-337a-48a5-be21-28e5f647b33e","year":2018},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.634997Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:b5fbc12903e9bd3d22f4c49f0a6e171476e95c0eb36cf778fa20db77bd29e63e","observation_id":"0b4d5f23-90b0-4e33-a785-5a265b30c801","resolution":{"observed_at":"2026-08-12T16:52:28.558233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:27.638672Z","title":"One perturbation is enough: On generating universal adversarial perturbations against vision- language pre-training models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.638672Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:4ca383e3fb2c95194220be59a9ebdad978b6c6f130c3a22fdc478ed7418405c2","observation_id":"81fd44ab-0bef-4235-a7bd-c303fa34ffcf","resolution":{"observed_at":"2026-08-12T16:52:27.638672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.542883Z","title":"Learning gener- ative visual models from few training examples: An incre- mental bayesian approach tested on 101 object categories","venue":null,"work_id":"2d0045e0-a49c-4df4-8f5e-673268caf228","year":2004},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.642731Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:143f5de108c8b108e418422178ec4764c00395228e798d0bf029c5f83edcbec5","observation_id":"349303b4-a001-43b0-9ebe-95f81653ba83","resolution":{"observed_at":"2026-08-12T16:52:28.546801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.531676Z","title":"Large-scale adversarial training for vision- and-language representation learning","venue":null,"work_id":"e24123bc-7929-43eb-ba56-389c803feda8","year":2020},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.646496Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:3d042a24d86e525c9f8cd91de94f1502ef1c93a949d006f06fe96e823458ede0","observation_id":"78b00c95-053d-41f0-a8ca-e158440afe2f","resolution":{"observed_at":"2026-08-12T16:52:28.535430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04913","last_updated":"2023-12-08T09:08:50Z","snapshot_observed_at":"2026-08-22T00:18:48.053727Z","submitted_at":"2023-12-08T09:08:50Z","title":"SA-Attack: Improving Adversarial Transferability of Vision-Language Pre-training Models via Self-Augmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.04913","snapshot_observed_at":"2026-08-12T16:52:27.650257Z","title":"Sa-attack: Improving adversar- ial transferability of vision-language pre-training models via self-augmentation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.650257Z"},"links":{"cited_paper":"/paper/2312.04913","citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:0446b371c4736cdb7dd06bac8a73f5bccc844bd825a16d02f91c507e3e21758a","observation_id":"8dedbda0-6fba-4535-acf3-d9cf26e09085","resolution":{"observed_at":"2026-08-12T16:52:27.650257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.520004Z","title":"Eurosat: A novel dataset and deep learning benchmark for land use and land cover classification","venue":null,"work_id":"276423c1-5fe7-4852-8f68-ab697cb8f882","year":2019},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.654463Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:eda2461007fe91ca288eb80f9437fa3dbd8f33029a4385f3df3759c3454730a4","observation_id":"13ec3537-cef7-4828-bd1d-65f5b106dadb","resolution":{"observed_at":"2026-08-12T16:52:28.524362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.508580Z","title":"A visual–language foundation model for pathology image analysis using medical twitter","venue":null,"work_id":"41f4bcb0-7e14-4653-bb35-66ebbad3a80b","year":2023},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.658077Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:19c188e978c91d37cbc1a63379cf471fbc5b7fad7709965118861c69aef7dc6e","observation_id":"29a8e459-3192-42de-b62e-bbf335eb3ab5","resolution":{"observed_at":"2026-08-12T16:52:28.512561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:27.661569Z","title":"Scaling up visual and vision-language representation learning with noisy text supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.661569Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:9c76411e9d909a9d5cad67657d4c1d94640bc779310dc31d736060d32668368c","observation_id":"0fcf6700-6d89-424a-a80b-78b7c1792702","resolution":{"observed_at":"2026-08-12T16:52:27.661569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.490531Z","title":"Simple but effective: Clip embed- dings for embodied ai","venue":null,"work_id":"ce449a29-0954-4535-8856-8aa86ee65f5d","year":2022},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.665179Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:502aaea8cf64d050a1bbb8509c468061652a4a40bb3fb1be5c6c0b768f6814b1","observation_id":"3e864907-8af8-4236-930d-fe36aa388c06","resolution":{"observed_at":"2026-08-12T16:52:28.494306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.479823Z","title":"Maple: Multi-modal prompt learning","venue":null,"work_id":"44f2e7e9-c9b3-48e7-be45-f865524aae17","year":2023},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.668740Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:c407a993e6d46f14087bb1341a3d7aa4a5ecaa4e8334eefb7625b4d685826b6e","observation_id":"e4c18c12-1230-482f-b5fb-de29ca7e3b9d","resolution":{"observed_at":"2026-08-12T16:52:28.483450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.469322Z","title":"Test-time adaptation induces stronger accuracy and agreement-on-the-line","venue":null,"work_id":"3f48c852-4bfd-43ac-b2ce-10291a276a95","year":null},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.672211Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:85522f31327fa540e8062682d98f475485b87388d2ba121b461cf03ddba2a30e","observation_id":"3af7214f-5933-4239-84e5-58bef45385b5","resolution":{"observed_at":"2026-08-12T16:52:28.473031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.01950","last_updated":"2021-02-19T15:42:38Z","snapshot_observed_at":"2026-08-21T19:48:17.652761Z","submitted_at":"2020-09-24T01:34:42Z","title":"Torchattacks: A PyTorch Repository for Adversarial Attacks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.01950","snapshot_observed_at":"2026-08-12T16:52:27.676168Z","title":"Torchattacks: A pytorch repository for adversar- ial attacks","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.676168Z"},"links":{"cited_paper":"/paper/2010.01950","citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:4dbc274330e7ae86cd91ed7684efa3d6421dc111888a7ba69dedae01ed599605","observation_id":"4b90cd3b-b27b-416b-bb0e-734cc5e92eb6","resolution":{"observed_at":"2026-08-12T16:52:27.676168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.457398Z","title":"3d object representations for fine-grained categorization","venue":null,"work_id":"09750e6e-d2e1-41d0-a7b5-5dc2de497b0a","year":2013},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.680010Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:2e19a25538326ea84bf2a54681fd011a1ac884c20ca8303ca49170aeef40118b","observation_id":"da76e5b1-5d8c-4c01-884f-4b77136b21bb","resolution":{"observed_at":"2026-08-12T16:52:28.461508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.445310Z","title":"One prompt word is enough to boost adversarial robustness for pre-trained vision-language models","venue":null,"work_id":"d5346297-0ff4-46df-bca4-7a1da97d0313","year":2024},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.683433Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:c5547dc942d950bd28f179e72669d90e3d4c6718439898c4e54903534923aa11","observation_id":"c39837d6-b2f8-4a78-8c6f-b82a8e18a410","resolution":{"observed_at":"2026-08-12T16:52:28.449188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.433186Z","title":"Set-level guidance at- tack: Boosting adversarial transferability of vision-language pre-training models","venue":null,"work_id":"61d5c5ae-0dc0-44ff-be37-d4a9ecc5efbc","year":2023},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.687095Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:2c23568445ae9b1a288a7199b2cb1b74a160c7252b3cd4f2251331b021227cdb","observation_id":"0a9c9bd7-3b95-4b63-9e85-4fa6c0761bb3","resolution":{"observed_at":"2026-08-12T16:52:28.437381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.420535Z","title":"Imbalanced gradients: a sub- tle cause of overestimated adversarial robustness","venue":null,"work_id":"ff6d3d3c-52d1-488d-8ad9-39841a776fab","year":2024},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.690518Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:64bb6fa3f68238119d47fb161aaeb7e7945db6172afb203fb4a2b48e5a932837","observation_id":"3c92c15d-06cd-4cef-bc1c-e32fe4662192","resolution":{"observed_at":"2026-08-12T16:52:28.425163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.409189Z","title":"Towards deep learning models resistant to adversarial attacks","venue":null,"work_id":"3643a0e4-af31-428f-9813-1fba2146bc9d","year":2018},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.694002Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:33d1b4aff122612ed5ae0c50896421df35188eaa0cdea4ab67da9bf5dd0cba12","observation_id":"dde244a9-6eb2-41f6-957f-c4d04065347b","resolution":{"observed_at":"2026-08-12T16:52:28.413171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1306.5151","last_updated":"2013-06-21T14:31:57Z","snapshot_observed_at":"2026-08-12T17:35:23.022229Z","submitted_at":"2013-06-21T14:31:57Z","title":"Fine-Grained Visual Classification of Aircraft","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1306.5151","snapshot_observed_at":"2026-08-12T16:52:27.697455Z","title":"Fine-grained visual classi- fication of aircraft","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.697455Z"},"links":{"cited_paper":"/paper/1306.5151","citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:39753cd42ee87802ad392662e280b4cb634afef0ba4d67b6f3b3b5c947316a7f","observation_id":"976d04d3-ca59-4659-86a6-534baca1fdb4","resolution":{"observed_at":"2026-08-12T16:52:27.697455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.398048Z","title":"Understanding zero-shot adversarial robust- ness for large-scale models","venue":null,"work_id":"6096681e-aa5a-4400-8d34-3c5b581a9604","year":2023},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.701377Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:5d2be949c472ae968ffdc5e5a0e8b49f7df1c81fd81e9a951a00cef1de6fb9c4","observation_id":"d48d05f9-ef81-4059-8835-d8954c02519c","resolution":{"observed_at":"2026-08-12T16:52:28.401839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.10963","last_updated":"2021-01-14T21:11:06Z","snapshot_observed_at":"2026-08-19T09:01:42.968993Z","submitted_at":"2020-06-19T05:08:43Z","title":"Evaluating Prediction-Time Batch Normalization for Robustness under Covariate Shift","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.10963","snapshot_observed_at":"2026-08-12T16:52:27.705166Z","title":"Evaluating prediction-time batch normalization for robust- ness under covariate shift","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.705166Z"},"links":{"cited_paper":"/paper/2006.10963","citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:4fb22299cfff415d0c02789b4f72a05673c2cc093bc84125edb0122aca489339","observation_id":"734dd0c1-8ae3-4277-9553-56e12181d32a","resolution":{"observed_at":"2026-08-12T16:52:27.705166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:27.709031Z","title":"Automated flower classification over a large number of classes","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.709031Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:31c12f2b433a8d962ab1659a5df1ac991a9099463e3ed63bff38f94552a02e18","observation_id":"74803c23-95d0-424b-988a-2fbcaf4b4bbe","resolution":{"observed_at":"2026-08-12T16:52:27.709031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.381349Z","title":"Efficient test- 9 time model adaptation without forgetting","venue":null,"work_id":"80025c28-da0b-4084-bdda-80f0cc7aeeab","year":2022},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.712504Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:bb90d1c4770412eb08f2d5ca8b38f9c9548959c1bebadb9bcdec97bd6d0e1daf","observation_id":"5cbe0811-ccd0-43d1-8bcc-a57544227ace","resolution":{"observed_at":"2026-08-12T16:52:28.384878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.370390Z","title":"Cats and dogs","venue":null,"work_id":"7ef012a0-2788-41fe-8544-72e3ba0ccd87","year":2012},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.715803Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:0fb40caa3a7b9135fadf446ee821cb2964438c7a57a7753b80ec3accf13c937b","observation_id":"3a57427d-82db-4c47-bbc7-9c72bd868fa5","resolution":{"observed_at":"2026-08-12T16:52:28.374117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.359536Z","title":"On the rela- tionship between generalization and robustness to adversar- ial examples","venue":null,"work_id":"fd3e2fba-08b9-4b18-9427-c3c999a110c4","year":2021},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.719415Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:ebf794cb9317559dd9ebd9a214aa00c687d9ea88708dcb7de400b1dbd9df602e","observation_id":"22cdc8ba-4300-4ff0-b6e3-6315966857c4","resolution":{"observed_at":"2026-08-12T16:52:28.363427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.348247Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"e2626cec-676f-4476-8f4f-a780fa15791e","year":2021},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.723200Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:4de3770c14de93884b7251f1d6f4e4699c6976bbaa3a1c1213b60b27ddf41c3e","observation_id":"43604da4-d9d7-4a04-8996-552f49b19418","resolution":{"observed_at":"2026-08-12T16:52:28.352421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:27.726821Z","title":"Imagenet large scale visual recognition challenge","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.726821Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:921c7ff2a7e52731c8f9b2e0ecec484bc7a7f951e613127b86c46b2e8fc05d58","observation_id":"f548a372-ab7e-4317-999b-1e0273013abe","resolution":{"observed_at":"2026-08-12T16:52:27.726821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.331125Z","title":"Robust CLIP: Unsupervised ad- versarial fine-tuning of vision embeddings for robust large vision-language models","venue":null,"work_id":"0411ec92-7839-4fb5-b040-fe6f537fb1af","year":2024},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.730286Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:3357d14100faa4c6054a21d14dd354b6eadf3397369e0dc3c750fca22585d2d0","observation_id":"b6504b37-73b6-46fd-9f79-2056d1ff285d","resolution":{"observed_at":"2026-08-12T16:52:28.334837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.320207Z","title":"Improving robustness against common corruptions by covariate shift adaptation","venue":null,"work_id":"dee30fa0-0681-4212-9b6a-4b8d4dca8edd","year":2020},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.733729Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:44b685c6681e7f25001239befd59c0fa92242421ffc9fe1013fd2b28cec5c0bc","observation_id":"d46bad2f-ee0e-4dee-8d29-f05fa39cb2e1","resolution":{"observed_at":"2026-08-12T16:52:28.323880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.08900","last_updated":"2020-04-19T16:28:35Z","snapshot_observed_at":"2026-08-18T21:03:48.548723Z","submitted_at":"2020-04-19T16:28:35Z","title":"The Cost of Training NLP Models: A Concise Overview","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.08900","snapshot_observed_at":"2026-08-12T16:52:27.737116Z","title":"The cost of training nlp models: A concise overview","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.737116Z"},"links":{"cited_paper":"/paper/2004.08900","citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:a00934a5492803fb3f25f89ae2a1df95a3aa9af84c47767debb7f079a68c1bf4","observation_id":"2e7e8c93-0ad0-4efb-a9c7-d2dd199e27eb","resolution":{"observed_at":"2026-08-12T16:52:27.737116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:27.740725Z","title":"Cliport: What and where pathways for robotic manipulation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.740725Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:fbea21b5ca57688f72b82339c49516a554e6715cfb464c59c7736dd3b00710ed","observation_id":"73432cff-c52a-4268-abfe-7a665328ef6f","resolution":{"observed_at":"2026-08-12T16:52:27.740725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.303309Z","title":"Test- time prompt tuning for zero-shot generalization in vision- language models","venue":null,"work_id":"80d9b257-b812-44b3-9491-0d3703ce3212","year":2022},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.744135Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:d54cb50a0e69e7740d47b798d58d0266152cc701c08caa7bdcb9ca66c1fcbc8c","observation_id":"c18ba89a-0142-4ea8-9d00-a3b4c0d57d9c","resolution":{"observed_at":"2026-08-12T16:52:28.307010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-08-16T21:21:44.768787Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-12T16:52:27.747523Z","title":"Ucf101: A dataset of 101 human actions classes from videos in the wild","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.747523Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:013374a4cceddb46fe03926e1f147268e3f4f9ca93a5ed06b5edec9eedfcc503","observation_id":"83f64589-886e-4de6-8068-7227558c7434","resolution":{"observed_at":"2026-08-12T16:52:27.747523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.292715Z","title":"Disentan- gling adversarial robustness and generalization","venue":null,"work_id":"8560401f-99dc-4e0b-b61c-f106e53fb36a","year":null},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.751187Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:40d58c1aeeaa1cbbf0a8b591a18723aefe1bf36208be1c2dce94a0dee038fd54","observation_id":"334da2de-a4af-4867-b6f3-d7a060623bf1","resolution":{"observed_at":"2026-08-12T16:52:28.296181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.282605Z","title":"Is robustness the cost of accuracy?– a comprehensive study on the robustness of 18 deep image classification models","venue":null,"work_id":"9c25ab75-42a7-438d-a19b-14efa2e9c668","year":2018},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.754913Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:27903369a5e2146e2bd49e519809d483bbfd177798a35971078dd45675414cdc","observation_id":"f1640690-67b7-4b13-8c26-549577e77a2f","resolution":{"observed_at":"2026-08-12T16:52:28.286114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.271543Z","title":"In- triguing properties of neural networks","venue":null,"work_id":"a94390c6-5475-4250-8aef-2e868da81c6d","year":2013},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.758345Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:e1be73179fd11ae7bbbb86ef22451ee149cc939588cfe16572ad8248c12bb722","observation_id":"07564bcb-9fd9-4ca7-8d0b-933c46156d7d","resolution":{"observed_at":"2026-08-12T16:52:28.275668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-08-20T18:27:04.837880Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-12T16:52:27.762038Z","title":"Gemini: a family of highly capable multimodal models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.762038Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:d94068a71d17ac4843dda80b11b3a5becd9f5403fe5a61d0ca2bcfe74c601cc3","observation_id":"48bfb5d2-56e9-4f83-9a16-a975a45e32c1","resolution":{"observed_at":"2026-08-12T16:52:27.762038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.260489Z","title":"Tent: Fully test-time adaptation by entropy minimization","venue":null,"work_id":"aeb7e91f-8587-40c6-a6da-e4706db30a9d","year":2021},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.766504Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:c7caa2e09a97427fd4ebb2e80cb4107a426ec3f26872fafc212581f8161bbb00","observation_id":"618d51b5-ad1a-4909-a400-6fb13dbb1db5","resolution":{"observed_at":"2026-08-12T16:52:28.264209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.248918Z","title":"Trans- ferable multimodal attack on vision-language pre-training models","venue":null,"work_id":"d75dfcea-a64f-47a1-aba9-b3dd3c07db50","year":2024},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.770075Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:e88bc8a14469a8d73688f4c77cc796a949d9136ad77436baf3df8829a55ba5bb","observation_id":"cf0df288-2cfd-4897-b477-f59e7b92bad2","resolution":{"observed_at":"2026-08-12T16:52:28.253088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.236955Z","title":"Con- tinual test-time domain adaptation","venue":null,"work_id":"4d60d96f-6e7d-46ce-9858-113ca33e2805","year":2022},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.773702Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:b1747497de449e66ac621eafa744af9f2656942e1bce0793db2e343f498e704e","observation_id":"2d5725b6-8f42-461b-a86e-79dea12622ed","resolution":{"observed_at":"2026-08-12T16:52:28.240908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.225849Z","title":"Pre- trained model guided fine-tuning for zero-shot adversarial robustness","venue":null,"work_id":"5863965c-3b48-450a-8cb0-6b101c1a02a5","year":2024},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.777170Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:cc63cbf54c3708887ff3336cce6c59c248245c367919dac1203db9e2bc16a8d3","observation_id":"2899b49b-91f6-4f65-bd82-ddeb0104ea37","resolution":{"observed_at":"2026-08-12T16:52:28.229558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.214326Z","title":"AdvQDet: Detecting query-based adversarial attacks with adversarial contrastive prompt tun- ing","venue":null,"work_id":"d1e110a5-165e-4439-9838-19a78167e17c","year":2024},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.781771Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:da4a91f5208c6e3d7b9548379df30f52b1e9405b20419a95ed70a3c11865026f","observation_id":"f06f41c9-ff90-41e2-8a1d-6b9953080415","resolution":{"observed_at":"2026-08-12T16:52:28.218578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.200912Z","title":"Medclip: Contrastive learning from unpaired medical images and text","venue":null,"work_id":"00544a30-4a50-4147-8e46-9d6f93901713","year":2022},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.785590Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:d663c34ee69e61ca29ca8f2c6f854b5b0e397edac3ac0bf87c964017c92dee6a","observation_id":"86fbb80f-6ce3-4d11-bcd3-d281eb6728d3","resolution":{"observed_at":"2026-08-12T16:52:28.205260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.189238Z","title":"Re- visiting adversarial training at scale","venue":null,"work_id":"6f266d7f-5e09-40f4-b7f5-f7aff4b54a92","year":2024},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.789220Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:a9bc279b603ad3cc6d8242a3c04d3e6c7b66e1605fb1810a39e33b014d241029","observation_id":"117c918d-4b18-4815-89c3-eae9ef280c0f","resolution":{"observed_at":"2026-08-12T16:52:28.193167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.177280Z","title":"Sun database: Large-scale scene recognition from abbey to zoo","venue":null,"work_id":"9562c4a7-0abb-4e63-85c6-d95c3fefe6d1","year":2010},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.793107Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:b3d5c377f8af47b552e183a82fee9568c1ce9a2b189d75d7f7db61a94aca8597","observation_id":"66b99564-25ac-4121-9163-a1c9f6bc6e50","resolution":{"observed_at":"2026-08-12T16:52:28.181483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:27.796630Z","title":"Improving transferabil- ity of adversarial examples with input diversity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.796630Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:249a22340ffe2a56136b37571a92245f165c4250d7f1613fce4381d805312c90","observation_id":"87066be0-5bbd-4476-855d-100b52867a59","resolution":{"observed_at":"2026-08-12T16:52:27.796630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.158968Z","title":"Vlattack: Multimodal adversarial attacks on vision-language tasks via pre-trained models","venue":null,"work_id":"7d8a76cd-672a-414f-809f-9b3564fa7b69","year":2023},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.800248Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:3603d256aad0008ef87701632d1ac7d54fd070f113e01b49241c9c3dc53fde6f","observation_id":"0ac438f1-2d45-48fe-8d75-4735f07aee6b","resolution":{"observed_at":"2026-08-12T16:52:28.162796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:27.803912Z","title":"Multi-event video-text retrieval","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.803912Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:297e4254340b305cf41ebb2992f126bb5c3c5fe259d82c261a1334bb5325a3be","observation_id":"7cea113f-6024-46a9-a37e-e4887bd8ab9a","resolution":{"observed_at":"2026-08-12T16:52:27.803912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.138637Z","title":"Theoretically principled trade-off between robustness and accuracy","venue":null,"work_id":"9c72196d-8040-4755-b2e8-b3bbf0406cee","year":2019},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.807451Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:d30adbac3716458d6e92c823db1b83733c6a2812a8506c546ab3ad6cb6c064e9","observation_id":"5383218d-6c5f-4f8c-8ece-fb10d5f9bc6a","resolution":{"observed_at":"2026-08-12T16:52:28.142508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:27.810981Z","title":"Towards adversarial attack on vision-language pre-training models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.810981Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:6010ba0f3578e236037d19e0377368fd09898ce905641b0c4e7268153b0722d2","observation_id":"802eae0a-60d1-478d-8b34-e4e9474bbb6a","resolution":{"observed_at":"2026-08-12T16:52:27.810981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.119909Z","title":"Adversarial prompt tuning for vision-language models","venue":null,"work_id":"119251f2-c0da-4381-875e-05599245b8f1","year":2024},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.814964Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:6c74e803379c2cb4b4154a252eb5a5b31018def8cda484a5474b0533aeb2c97c","observation_id":"6b4c7f66-c410-4302-965e-e9ee826b538d","resolution":{"observed_at":"2026-08-12T16:52:28.123706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.109289Z","title":"Memo: Test time robustness via adaptation and augmentation","venue":null,"work_id":"bd048be0-c1e5-4f1c-9c2c-6cac63db300d","year":2022},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.818545Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:741ffcda2e04716a6e5e0ec48536131167743277b20d382c54c68324850920b1","observation_id":"85d99722-1b83-4ef8-a023-84616393d9c7","resolution":{"observed_at":"2026-08-12T16:52:28.112918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.097574Z","title":"Univer- sal adversarial perturbations for vision-language pre-trained models","venue":null,"work_id":"79215db6-6610-43aa-8858-0f9d92697351","year":2024},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.822479Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:26ba6c2968544e8f504c11af686aeb2a5ab30e1dca1a78dc28d8b6008992997e","observation_id":"5025364b-d97a-40f5-ba13-f1dd194f1ff8","resolution":{"observed_at":"2026-08-12T16:52:28.101759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.086951Z","title":"On evaluating adversarial robustness of large vision-language models","venue":null,"work_id":"01286f4f-809b-4aa9-b6f6-ebd550496928","year":2024},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.825958Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:066a5cd4959db63ba7fb62cc141dc05f3cac6a7c6ab4a462e9e29d6f29f821fb","observation_id":"ceaf71e2-0ea8-4b4e-b96c-804f7497a86a","resolution":{"observed_at":"2026-08-12T16:52:28.090659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.074902Z","title":"Conditional prompt learning for vision-language models","venue":null,"work_id":"c4a03033-ef68-453d-8582-e4b3508ab96d","year":2022},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.829420Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:e1f2f29512b41f729cb89eff3fb078be449d6e8dd7b52a7b3aa894d6ca4664d0","observation_id":"a4ac5ca2-dc9a-45f2-9ed8-158319245599","resolution":{"observed_at":"2026-08-12T16:52:28.079185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:27.833011Z","title":"Learning to prompt for vision-language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.833011Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:518e3d42207e51a3ccd843c8de3c94bd493835240dd384e87a0ed80206bff0a6","observation_id":"54589e70-1270-4b66-9757-a3dc569a3c6d","resolution":{"observed_at":"2026-08-12T16:52:27.833011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19287","last_updated":"2024-11-12T10:48:21Z","snapshot_observed_at":"2026-08-17T16:14:39.856502Z","submitted_at":"2024-04-30T06:34:21Z","title":"Revisiting the Adversarial Robustness of Vision Language Models: a Multimodal Perspective","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19287","snapshot_observed_at":"2026-08-12T16:52:27.836524Z","title":"Revisiting the adversarial robustness of vision language models: a multimodal perspective","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.836524Z"},"links":{"cited_paper":"/paper/2404.19287","citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:22239331cfdce1ac9fda2298277ce23d88a5b27f6cae266446826ec81ebdf491","observation_id":"6f453f80-fa02-48b3-b641-d3932e2de760","resolution":{"observed_at":"2026-08-12T16:52:27.836524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.056892Z","title":"Few-shot adversarial prompt learning on vision-language models","venue":null,"work_id":"e027517a-da35-4056-ab6b-42e675baa28b","year":2024},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.840353Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:e45b2efb359022c0ef2d92de90c895409fff393153f2d761f73c7c9b04bc62bd","observation_id":"2364e03f-d124-460b-a650-99d3b036c607","resolution":{"observed_at":"2026-08-12T16:52:28.060689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:52:28.044101Z","title":"Advclip: Downstream-agnostic adversarial examples in multimodal contrastive learning","venue":null,"work_id":"b55e0e9e-4835-4aa2-ae00-9708c3665a2a","year":2023},"citing_paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T16:52:27.844180Z"},"links":{"citing_paper":"/paper/2411.13136"},"observation_digest":"sha256:2eb909de5bda7548eac52d8db2bd6108b9c91e4bf906203cc100f296e1a0706a","observation_id":"e3a2ccde-b8ee-493e-9b63-d4179845281a","resolution":{"observed_at":"2026-08-12T16:52:28.049547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.13136","last_updated":"2024-11-20T08:58:59Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-20T22:04:21.491930Z","submitted_at":"2024-11-20T08:58:59Z","title":"TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":0,"verified_fuzzy":45},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 0 inbound Pith citation observations for arXiv:2411.13136."}