{"as_of":"2026-08-13T21:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c27f26e9b0958f49bb8e350061e938b09f698fa7bd10dc9dbb1bbde4e3adad18","coverage":[{"denominator":81,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":81,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T05:46:32.312024Z","state":"measured"},{"denominator":81,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":81,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.01225/citation-record","integrity":"/paper/2508.01225/integrity","json":"/paper/2508.01225/citation-record.json","paper":"/paper/2508.01225"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.029565Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.029565Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:a9718c4321ea1b7ab986219ceb8b975a9fca00d629402248896d26af447df975","observation_id":"22fa6396-83ee-4773-b9c4-c8c9a4ff5679","resolution":{"observed_at":"2026-08-06T05:46:32.029565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.034293Z","title":"Align your prompts: Test-time prompting with distribution alignment for zero-shot generalization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.034293Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:63c29af949339b468556867bd8c3904a221aad79b1cf8bdeb679b29e80714bda","observation_id":"e5dc9d18-76b7-4775-9984-a3887c0735c2","resolution":{"observed_at":"2026-08-06T05:46:32.034293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.265281Z","title":"Dpa: Dual prototypes alignment for unsupervised adaptation of vision-language models","venue":null,"work_id":"3ae60d12-7f06-47e7-b9d5-0a98ebc883b7","year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.038343Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:8e04713fd3d52e1c064c0f1a7c6d004cad0caf66f9382fede740e176084f2433","observation_id":"97e9c35c-b097-464a-9ad0-6b202723ecc5","resolution":{"observed_at":"2026-08-06T05:46:33.269007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.253895Z","title":"Food-101--mining discriminative components with random forests","venue":null,"work_id":"be2a4c70-51fd-4a46-be07-8c4ed64aa4a1","year":2014},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.041745Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:ed75e7dd0c41a46372171ae33bc39a9848bf24188605883ec41d189e61dd7ed5","observation_id":"57822feb-419c-4b63-8adb-f9a40eddd7cb","resolution":{"observed_at":"2026-08-06T05:46:33.257708Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05466","last_updated":"2025-01-28T05:29:55Z","snapshot_observed_at":"2026-08-12T22:48:47.768358Z","submitted_at":"2024-09-09T09:48:27Z","title":"Proto-OOD: Enhancing OOD Object Detection with Prototype Feature Similarity","version":2},"cited_work":{"arxiv_id":"2409.05466","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.05466","snapshot_observed_at":"2026-08-06T05:46:32.711417Z","title":"Proto-OOD: Enhancing OOD Object Detection with Prototype Feature Similarity","venue":"cs.CV","work_id":"d8afbb5f-ae5a-4c36-8647-e004da87e309","year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.045410Z"},"links":{"cited_paper":"/paper/2409.05466","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:1b3b5aa451fc061fcdc67b3526b6827a5d11e32412bb0c9d997095e79db8cb7b","observation_id":"4c81c213-17af-4ef3-af96-4d38c1e48717","resolution":{"observed_at":"2026-08-06T05:46:32.715361Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.242005Z","title":"Describing textures in the wild","venue":null,"work_id":"db67ee9a-bd5e-4109-b4b9-4156dc59419e","year":2013},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.049279Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:4ac1214b4a04f6724c246b61052b5fa4b1a485ac1ca82674ec839d372499d72e","observation_id":"bc55afde-b573-4c70-aabb-9eda235e00ab","resolution":{"observed_at":"2026-08-06T05:46:33.246066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.230122Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"febd5de0-79c4-436c-94ca-b2b714377bb4","year":2009},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.052929Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:0d5090d4b0810512706ed331bf8ae39278b65b7124e72d872e0fb41f0aa4917d","observation_id":"e3641f26-c0d2-4559-9dc9-a2135f6dfac5","resolution":{"observed_at":"2026-08-06T05:46:33.233991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.218615Z","title":"Learning to prompt for open-vocabulary object detection with vision-language model","venue":null,"work_id":"972972bc-bca2-42d8-8e0e-03e7552facb3","year":2022},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.056698Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:71078cb34d5c7be87f623240bb90b0ea4838ecf52c8bc1407df1ceb53683b434","observation_id":"3df8d724-02b4-47e0-bb81-2339e2e4d24a","resolution":{"observed_at":"2026-08-06T05:46:33.222368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.207562Z","title":"Learning generative visual models from few training examples: An incremental bayesian approach tested on 101 object categories","venue":null,"work_id":"ee4881d5-de7c-4d7f-9534-76a40313ced5","year":2004},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.060300Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:b0511ca7c98609a9405e05bfb149c4508cc317e54bfb3fce9d7affad34e34475","observation_id":"63289751-34e3-44da-958c-6f41a3263845","resolution":{"observed_at":"2026-08-06T05:46:33.211368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.196275Z","title":"Diverse data augmentation with diffusions for effective test-time prompt tuning","venue":null,"work_id":"d4a4d4e8-1149-4626-91e7-86e7bf25eb8d","year":2023},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.063609Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:ab5ec6f04a8eed9c2c1c348809e980b9780c7a7bf080269ed28c48d65e221b9a","observation_id":"c54e37b3-a3fc-4be1-9e31-cac8ced2c9a8","resolution":{"observed_at":"2026-08-06T05:46:33.200204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.185538Z","title":"Khan, and Wangmeng Zuo","venue":null,"work_id":"6ef0df44-f963-4753-bcc8-2fbd6e10a743","year":2023},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.067385Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:fd0069c27b5916a2236a8eeab46109ceafca8486b07795de5d136f4a75cd6251","observation_id":"072f70f7-6106-4ee6-b358-8356a4d8ddcd","resolution":{"observed_at":"2026-08-06T05:46:33.189039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.174945Z","title":"Adapter merging with centroid prototype mapping for scalable class-incremental learning","venue":null,"work_id":"b53bfbb5-f9e2-495b-a2cf-da5a913663b9","year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.070665Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:28d74cfc75a4b6d70de0575d7914dd6001a2796b15030c92dc983a3ed3bf93d9","observation_id":"5dc6467c-833c-448e-8426-44c1fed8f72b","resolution":{"observed_at":"2026-08-06T05:46:33.178700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.074090Z","title":"Clip-adapter: Better vision-language models with feature adapters","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.074090Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:ef1daa31db9ea2810b4ffc5cbc0606cb3bc9d26bbf1ec00a7cfb57a660bcfef1","observation_id":"dc6a84ea-0f14-4cd1-9aa7-66c5e7923e6c","resolution":{"observed_at":"2026-08-06T05:46:32.074090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.158183Z","title":"Queryable prototype multiple instance learning with vision-language models for incremental whole slide image classification","venue":null,"work_id":"b76acc38-568a-435c-b734-4c6ba4c31e89","year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.077569Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:32219183727d2b3c3f7b7a470cc793ea329ddd04cd2181b01fb9103acf19356b","observation_id":"1edf48d1-8f87-4872-b305-faa97b20c772","resolution":{"observed_at":"2026-08-06T05:46:33.161730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.147300Z","title":"Open-vocabulary object detection via vision and language knowledge distillation","venue":null,"work_id":"5cb50d01-78c2-4b2a-9d57-dff912aa7626","year":2021},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.081160Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:590931dca00ca76f1c8d559191d3253e05a5c67b23a9a05af6b1669a5c4e31bf","observation_id":"b3c55728-5447-406e-b96a-d0032df28dd4","resolution":{"observed_at":"2026-08-06T05:46:33.151350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.136497Z","title":"Huang, and Shi-Min Hu","venue":null,"work_id":"b0a62aa7-03db-4f63-bb9f-a37370b7c883","year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.084962Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:9523f26b26b3c111ddcb83600a5217cabc97feb890da11a462f2db8dff44bc85","observation_id":"770a26b3-1dd6-4980-a3b4-7da607aeafd3","resolution":{"observed_at":"2026-08-06T05:46:33.140148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16441","last_updated":"2025-05-22T09:29:38Z","snapshot_observed_at":"2026-08-07T14:58:44.313460Z","submitted_at":"2025-05-22T09:29:38Z","title":"Ranked Entropy Minimization for Continual Test-Time Adaptation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16441","snapshot_observed_at":"2026-08-06T05:46:32.088296Z","title":"Ranked entropy minimization for continual test-time adaptation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.088296Z"},"links":{"cited_paper":"/paper/2505.16441","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:32ca06a381f6d101e6f2035d4b0de278feb457e4409e997de2d38aacb748fda0","observation_id":"274f8624-92a4-4ffa-98d3-2c5454a751f7","resolution":{"observed_at":"2026-08-06T05:46:32.088296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.125437Z","title":"Point-tta: Test-time adaptation for point cloud registration using multitask meta-auxiliary learning","venue":null,"work_id":"d9caeb96-817f-4bf9-8d2e-9289296c7d0a","year":2023},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.092163Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:05fffb01efd6db921e95773a2f2ce393b838fe2232fc87d14ade4c5d230a4201","observation_id":"7a78677f-4cf0-40f7-aef0-4d7ae40547f1","resolution":{"observed_at":"2026-08-06T05:46:33.129251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.095867Z","title":"Eurosat: A novel dataset and deep learning benchmark for land use and land cover classification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.095867Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:dacb7e0e8b0594f05d69c9d1715a23014b8e34639bb9aab216aedcd5b01527d4","observation_id":"d205a4f5-a360-4e4e-849e-2ca0cc48dffb","resolution":{"observed_at":"2026-08-06T05:46:32.095867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.107947Z","title":"The many faces of robustness: A critical analysis of out-of-distribution generalization","venue":null,"work_id":"8e53728b-eddb-4565-9370-62630a93b72c","year":2021},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.099034Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:3f6adeb76066a2b7e9f1005c2e2907ca5888603db4a1bca8dfc0c565ffa3242f","observation_id":"7c852298-20b0-4719-9da0-a8929e3d6cb9","resolution":{"observed_at":"2026-08-06T05:46:33.111877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.097453Z","title":"The many faces of robustness: A critical analysis of out-of-distribution generalization","venue":null,"work_id":"bde7f049-500f-4aa2-adf6-e3dcec4530a4","year":2021},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.102913Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:c5e95d96d65f8a37f7d8663745e82581038b07979be631c721776e720d6764aa","observation_id":"42e7a5a5-3cd9-4eaa-a600-d7a15c346c90","resolution":{"observed_at":"2026-08-06T05:46:33.100971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.086448Z","title":"Natural adversarial examples","venue":null,"work_id":"5a82d4db-2fd7-4c4e-b6c5-0a1f1e36ead4","year":2021},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.106480Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:1b5534e1bb4335cb2616d1cdd1b51935eb87886add503956737c658e028e297d","observation_id":"5f651cf4-eae6-481a-9059-9dde9d55db7e","resolution":{"observed_at":"2026-08-06T05:46:33.090129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.075601Z","title":"Scaling up vision-language pretraining for image captioning","venue":null,"work_id":"045bef92-9f87-4fac-a77d-f22c93b517e2","year":2021},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.109828Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:9e8708ab9d14cdbc9642c84be508cb691bda023d693fc25b037a1c8f68d75c0f","observation_id":"ee90338e-8766-4242-8cd5-09fdd567e526","resolution":{"observed_at":"2026-08-06T05:46:33.079406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20704","last_updated":"2025-06-04T07:00:00Z","snapshot_observed_at":"2026-08-09T13:17:07.821378Z","submitted_at":"2025-05-27T04:30:13Z","title":"Beyond Entropy: Region Confidence Proxy for Wild Test-Time Adaptation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20704","snapshot_observed_at":"2026-08-06T05:46:32.113176Z","title":"Beyond entropy: Region confidence proxy for wild test-time adaptation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.113176Z"},"links":{"cited_paper":"/paper/2505.20704","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:dcd47a3e005b51b6fb30ee6c90bbc13efb61b09c0b3c864e581c8d38b61656b4","observation_id":"1bd1bb0b-0a77-43ab-8a9d-64ebe19dd355","resolution":{"observed_at":"2026-08-06T05:46:32.113176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.065007Z","title":"Le, Yun-Hsuan Sung, Zhen Li, and Tom Duerig","venue":null,"work_id":"2d633710-5ae1-4693-8b4f-9001e7d41ada","year":2021},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.116718Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:a2906caf4a0ab268e9355701c39716e3dc2ddf8483f9f92aefcc82dd7713d60f","observation_id":"972a4e97-c828-4b55-b5a4-852cdfe9c36d","resolution":{"observed_at":"2026-08-06T05:46:33.068649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.052901Z","title":"Few-shot object detection via feature reweighting","venue":null,"work_id":"432990a4-ca25-4684-ba10-fc166a089a7b","year":2019},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.120050Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:1b73fa9110e19fc9ab986aa65f5a25b72e6fb1bb89af6bc0b6484590e4733526","observation_id":"fc3981a1-b591-4c82-b8ad-d957ab3a60f6","resolution":{"observed_at":"2026-08-06T05:46:33.057080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.040310Z","title":null,"venue":null,"work_id":"8936f681-d0fe-4908-b084-172ecef1ac58","year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.123577Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:388533e7f2712a1db1e66c5b23ec603aa0f76750e6e21b4dbc061146dac89813","observation_id":"f81cc1d5-840e-4e42-9ae7-8dc52c57ad9e","resolution":{"observed_at":"2026-08-06T05:46:33.045144Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.028150Z","title":"Khan, and Fahad Shahbaz Khan","venue":null,"work_id":"34884e7a-8555-417c-a1d2-5c76a7c3d4f5","year":2022},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.126802Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:26e60583c93b56eed856634ece974350708e770226407c03c6ebfc7f81d2c153","observation_id":"d570e990-6172-4265-8bc1-f5b2d760af1f","resolution":{"observed_at":"2026-08-06T05:46:33.032991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.016539Z","title":"3d object representations for fine-grained categorization","venue":null,"work_id":"c53fe6e1-93b9-4394-851a-30e58f9179c6","year":2013},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.130108Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:565077035cfdac7917b0b97a3635199b474c78c95007c4614d42511bf9807ff2","observation_id":"1e5636c7-2b2b-47bf-9ca9-45cfbf01fead","resolution":{"observed_at":"2026-08-06T05:46:33.020407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07366","last_updated":"2024-03-12T07:01:57Z","snapshot_observed_at":"2026-08-13T00:57:00.627680Z","submitted_at":"2024-03-12T07:01:57Z","title":"Entropy is not Enough for Test-Time Adaptation: From the Perspective of Disentangled Factors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07366","snapshot_observed_at":"2026-08-06T05:46:32.133314Z","title":"Entropy is not enough for test-time adaptation: From the perspective of disentangled factors","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.133314Z"},"links":{"cited_paper":"/paper/2403.07366","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:e6929ca62c477f57069a2385a53b1e77eadbb7aeccc8b286f6987127077ea6fc","observation_id":"db01d278-53a4-4d29-9081-c45288167cf8","resolution":{"observed_at":"2026-08-06T05:46:32.133314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.003592Z","title":"Dpu: Dynamic prototype updating for multimodal out-of-distribution detection","venue":null,"work_id":"571d29b7-ceaf-42d2-ad17-be0a36b50c64","year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.136743Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:4c8295912a1c08057a4a3dd882d3423075b46b33bdad972740783dae99930f4e","observation_id":"a73be666-3a5c-4e11-b876-e58aca289840","resolution":{"observed_at":"2026-08-06T05:46:33.008117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.992044Z","title":"Promptkd: Unsupervised prompt distillation for vision-language models","venue":null,"work_id":"eb029782-6060-4c70-bc70-e9b8f2e466a6","year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.140026Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:3553c892939dca8d29ac31ddec16736153c86fa5e902223cf884e024a74b7d52","observation_id":"01da3fdc-46e5-47cd-aa05-6007a774c55b","resolution":{"observed_at":"2026-08-06T05:46:32.995892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.143276Z","title":"A comprehensive survey on test-time adaptation under distribution shifts","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.143276Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:973a4f725c87438b04bc4fa5fe755818fb306d6fe09aa985cc4bfa5f49f0c63f","observation_id":"e87baa48-4fc8-4b49-aaa9-60a79a4c1e0d","resolution":{"observed_at":"2026-08-06T05:46:32.143276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.09500","last_updated":"2025-08-13T04:24:56Z","snapshot_observed_at":"2026-08-10T21:30:38.986327Z","submitted_at":"2025-07-13T05:37:33Z","title":"Advancing Reliable Test-Time Adaptation of Vision-Language Models under Visual Variations","version":2},"cited_work":{"arxiv_id":"2507.09500","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.09500","snapshot_observed_at":"2026-08-06T05:46:32.667366Z","title":"Advancing Reliable Test-Time Adaptation of Vision-Language Models under Visual Variations","venue":"cs.CV","work_id":"5f9d4bea-3dcc-4b3b-b9e7-ecff9294455d","year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.146449Z"},"links":{"cited_paper":"/paper/2507.09500","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:784a599c4ff0410ce1d9b849d97792fbec26b04ee82baf1b86f4a1861906022d","observation_id":"88584197-5741-413d-aa0a-50e475c004b9","resolution":{"observed_at":"2026-08-06T05:46:32.671342Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.22979","last_updated":"2025-06-28T18:36:22Z","snapshot_observed_at":"2026-08-10T11:23:16.471226Z","submitted_at":"2025-06-28T18:36:22Z","title":"Probabilistic Prototype Calibration of Vision-Language Models for Generalized Few-shot Semantic Segmentation","version":1},"cited_work":{"arxiv_id":"2506.22979","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.22979","snapshot_observed_at":"2026-08-06T05:46:32.650439Z","title":"Probabilistic Prototype Calibration of Vision-Language Models for Generalized Few-shot Semantic Segmentation","venue":"cs.CV","work_id":"fc5599be-0941-4569-a2c9-380e37345988","year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.150239Z"},"links":{"cited_paper":"/paper/2506.22979","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:2b4bffb743f5e54d9aa5aedb195c576659fabbc38346450c1c734b2d42f093b4","observation_id":"91bf670f-bce6-4652-90e3-20f31677b143","resolution":{"observed_at":"2026-08-06T05:46:32.655258Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02653","last_updated":"2024-02-05T00:52:50Z","snapshot_observed_at":"2026-08-13T04:27:10.499651Z","submitted_at":"2024-02-05T00:52:50Z","title":"Learning with Mixture of Prototypes for Out-of-Distribution Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02653","snapshot_observed_at":"2026-08-06T05:46:32.154250Z","title":"Learning with mixture of prototypes for out-of-distribution detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.154250Z"},"links":{"cited_paper":"/paper/2402.02653","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:071f2d581c2d7cb30e9908d0bdf7876e024eb8e7d238fd4a85a9f480eb52429b","observation_id":"c50a8507-60ab-4467-9c1a-c37e3e0e409d","resolution":{"observed_at":"2026-08-06T05:46:32.154250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1306.5151","last_updated":"2013-06-21T14:31:57Z","snapshot_observed_at":"2026-08-12T17:35:23.022229Z","submitted_at":"2013-06-21T14:31:57Z","title":"Fine-Grained Visual Classification of Aircraft","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1306.5151","snapshot_observed_at":"2026-08-06T05:46:32.158008Z","title":"Fine-grained visual classification of aircraft","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.158008Z"},"links":{"cited_paper":"/paper/1306.5151","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:440153f421dcd4b545662d5bd20305358722387f874c07ada2f873649dd85787","observation_id":"0b2848de-7893-4628-bbe9-fdbfa6f0dd57","resolution":{"observed_at":"2026-08-06T05:46:32.158008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.972553Z","title":"Black-box test-time prompt tuning for vision-language models","venue":null,"work_id":"593771f9-e40e-4765-93e3-b34ddee0bc54","year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.161403Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:077d3d1a404a2fb6f51a5a0def52f9ad2fb934f6b3251a7199039141a9eb088b","observation_id":"7bfdaf00-342f-443a-a8e6-a11e893615f8","resolution":{"observed_at":"2026-08-06T05:46:32.976421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04873","last_updated":"2024-05-21T06:56:53Z","snapshot_observed_at":"2026-08-13T13:24:41.618262Z","submitted_at":"2022-12-09T14:24:39Z","title":"Multimodal Prototype-Enhanced Network for Few-Shot Action Recognition","version":3},"cited_work":{"arxiv_id":"2212.04873","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.04873","snapshot_observed_at":"2026-08-06T05:46:32.616361Z","title":"Multimodal Prototype-Enhanced Network for Few-Shot Action Recognition","venue":"cs.CV","work_id":"e4394547-d3ac-4555-bdaa-528c2854aba7","year":2022},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.164631Z"},"links":{"cited_paper":"/paper/2212.04873","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:0a037cbe6792a711f57834157c6fcad77109bd1cea5c5f2ba51654175cc3e786","observation_id":"58d65caa-332d-4c28-bca1-0a8e44095b76","resolution":{"observed_at":"2026-08-06T05:46:32.620822Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.959397Z","title":"Automated flower classification over a large number of classes","venue":null,"work_id":"5bff29e9-60b8-4bdd-bbd2-5ffd331465b5","year":2008},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.168305Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:48a83423ebdbd6ff9ea6c5a24bf171eda34e80565c61c74bdcc31f0b5b396a0b","observation_id":"de3ba7b2-cbe4-4597-8d9c-c62f858d147a","resolution":{"observed_at":"2026-08-06T05:46:32.963791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.947460Z","title":"Proto-clip: Vision-language prototypical network for few-shot learning","venue":null,"work_id":"86887369-7dbe-46fc-9fce-6e7b3a8958e8","year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.171643Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:544dbc9bc30bc771f3eeb3928caf004039d58bfb83380aa0b3a6f097f5d10e18","observation_id":"c7e654dd-b5d0-490b-89e7-acde16f98099","resolution":{"observed_at":"2026-08-06T05:46:32.951326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.934167Z","title":null,"venue":null,"work_id":"a2e82316-0c2b-45f3-aa13-3daad7d309e0","year":2012},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.175224Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:bc38a0cf71cbd2b251fe60c48ae558fecd6cc5d50727b5968c31263e82092b22","observation_id":"56f086f9-ded6-49ea-b766-2b3e75cc63b9","resolution":{"observed_at":"2026-08-06T05:46:32.938577Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.922425Z","title":"What does a platypus look like? generating customized prompts for zero-shot image classification","venue":null,"work_id":"2e70bb18-4255-4f38-8306-356a48ed1081","year":2023},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.178980Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:11eaf3634c81a1ad7fdd0e7d5c328016d173cfa5571d03dc4ace014ee190a645","observation_id":"61175348-1f8d-440e-aa2c-36f87f9c839a","resolution":{"observed_at":"2026-08-06T05:46:32.926291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09394","last_updated":"2025-07-12T06:36:58Z","snapshot_observed_at":"2026-08-07T17:10:02.509069Z","submitted_at":"2025-03-12T13:40:33Z","title":"Bidirectional Prototype-Reward co-Evolution for Test-Time Adaptation of Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09394","snapshot_observed_at":"2026-08-06T05:46:32.182173Z","title":"Bidirectional prototype-reward co-evolution for test-time adaptation of vision-language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.182173Z"},"links":{"cited_paper":"/paper/2503.09394","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:2cdee8043bef181fb73f2ceb39638da0e5166f336ab125abab2415ad797064ae","observation_id":"0e9e456c-e9fd-4324-94ed-6d51846499e1","resolution":{"observed_at":"2026-08-06T05:46:32.182173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06501","last_updated":"2025-02-22T14:28:05Z","snapshot_observed_at":"2026-08-13T12:37:55.118073Z","submitted_at":"2025-02-10T14:20:01Z","title":"Learning Clustering-based Prototypes for Compositional Zero-shot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06501","snapshot_observed_at":"2026-08-06T05:46:32.185679Z","title":"Learning clustering-based prototypes for compositional zero-shot learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.185679Z"},"links":{"cited_paper":"/paper/2502.06501","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:4fbeba192de2eed9260f5afa88c844f1add44c004e7fcad2a65703ddeb34197d","observation_id":"66588149-311d-4d5d-825d-9fa5da80cc49","resolution":{"observed_at":"2026-08-06T05:46:32.185679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.189180Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.189180Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:94617b815b61e9f2d8f8f894e97f58900b95dc8a84f9daff0703712822cc75f6","observation_id":"4785b463-208e-453b-bd24-3f402cea8be6","resolution":{"observed_at":"2026-08-06T05:46:32.189180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.904654Z","title":"icarl: Incremental classifier and representation learning","venue":null,"work_id":"cb7f2efa-d039-42f1-b2b5-ad89c5925dbf","year":2001},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.192756Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:fe18904e3f5fc94521d6b2aa62e26d8c96ebb9430e4938522e0b5a2c7e45df05","observation_id":"224e49ab-1099-47d7-9c46-2028e90c7e5c","resolution":{"observed_at":"2026-08-06T05:46:32.908706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.196258Z","title":"Do imagenet classifiers generalize to imagenet? In International Conference on Machine Learning, pages 5389--5400","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.196258Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:4cf6e3fef5b833d88780f016c755a3e50a40b862ea0e86d7044387e4cd2d8662","observation_id":"acc90942-eb06-4705-a745-c3e1932264cb","resolution":{"observed_at":"2026-08-06T05:46:32.196258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.887212Z","title":"One-shot learning for semantic segmentation","venue":null,"work_id":"8e59cebf-c310-47bf-9799-66356c05e1ad","year":2017},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.199548Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:aa1fc3a66f5ae68772deefa5807248fc630bba07928755d85e86e04d8c574c41","observation_id":"72b00809-23ae-426f-86c5-6cb5d0cc834c","resolution":{"observed_at":"2026-08-06T05:46:32.891260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11195","last_updated":"2025-08-27T08:19:03Z","snapshot_observed_at":"2026-08-07T16:05:31.087198Z","submitted_at":"2025-04-15T13:49:31Z","title":"R-TPT: Improving Adversarial Robustness of Vision-Language Models through Test-Time Prompt Tuning","version":2},"cited_work":{"arxiv_id":"2504.11195","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.11195","snapshot_observed_at":"2026-08-06T05:46:32.583290Z","title":"R-TPT: Improving Adversarial Robustness of Vision-Language Models through Test-Time Prompt Tuning","venue":"cs.LG","work_id":"efc5b1e8-5ef4-4c44-9cd3-6f289c2d0438","year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.202937Z"},"links":{"cited_paper":"/paper/2504.11195","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:ceb22847dddb749db65d6043750df0d8c6b8eb95975f7946a78659473889a7b8","observation_id":"f77af7e5-c6d6-4491-9681-3970f6e80fd8","resolution":{"observed_at":"2026-08-06T05:46:32.587279Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07511","last_updated":"2022-09-15T17:55:11Z","snapshot_observed_at":"2026-08-13T14:25:34.375916Z","submitted_at":"2022-09-15T17:55:11Z","title":"Test-Time Prompt Tuning for Zero-Shot Generalization in Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.07511","snapshot_observed_at":"2026-08-06T05:46:32.206746Z","title":"Test-time prompt tuning for zero-shot generalization in vision-language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.206746Z"},"links":{"cited_paper":"/paper/2209.07511","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:f5289fd463ff77ceafe07608ab61352fb26b3441944d7a4a727c6065fa81cb0a","observation_id":"c337bbc0-ab82-472c-bbb6-150a4f7e10cc","resolution":{"observed_at":"2026-08-06T05:46:32.206746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.210504Z","title":"Prototypical networks for few-shot learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.210504Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:73db9505795b496dd71681ddb5d01c8ddadedc6c0920dd983e3e2342b4c8af61","observation_id":"02b8bee4-8950-40a3-8858-7daefeed4b01","resolution":{"observed_at":"2026-08-06T05:46:32.210504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-08-12T17:34:19.526460Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-06T05:46:32.213839Z","title":"Ucf101: A dataset of 101 human actions classes from videos in the wild","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.213839Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:b82ed727b3d8c983650c2480f2fe39cfc89feeb743a4da13cbda270d83e69765","observation_id":"acff71a3-a5cc-484b-ab44-8cb8b71c8291","resolution":{"observed_at":"2026-08-06T05:46:32.213839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12952","last_updated":"2024-12-10T22:53:16Z","snapshot_observed_at":"2026-08-13T00:50:06.939278Z","submitted_at":"2024-03-19T17:54:34Z","title":"Just Shift It: Test-Time Prototype Shifting for Zero-Shot Generalization with Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12952","snapshot_observed_at":"2026-08-06T05:46:32.217329Z","title":"Just shift it: Test-time prototype shifting for zero-shot generalization with vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.217329Z"},"links":{"cited_paper":"/paper/2403.12952","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:c13924609a091a92121871f30de30a0dd408aa65b4482cdf807ecaa23f390ef2","observation_id":"f3664812-3d43-40f2-9c1e-56d4c43e1564","resolution":{"observed_at":"2026-08-06T05:46:32.217329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.870239Z","title":"Point-cache: Test-time dynamic and hierarchical cache for robust and generalizable point cloud analysis","venue":null,"work_id":"32ffb13d-5977-4819-86b2-658bc3802ac4","year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.220924Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:c937c606fc75fb719e4a27086453db2acf158ca75a82c0dc148704328794e98d","observation_id":"3a5340b9-baa0-4289-b4f5-f2553fc77b52","resolution":{"observed_at":"2026-08-06T05:46:32.873885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-06T05:46:32.224600Z","title":"Representation learning with contrastive predictive coding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.224600Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:fc32168fa825b275fb61bb4afa78a8757518d7f607f058b8a55ccd46d378662e","observation_id":"383491c4-63a9-45e9-a613-ac783eb42e71","resolution":{"observed_at":"2026-08-06T05:46:32.224600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.228454Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.228454Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:8440b9c34aca9f683d5d59a19e62e6ff890e7e6637ad8e32345a63c97fb80d59","observation_id":"7fdaf66f-156e-4354-ba60-1975456d3cda","resolution":{"observed_at":"2026-08-06T05:46:32.228454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.10726","last_updated":"2021-03-18T17:58:01Z","snapshot_observed_at":"2026-07-06T09:30:32.320227Z","submitted_at":"2020-06-18T17:55:28Z","title":"Tent: Fully Test-time Adaptation by Entropy Minimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.10726","snapshot_observed_at":"2026-08-06T05:46:32.231846Z","title":"Olshausen, and Trevor Darrell","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.231846Z"},"links":{"cited_paper":"/paper/2006.10726","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:3e56f5b6f41002398a7f448623abf2c91020a926b3f1e05d22e26b053f03afe1","observation_id":"7344bde5-5f6b-42a4-913d-643b61da47ea","resolution":{"observed_at":"2026-08-06T05:46:32.231846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.853096Z","title":"Ctpt: Continual test-time prompt tuning for vision-language models","venue":null,"work_id":"7b68ae45-19aa-4bd5-a80b-54228389c6d5","year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.235775Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:0ba724b3073e4ffd24105441ab67b5ac1d9fea4a6f2187ed7f04cfb74ae6e9b9","observation_id":"420c4bcf-f715-4271-8d13-80c026219202","resolution":{"observed_at":"2026-08-06T05:46:32.856721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.842670Z","title":"Learning robust global representations by penalizing local predictive power","venue":null,"work_id":"c6d3db88-e9a4-45a1-9bee-7e5baeea3904","year":2019},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.238912Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:ac38ba311b782a1160bb0c155e68edbfd9220494b2c3cf91a98b042faa7c878d","observation_id":"a2e2df17-b518-44b6-bbca-9d074f72435b","resolution":{"observed_at":"2026-08-06T05:46:32.846364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.831102Z","title":"Learning robust global representations by penalizing local predictive power","venue":null,"work_id":"e989cf63-1a2e-48b9-b1c5-7258b487cdfb","year":2019},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.241931Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:7b584c8e1306bdd363f90ab7bfb770dd64fd7c2f940d65ed7718591990b9119d","observation_id":"3d0551a4-b3af-4f88-bade-5f0982d0cc01","resolution":{"observed_at":"2026-08-06T05:46:32.834957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.819605Z","title":"Deep visual domain adaptation: A survey","venue":null,"work_id":"dbf4e79b-cbb5-453e-8817-d0394ad73fde","year":2018},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.246085Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:2cd9eed2550368c543c4c08a325a5b50fe44a7af26e4426ac1e0038684d0535b","observation_id":"deabfa66-e0d5-4191-8073-daa2994e692f","resolution":{"observed_at":"2026-08-06T05:46:32.823289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.809348Z","title":"Sun database: Large-scale scene recognition from abbey to zoo","venue":null,"work_id":"faef85e6-7bac-4b58-a284-a768a62f8979","year":2010},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.249312Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:21bd626686d66761f01f8a58bd4bd52d4e7b598581109b34ca7340c5c3eeac4b","observation_id":"0e0582cc-44ca-4bb7-9c89-25ea18ee59fe","resolution":{"observed_at":"2026-08-06T05:46:32.813065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.799224Z","title":"Tran, Yi Xu, Sampath Chanda, Liqun Chen, Belinda Zeng, Trishul M","venue":null,"work_id":"4ca3a076-7247-46ab-81e3-4c11a2aa86d6","year":2022},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.252615Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:f4f1b47f98d4f27dbbe60f96bcd79f0154295436f886da1bea124af779bd4bff","observation_id":"88c75fb7-aa2c-44b4-a8ad-acfb19c41064","resolution":{"observed_at":"2026-08-06T05:46:32.802710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14119","last_updated":"2024-03-31T13:36:54Z","snapshot_observed_at":"2026-08-13T00:48:59.523832Z","submitted_at":"2024-03-21T04:08:29Z","title":"C-TPT: Calibrated Test-Time Prompt Tuning for Vision-Language Models via Text Feature Dispersion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14119","snapshot_observed_at":"2026-08-06T05:46:32.255963Z","title":"Hasegawa-Johnson, Yingzhen Li, and Chang Dong Yoo","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.255963Z"},"links":{"cited_paper":"/paper/2403.14119","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:1d647bdd778a465bc23d496da7a0b55bc58eb196e528a91417cca7774b40b4ec","observation_id":"2e942e99-aea2-4464-acd8-0b8b17909cda","resolution":{"observed_at":"2026-08-06T05:46:32.255963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.789038Z","title":"Task residual for tuning vision-language models","venue":null,"work_id":"2b827b6d-3bc4-444f-b74b-7a27f368651c","year":2022},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.259371Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:349c1f655c5505600e2d3b685965c4ddd44e3419e3782c6b88adb48c9c6c58ea","observation_id":"e73fe529-c715-4313-8dbe-0bfc05aaf2b6","resolution":{"observed_at":"2026-08-06T05:46:32.792595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18334","last_updated":"2025-03-31T10:28:04Z","snapshot_observed_at":"2026-08-12T07:45:49.130513Z","submitted_at":"2025-03-24T04:32:35Z","title":"Mitigating Cache Noise in Test-Time Adaptation for Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18334","snapshot_observed_at":"2026-08-06T05:46:32.263088Z","title":"Mitigating cache noise in test-time adaptation for large vision-language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.263088Z"},"links":{"cited_paper":"/paper/2503.18334","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:71ceaca927303ab4fe5ab7402a3e4b21adde152567a5ac06a5f425a84849e55f","observation_id":"285c82f3-6c22-40a1-b36c-d48b5968d4f4","resolution":{"observed_at":"2026-08-06T05:46:32.263088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12790","last_updated":"2024-10-16T17:59:49Z","snapshot_observed_at":"2026-08-12T22:21:38.261661Z","submitted_at":"2024-10-16T17:59:49Z","title":"Dual Prototype Evolving for Test-Time Generalization of Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12790","snapshot_observed_at":"2026-08-06T05:46:32.266544Z","title":"Sycara, and Yaqi Xie","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.266544Z"},"links":{"cited_paper":"/paper/2410.12790","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:4a287dc2b8b73e53151929fb2fdca8d3123ef50d03d14d65cf4e44638ab4d2c7","observation_id":"9d92611c-1bf8-4107-b1bb-98df5eea49e2","resolution":{"observed_at":"2026-08-06T05:46:32.266544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.778203Z","title":"Sycara, and Yaqi Xie","venue":null,"work_id":"d60b663b-8bb4-488e-aaf1-ebf8d3b8a61b","year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.270126Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:610a18b3ddb484da0e3d1fa70e5181ed8ed44679684f7c9f32cd8093128fe3e6","observation_id":"249b91bb-5a81-4cbb-9414-87639e981cda","resolution":{"observed_at":"2026-08-06T05:46:32.781843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20346","last_updated":"2024-10-27T06:03:15Z","snapshot_observed_at":"2026-08-12T22:14:30.064755Z","submitted_at":"2024-10-27T06:03:15Z","title":"Historical Test-time Prompt Tuning for Vision Foundation Models","version":1},"cited_work":{"arxiv_id":"2410.20346","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.20346","snapshot_observed_at":"2026-08-06T05:46:32.493258Z","title":"Historical Test-time Prompt Tuning for Vision Foundation Models","venue":"cs.CV","work_id":"3718011a-010c-497b-b618-bbb3db415dcc","year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.273370Z"},"links":{"cited_paper":"/paper/2410.20346","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:9df2efbeb20697aa9243c14f31100508f5329415b6a15c111fb46d9756045122","observation_id":"e4ecd247-fc3b-4448-b74c-de491c795126","resolution":{"observed_at":"2026-08-06T05:46:32.497166Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.767421Z","title":"Memo: Test time robustness via adaptation and augmentation","venue":null,"work_id":"8dd86efd-007d-43dc-bc45-54483d515133","year":2022},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.276720Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:98c248f031d08169664100413717db8fb444c9f8884b6ec063734f9a76cb036e","observation_id":"051cb293-f5c9-4113-996b-adb1f26203b6","resolution":{"observed_at":"2026-08-06T05:46:32.771202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.03930","last_updated":"2021-11-15T04:58:28Z","snapshot_observed_at":"2026-08-13T17:38:33.524743Z","submitted_at":"2021-11-06T18:09:22Z","title":"Tip-Adapter: Training-free CLIP-Adapter for Better Vision-Language Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.03930","snapshot_observed_at":"2026-08-06T05:46:32.280080Z","title":"Tip-adapter: Training-free clip-adapter for better vision-language modeling","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.280080Z"},"links":{"cited_paper":"/paper/2111.03930","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:442c01524299a1f5be0dd190b795ebfe26e3562a81af9b3fd8d1acd014c40337","observation_id":"efb6f400-10fc-494c-b126-5f0cd2893000","resolution":{"observed_at":"2026-08-06T05:46:32.280080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15430","last_updated":"2024-10-24T06:41:48Z","snapshot_observed_at":"2026-08-12T22:19:10.652409Z","submitted_at":"2024-10-20T15:58:43Z","title":"BoostAdapter: Improving Vision-Language Test-Time Adaptation via Regional Bootstrapping","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15430","snapshot_observed_at":"2026-08-06T05:46:32.283611Z","title":"Boostadapter: Improving vision-language test-time adaptation via regional bootstrapping","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.283611Z"},"links":{"cited_paper":"/paper/2410.15430","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:693a6d0f634cf6c9c3936192b83e73fb5783884db9bf3bfd50c3ba627171db55","observation_id":"7cd8a72c-bf13-48f5-8d48-eeafe56e47c6","resolution":{"observed_at":"2026-08-06T05:46:32.283611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.757153Z","title":"Adanpc: Exploring non-parametric classifier for test-time adaptation","venue":null,"work_id":"a3b54a3c-ed09-4b6e-8346-5766f46c9297","year":2023},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.287183Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:5be8a778780c54767fb97b412a3a0d3bc57fd7a6682c5f18c9fb3dfc00ccc997","observation_id":"776f35a1-d2e5-4067-8fd9-b138478a1493","resolution":{"observed_at":"2026-08-06T05:46:32.760741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.746088Z","title":"Unsupervised prototype adapter for vision-language models","venue":null,"work_id":"8cd81d89-e13b-419b-a43d-423c341d3ad3","year":2023},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.290610Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:b2fddfb17661d386884797a3f95c5aca9d888a6234d095e0667ba960ab8b395e","observation_id":"f369c21d-ebff-4299-bbc4-095754b7000b","resolution":{"observed_at":"2026-08-06T05:46:32.749855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08672","last_updated":"2024-07-11T17:04:19Z","snapshot_observed_at":"2026-08-12T23:24:02.367179Z","submitted_at":"2024-07-11T17:04:19Z","title":"NODE-Adapter: Neural Ordinary Differential Equations for Better Vision-Language Reasoning","version":1},"cited_work":{"arxiv_id":"2407.08672","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.08672","snapshot_observed_at":"2026-08-06T05:46:32.458413Z","title":"NODE-Adapter: Neural Ordinary Differential Equations for Better Vision-Language Reasoning","venue":"cs.CV","work_id":"06b31855-8ee2-49a9-bdb7-e52f41991db7","year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.293793Z"},"links":{"cited_paper":"/paper/2407.08672","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:4eece40dae4d14e5119b43f4cba5a73b6b9dd200455b6006cadddbf05ef72330","observation_id":"94302da5-d0f0-4006-af71-219a272a9bf8","resolution":{"observed_at":"2026-08-06T05:46:32.464127Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.07457","last_updated":"2024-01-15T04:04:47Z","snapshot_observed_at":"2026-08-13T18:39:35.533241Z","submitted_at":"2024-01-15T04:04:47Z","title":"Concept-Guided Prompt Learning for Generalization in Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2401.07457","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.07457","snapshot_observed_at":"2026-08-06T05:46:32.443883Z","title":"Concept-Guided Prompt Learning for Generalization in Vision-Language Models","venue":"cs.CV","work_id":"0290c4a8-7e97-4561-bb79-bffef2ca72fe","year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.297597Z"},"links":{"cited_paper":"/paper/2401.07457","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:b27dd26d8ad59c4e18afe3b38e5bb0c09a7b345f4f92cf8cf8b0d2a357df61ac","observation_id":"8a19fa93-33ae-410f-a338-95dc0eda8537","resolution":{"observed_at":"2026-08-06T05:46:32.447942Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.735281Z","title":"Dual memory networks: A versatile adaptation approach for vision-language models","venue":null,"work_id":"f3ba9c8b-35bb-495b-ac9f-0b134b3e2488","year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.301222Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:6b075e6f7908fd211513c9e7f78c159a5e823af056a07724827c8e29a7157259","observation_id":"82874f72-6417-4d81-905d-0d47a6077739","resolution":{"observed_at":"2026-08-06T05:46:32.738951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.723952Z","title":"Learning to prompt for vision-language models","venue":null,"work_id":"11943f39-2be7-4ba3-94a6-b7bd8b0cdea8","year":2021},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.304470Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:fea375d889fbff4dcd624cade1fe4cf169d1631ae85ab098e86b25e89a58d596","observation_id":"16c9008d-5f1a-42dc-af68-f0f4afeee43b","resolution":{"observed_at":"2026-08-06T05:46:32.727784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.03657","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.424166Z","title":"Dynamic multimodal prototype learning in vision-language models","venue":null,"work_id":"0fecdced-41e8-48ec-9438-5c581515e2e7","year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.307689Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:59997e51eb55827850ae52d02e46946e9e829c90d7ff281526d2231a74335b24","observation_id":"c94552b9-ea8d-44ab-944a-f929cb16010e","resolution":{"observed_at":"2026-08-06T05:46:32.432652Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05775","last_updated":"2024-08-11T13:55:58Z","snapshot_observed_at":"2026-08-12T23:05:21.391640Z","submitted_at":"2024-08-11T13:55:58Z","title":"Efficient Test-Time Prompt Tuning for Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05775","snapshot_observed_at":"2026-08-06T05:46:32.312024Z","title":"Efficient test-time prompt tuning for vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.312024Z"},"links":{"cited_paper":"/paper/2408.05775","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:d4081e51fc32ef474f3857d8c24b27cccd82dc391675a7a61a30598f25ce8a94","observation_id":"4aaabf6c-4248-4f81-8be1-6f8ea632a24b","resolution":{"observed_at":"2026-08-06T05:46:32.312024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models"},"reference_resolution":{"displayed":81,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":9,"verified_fuzzy":43},"total_outbound_references":81},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 81 of 81 outbound references and 0 inbound Pith citation observations for arXiv:2508.01225."}