{"as_of":"2026-08-13T17:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:96fe4ed5d70dcbe45a3a82d0b318695cb7c5520e06fe2388f06c090b0c030469","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T13:43:17.255931Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.16018/citation-record","integrity":"/paper/2411.16018/integrity","json":"/paper/2411.16018/citation-record.json","paper":"/paper/2411.16018"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.954566Z","title":"Stylip: Multi-scale style- conditioned prompt learning for clip-based domain gener- alization","venue":null,"work_id":"0e5cc21f-badf-4e22-a6d8-e2489b699c1f","year":null},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.029906Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:f2899c3456e364d52be472705de7725e2ed5fe349b47b3a299dcea4031a157f1","observation_id":"c3ca9e72-72ac-4875-a12f-331ac6d95284","resolution":{"observed_at":"2026-08-12T13:43:17.959412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.940112Z","title":"Food-101–mining discriminative components with random forests","venue":null,"work_id":"0be11871-2ba9-42fe-856a-1a1ee76bb5c2","year":2014},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.035189Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:b9dbd1c6fea34b607a8b8c490be6d954855e58c0c2e7a7f3dc126e86a52c8cad","observation_id":"fd82672e-ccf4-43fe-b69c-90c64bfdad9e","resolution":{"observed_at":"2026-08-12T13:43:17.944728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.925941Z","title":"LASP: Text-to- text optimization for language-aware soft prompting of vi- sion & language models","venue":null,"work_id":"b6f49379-8b82-441f-aac2-fac04a587590","year":2023},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.040045Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:20103b46449d05534e7c588b0572ef8afb056253dd23a6d165e27f47a7359077","observation_id":"51ff15e1-ac32-4a44-b269-452f71b17b76","resolution":{"observed_at":"2026-08-12T13:43:17.930524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.01253","last_updated":"2023-02-09T23:26:37Z","snapshot_observed_at":"2026-08-13T14:13:47.401443Z","submitted_at":"2022-10-03T22:21:07Z","title":"PLOT: Prompt Learning with Optimal Transport for Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.01253","snapshot_observed_at":"2026-08-12T13:43:17.045176Z","title":"PLOT: Prompt learning with optimal transport for vision-language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.045176Z"},"links":{"cited_paper":"/paper/2210.01253","citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:e24f20821b514a5b7dfd4eadabb280a7d858c6fb9f655b758ec2c2d569524bc2","observation_id":"7a8d533c-9ec1-4fc1-ad0f-02587bfbd8c4","resolution":{"observed_at":"2026-08-12T13:43:17.045176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.911219Z","title":"TokenMixup: Efficient attention-guided token-level data augmentation for transformers","venue":null,"work_id":"1573cd3b-d7cf-4d9d-ac84-1df298e7d873","year":2022},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.050206Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:fdf1d58eba840f0597e11e9703e4b1431387d95688a743c5586838bea176d994","observation_id":"3efc590f-1de9-4236-a803-efd263daf65f","resolution":{"observed_at":"2026-08-12T13:43:17.916082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.054542Z","title":"Describing textures in the wild","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.054542Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:89a0da2301f43afcd8c1b348d5239b412068cacbab3aa3e15bd64f6515b871c7","observation_id":"1870c37e-896f-4d09-969a-6dc9bda195b8","resolution":{"observed_at":"2026-08-12T13:43:17.054542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.888952Z","title":"RandAugment: Practical automated data augmenta- tion with a reduced search space","venue":null,"work_id":"9593a45b-6621-481a-b5c5-a2059c7b4200","year":2020},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.058792Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:925150ba3b986d87b36139fcac4c36dd380a08612c57763a6c48e2fe2a3321b3","observation_id":"cb40b0d5-8171-4c8f-b272-8731edb20110","resolution":{"observed_at":"2026-08-12T13:43:17.893660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.874912Z","title":"ImageNet: A large-scale hierarchical image database","venue":null,"work_id":"8a54ef42-77c2-4614-97df-dcb1377af7f8","year":2009},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.063277Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:84a93cc89da25d6bd7c93452f60a5941dc0ecf18ccbf487ac123b51e7a155f2e","observation_id":"89c20a9d-c461-4792-ae7f-897101ddb70c","resolution":{"observed_at":"2026-08-12T13:43:17.879614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.860339Z","title":"Bayesian prompt learn- ing for image-language model generalization","venue":null,"work_id":"9fb2d502-3a27-4b10-8b8e-c5b37e398e01","year":2023},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.068725Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:e46a0aad99178b444e4ad5d568c35112bd6c3ee1ac27dce858da89a1c3e8ec95","observation_id":"6cb34863-c9a6-4791-b571-1d395c1c7e84","resolution":{"observed_at":"2026-08-12T13:43:17.865278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.073193Z","title":"De- coupling zero-shot semantic segmentation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.073193Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:00cf946b5cfbc91a1177b11c58a6eef121ce07f10ad9493db7b5c4c11970bfdc","observation_id":"dbeff9d6-0a42-42f2-9ff6-e10f89f3f288","resolution":{"observed_at":"2026-08-12T13:43:17.073193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.835524Z","title":"Learning gener- ative visual models from few training examples: An incre- mental bayesian approach tested on 101 object categories","venue":null,"work_id":"f0cabeec-ae74-42da-8acc-840ff81707d2","year":2004},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.077918Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:6dc2e3b6b66fe40bbece81a6874587f464c9b4ddbb3bf86edad7a4b6a62afcc4","observation_id":"637af28f-0763-4930-9825-376404253760","resolution":{"observed_at":"2026-08-12T13:43:17.840574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.819444Z","title":"Prompt- Det: Towards open-vocabulary detection using uncurated images","venue":null,"work_id":"4fe69e26-e6e2-49c9-9898-cf154987eb04","year":2022},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.082410Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:296cd75a5322eb6d88c1969c25e1338425e110afddcec7be2f2cf8c470e78f7f","observation_id":"a0d50bc8-aed7-4d12-b9fe-3bba72eff8b7","resolution":{"observed_at":"2026-08-12T13:43:17.824676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.804633Z","title":"StyleAdv: Meta style adversarial training for cross-domain few-shot learning","venue":null,"work_id":"6f5234e5-22bf-4175-8e1a-4f1a762c67d2","year":2023},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.086972Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:9dfd488661915017bb177cbe583c3641bace104d6e93152f000852df13fb4fb1","observation_id":"e99bd2ba-65d9-4e89-b62c-d1c9e880227b","resolution":{"observed_at":"2026-08-12T13:43:17.809229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.790658Z","title":"CLIP-adapter: Better vision-language models with fea- ture adapters","venue":null,"work_id":"c7b951b4-5cca-42f5-9a61-0bce01be7fa5","year":2024},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.091763Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:023bdd601da93b61384ea93ab8911230dc1fd32fded51f7913e56494c0492619","observation_id":"a4318924-287e-4ccc-9da7-d2a8d6fff95e","resolution":{"observed_at":"2026-08-12T13:43:17.795197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.776453Z","title":"CLIP-S4: Language-guided self-supervised semantic seg- mentation","venue":null,"work_id":"3ff184c2-ff5f-4601-aceb-a87a7b137fe7","year":2023},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.096225Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:49fff6d38505ca2b0eaae3dbe7e8b5f479ca02eb519f5d15b6d63188fc103f31","observation_id":"02b751f5-f2f7-4f3a-9eaf-7c6ae1e348fb","resolution":{"observed_at":"2026-08-12T13:43:17.781297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.762629Z","title":"EuroSAT: A novel dataset and deep learn- ing benchmark for land use and land cover classification","venue":null,"work_id":"50a8abf9-3d26-4e32-ad5d-9b72b2059bff","year":2019},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.100731Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:6e021c461b2b173f690939353dc874fa0f4c1a87be275747361bb42554ed0492","observation_id":"ab84ac1e-a08f-4e4e-8d1a-f6de3b5a99a1","resolution":{"observed_at":"2026-08-12T13:43:17.767056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.105137Z","title":"The many faces of robust- ness: A critical analysis of out-of-distribution generalization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.105137Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:b03cb3940ff40fc73c1f2829b9c57580987a590c1b4b527a782d985de957e905","observation_id":"afb63f31-85d0-4d7f-a7d1-4e0f4ef41933","resolution":{"observed_at":"2026-08-12T13:43:17.105137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.109370Z","title":"Natural adversarial examples","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.109370Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:b898b35b3d57f2d8ef88997a42670d3d6070d5948afada8b1e072c6c8fc8f7e8","observation_id":"c7e895f4-a907-4f40-8ea1-7ccb77a3c558","resolution":{"observed_at":"2026-08-12T13:43:17.109370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.731574Z","title":"StyleMix: Sep- arating content and style for enhanced data augmentation","venue":null,"work_id":"81174aba-3ccb-41d5-a0e1-53ff7e1aaca9","year":2021},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.113689Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:cbedb644c396f9f59d8bb6eba46da03ebeefd45e14b9ac7a049f6db42401b373","observation_id":"2a2002b5-8f92-4853-9afe-eac001718b41","resolution":{"observed_at":"2026-08-12T13:43:17.736038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.717835Z","title":"Arbitrary style transfer in real-time with adaptive instance normalization","venue":null,"work_id":"83989ebb-db11-48bc-a47d-35a01a3cab21","year":2017},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.118103Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:64238adf930a10966928b3e1b6e9bbd3b4e04ebdfa57825e489485bec804b28d","observation_id":"b7b472c8-5e91-4f12-8e49-823b94a887b7","resolution":{"observed_at":"2026-08-12T13:43:17.722125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.122464Z","title":"Scaling up visual and vision-language representa- tion learning with noisy text supervision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.122464Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:c7d2fa13b50ddb9c361163ba249875cdd994775169f945f0120fbc0e1be02b66","observation_id":"cefd05dc-3dfe-4d98-8c0f-9843819bf688","resolution":{"observed_at":"2026-08-12T13:43:17.122464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.694176Z","title":"MaPLe: Multi-modal prompt learning","venue":null,"work_id":"4b0435a2-0b52-4f51-915a-03405881b838","year":2023},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.127110Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:94e20319c4127718ec2562b40d2fe8dbac3a9c0db804f7a39ae477b28b1cfbdd","observation_id":"73fc887c-2cd0-44c2-9a1e-ca0cb7e2374e","resolution":{"observed_at":"2026-08-12T13:43:17.699074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.680020Z","title":"Self-regulating prompts: Foundational model adaptation without forgetting","venue":null,"work_id":"31e84f8a-9252-43d2-a33e-24df01d44464","year":2023},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.131422Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:a3131d9f41bf65beaa8b803b971402ee5a429897403003508705f4fb8af70c82","observation_id":"32512aff-3ad6-4c9e-abdb-fb8f8ab6c0cd","resolution":{"observed_at":"2026-08-12T13:43:17.684468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.664634Z","title":"How to adapt your large-scale vision-and-language model","venue":null,"work_id":"b46bb83f-3099-40cb-839c-49313c107547","year":2021},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.135707Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:43604c93a3f2d5c06bab185a3d8bc4216b0c1d2d30345de650750a8ab2c2b05e","observation_id":"8d4dc1da-979d-4d9b-9736-531dd085eb29","resolution":{"observed_at":"2026-08-12T13:43:17.669396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.649558Z","title":"3D object representations for fine-grained categorization","venue":null,"work_id":"496e183c-988a-4470-b5a9-261c583d76ce","year":2013},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.140436Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:355ecdf592e2c90be0dd872895a0e8e12e52d817998b1bf275d0e6e42c410e76","observation_id":"c83f340d-f7d6-4d11-af8d-2be212f13440","resolution":{"observed_at":"2026-08-12T13:43:17.654574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.634417Z","title":"Cross- domain ensemble distillation for domain generalization","venue":null,"work_id":"af9b3f57-bea4-49cc-b83c-40daddc39021","year":2022},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.145878Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:a482c5c841ab1de2f276861e598a7c6d46e315b64d2ff7d0d4ff046628f12905","observation_id":"bb0b007c-de1c-4c0e-a7b9-152d3d9970f9","resolution":{"observed_at":"2026-08-12T13:43:17.639530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-12T13:43:17.151021Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.151021Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:fa3758e351898425defddd6409b0c85e8cbe0978a73137e018e2d384f2b512b7","observation_id":"16677cc3-1d28-479a-a337-38b02df588c7","resolution":{"observed_at":"2026-08-12T13:43:17.151021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.620020Z","title":"Prompt distribution learning","venue":null,"work_id":"fcf14b6e-2bca-4b1b-a859-e915521e6c2d","year":2022},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.156378Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:61b631f7436f65f791eec48b2967544d4722200c3f9868b6180f8ccd148d89e8","observation_id":"c2b3d254-1e27-4b9e-bc63-4071bf98b636","resolution":{"observed_at":"2026-08-12T13:43:17.624321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1306.5151","last_updated":"2013-06-21T14:31:57Z","snapshot_observed_at":"2026-08-12T17:35:23.022229Z","submitted_at":"2013-06-21T14:31:57Z","title":"Fine-Grained Visual Classification of Aircraft","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1306.5151","snapshot_observed_at":"2026-08-12T13:43:17.161247Z","title":"Fine-grained visual classi- fication of aircraft","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.161247Z"},"links":{"cited_paper":"/paper/1306.5151","citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:6cc583a8aff2c99fae871f3ebc75ca71a8a326768c7fb5dc6ac2954e608260ed","observation_id":"f3176a53-d0bb-4522-988b-80b680365948","resolution":{"observed_at":"2026-08-12T13:43:17.161247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.605602Z","title":"I2DFormer: Learning image to docu- ment attention for zero-shot image classification","venue":null,"work_id":"caa78a7a-3e51-4e7d-bf44-30592c5e6fa2","year":null},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.165941Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:3e7f8677c39ecb6ccde5d44ca4303f1f54880ac18611e2761d60535f77e03c3f","observation_id":"340f13ab-c3f6-48ac-8554-311d550bc91e","resolution":{"observed_at":"2026-08-12T13:43:17.610290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.170393Z","title":"Automated flower classification over a large number of classes","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.170393Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:1c577a00aab9be8f75291f79d602a9445b4f08e2cb7989f3f455ec50dbbc42be","observation_id":"e2549246-3e49-46f0-a567-d284c6e64216","resolution":{"observed_at":"2026-08-12T13:43:17.170393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.581202Z","title":"Cats and dogs","venue":null,"work_id":"7d9bcb04-5531-4154-adf8-71eed33dc5c1","year":2012},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.174943Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:83b2546fe65b3f8ce9dcb4198442c639d21288bbe1424dc3d74347b76c22f3ba","observation_id":"45bd7b0c-e5ef-4f0d-801c-d1b588bea9bd","resolution":{"observed_at":"2026-08-12T13:43:17.586386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.565275Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"a52c697b-47cb-48ec-8e7b-5984a1edfc6c","year":2021},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.179500Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:f88521a3e628c86bded0167a68ff1a595f5ccf5a2edba7f913f0c0db9178725b","observation_id":"0061fe7d-4958-4299-84ed-7048782bf1f8","resolution":{"observed_at":"2026-08-12T13:43:17.570187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.549774Z","title":"DenseCLIP: Language-guided dense prediction with context-aware prompting","venue":null,"work_id":"ca1b3469-6e11-4449-abd9-fb95a62855ea","year":2022},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.183781Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:c726bcd98f13387ef7bc96df8f84af75c06168f35940211564b76b8e54fef83f","observation_id":"be973264-c81e-4e24-9203-e1a03b0e5842","resolution":{"observed_at":"2026-08-12T13:43:17.554335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.535241Z","title":"Fine-tuned CLIP models are efficient video learners","venue":null,"work_id":"06dd8627-edd4-410d-abcf-83a3db4afe29","year":2023},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.188175Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:caf3a69a170297bfff0540b06965df028dcc91f98ec0cc8e79b974850d97761f","observation_id":"abbb866d-e1d7-40d3-adb1-4b0c9918609e","resolution":{"observed_at":"2026-08-12T13:43:17.539984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.520510Z","title":"Do ImageNet classifiers generalize to Im- ageNet? In International Conference on Machine Learning, pages 5389–5400","venue":null,"work_id":"60e18305-d892-47cc-b560-4a38cffcc7c2","year":2019},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.192526Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:f007bce75067a8c063d41356da1fdb1e8dd27fe265a1648135153c8022070d66","observation_id":"bad5c5dd-fa5c-4c5c-bfeb-77488c61b008","resolution":{"observed_at":"2026-08-12T13:43:17.525589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.01195","last_updated":"2024-08-03T18:48:43Z","snapshot_observed_at":"2026-08-13T11:26:47.468439Z","submitted_at":"2023-06-01T23:20:47Z","title":"Consistency-guided Prompt Learning for Vision-Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.01195","snapshot_observed_at":"2026-08-12T13:43:17.196914Z","title":"Consistency-guided prompt learning for vision-language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.196914Z"},"links":{"cited_paper":"/paper/2306.01195","citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:ed03a2ab75979e3346d3b26ca40380ee4084fe66c46760c4385e834b757e7562","observation_id":"10dc5289-f6bc-43a1-bd77-f95113efe67c","resolution":{"observed_at":"2026-08-12T13:43:17.196914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-08-12T17:34:19.526460Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-12T13:43:17.201302Z","title":"UCF101: A dataset of 101 human actions classes from videos in the wild","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.201302Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:51953a8d74a71c27ec99cf09b54040e254bd71da2d95dfc3e599ed1390cee54f","observation_id":"ee464c62-9fcb-4972-ad23-d4f51f2cd4bf","resolution":{"observed_at":"2026-08-12T13:43:17.201302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.506057Z","title":"Dropout: a simple way to prevent neural networks from overfitting","venue":null,"work_id":"32860cfb-1828-401f-ae14-2b24c9f96b3b","year":1929},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.205994Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:9a0762be474aa9cf4aaae3da9e0ccad40f1bcbc74f3d6bf09cb2e51c0b1b723a","observation_id":"81fa0f43-5c55-4bd1-b9e0-926c0840b46e","resolution":{"observed_at":"2026-08-12T13:43:17.510776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.210455Z","title":"Multimodal few-shot learning with frozen language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.210455Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:495ff4440962f34cab8cdeec0de94af2a83b6fbe79e9e44e989ea25c5930214d","observation_id":"07bded2c-1812-4283-9e73-3f1e23206a40","resolution":{"observed_at":"2026-08-12T13:43:17.210455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.482231Z","title":"Calculation of the Wasserstein distance be- tween probability distributions on the line","venue":null,"work_id":"86fb5f24-4177-4f56-8955-e174b7473baa","year":1974},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.215154Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:29f632aa1c3ac3cf728724f6067d20e700e771f3b658289a3f3961096c55f830","observation_id":"fd2486e5-b147-4d31-817b-22b2942e8b0f","resolution":{"observed_at":"2026-08-12T13:43:17.487076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.219519Z","title":"Learning robust global representations by penalizing local predictive power.Advances in Neural Information Pro- cessing Systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.219519Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:67e39f6d0018eafff4e2c60f77a27dfd96a7c0e117805934dd1fbca8ef775643","observation_id":"f79c5157-f452-460a-a4e6-03f430ca325e","resolution":{"observed_at":"2026-08-12T13:43:17.219519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.458815Z","title":"Feature- based style randomization for domain generalization","venue":null,"work_id":"61e03566-f3bb-4d8b-a21b-4b070a0b91e4","year":2022},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.223587Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:d1b1afd6f1fef8fe072013a01cd346a42acacd08f26224c7372450c65d9b5b91","observation_id":"95100914-fa1a-4868-88bc-5f4cad3e6026","resolution":{"observed_at":"2026-08-12T13:43:17.463746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.443799Z","title":"SUN database: Large-scale scene recognition from abbey to zoo","venue":null,"work_id":"d3e90cb3-9022-4268-b55b-c6623872ce53","year":2010},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.228072Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:1403ae4ee9f88879090c648a625334862b84a10c5d417b0f128c4ae48bb9895d","observation_id":"0436bb29-7b48-4bf6-9260-13c3225f5c70","resolution":{"observed_at":"2026-08-12T13:43:17.448583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.428864Z","title":"MMA: Multi-modal adapter for vision-language models","venue":null,"work_id":"f70d8259-c26e-4438-ac65-02cc9d57b736","year":2024},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.232505Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:986e98e664c882368d34dbd94a69e71d931f2e2ddbc0d79c0008522b0c8cf281","observation_id":"7df83f5d-6dec-4e2c-a0ee-f11827727ee5","resolution":{"observed_at":"2026-08-12T13:43:17.433726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07783","last_updated":"2021-11-09T17:15:38Z","snapshot_observed_at":"2026-08-13T15:16:57.345726Z","submitted_at":"2021-11-09T17:15:38Z","title":"FILIP: Fine-grained Interactive Language-Image Pre-Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07783","snapshot_observed_at":"2026-08-12T13:43:17.237195Z","title":"FILIP: Fine-grained interactive language- image pre-training","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.237195Z"},"links":{"cited_paper":"/paper/2111.07783","citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:30c4aed087fcea0746cfa283063becec78eb557844d1097f785cc139fd114970","observation_id":"b19e2ac0-7835-4940-8197-219afc716d48","resolution":{"observed_at":"2026-08-12T13:43:17.237195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.410705Z","title":"Barlow Twins: Self-supervised learning via redundancy reduction","venue":null,"work_id":"8282ffa4-e807-4878-8f81-7f3d826c9144","year":2021},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.242155Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:40e3f107d64b0ca9391ebfb013573ca367a328c3b6afee7bf0b5bd3320c74381","observation_id":"8540c76e-078d-4324-b728-6eedc0780908","resolution":{"observed_at":"2026-08-12T13:43:17.417580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.246354Z","title":"Conditional prompt learning for vision-language mod- els","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.246354Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:460d6f5091aa725874b8e821e6bfb96354380739724627b68acbfd0b454d1ff3","observation_id":"1e69d658-16df-49b6-abc0-3dd8f44c904c","resolution":{"observed_at":"2026-08-12T13:43:17.246354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.251062Z","title":"Learning to prompt for vision-language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.251062Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:d7417216cd027c4f7a5a6c2027cf55d407145581eb1353f784fb5d35197f7154","observation_id":"d09415e4-1066-4c7c-9166-48f2bd54f83a","resolution":{"observed_at":"2026-08-12T13:43:17.251062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.02008","last_updated":"2021-04-05T16:58:09Z","snapshot_observed_at":"2026-08-10T09:28:28.538323Z","submitted_at":"2021-04-05T16:58:09Z","title":"Domain Generalization with MixStyle","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.02008","snapshot_observed_at":"2026-08-12T13:43:17.255931Z","title":"Domain generalization with MixStyle","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.255931Z"},"links":{"cited_paper":"/paper/2104.02008","citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:f80152e427d51e33f2cbcc3b35dd332e31134a3212e69adff6d364227de4da55","observation_id":"5cce0ce8-e5b3-4884-8985-46150e3aa315","resolution":{"observed_at":"2026-08-12T13:43:17.255931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":33},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 0 inbound Pith citation observations for arXiv:2411.16018."}