{"as_of":"2026-08-14T07:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:15b84b0e71a9e9a32d1d1bbf141857da91baeeb92d4d7327a294cc689c2a16c3","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T16:56:32.082419Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.17417/citation-record","integrity":"/paper/2508.17417/integrity","json":"/paper/2508.17417/citation-record.json","paper":"/paper/2508.17417"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:21.313379Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:21.313379Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:fbc854b138608ff0fcbc9ad7e2372434a73fa750a3e16698092ee3bdef27c7e2","observation_id":"c8c8c761-ad66-4996-b2ce-87ff1215eb9b","resolution":{"observed_at":"2026-08-05T16:56:21.313379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02114","last_updated":"2021-11-03T10:16:39Z","snapshot_observed_at":"2026-08-02T08:12:49.547570Z","submitted_at":"2021-11-03T10:16:39Z","title":"LAION-400M: Open Dataset of CLIP-Filtered 400 Million Image-Text Pairs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.02114","snapshot_observed_at":"2026-08-05T16:56:21.422372Z","title":"Laion-400m: Open dataset of clip-filtered 400 million image-text pairs","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:21.422372Z"},"links":{"cited_paper":"/paper/2111.02114","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:c9bf55af77d7627d700da8de5f899e81cde63631c005ae48667ffc9d7e022678","observation_id":"49d06e05-f51c-4b05-9f73-6163a0c31e9f","resolution":{"observed_at":"2026-08-05T16:56:21.422372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:52.344867Z","title":"Laion-5b: An open large-scale dataset for training next generation image-text models","venue":null,"work_id":"f5579981-797d-4cc8-a2c1-72f6c89fedcc","year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:21.591992Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:d38b2d10d5e46d27778a189105b3e6d4b13529d30af5f87d7aaa5fcdcfa69953","observation_id":"535f3df9-4666-4195-bd9d-62db10446307","resolution":{"observed_at":"2026-08-05T16:56:52.514923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:52.024753Z","title":"Scaling up visual and vision-language representation learning with noisy text supervision","venue":null,"work_id":"520ddc24-09d8-4455-bba7-1b6567f8b73b","year":2021},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:21.743402Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:c73732c0562051e35adf9cad18451e0148d7c9cc72eb4889483d0e352af02345","observation_id":"f337120e-bdcf-4e9d-b258-fbfc93d83714","resolution":{"observed_at":"2026-08-05T16:56:52.161408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:51.568671Z","title":"Lit: Zero-shot transfer with locked-image text tuning","venue":null,"work_id":"3635943d-d2ea-4414-a69d-6654ee8292a0","year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:21.893229Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:682fa56d6adb0166ce9dd611f78b4d88ca9f7ca18bfd25ce87f47280b8b02032","observation_id":"444680d6-705b-4c17-91d2-b07e5e8d7d0f","resolution":{"observed_at":"2026-08-05T16:56:51.754742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.09592","last_updated":"2022-12-22T00:55:29Z","snapshot_observed_at":"2026-08-13T15:20:29.889697Z","submitted_at":"2022-06-20T06:43:17Z","title":"DALL-E for Detection: Language-driven Compositional Image Synthesis for Object Detection","version":3},"cited_work":{"arxiv_id":"2206.09592","doi":null,"metadata_source":"pith","pith_arxiv_id":"2206.09592","snapshot_observed_at":"2026-08-05T16:56:33.732887Z","title":"DALL-E for Detection: Language-driven Compositional Image Synthesis for Object Detection","venue":"cs.CV","work_id":"8bacb058-6101-44b9-ac0a-3a631169d70c","year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:22.048767Z"},"links":{"cited_paper":"/paper/2206.09592","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:72dc50b6cc48a18119e3fa2002d94cbf726aaa6f8136db405e0ed200d98181ed","observation_id":"fedcb52c-a8fe-474e-8af8-b00f2394a436","resolution":{"observed_at":"2026-08-05T16:56:33.907280Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:22.274493Z","title":"Zero-shot text-to-image generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:22.274493Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:9488a109605aae2b55a719cd39ed86cb4c2584212e8fe835ce208e9044779624","observation_id":"ea4060a8-f1bb-4b42-8c49-bdace9083d96","resolution":{"observed_at":"2026-08-05T16:56:22.274493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:51.294753Z","title":"A survey on bias and fairness in machine learning","venue":null,"work_id":"75a66374-169e-4432-b702-b2a25998dc02","year":2021},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:22.423039Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:eedfc238defad614136ab584235570e1bfe872da9354abd21d86ccefeb390e61","observation_id":"63dce2e1-fdfd-4838-bfc9-4936db10418b","resolution":{"observed_at":"2026-08-05T16:56:51.394859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04412","last_updated":"2022-12-08T17:10:31Z","snapshot_observed_at":"2026-08-13T13:25:13.388447Z","submitted_at":"2022-12-08T17:10:31Z","title":"Task Bias in Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04412","snapshot_observed_at":"2026-08-05T16:56:22.558215Z","title":"Task bias in vision-language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:22.558215Z"},"links":{"cited_paper":"/paper/2212.04412","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:e1c1c1bac76be767688af42be28975cee84a99a528a524b827105ccd99b37f30","observation_id":"950e7d10-0b9b-48e0-8b71-d01cd5288f81","resolution":{"observed_at":"2026-08-05T16:56:22.558215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.02818","last_updated":"2021-08-05T19:05:57Z","snapshot_observed_at":"2026-08-13T18:33:17.774412Z","submitted_at":"2021-08-05T19:05:57Z","title":"Evaluating CLIP: Towards Characterization of Broader Capabilities and Downstream Implications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.02818","snapshot_observed_at":"2026-08-05T16:56:22.655634Z","title":"Evaluating clip: towards characterization of broader capabilities and downstream implications","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:22.655634Z"},"links":{"cited_paper":"/paper/2108.02818","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:35f45a4cd4e944989dfdca542347bfde6feae1521cbc531b97e033f01be20574","observation_id":"e1bda523-21bc-4b8a-b8b2-d5126c285824","resolution":{"observed_at":"2026-08-05T16:56:22.655634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:50.944754Z","title":"Visual classification via description from large language models","venue":null,"work_id":"bb903f3d-0e46-4702-b49f-16a045863b28","year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:22.855317Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:a110fd58aa4f3e8e7bcc444c0225174712ba383b01550af3a6404234c8ed7c0c","observation_id":"733d2098-bd7c-456f-b247-911f22669ad5","resolution":{"observed_at":"2026-08-05T16:56:51.083626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12952","last_updated":"2024-12-10T22:53:16Z","snapshot_observed_at":"2026-08-13T00:50:06.939278Z","submitted_at":"2024-03-19T17:54:34Z","title":"Just Shift It: Test-Time Prototype Shifting for Zero-Shot Generalization with Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12952","snapshot_observed_at":"2026-08-05T16:56:23.006176Z","title":"Just shift it: Test-time prototype shifting for zero-shot generalization with vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:23.006176Z"},"links":{"cited_paper":"/paper/2403.12952","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:af70fff47c4ce879b561dcc912d78a3c649e3f8cc6be561b1ce1e0fd1518b7ff","observation_id":"b3a4d953-ec17-4a30-bfcf-5886d277c139","resolution":{"observed_at":"2026-08-05T16:56:23.006176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:50.674752Z","title":"Awt: Transferring vision-language models via augmentation, weighting, and transportation","venue":null,"work_id":"d75df83b-56cb-4bea-9a68-c0e2d37234e6","year":2024},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:23.135856Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:b83e4282b9d4b56661eb3b78e72c6b3e751516e3edb1fbe9445d939a799444c3","observation_id":"21327a27-b384-4928-b820-05b35c3de49b","resolution":{"observed_at":"2026-08-05T16:56:50.804844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:50.354756Z","title":"The neglected tails in vision-language models","venue":null,"work_id":"87dee6fa-af7f-442d-a137-c4168ed23e72","year":2024},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:23.299058Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:5933a914dec1b9d472e9974e77223aacb3a79fdc6624dd10bb810bf41ed2ec3d","observation_id":"1d4a1ff4-6500-4f54-8d65-6b795edbab0c","resolution":{"observed_at":"2026-08-05T16:56:50.494769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02915","last_updated":"2024-06-05T04:08:41Z","snapshot_observed_at":"2026-08-13T15:40:32.691827Z","submitted_at":"2024-06-05T04:08:41Z","title":"Visual-Text Cross Alignment: Refining the Similarity Score in Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2406.02915","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.02915","snapshot_observed_at":"2026-08-05T16:56:33.417358Z","title":"Visual-Text Cross Alignment: Refining the Similarity Score in Vision-Language Models","venue":"cs.CV","work_id":"2252ac60-a7d7-4907-9f08-fb428f677531","year":2024},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:23.425788Z"},"links":{"cited_paper":"/paper/2406.02915","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:44ea330a28763d0699a1a33e48114f97b0845a880b8a789defc31059b629e40f","observation_id":"d1dd3986-f640-441f-a1c4-83afc3a06ec3","resolution":{"observed_at":"2026-08-05T16:56:33.495768Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:23.536646Z","title":"The claude 3 model family: Opus, sonnet, haiku, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:23.536646Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:512517ca54055f08556b84faa361b386151065e6957db5f900b42d579ef1c110","observation_id":"d01b4a18-1960-4149-9125-0e066e4284df","resolution":{"observed_at":"2026-08-05T16:56:23.536646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T16:56:23.637996Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:23.637996Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:03f759710d951a2319ed61796360ec6f6d6e5a8bc97726966aa117c7c5717e35","observation_id":"37673094-b179-412c-a7d8-72487fa37f80","resolution":{"observed_at":"2026-08-05T16:56:23.637996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:23.736980Z","title":"Emerging properties in self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:23.736980Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:71935d97e3c41621930101f4bf7447ef762b1b6d86683934350c5a483ac92225","observation_id":"d13cb8ba-6a9b-478e-a49d-0433020fb721","resolution":{"observed_at":"2026-08-05T16:56:23.736980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:49.878638Z","title":"Automated flower classification over a large number of classes","venue":null,"work_id":"31a4f6a5-e58c-4976-886c-019537f25075","year":2008},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:23.838694Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:cb444562387ebe15c4d969b8446824992f9b1340a8da56354581e7ea5273ba41","observation_id":"6748b9da-eedd-4c05-986b-5ad593168133","resolution":{"observed_at":"2026-08-05T16:56:50.027254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:49.524756Z","title":"Describing textures in the wild","venue":null,"work_id":"888e0d52-4951-46db-9666-223e36b2356f","year":2014},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:23.966463Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:e93a244a0a94de2e32b5583157eaf070f302f121c4300d681b70dcc5bf40df2f","observation_id":"97f8ab56-a535-4925-91cf-72aaa9062510","resolution":{"observed_at":"2026-08-05T16:56:49.684771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:49.165923Z","title":"Cats and dogs","venue":null,"work_id":"f4705eea-32fa-4390-a60d-5f253a8ddbfa","year":2012},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:24.137558Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:7e5ce3423780c44c7a12c4e7372a8f44ef95225bd7c552f2dc8a37db9203f685","observation_id":"350e58c3-6883-4945-ab16-8c10f95562b8","resolution":{"observed_at":"2026-08-05T16:56:49.314756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:48.866823Z","title":"3d object representations for fine-grained categorization","venue":null,"work_id":"2d226a7d-d694-42f7-b2ab-a25d9e4c7881","year":2013},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:24.227495Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:7eadd7d64709133253e310a5e9fae56e1036a7599e6b9e71aea36b2525cf788d","observation_id":"aa874e91-d946-4842-9a99-44eb59cc262f","resolution":{"observed_at":"2026-08-05T16:56:48.995360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-08-13T22:00:40.727122Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-05T16:56:24.374740Z","title":"Ucf101: A dataset of 101 human actions classes from videos in the wild","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:24.374740Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:11bef857417a3901ff1efb45566a8cd5b9543e7062114fe13e7a3fd09660149c","observation_id":"30453b8b-c72a-4709-b123-fec286be3094","resolution":{"observed_at":"2026-08-05T16:56:24.374740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:48.554791Z","title":"Learning generative visual models from few training examples: An incremental bayesian approach tested on 101 object categories","venue":null,"work_id":"7a568810-68f8-44d7-91ef-b70d665d2895","year":2004},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:24.498592Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:1f1c2633e2ee8c3ebcebed04047db4a72a411cc2ca735fa767ba81a3d2c32a44","observation_id":"84836bb8-79bf-46cc-88e8-80dbed42f68f","resolution":{"observed_at":"2026-08-05T16:56:48.675055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:48.243387Z","title":"Food-101--mining discriminative components with random forests","venue":null,"work_id":"00ea9e88-22b4-48aa-b6f2-6afcb547e7cd","year":2014},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:24.642439Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:367b48ffeb9676077f82556edee5555d1c85cedf3e2d9ceabf6d76a47159d8a1","observation_id":"72cfc87d-a211-49da-a58a-6d12178fb360","resolution":{"observed_at":"2026-08-05T16:56:48.373659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:47.874756Z","title":"Sun database: Large-scale scene recognition from abbey to zoo","venue":null,"work_id":"28804674-8ba3-49d4-a5f5-f85b94d225f9","year":2010},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:24.802819Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:e5ddf86abcfba6d6157aece31a4caed5ce1e553b85237fb793237bbfa43f2c45","observation_id":"29dafd16-603a-430d-89e8-bd3f322c4459","resolution":{"observed_at":"2026-08-05T16:56:48.017076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1306.5151","last_updated":"2013-06-21T14:31:57Z","snapshot_observed_at":"2026-08-12T17:35:23.022229Z","submitted_at":"2013-06-21T14:31:57Z","title":"Fine-Grained Visual Classification of Aircraft","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1306.5151","snapshot_observed_at":"2026-08-05T16:56:24.991347Z","title":"Fine-grained visual classification of aircraft","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:24.991347Z"},"links":{"cited_paper":"/paper/1306.5151","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:93d477c3851d17dd77bf53cd7f7d247d67f099d03b2be2d56abcc1bc8c0005c2","observation_id":"fa459683-3112-4396-9c2b-c4b4c9f95477","resolution":{"observed_at":"2026-08-05T16:56:24.991347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:25.113859Z","title":"Eurosat: A novel dataset and deep learning benchmark for land use and land cover classification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:25.113859Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:a2199810373e10aadbd0c96dd576aad917bfa5b5752ff5d942ff044c7cf8454d","observation_id":"4465be75-9d42-4543-ab10-440b8894d4ec","resolution":{"observed_at":"2026-08-05T16:56:25.113859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:47.474757Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"cc2b644d-d75d-4570-948c-bb834fadead3","year":2009},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:25.271660Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:de4b6ecd6d5f0d3c6309660a6e7aea2c116a5a2ca926964afb122c2bc6973449","observation_id":"eb007dc9-b3c0-4b03-87c5-c27d13ee8fb3","resolution":{"observed_at":"2026-08-05T16:56:47.604881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:47.134832Z","title":"Natural adversarial examples","venue":null,"work_id":"f88c27b4-4eb1-436a-91d2-84d7e6b9d292","year":2021},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:25.406558Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:cc6b87d7bc252957037e1c4cc83a8e3171a730705813cc7bdf91a0b250adb4f5","observation_id":"47e34d39-a541-4131-8b4f-a0f5c48a95c1","resolution":{"observed_at":"2026-08-05T16:56:47.254755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:46.794753Z","title":"Do imagenet classifiers generalize to imagenet? In International Conference on Machine Learning, pages 5389--5400","venue":null,"work_id":"2ccd0f34-2c01-46bb-81f1-7d1503aa7d6d","year":2019},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:25.563571Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:74a46027335bcb26af98cba9e3ba42ae59de64d98da9c336d5bf078b485c5b82","observation_id":"eb5b3199-40b2-4d6f-afcb-874810b4b83f","resolution":{"observed_at":"2026-08-05T16:56:46.915058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:46.345710Z","title":"The many faces of robustness: A critical analysis of out-of-distribution generalization","venue":null,"work_id":"749dd0de-156f-4634-a251-c9d87a3dfece","year":2021},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:25.696304Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:9b6448b0cfc9ad224284c890ab02ad5e9ef905742d1182a27c6db8d1bf1f13bd","observation_id":"22055c34-0c71-4c59-ab45-d8d4db1e978a","resolution":{"observed_at":"2026-08-05T16:56:46.524575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:45.854938Z","title":"Learning robust global representations by penalizing local predictive power","venue":null,"work_id":"e98a9281-9e15-49f1-b6cc-b79c74de4d1d","year":2019},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:25.878557Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:c5795e03fda7abf384fd46cc612833771f5ee20a33ec5015751ac4b563ad7dc0","observation_id":"1aa43631-29df-4431-b812-436722748aad","resolution":{"observed_at":"2026-08-05T16:56:46.044755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:45.434797Z","title":"Hmdb: a large video database for human motion recognition","venue":null,"work_id":"3b27f3f8-5f23-40a1-b355-500a787dd452","year":2011},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:25.986884Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:59029b5a540e243e260cb1a0abe172204087bccdd7db41808a34c2697f4b1a77","observation_id":"b03099b8-b08a-4c78-942d-f26cb9c98bb9","resolution":{"observed_at":"2026-08-05T16:56:45.604758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1808.01340","last_updated":"2018-08-03T20:17:05Z","snapshot_observed_at":"2026-08-12T17:41:53.544669Z","submitted_at":"2018-08-03T20:17:05Z","title":"A Short Note about Kinetics-600","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.01340","snapshot_observed_at":"2026-08-05T16:56:26.108454Z","title":"A short note about kinetics-600","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:26.108454Z"},"links":{"cited_paper":"/paper/1808.01340","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:7b8704e400b1364d6b82917d08dbbd6d83f27eb38dbb5e6230b837118ece6159","observation_id":"87b72080-6e1b-4771-9341-0724feb56a35","resolution":{"observed_at":"2026-08-05T16:56:26.108454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:44.954853Z","title":"Sigmoid loss for language image pre-training","venue":null,"work_id":"6dc374ed-cfa4-4ed6-bbca-577e0481d58c","year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:26.457794Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:b6c1219931fb1452fd033f50e438c4f859f186319e2cd365e4bd7d43035c3a46","observation_id":"51feb682-3833-42f2-9c18-4da66ec5a487","resolution":{"observed_at":"2026-08-05T16:56:45.094760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.15389","last_updated":"2023-03-27T17:02:21Z","snapshot_observed_at":"2026-07-06T15:08:34.018146Z","submitted_at":"2023-03-27T17:02:21Z","title":"EVA-CLIP: Improved Training Techniques for CLIP at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.15389","snapshot_observed_at":"2026-08-05T16:56:26.617118Z","title":"Eva-clip: Improved training techniques for clip at scale","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:26.617118Z"},"links":{"cited_paper":"/paper/2303.15389","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:4aa491b10975cacb7652899f039ffa166875654eec8fccda736fd922f7c9db03","observation_id":"e6a312fb-d024-40b9-b282-71b5beeada23","resolution":{"observed_at":"2026-08-05T16:56:26.617118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.03546","last_updated":"2022-04-03T03:33:43Z","snapshot_observed_at":"2026-08-01T06:14:31.660540Z","submitted_at":"2022-01-10T18:59:10Z","title":"Language-driven Semantic Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.03546","snapshot_observed_at":"2026-08-05T16:56:26.737825Z","title":"Language-driven semantic segmentation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:26.737825Z"},"links":{"cited_paper":"/paper/2201.03546","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:ec88c7c37c7a6178070322cdd48671ce3731f28434b213cc96ba6c9aaeb973c0","observation_id":"d509531e-ea47-4d57-9f4f-1ab5cf55e893","resolution":{"observed_at":"2026-08-05T16:56:26.737825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:44.614838Z","title":"Learning to prompt for vision-language models","venue":null,"work_id":"08b1b428-7f7a-4274-847c-547c7d861bb1","year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:26.832904Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:83686803bce4987cda4bf0164860bcbf8f0fd82827467650caa442bf9bf923ee","observation_id":"b3b14165-0be8-4381-8f76-d876bfdbbe44","resolution":{"observed_at":"2026-08-05T16:56:44.735087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:44.264944Z","title":"Conditional prompt learning for vision-language models","venue":null,"work_id":"39a92ebf-e6bc-4f74-bad6-98c08b79e8cf","year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:27.011946Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:2418722eea93f39f7b8162dc74388c2bc6ca2e1a30c7393ec8f2667166493e43","observation_id":"563334ef-11ad-4e64-98ec-79d0b536f932","resolution":{"observed_at":"2026-08-05T16:56:44.375052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:43.954745Z","title":"Towards open-vocabulary detection using uncurated images","venue":null,"work_id":"dbfa9f77-3d60-45c9-8bbb-56d31ee7d761","year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:27.163331Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:85c8502025643cf8a9cfec5dcdfec797f39c6d29747883cd3c81d63d109acbd8","observation_id":"1f9fe65c-d619-4eae-a60a-1b683a003093","resolution":{"observed_at":"2026-08-05T16:56:44.064833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.13921","last_updated":"2022-05-12T01:27:40Z","snapshot_observed_at":"2026-08-08T10:08:57.896975Z","submitted_at":"2021-04-28T17:58:57Z","title":"Open-vocabulary Object Detection via Vision and Language Knowledge Distillation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.13921","snapshot_observed_at":"2026-08-05T16:56:27.247293Z","title":"Zero-shot detection via vision and language knowledge distillation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:27.247293Z"},"links":{"cited_paper":"/paper/2104.13921","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:916d7d2d63b6cfc284a53ec82b9cc84897a356d13e15777ef26de2d42ab58c54","observation_id":"ac8ad135-8559-48e8-98ee-91830211d1a1","resolution":{"observed_at":"2026-08-05T16:56:27.247293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:43.639118Z","title":"Learning to prompt for open-vocabulary object detection with vision-language model","venue":null,"work_id":"2206ba3a-b4fa-49b3-9222-a18b10dceca9","year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:27.312753Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:cb535b23f75a265c2c007a6d7762a96ab2fff023346369dd1e9178565e6679b9","observation_id":"d9606749-7dbb-4ed0-87ef-b19eba0a18e4","resolution":{"observed_at":"2026-08-05T16:56:43.775067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.08472","last_updated":"2021-09-17T11:21:34Z","snapshot_observed_at":"2026-08-13T18:09:42.014649Z","submitted_at":"2021-09-17T11:21:34Z","title":"ActionCLIP: A New Paradigm for Video Action Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.08472","snapshot_observed_at":"2026-08-05T16:56:27.442977Z","title":"Actionclip: A new paradigm for video action recognition","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:27.442977Z"},"links":{"cited_paper":"/paper/2109.08472","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:1d5da2fc3ed1d5464d7969ec66237d8813df9d3e25371b88e477687fdef5f6b2","observation_id":"8793f05a-a5f2-4c71-9e9d-648154d60476","resolution":{"observed_at":"2026-08-05T16:56:27.442977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:43.397213Z","title":"Open-vclip: Transforming clip to an open-vocabulary video model via interpolated weight optimization","venue":null,"work_id":"12b1a0de-2f19-43dd-96a3-bcbca67c324e","year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:27.573432Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:b9e8bd888878ca1849293cd2a5c9189c865141d1313b5dadd5f469c2679edd33","observation_id":"3386808a-79da-46f2-b10d-4833db01ad8d","resolution":{"observed_at":"2026-08-05T16:56:43.494835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03241","last_updated":"2024-02-05T17:56:41Z","snapshot_observed_at":"2026-08-13T13:08:57.215682Z","submitted_at":"2024-02-05T17:56:41Z","title":"FROSTER: Frozen CLIP Is A Strong Teacher for Open-Vocabulary Action Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03241","snapshot_observed_at":"2026-08-05T16:56:27.685761Z","title":"Froster: Frozen clip is a strong teacher for open-vocabulary action recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:27.685761Z"},"links":{"cited_paper":"/paper/2402.03241","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:29014a3816f17db544493d55d9877b85fd3f2dd9e212001cc8efa0ef4820bbe4","observation_id":"2b572db5-e794-4d38-ab53-ae4b1e2c1363","resolution":{"observed_at":"2026-08-05T16:56:27.685761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:43.135940Z","title":"What does a platypus look like? generating customized prompts for zero-shot image classification","venue":null,"work_id":"7bfb26d3-52f5-4e61-a1f9-d600a2a23695","year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:27.832840Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:1d54c5bb30cb09d7ecabbc3b5d11906cff4cdaa11a5fe981c9b61400ba1bc47c","observation_id":"a1b99094-d1aa-4767-bdbd-69d7ab0178db","resolution":{"observed_at":"2026-08-05T16:56:43.214755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:42.574752Z","title":"Language models are few-shot learners","venue":null,"work_id":"4d2d3b89-eae7-46ea-8d3e-146feef900a2","year":1901},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:27.982311Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:1f5d23c930465d5d5c14d96cd278fc37a8536d30691e588f9e4542b427ec0ced","observation_id":"e9a25d44-8408-4a80-be51-7484593d9b16","resolution":{"observed_at":"2026-08-05T16:56:42.864740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:42.217109Z","title":"Waffling around for performance: Visual classification with random words and broad concepts","venue":null,"work_id":"7260d9b0-6b4a-43d2-8971-e2ed985eaebe","year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:28.105132Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:759393b3b426935a28a6f5e1d2be5ef3d973f6709ee14b73614511c5bf98fd3e","observation_id":"cdf0e85a-6eaa-46e5-976d-15cfb2d036e0","resolution":{"observed_at":"2026-08-05T16:56:42.384859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:41.800955Z","title":"Meta-prompting for automating zero-shot visual recognition with llms","venue":null,"work_id":"127f457d-59a2-426f-bb32-4f82ad6da303","year":2024},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:28.235947Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:5cac7bea4d45c4743c6587a123983d8ffbae351ec6d9b67f5c32391084a74a0e","observation_id":"f7062c60-c7c2-4c5a-aa40-969a595b6f70","resolution":{"observed_at":"2026-08-05T16:56:42.022718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:41.499088Z","title":"Test-time prompt tuning for zero-shot generalization in vision-language models","venue":null,"work_id":"1af92059-6f55-4b21-99b4-65f9d2b6b106","year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:28.398019Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:c21d422799096cc51d30b64a070f458085940097962c3628865cf8fc37d6f2c2","observation_id":"531f865f-dbd1-4d59-9f32-fa0c4dfa01e4","resolution":{"observed_at":"2026-08-05T16:56:41.637583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:41.124528Z","title":"Diverse data augmentation with diffusions for effective test-time prompt tuning","venue":null,"work_id":"b7742e1d-56e7-42db-a5c8-ceb4db2de65f","year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:28.566663Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:118def8836bd87f46ac9c265935719a21899cac7f4c395b520c42c69c0422559","observation_id":"c9e4580d-0947-4b49-9070-272edb50bdbb","resolution":{"observed_at":"2026-08-05T16:56:41.294760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:40.875974Z","title":"Align your prompts: Test-time prompting with distribution alignment for zero-shot generalization","venue":null,"work_id":"026795d1-3a92-4784-8f10-1a568ea340df","year":2024},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:28.703161Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:3f65ae13e3000f3e7eec743b469163eb09fc88486c1e55df2b911edaf4456f75","observation_id":"60608a08-bec1-467e-a586-9fb455c11135","resolution":{"observed_at":"2026-08-05T16:56:40.948684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:40.566596Z","title":"Test-time low rank adaptation via confidence maximization for zero-shot generalization of vision-language models","venue":null,"work_id":"6d2b88f9-cd54-4a2c-9c97-41dec5f8d7ee","year":2025},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:28.928978Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:6a14a0bb3cf7ca36fe1de185cef267d3eaaad55e24f66e52fb9e3fecf39549c3","observation_id":"5e9f55bf-d615-43a8-8448-82e2903e6215","resolution":{"observed_at":"2026-08-05T16:56:40.702424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01219","last_updated":"2025-09-14T09:34:46Z","snapshot_observed_at":"2026-07-06T16:13:46.112815Z","submitted_at":"2023-09-03T16:56:48Z","title":"Siren's Song in the AI Ocean: A Survey on Hallucination in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01219","snapshot_observed_at":"2026-08-05T16:56:29.058468Z","title":"Siren's song in the ai ocean: a survey on hallucination in large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:29.058468Z"},"links":{"cited_paper":"/paper/2309.01219","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:e758e8a61ff81977adffb86c398119df1ccbccd9479d590fcdff5b1334654860","observation_id":"be7368a7-1894-4fc1-abe5-fe285db8c13c","resolution":{"observed_at":"2026-08-05T16:56:29.058468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05232","last_updated":"2024-11-19T12:42:45Z","snapshot_observed_at":"2026-07-06T16:45:07.733095Z","submitted_at":"2023-11-09T09:25:37Z","title":"A Survey on Hallucination in Large Language Models: Principles, Taxonomy, Challenges, and Open Questions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05232","snapshot_observed_at":"2026-08-05T16:56:29.199766Z","title":"A survey on hallucination in large language models: Principles, taxonomy, challenges, and open questions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:29.199766Z"},"links":{"cited_paper":"/paper/2311.05232","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:16d2839f82d121d9fdf292e85f9ef0bf14572361131ca7e041938568200e1711","observation_id":"0c467758-f47d-4c81-9811-50d5004900ae","resolution":{"observed_at":"2026-08-05T16:56:29.199766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:40.255011Z","title":"Computational homology","venue":null,"work_id":"630abd97-9e01-4797-9703-d27dbe76e0da","year":2004},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:29.407524Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:8d583ac6873e85950ee1534645ea24477b8fc765578e72716395ebc33c79f128","observation_id":"c53674d8-f7eb-4eec-86a3-d271ebe29060","resolution":{"observed_at":"2026-08-05T16:56:40.404753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:39.962235Z","title":"Persistent homology: An introduction and a new text representation for natural language processing","venue":null,"work_id":"c5b3d83b-ed55-49a0-828f-56496632fdc6","year":1953},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:29.547863Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:4c0ee4755af3a8d3689a1130d1fb9a832e361adb8dc48d31477e6631d1ce47cb","observation_id":"59a768ed-b431-4267-8910-35970e90125f","resolution":{"observed_at":"2026-08-05T16:56:40.044760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:39.594755Z","title":"Statistics notes: measurement error","venue":null,"work_id":"0a494c2a-16e0-45e9-a54c-cae64e8fdaeb","year":1996},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:29.820360Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:e39ea5bc244d0f5e1be437daa90e77c97e0155532200aa2ae62679274feb6a30","observation_id":"081ff389-8b84-47c8-ac45-d34ebd4e9f64","resolution":{"observed_at":"2026-08-05T16:56:39.794839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:39.137690Z","title":"M \\'e moire sur la th \\'e orie des d \\'e blais et des remblais","venue":null,"work_id":"170fcb56-048f-4494-be8e-7f6e7d965c3b","year":null},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:29.950212Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:bd62b1bd878eaf2f9fdbc5c58deae2d0666293fc26c3ee3d7b0edfb312f73410","observation_id":"27cc522b-b7dc-4cfb-89b6-020148ae89dd","resolution":{"observed_at":"2026-08-05T16:56:39.344859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:38.775037Z","title":"On the translocation of masses","venue":null,"work_id":"d052e575-45f1-4e1b-a9d5-84a73ca43872","year":2006},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:30.127605Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:859f601a8fa6fbae7309b35adacf46e74cd289d273a18a5d08071179db03b2d8","observation_id":"471b29ad-11cb-47a7-9a2c-0e31d5a8936b","resolution":{"observed_at":"2026-08-05T16:56:38.965026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:38.404753Z","title":"Sinkhorn distances: Lightspeed computation of optimal transport","venue":null,"work_id":"bb1fa353-ae89-45f9-aab9-7bd5b34b6c10","year":2013},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:30.264340Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:7476ed28a52e7805846c1cb6fabe0a8048a9f6ebd92a795571b36beb8265d1f8","observation_id":"30111325-eaa1-468c-827f-69f862a0c641","resolution":{"observed_at":"2026-08-05T16:56:38.564863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04341","last_updated":"2019-06-11T01:31:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-06-11T01:31:41Z","title":"What Does BERT Look At? An Analysis of BERT's Attention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.04341","snapshot_observed_at":"2026-08-05T16:56:30.457669Z","title":"What does bert look at? an analysis of bert's attention","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:30.457669Z"},"links":{"cited_paper":"/paper/1906.04341","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:7e37e31b78aa3b789a12d5e88fd05f4be8596c49d9cdc0f5f37476820f3497f6","observation_id":"51e45676-51e1-4745-9dbc-899aa16c3c01","resolution":{"observed_at":"2026-08-05T16:56:30.457669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:38.114766Z","title":"Maple: Multi-modal prompt learning","venue":null,"work_id":"e9ca0ebd-a704-445f-b49c-10fa05c0711e","year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:30.598383Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:35fab579ce03efb7a2e12495486cdc9ce6d11426e8a84c77238a531500aeaf0c","observation_id":"8a912ac3-f178-480a-b3ae-74df75eedd7b","resolution":{"observed_at":"2026-08-05T16:56:38.225174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:37.794755Z","title":"Plot: Prompt learning with optimal transport for vision-language models","venue":null,"work_id":"98ae0aae-67b8-4fe2-a7da-0ef4534f55d4","year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:30.777577Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:080b1f35e26ea2413b26a8897cd02590c547944b2224f7de2c9a972ba78f904c","observation_id":"40fa3893-642d-4eb9-95ea-6916435ef972","resolution":{"observed_at":"2026-08-05T16:56:37.922607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:37.408069Z","title":"Prompt pre-training with twenty-thousand classes for open-vocabulary visual recognition","venue":null,"work_id":"7be20d48-c2e9-4708-84cd-295d36afee96","year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:30.891428Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:87ae9e238ed740efead1c493d28166e133549fc857d112dd1ef5cf89374f0e9b","observation_id":"fd94c28a-2e24-4521-b32f-07c9ce3acc89","resolution":{"observed_at":"2026-08-05T16:56:37.554832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:37.054863Z","title":"Progressive visual prompt learning with contrastive feature re-formation","venue":null,"work_id":"573b0143-f652-43e3-9ff1-7d7609ba94ec","year":2025},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:30.978988Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:32b26846dd2d3cc6758c5177a8be37a2680756902c74572a5de117a7f05734ac","observation_id":"d4a41edd-8e2c-42a6-8604-5dd005d8d848","resolution":{"observed_at":"2026-08-05T16:56:37.183790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:36.744754Z","title":"Sus-x: Training-free name-only transfer of vision-language models","venue":null,"work_id":"1b617e4d-9bee-46d5-bc4f-ff97f9aa8e69","year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:31.161055Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:ac1e3d621046d4f5dd834352e4848c0d1ee04720206f9cd15e13c44f9727c0df","observation_id":"9c316020-d540-4431-9e06-1130128560b4","resolution":{"observed_at":"2026-08-05T16:56:36.834755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:36.294754Z","title":"Expanding language-image pretrained models for general video recognition","venue":null,"work_id":"ae72fe1e-5deb-4a6e-b343-60586182aedb","year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:31.279343Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:4168e3afc517edae0fb4db5fa6ae7a7961a86b36d6b513c1586b37f0c0484003","observation_id":"2b9864b4-95cb-4eb0-afba-dd2048b66db8","resolution":{"observed_at":"2026-08-05T16:56:36.476755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:36.042286Z","title":"Aim: Adapting image models for efficient video action recognition","venue":null,"work_id":"45e04571-4cae-45d9-8e77-c33013039615","year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:31.376546Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:c2246e55bdb05e7a55d56b83496c40c2cc44a3466e55dd036a06de46f0ad4f18","observation_id":"6b8f0241-f31b-45f2-96f2-ba26ab718d33","resolution":{"observed_at":"2026-08-05T16:56:36.140739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:35.694756Z","title":"St-adapter: Parameter-efficient image-to-video transfer learning","venue":null,"work_id":"335c4dff-150b-41ea-9b0a-bee9aa034cdf","year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:31.472482Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:7d247e0a28ac987b916ac8d52013b3b331510972a5554991492a7ab36f980c77","observation_id":"fc34f552-a61e-456b-b4ff-5c4dd2b87957","resolution":{"observed_at":"2026-08-05T16:56:35.846629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:35.285836Z","title":"Vita-clip: Video and text adaptive clip via multimodal prompting","venue":null,"work_id":"011d3de6-8425-4181-a43a-2a6969560ba0","year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:31.584758Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:22d2df8d90b8ed0e800cada9e9730b5ed514c3fd96725a167202ec387a6bb203","observation_id":"c808adf0-bcd8-4696-bf77-50815d56bdbd","resolution":{"observed_at":"2026-08-05T16:56:35.409624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:34.984989Z","title":"Fine-tuned clip models are efficient video learners","venue":null,"work_id":"b09e721a-fb3e-4201-94db-e778450b0bf8","year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:31.695057Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:1e62c448de10b9d28a7a6adeaa33d3824fb3a327fb05ab4a5efe5bbe85526593","observation_id":"60937bb5-9db1-428a-a577-1e93083869f0","resolution":{"observed_at":"2026-08-05T16:56:35.131472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:34.635712Z","title":"Adaptformer: Adapting vision transformers for scalable visual recognition","venue":null,"work_id":"d0b73a19-7357-40fa-b04e-3f326366ce5e","year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:31.824750Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:aaa4c9aa77f437d6b314afc241c89002e59bb398cd162476b869e4558666ad17","observation_id":"ba7ae1bd-fa9a-45bf-b5c0-168f32c2102f","resolution":{"observed_at":"2026-08-05T16:56:34.768234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:34.293831Z","title":"Reproducible scaling laws for contrastive language-image learning","venue":null,"work_id":"1d04027f-0754-4184-a6ce-f5415ff717c0","year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:32.082419Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:6adf4eb77555e7d9bf9dbd3105c4bbf2b56d124f1b1984d828bfacc1a0672c42","observation_id":"b42dd996-929f-4482-a95b-15e75df6ba26","resolution":{"observed_at":"2026-08-05T16:56:34.484053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T16:18:47.995985Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":2,"verified_fuzzy":52},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 0 inbound Pith citation observations for arXiv:2508.17417."}