{"as_of":"2026-08-16T04:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5f93c9e67069a074644016f68db4f4d74fbed61ea0839478f02cd6913fc67388","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:42:20.694165Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.08644/citation-record","integrity":"/paper/2508.08644/integrity","json":"/paper/2508.08644/citation-record.json","paper":"/paper/2508.08644"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:20.338143Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.338143Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:8d2abae8d119847462eae9871666974d9c838b8b166b8b9827eff46b712edcf8","observation_id":"d44d6aef-5ae3-4775-90a9-5ce667f0732d","resolution":{"observed_at":"2026-08-15T17:42:20.338143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:20.345409Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.345409Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:f41324f6a77ff2ab876524dd27897f640268027980b8770cd5e2c754590bdd73","observation_id":"061270ab-f097-4cc7-b552-518babdd280c","resolution":{"observed_at":"2026-08-15T17:42:20.345409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:20.353240Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.353240Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:0361c18f3c392218de0c7ca96bdd0778c22fe9829166cc9fedc3305fefea7aa6","observation_id":"48c192ce-c34e-4c87-b84d-8c0ed83a37ea","resolution":{"observed_at":"2026-08-15T17:42:20.353240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:22.146573Z","title":null,"venue":null,"work_id":"3c6d079d-3448-467c-a722-44e5660c0153","year":2019},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.359210Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:d05960ba169d39d19324d1e5df497362f86c5d28b7ca4e713a1ab76e4c5ac097","observation_id":"6e27eaec-127a-4d63-82e8-8f3237070a64","resolution":{"observed_at":"2026-08-15T17:42:22.152988Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.11740","last_updated":"2020-07-17T22:19:59Z","snapshot_observed_at":"2026-08-09T19:02:25.484253Z","submitted_at":"2019-09-25T20:02:54Z","title":"UNITER: UNiversal Image-TExt Representation Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.11740","snapshot_observed_at":"2026-08-15T17:42:20.365794Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.365794Z"},"links":{"cited_paper":"/paper/1909.11740","citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:1b072c616770d24df6749721b5578b762abbdd330e976b2c02de08127a07be1a","observation_id":"fde2c972-902f-483c-8a35-38d25d02358d","resolution":{"observed_at":"2026-08-15T17:42:20.365794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1311.3618","last_updated":"2013-11-15T16:14:12Z","snapshot_observed_at":"2026-08-15T14:49:17.072467Z","submitted_at":"2013-11-14T19:28:35Z","title":"Describing Textures in the Wild","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1311.3618","snapshot_observed_at":"2026-08-15T17:42:20.371834Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.371834Z"},"links":{"cited_paper":"/paper/1311.3618","citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:e52a14bed69c0bfb08c1cde12ef6d5bf080cc54c076ba64e41b6b1625f8a5a2c","observation_id":"14d85165-2c8e-4cc5-994d-0a648c7684f7","resolution":{"observed_at":"2026-08-15T17:42:20.371834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:20.378733Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.378733Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:1d42a4780085a045c5d11f3c4c13b3cdbf40cf5baa05cbb1a4cd03b5c7730169","observation_id":"2f27cd9d-90a1-44f9-868f-166233153f06","resolution":{"observed_at":"2026-08-15T17:42:20.378733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.07910","last_updated":"2022-04-15T10:28:07Z","snapshot_observed_at":"2026-08-13T17:15:02.920908Z","submitted_at":"2021-12-15T06:21:47Z","title":"Decoupling Zero-Shot Semantic Segmentation","version":2},"cited_work":{"arxiv_id":"2112.07910","doi":null,"metadata_source":"pith","pith_arxiv_id":"2112.07910","snapshot_observed_at":"2026-08-15T17:42:21.554692Z","title":"Decoupling Zero-Shot Semantic Segmentation","venue":"cs.CV","work_id":"83db5703-f0cb-47fb-ba1d-7149027250b8","year":2021},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.383987Z"},"links":{"cited_paper":"/paper/2112.07910","citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:a6663e9873ea50fa7c00a93f829afb719093043fa70c989b6f91dfba8555f0ae","observation_id":"e0ab80c0-bbaf-4c85-9bf9-ecf4d8cff19a","resolution":{"observed_at":"2026-08-15T17:42:21.561016Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06138","last_updated":"2022-12-12T18:59:59Z","snapshot_observed_at":"2026-08-14T21:22:43.592804Z","submitted_at":"2022-12-12T18:59:59Z","title":"CLIP Itself is a Strong Fine-tuner: Achieving 85.7% and 88.0% Top-1 Accuracy with ViT-B and ViT-L on ImageNet","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06138","snapshot_observed_at":"2026-08-15T17:42:20.389779Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.389779Z"},"links":{"cited_paper":"/paper/2212.06138","citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:c317a232bc29d11419ffd143bd2a324efb6ab8486e98903bed663fa9132b0d43","observation_id":"e68e7095-416f-43d7-85a6-c564a9ea7138","resolution":{"observed_at":"2026-08-15T17:42:20.389779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:22.127013Z","title":null,"venue":null,"work_id":"b0f303bb-fc83-4587-a981-0775cd3a2c92","year":2020},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.395775Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:42b8e2106b4baca8e107100ca208596524d0a282607f83043dc48d7e758e5343","observation_id":"62884dfe-33f8-4bd1-b2bb-f1991d4ae64a","resolution":{"observed_at":"2026-08-15T17:42:22.133692Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:20.400974Z","title":"Fergus, and P","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.400974Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:a307dbbed7e39c6b9ec961d6721cbc5456257a01fa001c4e2b87c24b59400001","observation_id":"0678e322-4d73-49b3-aedc-acbd3e2c5636","resolution":{"observed_at":"2026-08-15T17:42:20.400974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.16513","last_updated":"2022-07-18T17:44:15Z","snapshot_observed_at":"2026-08-13T16:12:19.480559Z","submitted_at":"2022-03-30T17:50:21Z","title":"PromptDet: Towards Open-vocabulary Detection using Uncurated Images","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.16513","snapshot_observed_at":"2026-08-15T17:42:20.406039Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.406039Z"},"links":{"cited_paper":"/paper/2203.16513","citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:f0759af2e3765fc7545c4c704d90fdbf1783b756ab3d12a24ed04c03005f6578","observation_id":"061a62b9-33a3-45e4-a95a-103528a42ef9","resolution":{"observed_at":"2026-08-15T17:42:20.406039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.04544","last_updated":"2025-03-25T14:34:04Z","snapshot_observed_at":"2026-08-13T17:56:46.435125Z","submitted_at":"2021-10-09T11:39:30Z","title":"CLIP-Adapter: Better Vision-Language Models with Feature Adapters","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.04544","snapshot_observed_at":"2026-08-15T17:42:20.412256Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.412256Z"},"links":{"cited_paper":"/paper/2110.04544","citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:220dbe395e147a2c94a38463186091c72215351e7ff468bad0f31639421dad61","observation_id":"12d0404f-56ec-4b0d-a74f-7bc38a398ca8","resolution":{"observed_at":"2026-08-15T17:42:20.412256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:22.107098Z","title":null,"venue":null,"work_id":"c2a501bf-0f7e-4798-b07a-1221e78eb66a","year":null},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.418537Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:ede2a99f7d787f96a5b1d7a67cd6d83bfe52ee87783f6a983f5a90cfcfc1b7ee","observation_id":"ba48f29c-b5d0-49cf-a34d-03a95480691f","resolution":{"observed_at":"2026-08-15T17:42:22.112464Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.13921","last_updated":"2022-05-12T01:27:40Z","snapshot_observed_at":"2026-08-16T03:57:01.951598Z","submitted_at":"2021-04-28T17:58:57Z","title":"Open-vocabulary Object Detection via Vision and Language Knowledge Distillation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.13921","snapshot_observed_at":"2026-08-15T17:42:20.430512Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.430512Z"},"links":{"cited_paper":"/paper/2104.13921","citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:271db573de0d9c010e8a7312da9d05422c43b7eded3f99f53550b553578a8939","observation_id":"9e7d18cd-d11e-4c93-81a6-ddfe03eea393","resolution":{"observed_at":"2026-08-15T17:42:20.430512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:22.088494Z","title":null,"venue":null,"work_id":"48720c18-c0c2-4647-bdfc-5d9188e16409","year":2019},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.438463Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:b2ae6cdd9b5bc1f04bbcf08d48338debac79b01623ba19721725e47704c69376","observation_id":"fdf841b1-deec-4055-86dc-a2e38d60358e","resolution":{"observed_at":"2026-08-15T17:42:22.094391Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1709.00029","last_updated":"2019-02-01T09:51:18Z","snapshot_observed_at":"2026-08-14T20:37:11.220901Z","submitted_at":"2017-08-31T18:19:10Z","title":"EuroSAT: A Novel Dataset and Deep Learning Benchmark for Land Use and Land Cover Classification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.00029","snapshot_observed_at":"2026-08-15T17:42:20.445237Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.445237Z"},"links":{"cited_paper":"/paper/1709.00029","citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:f5b619e1b7841432440d75c995cc1786cbfc1cfad710de46b5f9a6d7e1b72582","observation_id":"c4c2c901-80be-4ed7-b27b-9eb20743f291","resolution":{"observed_at":"2026-08-15T17:42:20.445237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-14T22:57:08.956233Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-15T17:42:20.451151Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.451151Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:8dd1779bf3802ed5772c82291fa33b506799ae825094ec1a28e2211a2a8abc3a","observation_id":"171edab0-70b7-4257-96eb-5bf06912b160","resolution":{"observed_at":"2026-08-15T17:42:20.451151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.05918","last_updated":"2021-06-11T07:51:39Z","snapshot_observed_at":"2026-08-13T20:15:51.556270Z","submitted_at":"2021-02-11T10:08:12Z","title":"Scaling Up Visual and Vision-Language Representation Learning With Noisy Text Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.05918","snapshot_observed_at":"2026-08-15T17:42:20.457731Z","title":"Le, Yunhsuan Sung, Zhen Li, and Tom Duerig","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.457731Z"},"links":{"cited_paper":"/paper/2102.05918","citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:9dd20cd8dd4ffc4d1c9ce016622dcbe5e9e540f9d69d4cc8d860831be8a039d6","observation_id":"6b9a24a1-bcfe-45ed-99ca-0c0b7e41e17d","resolution":{"observed_at":"2026-08-15T17:42:20.457731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:20.466843Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.466843Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:47dcab8fdcebd6da7b96ea0164b3c277ae99f65a4030d5407fd424d969751160","observation_id":"50da61d6-bfd8-48b0-9168-e2903a26f9a2","resolution":{"observed_at":"2026-08-15T17:42:20.466843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:22.046909Z","title":null,"venue":null,"work_id":"73833f31-602d-4cd7-9b2c-721c27a2834b","year":2023},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.472325Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:3367e82bbc414067f646899b8d429f9bafe702419f594303072c4cf98ede32cd","observation_id":"88b4fd71-bb6d-4d78-bcbf-b63253b9562b","resolution":{"observed_at":"2026-08-15T17:42:22.054187Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.07932","last_updated":"2018-10-19T11:29:49Z","snapshot_observed_at":"2026-08-14T19:13:06.486523Z","submitted_at":"2018-05-21T07:58:31Z","title":"Bilinear Attention Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.07932","snapshot_observed_at":"2026-08-15T17:42:20.478179Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.478179Z"},"links":{"cited_paper":"/paper/1805.07932","citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:cb4fa47348f1dd66df93973d04e63cb45127bec3a43f476648bd1c9e58d2ef46","observation_id":"b5bd18f8-4233-480d-ae60-4e920092400a","resolution":{"observed_at":"2026-08-15T17:42:20.478179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:22.025751Z","title":null,"venue":null,"work_id":"636bf319-8c53-4907-9ac1-4015e00eeee3","year":2022},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.483831Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:ac082ea09e1e4d7fe526e401c8cff39b02230ddd437ff001eb1bb729b741864e","observation_id":"8702ff02-c692-41f3-bedc-08f53c2cbdde","resolution":{"observed_at":"2026-08-15T17:42:22.032314Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:20.488642Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.488642Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:3032cc08fff5d496600b9734d25f7b68d6f3ecb8c316741146ffe9b20268f382","observation_id":"c583cbaa-b3d4-472e-9494-595d7dc48dd2","resolution":{"observed_at":"2026-08-15T17:42:20.488642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:22.004333Z","title":"Weinberger, Serge Belongie, Vladlen Koltun, and René Ranftl","venue":null,"work_id":"cecba0c5-82ea-4268-857a-d89a4b316f5e","year":null},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.494758Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:422229dee038121a0bf7b4d380a604d8456819484c9a69d03a88abe2d9239b9a","observation_id":"9c8d6292-7299-486d-b431-f83aca9e96ac","resolution":{"observed_at":"2026-08-15T17:42:22.010136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:21.985071Z","title":null,"venue":null,"work_id":"404e7dca-a65a-479f-929f-f08a42acea09","year":2024},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.506299Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:982f5d3924757c2c289b5bd88530252380109f7fc9916c6466e7ed54ac414cc7","observation_id":"97a51559-03e4-41fd-a8ff-420db397ad17","resolution":{"observed_at":"2026-08-15T17:42:21.991024Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.02265","last_updated":"2019-08-06T17:33:52Z","snapshot_observed_at":"2026-08-14T14:46:41.013114Z","submitted_at":"2019-08-06T17:33:52Z","title":"ViLBERT: Pretraining Task-Agnostic Visiolinguistic Representations for Vision-and-Language Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.02265","snapshot_observed_at":"2026-08-15T17:42:20.512268Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.512268Z"},"links":{"cited_paper":"/paper/1908.02265","citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:16e5f4c5e9c8545f4b885ca0d221bd079b27ded8da41b49f894a966e67a34f5c","observation_id":"691bee43-3208-4384-888e-71ed7341d524","resolution":{"observed_at":"2026-08-15T17:42:20.512268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:20.518819Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.518819Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:b53da9bf13e006935c95ef3c6052f16e782ada04d8cc2e37d305bd0888796462","observation_id":"173ff759-306f-4eb5-a9dc-7e456b931008","resolution":{"observed_at":"2026-08-15T17:42:20.518819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.11430","last_updated":"2022-07-19T12:02:49Z","snapshot_observed_at":"2026-08-11T15:04:38.686756Z","submitted_at":"2021-11-22T18:59:29Z","title":"Class-agnostic Object Detection with Multi-modal Transformer","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.11430","snapshot_observed_at":"2026-08-15T17:42:20.525120Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.525120Z"},"links":{"cited_paper":"/paper/2111.11430","citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:19d27896d972a3612c56afd3b26b44324e42e68a0aabe3138564440bbb6b3cda","observation_id":"f4630150-07a8-43ee-847e-5a629293ba28","resolution":{"observed_at":"2026-08-15T17:42:20.525120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:20.530171Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.530171Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:7e3ebabe95d879b7d81b84a59e0b06b317721527fe11d4c3029df4d49e02bd5e","observation_id":"fd0b1256-c7d0-4563-a101-01cfb92616ab","resolution":{"observed_at":"2026-08-15T17:42:20.530171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:21.927760Z","title":null,"venue":null,"work_id":"7207365d-b52b-4a21-9eb1-b556dc24d988","year":2024},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.541820Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:d0f3dbb5560c9bbfdf71956ee417bf9ccab1058f31918bfad82cd5ba67590ad7","observation_id":"b201a111-a663-4028-bee1-1208cfa09d96","resolution":{"observed_at":"2026-08-15T17:42:21.933474Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:20.546833Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.546833Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:7dbf9952e427ef9ad411e1fa7e55511dd60a9e32f0a8ee0c1cf9a236bfd519fe","observation_id":"c1d77f2c-4a6f-4f65-b136-c09bd3a4aced","resolution":{"observed_at":"2026-08-15T17:42:20.546833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:21.908033Z","title":"Parkhi, Andrea Vedaldi, Andrew Zisserman, and C","venue":null,"work_id":"4555bd18-47cf-4100-a8d6-2a674dd0d165","year":2012},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.551905Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:03f3e72c2eb6daef17883c1bc96db1395b2ef3071f2dccf2ad7fcbbb0f30d1e6","observation_id":"59748ce7-885a-472b-a075-fb7b5fe71d61","resolution":{"observed_at":"2026-08-15T17:42:21.913680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:21.888405Z","title":null,"venue":null,"work_id":"4721fafc-cc87-4995-b178-4f2c5d110ccf","year":2019},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.557189Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:112fe00c7effdf592f1325994256cd3aed1dbabc9ce2a455140158df69f93377","observation_id":"6994f347-b1fe-4bc0-8ca1-e807f7cae4e2","resolution":{"observed_at":"2026-08-15T17:42:21.894102Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-15T17:42:20.563134Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.563134Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:2f931c44fe2e006370fc190fd9e0120021fbe8f504b76c131580651f4b7d6407","observation_id":"ccd47a3a-78b1-4a7d-acc3-0f4329f1867d","resolution":{"observed_at":"2026-08-15T17:42:20.563134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.01518","last_updated":"2022-03-21T08:27:06Z","snapshot_observed_at":"2026-08-13T17:22:54.526569Z","submitted_at":"2021-12-02T18:59:32Z","title":"DenseCLIP: Language-Guided Dense Prediction with Context-Aware Prompting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.01518","snapshot_observed_at":"2026-08-15T17:42:20.569635Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.569635Z"},"links":{"cited_paper":"/paper/2112.01518","citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:45fdc5ba0418cf4cae07bc4819e9cf274c27bdfaff0f1f373f1b71bdbfc83be2","observation_id":"88c4db47-4e3e-4d27-863b-1e058cf49a56","resolution":{"observed_at":"2026-08-15T17:42:20.569635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:20.575394Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.575394Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:2581d2c90865bfb9afb31f53905645e0bc3ea190950a273cb845f241ba44d846","observation_id":"7972b44e-6afe-429a-92f9-2f83463cdd97","resolution":{"observed_at":"2026-08-15T17:42:20.575394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:21.848611Z","title":null,"venue":null,"work_id":"2ac13c94-d55a-4767-b9a2-31767b1016b9","year":2004},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.581261Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:5e611a77df7d0632c1fa08a44de53ee303544f550395171b996b06764bd88c40","observation_id":"25c6a532-fd68-48be-9359-f7f22f571969","resolution":{"observed_at":"2026-08-15T17:42:21.854281Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-08-15T13:34:03.745436Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-15T17:42:20.586168Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.586168Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:b57b41cb75ef31678031856b169ff15e27ae0209efef62cc67a15261426621f3","observation_id":"21980f72-bf01-4a38-9a8b-23d11fddbab9","resolution":{"observed_at":"2026-08-15T17:42:20.586168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.07490","last_updated":"2019-12-03T19:30:19Z","snapshot_observed_at":"2026-08-14T12:12:43.486524Z","submitted_at":"2019-08-20T17:05:18Z","title":"LXMERT: Learning Cross-Modality Encoder Representations from Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.07490","snapshot_observed_at":"2026-08-15T17:42:20.591575Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.591575Z"},"links":{"cited_paper":"/paper/1908.07490","citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:3696cff7cd5b54b839d476fee3b0d17493750af8c6f572011937f05582335d64","observation_id":"6454ee2d-ec30-48ff-83e9-21231d796788","resolution":{"observed_at":"2026-08-15T17:42:20.591575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:21.827759Z","title":null,"venue":null,"work_id":"b47edb57-2bc1-4a24-bf71-ec0264dc05a2","year":2000},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.597881Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:c3848fb0e369c94b5da3956cf2d6f141bc64f76f7c77267ce400044def122841","observation_id":"580e3987-51d1-4a55-b096-277acc26eee3","resolution":{"observed_at":"2026-08-15T17:42:21.835419Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.13549","last_updated":"2019-11-05T03:56:06Z","snapshot_observed_at":"2026-08-14T16:24:49.754760Z","submitted_at":"2019-05-29T00:27:54Z","title":"Learning Robust Global Representations by Penalizing Local Predictive Power","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.13549","snapshot_observed_at":"2026-08-15T17:42:20.603037Z","title":"Xing, and Zachary C","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.603037Z"},"links":{"cited_paper":"/paper/1905.13549","citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:a4392753f2fe208b66020c2a2ade24fb2644c5f79914b0e31ebde4527e7ac9fc","observation_id":"33b4dd91-fa6c-4b69-b8a6-ea67f2d56e30","resolution":{"observed_at":"2026-08-15T17:42:20.603037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.07397","last_updated":"2023-07-14T15:15:45Z","snapshot_observed_at":"2026-08-13T10:55:24.423936Z","submitted_at":"2023-07-14T15:15:45Z","title":"Improving Zero-Shot Generalization for CLIP with Synthesized Prompts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.07397","snapshot_observed_at":"2026-08-15T17:42:20.609636Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.609636Z"},"links":{"cited_paper":"/paper/2307.07397","citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:b598b0778219a292b7e5ae9fddd7fb4a8162434c68f245f72660c8292a6d3ea4","observation_id":"780bd6d6-273e-40f1-973f-c71f8c620dff","resolution":{"observed_at":"2026-08-15T17:42:20.609636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:20.616028Z","title":"Ehinger, Aude Oliva, and Antonio Torralba","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.616028Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:c60d54d44f5a09b82c002140c8c6d03e4efdffa558aabb020f6f72d87fd44848","observation_id":"9442a691-76d7-4af4-a18e-41c7a0f2dce8","resolution":{"observed_at":"2026-08-15T17:42:20.616028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.10770","last_updated":"2019-06-25T22:16:03Z","snapshot_observed_at":"2026-08-15T08:54:55.785416Z","submitted_at":"2019-06-25T22:16:03Z","title":"Deep Modular Co-Attention Networks for Visual Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.10770","snapshot_observed_at":"2026-08-15T17:42:20.631859Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.631859Z"},"links":{"cited_paper":"/paper/1906.10770","citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:7645ff6d4427ab231602ff01298f9a90427226098deaa26465c6cc5ff511d640","observation_id":"d411c123-6c6b-4005-96fd-6083088b82a5","resolution":{"observed_at":"2026-08-15T17:42:20.631859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:21.794004Z","title":null,"venue":null,"work_id":"ed552b56-e775-4591-9f4c-05a5eed13bf2","year":2020},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.638290Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:ba34476a39d3eb05583584e2adbccef4febc0846968122eab06723a6324240ed","observation_id":"d2d86420-80db-46ae-a1ab-5b49f94f4215","resolution":{"observed_at":"2026-08-15T17:42:21.801174Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:21.770271Z","title":null,"venue":null,"work_id":"8fe0d2ee-80bc-4243-b902-6f8815170a80","year":2020},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.644665Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:57a85ca62fdc5faadcc8516cababd67473d8c998ff8469e8d9f48216361017e0","observation_id":"d7427dba-628a-4319-97f9-b170551b3f1f","resolution":{"observed_at":"2026-08-15T17:42:21.777714Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:21.746921Z","title":null,"venue":null,"work_id":"5b7137d0-685f-43ab-b41f-d5a667d7e3dc","year":2022},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.650818Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:afd728f976d0ed38d4899608d92f970620a1dea284bcff156bb14e3ef6d19906","observation_id":"6489b552-ff4d-45f1-9b02-1922364eac6c","resolution":{"observed_at":"2026-08-15T17:42:21.755013Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:21.722746Z","title":null,"venue":null,"work_id":"6d2ab5d6-ff92-4213-9a52-34848fed366c","year":2022},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.657427Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:416557be954080ae030273619bfd910c1e94020ef2399b492553ddce4f15c732","observation_id":"9bf16591-9c09-4bb8-8b00-2524930fe332","resolution":{"observed_at":"2026-08-15T17:42:21.730316Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.03930","last_updated":"2021-11-15T04:58:28Z","snapshot_observed_at":"2026-08-13T17:38:33.524743Z","submitted_at":"2021-11-06T18:09:22Z","title":"Tip-Adapter: Training-free CLIP-Adapter for Better Vision-Language Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.03930","snapshot_observed_at":"2026-08-15T17:42:20.669112Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.669112Z"},"links":{"cited_paper":"/paper/2111.03930","citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:a2027bcb7c3e698f2c70bb459540cee75d321be166d11e72738d3b5acec1db9b","observation_id":"9bbfd4bf-60a3-4bdc-845c-291435d5091f","resolution":{"observed_at":"2026-08-15T17:42:20.669112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:20.675816Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.675816Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:cefc8bb830466000f0b89b672e220ca1a6a348c94d268d622391cae16bd98883","observation_id":"79c287e7-5c5b-4460-8770-8be653cdccd8","resolution":{"observed_at":"2026-08-15T17:42:20.675816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:20.682054Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.682054Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:664865efe46f65bcdd95d29650d638224594a0bb2660d37bd031086b29f65764","observation_id":"1fc15532-e976-498b-9774-e2002c81d14b","resolution":{"observed_at":"2026-08-15T17:42:20.682054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.05557","last_updated":"2022-10-06T11:52:39Z","snapshot_observed_at":"2026-08-13T16:25:20.605925Z","submitted_at":"2022-03-10T18:59:41Z","title":"Conditional Prompt Learning for Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.05557","snapshot_observed_at":"2026-08-15T17:42:20.688267Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.688267Z"},"links":{"cited_paper":"/paper/2203.05557","citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:ed7460b2310fd3f5ce1cda61070b87ef2d6ab2edebdd65d0212bbb72af319484","observation_id":"9a2f7b95-5d66-434c-9072-964ac3ef5f06","resolution":{"observed_at":"2026-08-15T17:42:20.688267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:20.694165Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.694165Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:794d12d24f4d3154dd6f5bd622dd24e39351dfaef4ce245da7d2c31df33ada8d","observation_id":"8a64f2ab-10d0-4692-8e4c-8a062aa7a2e4","resolution":{"observed_at":"2026-08-15T17:42:20.694165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:42:20.622455Z","title":"In 2010 IEEE Computer Society Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.622455Z"},"links":{"citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:53fdad5117dcb4fc14ec83d94bbb924b708af1951279098bbbddf119f677c74a","observation_id":"a747b341-88e4-422d-921b-a8a28d639ac9","resolution":{"observed_at":"2026-08-15T17:42:20.622455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1306.5151","last_updated":"2013-06-21T14:31:57Z","snapshot_observed_at":"2026-08-12T17:35:23.022229Z","submitted_at":"2013-06-21T14:31:57Z","title":"Fine-Grained Visual Classification of Aircraft","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1306.5151","snapshot_observed_at":"2026-08-15T17:42:20.535761Z","title":"arXiv:1306.5151 [cs.CV]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.535761Z"},"links":{"cited_paper":"/paper/1306.5151","citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:d2720246ddb8b6133fe3af3361e25f80d4314e90ff679bce4da2ddcc462b081b","observation_id":"54cdff85-7d59-47b7-8529-eacff878a346","resolution":{"observed_at":"2026-08-15T17:42:20.535761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.01401","last_updated":"2021-10-18T06:52:31Z","snapshot_observed_at":"2026-08-08T13:22:35.919401Z","submitted_at":"2021-06-02T18:09:11Z","title":"Container: Context Aggregation Network","version":2},"cited_work":{"arxiv_id":"2106.01401","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.01401","snapshot_observed_at":"2026-08-15T17:42:21.431354Z","title":"Container: Context Aggregation Network","venue":"cs.CV","work_id":"c7b3e15f-db5f-4283-bce4-a69211cf8bce","year":2021},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.423702Z"},"links":{"cited_paper":"/paper/2106.01401","citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:9844568dd16bcb3615862f617c6c16c75e1e7cc301dbe60ac1b2122e8f8f0bd2","observation_id":"5f90e7e1-f6e7-4525-835f-4953b2b516f1","resolution":{"observed_at":"2026-08-15T17:42:21.441547Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.03546","last_updated":"2022-04-03T03:33:43Z","snapshot_observed_at":"2026-08-01T06:14:31.660540Z","submitted_at":"2022-01-10T18:59:10Z","title":"Language-driven Semantic Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.03546","snapshot_observed_at":"2026-08-15T17:42:20.499853Z","title":"arXiv:2201.03546 [cs.CV]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:20.499853Z"},"links":{"cited_paper":"/paper/2201.03546","citing_paper":"/paper/2508.08644"},"observation_digest":"sha256:b458ddaaae5e35d089596bdfb0ae4fdbf2d2229f6f099bee06bcc115d7cca1ce","observation_id":"43bbdb1c-730a-4207-9a7c-662602a8977d","resolution":{"observed_at":"2026-08-15T17:42:20.499853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.08644","last_updated":"2025-08-12T05:16:00Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T17:31:43.996364Z","submitted_at":"2025-08-12T05:16:00Z","title":"AME: Aligned Manifold Entropy for Robust Vision-Language Distillation"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":54,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 0 inbound Pith citation observations for arXiv:2508.08644."}