{"as_of":"2026-08-15T23:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:77c15682e09ed8261eb2c9bf30ed7ea0c23b392a1a476d99747e349474543cb5","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":28,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:01:38.625976Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T15:47:23.261860Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm","version":2},"cited_work":{"arxiv_id":"2110.05208","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.05208","snapshot_observed_at":"2026-07-10T15:47:23.261860Z","title":"Supervision exists everywhere: A data efficient contrastive language-image pre-training paradigm.arXiv preprint arXiv:2110.05208","venue":"cs.CV","work_id":"159f37ef-6281-4848-9530-1c3c4dd82ad5","year":2021},"citing_paper":{"arxiv_id":"2208.14649","last_updated":"2026-04-22T00:33:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-31T06:18:10Z","title":"DetailCLIP: Injecting Image Details into CLIP's Feature Space","version":7},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-24T11:08:20.298043Z"},"links":{"cited_paper":"/paper/2110.05208","citing_paper":"/paper/2208.14649"},"observation_digest":"sha256:da3dc348c6c3e2e05494726878d8356700d8190574c51ce94fc59fcfa6641d56","observation_id":"c3088681-764d-47e2-bfed-00f40ccd0737","resolution":{"observed_at":"2026-05-24T11:09:22.475201Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm","version":2},"cited_work":{"arxiv_id":"2110.05208","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.05208","snapshot_observed_at":"2026-07-10T15:47:23.261860Z","title":"Supervision exists everywhere: A data efficient contrastive language-image pre-training paradigm.arXiv preprint arXiv:2110.05208","venue":"cs.CV","work_id":"159f37ef-6281-4848-9530-1c3c4dd82ad5","year":2021},"citing_paper":{"arxiv_id":"2309.16671","last_updated":"2025-11-23T00:34:43Z","snapshot_observed_at":"2026-08-02T18:24:11.208164Z","submitted_at":"2023-09-28T17:59:56Z","title":"Demystifying CLIP Data","version":6},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-05-16T09:20:20.143143Z"},"links":{"cited_paper":"/paper/2110.05208","citing_paper":"/paper/2309.16671"},"observation_digest":"sha256:ca51301c6c1965ec2bb3f93e18a0124c03a3e88bd4184224e943369000f50d15","observation_id":"43973210-4fda-49f0-b1e1-5407148d264f","resolution":{"observed_at":"2026-05-16T09:20:20.309226Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm","version":2},"cited_work":{"arxiv_id":"2110.05208","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.05208","snapshot_observed_at":"2026-07-10T15:47:23.261860Z","title":"Supervision exists everywhere: A data efficient contrastive language-image pre-training paradigm.arXiv preprint arXiv:2110.05208","venue":"cs.CV","work_id":"159f37ef-6281-4848-9530-1c3c4dd82ad5","year":2021},"citing_paper":{"arxiv_id":"2403.14608","last_updated":"2024-09-16T02:54:50Z","snapshot_observed_at":"2026-08-04T09:07:42.158421Z","submitted_at":"2024-03-21T17:55:50Z","title":"Parameter-Efficient Fine-Tuning for Large Models: A Comprehensive Survey","version":7},"reference_index":201,"source":"pdf_text","source_observed_at":"2026-05-13T11:32:36.738536Z"},"links":{"cited_paper":"/paper/2110.05208","citing_paper":"/paper/2403.14608"},"observation_digest":"sha256:b1c6a1d6e3bf0e2ef9987295e7b5b1468a7a3446e57ff052ec2dd0ddee4a096e","observation_id":"2b4ca0b7-0483-459c-8a3a-09de53af94b3","resolution":{"observed_at":"2026-05-13T11:32:36.972218Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05208","snapshot_observed_at":"2026-08-12T21:23:18.755350Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.08842","last_updated":"2024-11-13T18:20:29Z","snapshot_observed_at":"2026-08-15T15:09:42.113539Z","submitted_at":"2024-11-13T18:20:29Z","title":"AstroM$^3$: A self-supervised multimodal model for astronomy","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-12T21:23:18.755350Z"},"links":{"cited_paper":"/paper/2110.05208","citing_paper":"/paper/2411.08842"},"observation_digest":"sha256:169fae67b52f78d2ba5fe64fa28c615b84a8b90b6bc014d3490dfc1724671c05","observation_id":"9066309a-9e9b-43bb-8d46-653d2303d4e6","resolution":{"observed_at":"2026-08-12T21:23:18.755350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05208","snapshot_observed_at":"2026-08-12T17:55:23.799740Z","title":"Supervision exists everywhere: A data efficient contrastive language-image pre-training paradigm","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.12156","last_updated":"2024-11-19T01:26:20Z","snapshot_observed_at":"2026-08-13T10:28:20.380423Z","submitted_at":"2024-11-19T01:26:20Z","title":"HNCSE: Advancing Sentence Embeddings via Hybrid Contrastive Learning with Hard Negatives","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-12T17:55:23.799740Z"},"links":{"cited_paper":"/paper/2110.05208","citing_paper":"/paper/2411.12156"},"observation_digest":"sha256:36962274b936acfe8d908425e73542d35ab0765e4fc1802c5878268a50023c66","observation_id":"e3248fd1-ec62-4470-8ee1-387d7052c612","resolution":{"observed_at":"2026-08-12T17:55:23.799740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05208","snapshot_observed_at":"2026-08-12T14:59:52.135248Z","title":"Supervision exists everywhere: A data efficient contrastive language-image pre-training paradigm","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.14789","last_updated":"2025-01-13T07:29:53Z","snapshot_observed_at":"2026-08-15T20:44:10.408662Z","submitted_at":"2024-11-22T08:17:46Z","title":"Simplifying CLIP: Unleashing the Power of Large-Scale Models on Consumer-level Computers","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T14:59:52.135248Z"},"links":{"cited_paper":"/paper/2110.05208","citing_paper":"/paper/2411.14789"},"observation_digest":"sha256:d6f750b6fb65d044920f2ca362def3dbd2befd7fab350d21fc02dedef50f3cbd","observation_id":"9e9d7ef6-4019-4fdb-ad6a-63b163c52140","resolution":{"observed_at":"2026-08-12T14:59:52.135248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05208","snapshot_observed_at":"2026-08-12T14:24:55.429777Z","title":"Su- pervision exists everywhere: A data efficient contrastive language-image pre-training paradigm","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.15421","last_updated":"2024-11-26T13:25:34Z","snapshot_observed_at":"2026-08-13T23:49:26.123194Z","submitted_at":"2024-11-23T02:53:08Z","title":"OphCLIP: Hierarchical Retrieval-Augmented Learning for Ophthalmic Surgical Video-Language Pretraining","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:55.429777Z"},"links":{"cited_paper":"/paper/2110.05208","citing_paper":"/paper/2411.15421"},"observation_digest":"sha256:2ad563a11dc3ee9c287c8c94dab201188f93b79012932760906ae862bf9e5dd0","observation_id":"5a182fec-8b24-4af0-aba6-5b67af6419af","resolution":{"observed_at":"2026-08-12T14:24:55.429777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05208","snapshot_observed_at":"2026-08-11T22:19:06.735220Z","title":"Su- pervision exists everywhere: A data efficient contrastive language-image pre-training paradigm","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03561","last_updated":"2024-12-04T18:56:04Z","snapshot_observed_at":"2026-08-15T07:02:35.320754Z","submitted_at":"2024-12-04T18:56:04Z","title":"FLAIR: VLM with Fine-grained Language-informed Image Representations","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T22:19:06.735220Z"},"links":{"cited_paper":"/paper/2110.05208","citing_paper":"/paper/2412.03561"},"observation_digest":"sha256:ebec2f9ce9a493a7b95bd76908670cf794eed261f7ad5d4f2b5ec8e646db1558","observation_id":"7827851f-bd7d-4a94-8440-0bda523518d5","resolution":{"observed_at":"2026-08-11T22:19:06.735220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05208","snapshot_observed_at":"2026-08-11T21:29:26.418704Z","title":"Su- pervision exists everywhere: A data efficient contrastive language-image pre-training paradigm","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.04378","last_updated":"2025-05-08T19:16:29Z","snapshot_observed_at":"2026-08-14T18:05:39.883853Z","submitted_at":"2024-12-05T17:54:27Z","title":"VladVA: Discriminative Fine-tuning of LVLMs","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T21:29:26.418704Z"},"links":{"cited_paper":"/paper/2110.05208","citing_paper":"/paper/2412.04378"},"observation_digest":"sha256:5708bc9062d0cb8d428c50a6c16b09d7f61139c1ad73df0ae76c2f29b6aba7d8","observation_id":"eaed1dd4-93c9-428d-b2f0-f0d9497deb5b","resolution":{"observed_at":"2026-08-11T21:29:26.418704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05208","snapshot_observed_at":"2026-08-11T19:11:02.387573Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.07119","last_updated":"2024-12-10T02:21:39Z","snapshot_observed_at":"2026-08-14T03:27:46.875678Z","submitted_at":"2024-12-10T02:21:39Z","title":"DiffCLIP: Few-shot Language-driven Multimodal Classifier","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T19:11:02.387573Z"},"links":{"cited_paper":"/paper/2110.05208","citing_paper":"/paper/2412.07119"},"observation_digest":"sha256:4e5a0b5e1769c110b81ea68d661f91890e0484d10beed57242197bd97cc30947","observation_id":"55cfc67b-9615-45a6-b1c6-22fd8b29633a","resolution":{"observed_at":"2026-08-11T19:11:02.387573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05208","snapshot_observed_at":"2026-08-11T16:32:24.360452Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10029","last_updated":"2024-12-13T10:39:31Z","snapshot_observed_at":"2026-08-12T06:42:37.893819Z","submitted_at":"2024-12-13T10:39:31Z","title":"Enhancing Fine-Grained Vision-Language Pretraining with Negative Augmented Samples","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T16:32:24.360452Z"},"links":{"cited_paper":"/paper/2110.05208","citing_paper":"/paper/2412.10029"},"observation_digest":"sha256:25d41ca7031c5bc0152994ee7313194e5a98d25b02684e9e2bda295aac653e2c","observation_id":"36871028-b91e-4da9-a0f0-6ea3e3c58058","resolution":{"observed_at":"2026-08-11T16:32:24.360452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05208","snapshot_observed_at":"2026-08-11T18:10:44.688935Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.10435","last_updated":"2025-07-02T21:50:59Z","snapshot_observed_at":"2026-08-14T12:30:59.887723Z","submitted_at":"2024-12-11T08:10:32Z","title":"COEF-VQ: Cost-Efficient Video Quality Understanding through a Cascaded Multimodal LLM Framework","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T18:10:44.688935Z"},"links":{"cited_paper":"/paper/2110.05208","citing_paper":"/paper/2412.10435"},"observation_digest":"sha256:429992c93b7945c75f9166fb961fa69b8f8ba69091d1f1cdf47e855d66ceb9d2","observation_id":"c8d1c715-6f9e-4bdd-a4f7-801b17483251","resolution":{"observed_at":"2026-08-11T18:10:44.688935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05208","snapshot_observed_at":"2026-08-10T22:10:19.572614Z","title":"Supervision exists everywhere: A data efficient contrastive language - image pre-training paradigm","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.03284","last_updated":"2025-01-06T03:14:47Z","snapshot_observed_at":"2026-08-13T01:18:39.720537Z","submitted_at":"2025-01-06T03:14:47Z","title":"Sensorformer: Cross-patch attention with global-patch compression is effective for high-dimensional multivariate time series forecasting","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T22:10:19.572614Z"},"links":{"cited_paper":"/paper/2110.05208","citing_paper":"/paper/2501.03284"},"observation_digest":"sha256:adc40f77a0645a72fff69a96ee19a3eec1c076dbb9f3369a16353dd4d0c4a86a","observation_id":"4ff8a9fe-0978-4103-95c2-21f22b981205","resolution":{"observed_at":"2026-08-10T22:10:19.572614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05208","snapshot_observed_at":"2026-08-10T18:40:27.171479Z","title":"Supervision exists everywhere: A data efficient con- trastive language-image pre-training paradigm","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.11175","last_updated":"2025-01-19T21:25:53Z","snapshot_observed_at":"2026-08-15T17:59:21.502153Z","submitted_at":"2025-01-19T21:25:53Z","title":"ProKeR: A Kernel Perspective on Few-Shot Adaptation of Large Vision-Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T18:40:27.171479Z"},"links":{"cited_paper":"/paper/2110.05208","citing_paper":"/paper/2501.11175"},"observation_digest":"sha256:5ecfef2d2c993ba792b1d734a115b15463832718a51c5749b8a72192c732a3f1","observation_id":"e7fbefa1-7d61-472e-9f7b-ca5749a063c4","resolution":{"observed_at":"2026-08-10T18:40:27.171479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05208","snapshot_observed_at":"2026-08-09T14:32:36.832435Z","title":"Supervision exists everywhere: A data efficient contrastive language- image pre-training paradigm,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.01785","last_updated":"2025-02-03T19:56:16Z","snapshot_observed_at":"2026-08-15T09:32:32.725190Z","submitted_at":"2025-02-03T19:56:16Z","title":"AquaticCLIP: A Vision-Language Foundation Model for Underwater Scene Analysis","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-09T14:32:36.832435Z"},"links":{"cited_paper":"/paper/2110.05208","citing_paper":"/paper/2502.01785"},"observation_digest":"sha256:728c69a56ffa87953ba081d05c9363c502eabf2e5c8b6c2a09ecd32be051ca5d","observation_id":"1af0c70c-95e4-4bc5-ae4f-476ff02b4339","resolution":{"observed_at":"2026-08-09T14:32:36.832435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05208","snapshot_observed_at":"2026-08-08T23:05:28.238464Z","title":"Supervision exists everywhere: A data efficient contrastive language-image pre-training paradigm","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04263","last_updated":"2025-02-06T17:58:59Z","snapshot_observed_at":"2026-08-10T12:43:07.597859Z","submitted_at":"2025-02-06T17:58:59Z","title":"Cross the Gap: Exposing the Intra-modal Misalignment in CLIP via Modality Inversion","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-08T23:05:28.238464Z"},"links":{"cited_paper":"/paper/2110.05208","citing_paper":"/paper/2502.04263"},"observation_digest":"sha256:c0681e9a3288353d785fb20f073edaf9f06922916b8e06fd81e487e4fd8e769c","observation_id":"7eaf461c-ec4e-4ac5-bf04-695ec715f0a5","resolution":{"observed_at":"2026-08-08T23:05:28.238464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05208","snapshot_observed_at":"2026-08-15T21:01:38.625976Z","title":"Supervision exists everywhere: A data efficient contrastive language-image pre- training paradigm","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.11216","last_updated":"2025-05-16T13:12:41Z","snapshot_observed_at":"2026-08-15T23:38:07.984232Z","submitted_at":"2025-05-16T13:12:41Z","title":"GeoMM: On Geodesic Perspective for Multi-modal Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T21:01:38.625976Z"},"links":{"cited_paper":"/paper/2110.05208","citing_paper":"/paper/2505.11216"},"observation_digest":"sha256:96221ef2cfd45cc7c41d0ecc4d52b36278cdbfe8300c2280ca64e94620803394","observation_id":"b18e0303-3dcd-4727-b2b8-c843df5c473e","resolution":{"observed_at":"2026-08-15T21:01:38.625976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05208","snapshot_observed_at":"2026-08-15T20:53:54.703738Z","title":"Supervision exists everywhere: A data efficient con- trastive language-image pre-training paradigm","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.11758","last_updated":"2026-05-25T11:20:14Z","snapshot_observed_at":"2026-08-15T20:46:10.703756Z","submitted_at":"2025-05-16T23:39:34Z","title":"Generalizable Vision-Language Few-Shot Adaptation with Predictive Prompts and Negative Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T20:53:54.703738Z"},"links":{"cited_paper":"/paper/2110.05208","citing_paper":"/paper/2505.11758"},"observation_digest":"sha256:d6898370721f6e766bb7f81ad61cd86fb240dd52f08edd548a37606adbd42dff","observation_id":"9cc2e9ac-1017-478e-a544-49dab47ca017","resolution":{"observed_at":"2026-08-15T20:53:54.703738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05208","snapshot_observed_at":"2026-08-07T13:21:11.100535Z","title":"Su- pervision exists everywhere: A data efficient contrastive language-image pre-training paradigm.arXiv preprint arXiv:2110.05208, 2021","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22079","last_updated":"2025-05-28T08:00:18Z","snapshot_observed_at":"2026-08-11T15:28:00.033815Z","submitted_at":"2025-05-28T08:00:18Z","title":"Bringing CLIP to the Clinic: Dynamic Soft Labels and Negation-Aware Learning for Medical Analysis","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:11.100535Z"},"links":{"cited_paper":"/paper/2110.05208","citing_paper":"/paper/2505.22079"},"observation_digest":"sha256:158d7ea1cf4624e596850f85946d2eb14f4a0b4d573249104e156cfbabd00270","observation_id":"d77a6c48-9565-4f39-98f8-80179d8c550b","resolution":{"observed_at":"2026-08-07T13:21:11.100535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05208","snapshot_observed_at":"2026-08-07T13:50:49.294185Z","title":"Su- pervision exists everywhere: A data efficient contrastive language-image pre-training paradigm.arXiv preprint arXiv:2110.05208, 2021","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08023","last_updated":"2025-05-27T08:13:08Z","snapshot_observed_at":"2026-08-15T23:29:25.862015Z","submitted_at":"2025-05-27T08:13:08Z","title":"Aligning Proteins and Language: A Foundation Model for Protein Retrieval","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:50:49.294185Z"},"links":{"cited_paper":"/paper/2110.05208","citing_paper":"/paper/2506.08023"},"observation_digest":"sha256:30570ff4f1e3bd59b188c894fbebcbddea33ae21c384d1bfed971f72956c0d65","observation_id":"016af8a9-8f2a-410a-80f5-dbd356d88a0f","resolution":{"observed_at":"2026-08-07T13:50:49.294185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05208","snapshot_observed_at":"2026-08-07T01:06:20.470954Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.11967","last_updated":"2025-06-13T17:25:27Z","snapshot_observed_at":"2026-08-15T09:07:02.111235Z","submitted_at":"2025-06-13T17:25:27Z","title":"Visual Pre-Training on Unlabeled Images using Reinforcement Learning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T01:06:20.470954Z"},"links":{"cited_paper":"/paper/2110.05208","citing_paper":"/paper/2506.11967"},"observation_digest":"sha256:00e16b873f3137529632f1a95ba72ee761d8fbd2c92239b3595029aa1f47b91e","observation_id":"34035c79-8394-499e-ab5e-55eef93e6e98","resolution":{"observed_at":"2026-08-07T01:06:20.470954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05208","snapshot_observed_at":"2026-08-06T15:07:31.213119Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16716","last_updated":"2025-07-22T15:54:53Z","snapshot_observed_at":"2026-08-13T18:31:31.105779Z","submitted_at":"2025-07-22T15:54:53Z","title":"Enhancing Remote Sensing Vision-Language Models Through MLLM and LLM-Based High-Quality Image-Text Dataset Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:07:31.213119Z"},"links":{"cited_paper":"/paper/2110.05208","citing_paper":"/paper/2507.16716"},"observation_digest":"sha256:1a24c1b0360e9addb916f665390f4735d84f60dea3873f856c8daa5fcec80395","observation_id":"a9d6ab1f-8d29-4de2-b802-510eeafda76c","resolution":{"observed_at":"2026-08-06T15:07:31.213119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05208","snapshot_observed_at":"2026-08-05T14:59:19.571959Z","title":"Supervision exists everywhere: A data efficient contrastive language-image pre-training paradigm.arXiv preprint arXiv:2110.05208,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.20691","last_updated":"2025-08-28T11:50:22Z","snapshot_observed_at":"2026-08-12T19:21:49.224477Z","submitted_at":"2025-08-28T11:50:22Z","title":"MobileCLIP2: Improving Multi-Modal Reinforced Training","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T14:59:19.571959Z"},"links":{"cited_paper":"/paper/2110.05208","citing_paper":"/paper/2508.20691"},"observation_digest":"sha256:6bac12d0d3804268071daef56eaa188a5600f8827964e8b2e564ec031e2a90ea","observation_id":"7568b478-a665-4c51-b333-02e35e594616","resolution":{"observed_at":"2026-08-05T14:59:19.571959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm","version":2},"cited_work":{"arxiv_id":"2110.05208","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.05208","snapshot_observed_at":"2026-07-10T15:47:23.261860Z","title":"Supervision exists everywhere: A data efficient contrastive language-image pre-training paradigm.arXiv preprint arXiv:2110.05208","venue":"cs.CV","work_id":"159f37ef-6281-4848-9530-1c3c4dd82ad5","year":2021},"citing_paper":{"arxiv_id":"2604.13970","last_updated":"2026-04-15T15:19:54Z","snapshot_observed_at":"2026-07-06T23:01:50.745555Z","submitted_at":"2026-04-15T15:19:54Z","title":"MApLe: Multi-instance Alignment of Diagnostic Reports and Large Medical Images","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T13:33:02.946839Z"},"links":{"cited_paper":"/paper/2110.05208","citing_paper":"/paper/2604.13970"},"observation_digest":"sha256:0c5d355575587116b0c48146bea2a05010c32e0289fc0de38f35eeeec5687f83","observation_id":"31375c32-c378-4279-8aa1-deb280288a65","resolution":{"observed_at":"2026-05-10T13:35:26.369563Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm","version":2},"cited_work":{"arxiv_id":"2110.05208","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.05208","snapshot_observed_at":"2026-07-10T15:47:23.261860Z","title":"Supervision exists everywhere: A data efficient contrastive language-image pre-training paradigm.arXiv preprint arXiv:2110.05208","venue":"cs.CV","work_id":"159f37ef-6281-4848-9530-1c3c4dd82ad5","year":2021},"citing_paper":{"arxiv_id":"2605.15615","last_updated":"2026-05-15T04:54:08Z","snapshot_observed_at":"2026-08-15T00:08:24.701727Z","submitted_at":"2026-05-15T04:54:08Z","title":"Neutral-Reference Prompting for Vision-Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T19:15:54.152498Z"},"links":{"cited_paper":"/paper/2110.05208","citing_paper":"/paper/2605.15615"},"observation_digest":"sha256:9ca2849ddd46ed2f0419c926fec132328b656fa95eb76ac20e241c64d6fab3b1","observation_id":"b90db992-73a4-4d65-b59c-e8ee759f25d4","resolution":{"observed_at":"2026-05-20T19:18:54.591922Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm","version":2},"cited_work":{"arxiv_id":"2110.05208","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.05208","snapshot_observed_at":"2026-07-10T15:47:23.261860Z","title":"Supervision exists everywhere: A data efficient contrastive language-image pre-training paradigm.arXiv preprint arXiv:2110.05208","venue":"cs.CV","work_id":"159f37ef-6281-4848-9530-1c3c4dd82ad5","year":2021},"citing_paper":{"arxiv_id":"2606.26794","last_updated":"2026-06-25T09:27:54Z","snapshot_observed_at":"2026-08-03T16:40:37.506200Z","submitted_at":"2026-06-25T09:27:54Z","title":"ReasonCLIP-58M: Visually Grounded Commonsense Reasoning Supervision for CLIP","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-26T05:03:15.044146Z"},"links":{"cited_paper":"/paper/2110.05208","citing_paper":"/paper/2606.26794"},"observation_digest":"sha256:d223749575e01ad6b9a87d3deb0c84b43339984a4b5a1d54a713aaf57bc51076","observation_id":"40426464-81bd-4cec-aac9-4c6a226316bf","resolution":{"observed_at":"2026-07-04T13:39:50.752092Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm","version":2},"cited_work":{"arxiv_id":"2110.05208","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.05208","snapshot_observed_at":"2026-07-10T15:47:23.261860Z","title":"Supervision exists everywhere: A data efficient contrastive language-image pre-training paradigm.arXiv preprint arXiv:2110.05208","venue":"cs.CV","work_id":"159f37ef-6281-4848-9530-1c3c4dd82ad5","year":2021},"citing_paper":{"arxiv_id":"2607.07907","last_updated":"2026-07-08T20:42:46Z","snapshot_observed_at":"2026-08-14T01:59:45.772219Z","submitted_at":"2026-07-08T20:42:46Z","title":"Multimodal Unlearning Across Vision, Language, Video, and Audio: Survey of Methods, Datasets, and Benchmarks","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-07-10T15:38:58.361411Z"},"links":{"cited_paper":"/paper/2110.05208","citing_paper":"/paper/2607.07907"},"observation_digest":"sha256:c30e4a9a226d4d7d98183122a779cca9bb6330a640dc5cb63d07243927ae9ad0","observation_id":"e444a6ec-ce9f-4c29-9e81-52cb1ed6fd91","resolution":{"observed_at":"2026-07-10T15:47:23.263021Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05208","snapshot_observed_at":"2026-08-15T14:37:07.932304Z","title":"arXiv preprint arXiv:2110.05208 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06467","last_updated":"2026-08-06T18:02:20Z","snapshot_observed_at":"2026-08-15T14:30:59.577251Z","submitted_at":"2026-08-06T18:02:20Z","title":"Test-Time Adaptation with Online Personalized Energy-Based Cache for Fine-Grained Video Expression Recognition","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-15T14:37:07.932304Z"},"links":{"cited_paper":"/paper/2110.05208","citing_paper":"/paper/2608.06467"},"observation_digest":"sha256:6496451e81e5e2f3e4a612ef0c4a1b0f9ab4437c71816e96b4d4c6fb997b7c2f","observation_id":"89e3af63-ede3-4e24-89ff-40271e8def59","resolution":{"observed_at":"2026-08-15T14:37:07.932304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2110.05208/citation-record","integrity":"/paper/2110.05208/integrity","json":"/paper/2110.05208/citation-record.json","paper":"/paper/2110.05208"},"outbound":[],"paper":{"arxiv_id":"2110.05208","last_updated":"2022-03-14T08:53:07Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T17:55:27.704848Z","submitted_at":"2021-10-11T12:17:32Z","title":"Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 28 inbound Pith citation observations for arXiv:2110.05208."}