{"as_of":"2026-08-16T17:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9db50dd587711d70caed2cdae4c4ac81b9071a804b3288042b61f77734c5a5e1","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":24,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:54:30.719496Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T19:56:11.264751Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-16T16:24:23.857686Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":"2210.07225","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-07-01T19:56:11.264751Z","title":"Unified vision and language prompt learning","venue":null,"work_id":"1f5888f6-45b3-4315-b4bf-61f128fcfcd0","year":2022},"citing_paper":{"arxiv_id":"2407.17491","last_updated":"2026-04-03T23:10:26Z","snapshot_observed_at":"2026-08-13T12:50:57.041166Z","submitted_at":"2024-07-04T02:35:00Z","title":"Robust Adaptation of Foundation Models with Black-Box Visual Prompting","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-23T23:23:03.562550Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2407.17491"},"observation_digest":"sha256:1e9b775cdf7397bf87659b5a3ba886449c536ffadc28953d296f25d3ee47e7ec","observation_id":"9b391797-2dda-4b4e-bf9b-be54cf8708e6","resolution":{"observed_at":"2026-05-23T23:23:36.362418Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-16T16:24:23.857686Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-12T19:14:24.286924Z","title":"Unified vision and language prompt learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.10928","last_updated":"2024-11-17T01:16:37Z","snapshot_observed_at":"2026-08-14T10:09:58.775826Z","submitted_at":"2024-11-17T01:16:37Z","title":"Learn from Downstream and Be Yourself in Multimodal Large Language Model Fine-Tuning","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-12T19:14:24.286924Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2411.10928"},"observation_digest":"sha256:89a2175c135190cd7ee87034dc4619a29d17155ac0ce8663569a7bccae5e2c9a","observation_id":"7fa3b420-754e-499b-9489-2fb4b47b4d9c","resolution":{"observed_at":"2026-08-12T19:14:24.286924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-16T16:24:23.857686Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-11T17:27:49.486626Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.08979","last_updated":"2024-12-12T06:26:02Z","snapshot_observed_at":"2026-08-16T11:33:54.761750Z","submitted_at":"2024-12-12T06:26:02Z","title":"A Wander Through the Multimodal Landscape: Efficient Transfer Learning via Low-rank Sequence Multimodal Adapter","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T17:27:49.486626Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2412.08979"},"observation_digest":"sha256:0df430800781763bde9c003fb86ee00c9c14f8ae19ec40cca8e7bf7aafeb53d4","observation_id":"2fae7ffd-2efb-4a74-832f-e2492235e3c3","resolution":{"observed_at":"2026-08-11T17:27:49.486626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-16T16:24:23.857686Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-11T15:20:47.281351Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11087","last_updated":"2024-12-15T07:09:02Z","snapshot_observed_at":"2026-08-15T19:54:00.452893Z","submitted_at":"2024-12-15T07:09:02Z","title":"Leveraging Large Vision-Language Model as User Intent-aware Encoder for Composed Image Retrieval","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-11T15:20:47.281351Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2412.11087"},"observation_digest":"sha256:23bafd81bfb9365fef5a1ef54a04c4953a649ab4acc81211b4e3193a60587145","observation_id":"5004d9f0-efa5-4d6c-956a-19b78d0446eb","resolution":{"observed_at":"2026-08-11T15:20:47.281351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-16T16:24:23.857686Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-11T14:57:26.850243Z","title":"Unified vision and language prompt learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11484","last_updated":"2024-12-16T06:53:00Z","snapshot_observed_at":"2026-08-15T21:19:39.311459Z","submitted_at":"2024-12-16T06:53:00Z","title":"Efficient Policy Adaptation with Contrastive Prompt Ensemble for Embodied Agents","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:26.850243Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2412.11484"},"observation_digest":"sha256:7e69b17c13e616ca771637fe685901da69e61e60706b03310ce2a61b35b1a8e3","observation_id":"1d8a6df2-3b78-4d5b-b138-bac6621499c6","resolution":{"observed_at":"2026-08-11T14:57:26.850243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-16T16:24:23.857686Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-10T22:54:52.244277Z","title":"Unified vi- sion and language prompt learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.00457","last_updated":"2024-12-31T14:13:28Z","snapshot_observed_at":"2026-08-15T18:22:17.984449Z","submitted_at":"2024-12-31T14:13:28Z","title":"Differentiable Prompt Learning for Vision Language Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:52.244277Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2501.00457"},"observation_digest":"sha256:c73f5b7ded614e8146f68df53d1df29194126af0eeec35b1bfccf9430d2d6918","observation_id":"d83aaa4e-80f9-4c28-a96b-cb41c20b476a","resolution":{"observed_at":"2026-08-10T22:54:52.244277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-16T16:24:23.857686Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-10T18:40:27.352337Z","title":"Unified vision and language prompt learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.11175","last_updated":"2025-01-19T21:25:53Z","snapshot_observed_at":"2026-08-15T17:59:21.502153Z","submitted_at":"2025-01-19T21:25:53Z","title":"ProKeR: A Kernel Perspective on Few-Shot Adaptation of Large Vision-Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-10T18:40:27.352337Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2501.11175"},"observation_digest":"sha256:ab72d9d9d8993f0fb4cfd82bebe86379b20a6b62173512285ea2efb388c6553c","observation_id":"81e7903e-4ab9-4d2c-95f2-8fe5605cacde","resolution":{"observed_at":"2026-08-10T18:40:27.352337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-16T16:24:23.857686Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-09T22:41:21.249653Z","title":"Unified vi- sion and language prompt learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.18753","last_updated":"2025-01-30T21:07:14Z","snapshot_observed_at":"2026-08-10T01:57:58.405485Z","submitted_at":"2025-01-30T21:07:14Z","title":"INT: Instance-Specific Negative Mining for Task-Generic Promptable Segmentation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T22:41:21.249653Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2501.18753"},"observation_digest":"sha256:5654676876f8b06f9ae022741576b7ad82c7ad9ef498931eb2e8f74715513e53","observation_id":"1f316495-d2d1-41c2-a895-ee29292b7a3f","resolution":{"observed_at":"2026-08-09T22:41:21.249653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-16T16:24:23.857686Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-16T11:54:30.719496Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.14280","last_updated":"2025-04-19T12:27:24Z","snapshot_observed_at":"2026-08-16T11:50:25.744056Z","submitted_at":"2025-04-19T12:27:24Z","title":"CLIP-Powered Domain Generalization and Domain Adaptation: A Comprehensive Survey","version":1},"reference_index":185,"source":"pdf_text","source_observed_at":"2026-08-16T11:54:30.719496Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2504.14280"},"observation_digest":"sha256:b9a7c4edb97b9a5394cd33d5c8fc9db30b9d28af4bdb61a7fc20731ab948a5f3","observation_id":"28d56910-a1f6-42eb-b20e-c06f648a3bcb","resolution":{"observed_at":"2026-08-16T11:54:30.719496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-16T16:24:23.857686Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-16T05:10:33.024513Z","title":"Runjia Zeng, Cheng Han, Qifan Wang, Chunshu Wu, Tong Geng, Lifu Huang, Ying Nian Wu, and Dongfang Liu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.21423","last_updated":"2025-04-30T08:28:38Z","snapshot_observed_at":"2026-08-16T06:44:10.764782Z","submitted_at":"2025-04-30T08:28:38Z","title":"Diff-Prompt: Diffusion-Driven Prompt Generator with Mask Supervision","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T05:10:33.024513Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2504.21423"},"observation_digest":"sha256:44b0a482be26bf5355a22e77a29a304cd465bbc0c5b70c381982fded4a64f7d8","observation_id":"1b30b410-3ea5-4a2f-87a9-676f990ee42d","resolution":{"observed_at":"2026-08-16T05:10:33.024513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-16T16:24:23.857686Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-16T04:09:12.396220Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02056","last_updated":"2025-05-04T10:24:34Z","snapshot_observed_at":"2026-08-16T04:00:11.374555Z","submitted_at":"2025-05-04T10:24:34Z","title":"Handling Imbalanced Pseudolabels for Vision-Language Models with Concept Alignment and Confusion-Aware Calibrated Margin","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:12.396220Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2505.02056"},"observation_digest":"sha256:2ddd5636bc6e1dca58273d197aab8071db5ed4e47b3129480295a714852762c8","observation_id":"7123ad45-4d58-4392-a778-c9aa7356ea6a","resolution":{"observed_at":"2026-08-16T04:09:12.396220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-16T16:24:23.857686Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-15T20:24:33.625715Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.13233","last_updated":"2025-05-19T15:15:37Z","snapshot_observed_at":"2026-08-15T20:14:51.390069Z","submitted_at":"2025-05-19T15:15:37Z","title":"From Local Details to Global Context: Advancing Vision-Language Models with Attention-Based Selection","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T20:24:33.625715Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2505.13233"},"observation_digest":"sha256:be51151a93b1f3088b52cd16f11841c7ffcc88a32255e45897a469817053562e","observation_id":"8c07e3f0-3ee9-462b-a1af-89adab118d97","resolution":{"observed_at":"2026-08-15T20:24:33.625715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-16T16:24:23.857686Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-06T23:20:44.558520Z","title":"Unified vision and language prompt learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.18504","last_updated":"2025-06-30T05:24:22Z","snapshot_observed_at":"2026-08-16T09:44:26.567520Z","submitted_at":"2025-06-23T10:56:37Z","title":"Generalizing vision-language models to novel domains: A comprehensive survey","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:44.558520Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2506.18504"},"observation_digest":"sha256:d2d5d5f3daec25e50630226d695a5c82f3b297ff20bc916006d021a7290356da","observation_id":"a4721250-0fee-4c53-9569-210c1669cab5","resolution":{"observed_at":"2026-08-06T23:20:44.558520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-16T16:24:23.857686Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-06T18:27:46.914058Z","title":"Unified vision and language prompt learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08410","last_updated":"2025-07-11T08:45:27Z","snapshot_observed_at":"2026-08-09T12:40:28.487754Z","submitted_at":"2025-07-11T08:45:27Z","title":"Multi-modal Mutual-Guidance Conditional Prompt Learning for Vision-Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:27:46.914058Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2507.08410"},"observation_digest":"sha256:c36af0aa37c28b43f791bab7aab26eb54e6df7106485f8366f3ca29b9281d98c","observation_id":"238e3490-284d-4bb2-961f-47d8d62720ee","resolution":{"observed_at":"2026-08-06T18:27:46.914058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-16T16:24:23.857686Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-06T15:42:16.472212Z","title":"Unified vision and language prompt learning.arXiv:2210.07225, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.15480","last_updated":"2025-07-28T04:47:15Z","snapshot_observed_at":"2026-08-15T20:19:55.065831Z","submitted_at":"2025-07-21T10:35:32Z","title":"One Last Attention for Your Vision-Language Model","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:16.472212Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2507.15480"},"observation_digest":"sha256:800e5a7d7582d45f7491e0642327137dd9871ff9a996682afb46b7903ab800fa","observation_id":"4e1bf780-8215-4fab-ba9e-e3142fd70d09","resolution":{"observed_at":"2026-08-06T15:42:16.472212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-16T16:24:23.857686Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-06T15:36:17.773682Z","title":"Unified vision and language prompt learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.15542","last_updated":"2025-08-04T02:28:09Z","snapshot_observed_at":"2026-08-14T18:20:35.027776Z","submitted_at":"2025-07-21T12:15:27Z","title":"HOLa: Zero-Shot HOI Detection with Low-Rank Decomposed VLM Feature Adaptation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T15:36:17.773682Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2507.15542"},"observation_digest":"sha256:632926881e1163c35ed6cd6db065b1080b41793c1142b2d98e554c2e3a3bd6bb","observation_id":"39cf9e76-117e-4977-ac08-f79d7f62f868","resolution":{"observed_at":"2026-08-06T15:36:17.773682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-16T16:24:23.857686Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-06T15:34:44.496621Z","title":"Unified vision and language prompt learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.15569","last_updated":"2025-07-21T12:50:49Z","snapshot_observed_at":"2026-08-13T20:41:43.519119Z","submitted_at":"2025-07-21T12:50:49Z","title":"DynImg: Key Frames with Visual Prompts are Good Representation for Multi-Modal Video Understanding","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T15:34:44.496621Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2507.15569"},"observation_digest":"sha256:1673fd3fc7d20f8d6b82ce22c5a767318dd627ac929771d6bcb06e362f4cd0ee","observation_id":"624eca69-ece9-48ad-a3fe-6ee505763a9a","resolution":{"observed_at":"2026-08-06T15:34:44.496621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-16T16:24:23.857686Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-05T16:05:18.776777Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.19024","last_updated":"2025-08-26T13:42:48Z","snapshot_observed_at":"2026-08-08T00:07:02.060969Z","submitted_at":"2025-08-26T13:42:48Z","title":"ProPy: Building Interactive Prompt Pyramids upon CLIP for Partially Relevant Video Retrieval","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T16:05:18.776777Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2508.19024"},"observation_digest":"sha256:3dbcfc8cfb82521f29c3f8d68aa7492d0dcd2644bf932539d22be47514d7483d","observation_id":"14f5836f-5f9b-4a54-9b2e-280aa943cf85","resolution":{"observed_at":"2026-08-05T16:05:18.776777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-16T16:24:23.857686Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-02T21:07:50.961211Z","title":"arXiv preprint arXiv:2210.07225 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.21397","last_updated":"2026-07-01T05:08:00Z","snapshot_observed_at":"2026-08-15T11:03:53.825448Z","submitted_at":"2026-02-24T22:00:34Z","title":"MMLoP: Multi-Modal Low-Rank Prompting for Efficient Vision-Language Adaptation","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-02T21:07:50.961211Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2602.21397"},"observation_digest":"sha256:d3e201b44b8c152fc0a7952f234af5d35bcea150979b93533812d66ac5d456da","observation_id":"430a400d-024f-44b2-aaed-d4f41bdcf8ee","resolution":{"observed_at":"2026-08-02T21:07:50.961211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-16T16:24:23.857686Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":"2210.07225","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-07-01T19:56:11.264751Z","title":"Unified vision and language prompt learning","venue":null,"work_id":"1f5888f6-45b3-4315-b4bf-61f128fcfcd0","year":2022},"citing_paper":{"arxiv_id":"2605.05910","last_updated":"2026-05-07T09:20:42Z","snapshot_observed_at":"2026-08-16T01:06:25.963385Z","submitted_at":"2026-05-07T09:20:42Z","title":"Plug-and-play Class-aware Knowledge Injection for Prompt Learning with Visual-Language Model","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-09T15:52:06.698536Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2605.05910"},"observation_digest":"sha256:9cca965905d3dd4c7d8e1541556bd0efa00eb87cecae1fdfdc8506edf19b78cd","observation_id":"b8f107ab-92ba-40cf-8cca-ad6cd4da042d","resolution":{"observed_at":"2026-05-11T16:36:09.434253Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-16T16:24:23.857686Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":"2210.07225","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-07-01T19:56:11.264751Z","title":"Unified vision and language prompt learning","venue":null,"work_id":"1f5888f6-45b3-4315-b4bf-61f128fcfcd0","year":2022},"citing_paper":{"arxiv_id":"2605.08156","last_updated":"2026-05-04T09:07:00Z","snapshot_observed_at":"2026-08-11T05:30:38.614499Z","submitted_at":"2026-05-04T09:07:00Z","title":"LAGO: Language-Guided Adaptive Object-Region Focus for Zero-Shot Visual-Text Alignment","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-12T01:38:09.299209Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2605.08156"},"observation_digest":"sha256:0d6a25d8a802135c6ab91a727de2d4d9acc86dcd8f81053eed79cadd3efd3f7e","observation_id":"9dbc0ea5-6f51-4c6a-a557-f63ee02a9a45","resolution":{"observed_at":"2026-05-12T01:46:14.753399Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-16T16:24:23.857686Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":"2210.07225","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-07-01T19:56:11.264751Z","title":"Unified vision and language prompt learning","venue":null,"work_id":"1f5888f6-45b3-4315-b4bf-61f128fcfcd0","year":2022},"citing_paper":{"arxiv_id":"2605.31246","last_updated":"2026-05-29T12:46:15Z","snapshot_observed_at":"2026-08-14T12:50:50.277598Z","submitted_at":"2026-05-29T12:46:15Z","title":"BadBone: Backdoor Attacks Against Backbone Models in Visual Prompt Learning","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-28T21:52:23.150188Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2605.31246"},"observation_digest":"sha256:0318194ff94b548123d7505f5e92a151d1242ba27c773739162a66179d330fcc","observation_id":"1f3fa981-2b57-451d-8e51-02776867f051","resolution":{"observed_at":"2026-07-01T19:56:11.266427Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-16T16:24:23.857686Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-07-13T01:03:27.721212Z","title":"Unified vision and language prompt learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09008","last_updated":"2026-07-10T00:24:41Z","snapshot_observed_at":"2026-08-13T22:18:29.704830Z","submitted_at":"2026-07-10T00:24:41Z","title":"C-GAP: Class-Aware and Online Prompting Improves Vision-Language Models on Imbalanced Classes","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-13T01:03:27.721212Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2607.09008"},"observation_digest":"sha256:af7d90d19581048fcfa8dc98b069570d5f0a317260df2d3f3997b96be8e01e3e","observation_id":"b6ab8ff8-cd44-49a3-838d-280f7150b7ac","resolution":{"observed_at":"2026-07-13T01:03:27.721212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-16T16:24:23.857686Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-05T10:32:23.244452Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03885","last_updated":"2026-08-04T16:20:54Z","snapshot_observed_at":"2026-08-15T15:44:28.184205Z","submitted_at":"2026-08-04T16:20:54Z","title":"MuRA: Multi-Rank Adaptation for Efficient and Effective Test-Time Vision-Language Generalization","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:23.244452Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2608.03885"},"observation_digest":"sha256:9cd6d1d73ea90688ec6a3cb6ca46a8b5a5553ec8ea78533d8489d4762a53b6ea","observation_id":"8b1b1f59-2338-4732-a32c-6c7cbda10091","resolution":{"observed_at":"2026-08-05T10:32:23.244452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2210.07225/citation-record","integrity":"/paper/2210.07225/integrity","json":"/paper/2210.07225/citation-record.json","paper":"/paper/2210.07225"},"outbound":[],"paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T16:24:23.857686Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 24 inbound Pith citation observations for arXiv:2210.07225."}