Pith. sign in

Paper Citation Record · LEDGER

Unified Vision and Language Prompt Learning

As of 17 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 24 inbound Pith citation observations for arXiv:2210.07225.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2210.07225 v1

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 24 of 24 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-16T06:30:59.297886+00:00

measured 24 of 24 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-16T11:54:30.719496Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-01T19:56:11.264751Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 9b391797-2dda-4b4e-bf9b-be54cf8708e6 · inbound

Robust Adaptation of Foundation Models with Black-Box Visual Prompting cites this paper.

Robust Adaptation of Foundation Models with Black-Box Visual Prompting Unified Vision and Language Prompt Learning

Reference 12

Resolution
verified exact
arxiv_id, observed 2026-05-23T23:23:36.362418Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-05-23T23:23:03.562550Z digest=sha256:1e9b775cdf7397bf87659b5a3ba886449c536ffadc28953d296f25d3ee47e7ec

Observation 7fa3b420-754e-499b-9489-2fb4b47b4d9c · inbound

Learn from Downstream and Be Yourself in Multimodal Large Language Model Fine-Tuning cites this paper.

Learn from Downstream and Be Yourself in Multimodal Large Language Model Fine-Tuning Unified Vision and Language Prompt Learning

Reference 95

Resolution
unresolved
no resolver link, observed 2026-08-12T19:14:24.286924Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:14:24.286924Z digest=sha256:f9a89e8e2162e7a61a658ef37d3226b4a428ac0530cb6b0a06bd518c99c4dfb9

Observation 2fae7ffd-2efb-4a74-832f-e2492235e3c3 · inbound

A Wander Through the Multimodal Landscape: Efficient Transfer Learning via Low-rank Sequence Multimodal Adapter cites this paper.

A Wander Through the Multimodal Landscape: Efficient Transfer Learning via Low-rank Sequence Multimodal Adapter Unified Vision and Language Prompt Learning

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-11T17:27:49.486626Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T17:27:49.486626Z digest=sha256:0df430800781763bde9c003fb86ee00c9c14f8ae19ec40cca8e7bf7aafeb53d4

Observation 5004d9f0-efa5-4d6c-956a-19b78d0446eb · inbound

Leveraging Large Vision-Language Model as User Intent-aware Encoder for Composed Image Retrieval cites this paper.

Leveraging Large Vision-Language Model as User Intent-aware Encoder for Composed Image Retrieval Unified Vision and Language Prompt Learning

Reference 57

Resolution
unresolved
no resolver link, observed 2026-08-11T15:20:47.281351Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T15:20:47.281351Z digest=sha256:e5d75e7d46eeffc29dc65d61e9ef4b5509dcabd4a423a44ac689ef656d1467f6

Observation 1d8a6df2-3b78-4d5b-b138-bac6621499c6 · inbound

Efficient Policy Adaptation with Contrastive Prompt Ensemble for Embodied Agents cites this paper.

Efficient Policy Adaptation with Contrastive Prompt Ensemble for Embodied Agents Unified Vision and Language Prompt Learning

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-11T14:57:26.850243Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:57:26.850243Z digest=sha256:7e69b17c13e616ca771637fe685901da69e61e60706b03310ce2a61b35b1a8e3

Observation d83aaa4e-80f9-4c28-a96b-cb41c20b476a · inbound

Differentiable Prompt Learning for Vision Language Models cites this paper.

Differentiable Prompt Learning for Vision Language Models Unified Vision and Language Prompt Learning

Reference 70

Resolution
unresolved
no resolver link, observed 2026-08-10T22:54:52.244277Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:54:52.244277Z digest=sha256:c73f5b7ded614e8146f68df53d1df29194126af0eeec35b1bfccf9430d2d6918

Observation 81e7903e-4ab9-4d2c-95f2-8fe5605cacde · inbound

ProKeR: A Kernel Perspective on Few-Shot Adaptation of Large Vision-Language Models cites this paper.

ProKeR: A Kernel Perspective on Few-Shot Adaptation of Large Vision-Language Models Unified Vision and Language Prompt Learning

Reference 61

Resolution
unresolved
no resolver link, observed 2026-08-10T18:40:27.352337Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T18:40:27.352337Z digest=sha256:b318edf1cd2ffec653c8402e432c21ba18dfc32134d56764dd54569f6b1cc99c

Observation 1f316495-d2d1-41c2-a895-ee29292b7a3f · inbound

INT: Instance-Specific Negative Mining for Task-Generic Promptable Segmentation cites this paper.

INT: Instance-Specific Negative Mining for Task-Generic Promptable Segmentation Unified Vision and Language Prompt Learning

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-09T22:41:21.249653Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T22:41:21.249653Z digest=sha256:bd8c3278b13dba07e945a53d88559a24a778242082c95d8f100eab17e8f52704

Observation 28d56910-a1f6-42eb-b20e-c06f648a3bcb · inbound

CLIP-Powered Domain Generalization and Domain Adaptation: A Comprehensive Survey cites this paper.

CLIP-Powered Domain Generalization and Domain Adaptation: A Comprehensive Survey Unified Vision and Language Prompt Learning

Reference 185

Resolution
unresolved
no resolver link, observed 2026-08-16T11:54:30.719496Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:54:30.719496Z digest=sha256:fbf108a60ff12f3da170059fb46efd683a510bd780f8eb8b1a2e696f12e93e10

Observation 1b30b410-3ea5-4a2f-87a9-676f990ee42d · inbound

Diff-Prompt: Diffusion-Driven Prompt Generator with Mask Supervision cites this paper.

Diff-Prompt: Diffusion-Driven Prompt Generator with Mask Supervision Unified Vision and Language Prompt Learning

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-16T05:10:33.024513Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T05:10:33.024513Z digest=sha256:56c3e5ffde10b1f267e477a725798dc0fcab2343e703b3a7b8fe8c653bc4dbaa

Observation 7123ad45-4d58-4392-a778-c9aa7356ea6a · inbound

Handling Imbalanced Pseudolabels for Vision-Language Models with Concept Alignment and Confusion-Aware Calibrated Margin cites this paper.

Handling Imbalanced Pseudolabels for Vision-Language Models with Concept Alignment and Confusion-Aware Calibrated Margin Unified Vision and Language Prompt Learning

Reference 2021

Resolution
unresolved
no resolver link, observed 2026-08-16T04:09:12.396220Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T04:09:12.396220Z digest=sha256:2ddd5636bc6e1dca58273d197aab8071db5ed4e47b3129480295a714852762c8

Observation 8c07e3f0-3ee9-462b-a1af-89adab118d97 · inbound

From Local Details to Global Context: Advancing Vision-Language Models with Attention-Based Selection cites this paper.

From Local Details to Global Context: Advancing Vision-Language Models with Attention-Based Selection Unified Vision and Language Prompt Learning

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-15T20:24:33.625715Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T20:24:33.625715Z digest=sha256:be51151a93b1f3088b52cd16f11841c7ffcc88a32255e45897a469817053562e

Observation a4721250-0fee-4c53-9569-210c1669cab5 · inbound

Generalizing vision-language models to novel domains: A comprehensive survey cites this paper.

Generalizing vision-language models to novel domains: A comprehensive survey Unified Vision and Language Prompt Learning

Reference 84

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:44.558520Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:44.558520Z digest=sha256:d2d5d5f3daec25e50630226d695a5c82f3b297ff20bc916006d021a7290356da

Observation 238e3490-284d-4bb2-961f-47d8d62720ee · inbound

Multi-modal Mutual-Guidance Conditional Prompt Learning for Vision-Language Models cites this paper.

Multi-modal Mutual-Guidance Conditional Prompt Learning for Vision-Language Models Unified Vision and Language Prompt Learning

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-06T18:27:46.914058Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T18:27:46.914058Z digest=sha256:c36af0aa37c28b43f791bab7aab26eb54e6df7106485f8366f3ca29b9281d98c

Observation 4e1bf780-8215-4fab-ba9e-e3142fd70d09 · inbound

One Last Attention for Your Vision-Language Model cites this paper.

One Last Attention for Your Vision-Language Model Unified Vision and Language Prompt Learning

Reference 54

Resolution
unresolved
no resolver link, observed 2026-08-06T15:42:16.472212Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T15:42:16.472212Z digest=sha256:800e5a7d7582d45f7491e0642327137dd9871ff9a996682afb46b7903ab800fa

Observation 39cf9e76-117e-4977-ac08-f79d7f62f868 · inbound

HOLa: Zero-Shot HOI Detection with Low-Rank Decomposed VLM Feature Adaptation cites this paper.

HOLa: Zero-Shot HOI Detection with Low-Rank Decomposed VLM Feature Adaptation Unified Vision and Language Prompt Learning

Reference 56

Resolution
unresolved
no resolver link, observed 2026-08-06T15:36:17.773682Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T15:36:17.773682Z digest=sha256:632926881e1163c35ed6cd6db065b1080b41793c1142b2d98e554c2e3a3bd6bb

Observation 624eca69-ece9-48ad-a3fe-6ee505763a9a · inbound

DynImg: Key Frames with Visual Prompts are Good Representation for Multi-Modal Video Understanding cites this paper.

DynImg: Key Frames with Visual Prompts are Good Representation for Multi-Modal Video Understanding Unified Vision and Language Prompt Learning

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-06T15:34:44.496621Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T15:34:44.496621Z digest=sha256:1673fd3fc7d20f8d6b82ce22c5a767318dd627ac929771d6bcb06e362f4cd0ee

Observation 14f5836f-5f9b-4a54-9b2e-280aa943cf85 · inbound

ProPy: Building Interactive Prompt Pyramids upon CLIP for Partially Relevant Video Retrieval cites this paper.

ProPy: Building Interactive Prompt Pyramids upon CLIP for Partially Relevant Video Retrieval Unified Vision and Language Prompt Learning

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-05T16:05:18.776777Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T16:05:18.776777Z digest=sha256:3dbcfc8cfb82521f29c3f8d68aa7492d0dcd2644bf932539d22be47514d7483d

Observation 430a400d-024f-44b2-aaed-d4f41bdcf8ee · inbound

MMLoP: Multi-Modal Low-Rank Prompting for Efficient Vision-Language Adaptation cites this paper.

MMLoP: Multi-Modal Low-Rank Prompting for Efficient Vision-Language Adaptation Unified Vision and Language Prompt Learning

Reference 66

Resolution
unresolved
no resolver link, observed 2026-08-02T21:07:50.961211Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T21:07:50.961211Z digest=sha256:d3e201b44b8c152fc0a7952f234af5d35bcea150979b93533812d66ac5d456da

Observation b8f107ab-92ba-40cf-8cca-ad6cd4da042d · inbound

Plug-and-play Class-aware Knowledge Injection for Prompt Learning with Visual-Language Model cites this paper.

Plug-and-play Class-aware Knowledge Injection for Prompt Learning with Visual-Language Model Unified Vision and Language Prompt Learning

Reference 13

Resolution
metadata mismatch
arxiv_id, observed 2026-05-11T16:36:09.434253Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-05-09T15:52:06.698536Z digest=sha256:9cca965905d3dd4c7d8e1541556bd0efa00eb87cecae1fdfdc8506edf19b78cd

Observation 9dbc0ea5-6f51-4c6a-a557-f63ee02a9a45 · inbound

LAGO: Language-Guided Adaptive Object-Region Focus for Zero-Shot Visual-Text Alignment cites this paper.

LAGO: Language-Guided Adaptive Object-Region Focus for Zero-Shot Visual-Text Alignment Unified Vision and Language Prompt Learning

Reference 11

Resolution
verified exact
arxiv_id, observed 2026-05-12T01:46:14.753399Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-05-12T01:38:09.299209Z digest=sha256:0d6a25d8a802135c6ab91a727de2d4d9acc86dcd8f81053eed79cadd3efd3f7e

Observation 1f3fa981-2b57-451d-8e51-02776867f051 · inbound

BadBone: Backdoor Attacks Against Backbone Models in Visual Prompt Learning cites this paper.

BadBone: Backdoor Attacks Against Backbone Models in Visual Prompt Learning Unified Vision and Language Prompt Learning

Reference 71

Resolution
verified exact
arxiv_id, observed 2026-07-01T19:56:11.266427Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-06-28T21:52:23.150188Z digest=sha256:0318194ff94b548123d7505f5e92a151d1242ba27c773739162a66179d330fcc

Observation b6ab8ff8-cd44-49a3-838d-280f7150b7ac · inbound

C-GAP: Class-Aware and Online Prompting Improves Vision-Language Models on Imbalanced Classes cites this paper.

C-GAP: Class-Aware and Online Prompting Improves Vision-Language Models on Imbalanced Classes Unified Vision and Language Prompt Learning

Reference 50

Resolution
unresolved
no resolver link, observed 2026-07-13T01:03:27.721212Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T01:03:27.721212Z digest=sha256:af7d90d19581048fcfa8dc98b069570d5f0a317260df2d3f3997b96be8e01e3e

Observation 8b1b1f59-2338-4732-a32c-6c7cbda10091 · inbound

MuRA: Multi-Rank Adaptation for Efficient and Effective Test-Time Vision-Language Generalization cites this paper.

MuRA: Multi-Rank Adaptation for Efficient and Effective Test-Time Vision-Language Generalization Unified Vision and Language Prompt Learning

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-05T10:32:23.244452Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T10:32:23.244452Z digest=sha256:359ed527a6a20afe59df03d4f3c6e1c3cedeec904a02c00531ff2e729fcda2f1