Pith. sign in

Paper Citation Record · LEDGER

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering

As of 10 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 1 inbound Pith citation observation for arXiv:2505.19455.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.19455 v2

Coverage vector

measured 47 of 47 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T14:18:45.684227Z

measured 48 of 48 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-02T11:29:29.185783Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

47 of 47 outbound references displayed

  • verified exact1
  • verified fuzzy41
  • unresolved5
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation e6ae922a-bab8-4215-b0b6-9dfe69934b24 · outbound

This paper cites VLC-BERT: Visual question answering with contextualized commonsense knowledge.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering VLC-BERT: Visual question answering with contextualized commonsense knowledge

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:58.338712Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:39.472572Z digest=sha256:c54f93393e2fda0629ffb506962c8f312d29d4db04186586364eb2be027bcdd0

Observation ac9a5d60-9325-4594-9b14-5daab540db17 · outbound

This paper cites Align before fuse: Vision and language representation learning with momen- tum distillation.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Align before fuse: Vision and language representation learning with momen- tum distillation

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:58.045224Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:39.629437Z digest=sha256:2fe9e5bdcd1fdbb2e995c1c15c9e290260245a68ed130f3d2058d1c855c3abf0

Observation 6fe75be5-1eb4-48a5-84e7-29fca135b16d · outbound

This paper cites Vqacl: A novel visual question answering continual learning setting.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Vqacl: A novel visual question answering continual learning setting

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:57.760674Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:39.809754Z digest=sha256:67f9cc0d5cc6ddbd0743953f254afa95506bfc77602c05954f1ffdb8a1607485

Observation 36d15d62-f440-4a59-bac7-880688c382d0 · outbound

This paper cites Enhancing Continual Learning in Visual Question Answering with Modality-Aware Feature Distillation.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Enhancing Continual Learning in Visual Question Answering with Modality-Aware Feature Distillation

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-07T14:18:39.958714Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:18:39.958714Z digest=sha256:e37a414e7ac189c2fbee4c09d73065f85d8b37eef909845d7faa5a0d70115c7c

Observation 9d597ad1-f91c-424b-8710-be8908819f64 · outbound

This paper cites Decouple before interact: Multi-modal prompt learning for continual visual question answering.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Decouple before interact: Multi-modal prompt learning for continual visual question answering

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:57.445456Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:40.068963Z digest=sha256:f74ced65cb668a69c4ac7b1506a2ca4b4059a3aab540bb8c00a10d4cdee3b4fc

Observation cd25b4d6-6e6c-471a-b13d-58b5c22cbb64 · outbound

This paper cites RE- VIVE: Regional visual representation matters in knowledge-based visual question answering.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering RE- VIVE: Regional visual representation matters in knowledge-based visual question answering

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:58.667094Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:40.219348Z digest=sha256:0997e66302222d58f6a1afe0fcc02dac0322b7ea3ebcfafaa8590aeddf73e468

Observation 8c5b0a7f-e4cd-4b7c-999a-0345ea4cb14d · outbound

This paper cites Symbolic replay: Scene graph as prompt for continual learning on VQA task.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Symbolic replay: Scene graph as prompt for continual learning on VQA task

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:57.179424Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:40.380500Z digest=sha256:319ddf89728e9d97acb14e878532f6a503d6c4d92dd1d54f5ada679bbb4c4fb4

Observation 9913f3ed-6ddc-4afe-82ca-58238da31f9c · outbound

This paper cites CluMo: Cluster-based Modality Fusion Prompt for Continual Learning in Visual Question Answering.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering CluMo: Cluster-based Modality Fusion Prompt for Continual Learning in Visual Question Answering

Reference 9

Resolution
verified exact
local_arxiv, observed 2026-08-07T14:18:46.155924Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:40.495264Z digest=sha256:0998ea396640e730f0d75d21e783326daf896693300fb7c4089b309c2a7312fd

Observation 3f726f8c-57e2-4b33-8db8-3ed788348b82 · outbound

This paper cites DualPrompt: Complementary prompting for rehearsal-free continual learning.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering DualPrompt: Complementary prompting for rehearsal-free continual learning

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:56.940890Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:40.652713Z digest=sha256:a2cc221d5d2b28ce8eac3b3a2da8f29cb8727314c3d4778a5e2a51aaaa681f0a

Observation 43e4801c-2209-4de4-8d8f-b00eaea56e1f · outbound

This paper cites Learning to prompt for continual learning.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Learning to prompt for continual learning

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:56.599667Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:40.777953Z digest=sha256:4d4f08584eda9a6b07dbe36deb2b0ee0785dcc42bfa432b0f9e9becc04ac6f50

Observation 6f9b46ce-0b9f-4b0c-89ae-6c2668842733 · outbound

This paper cites CODA-Prompt: Contin- ual decomposed attention-based prompting for rehearsal-free continual learning.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering CODA-Prompt: Contin- ual decomposed attention-based prompting for rehearsal-free continual learning

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:56.343115Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:40.943821Z digest=sha256:efe6f48a2fbe91a6c67c80731f8a0320133acf867c88820c9de5f11fe5b1a311

Observation 22dffaf8-fe08-4f55-aee0-fb0b0bd2dddf · outbound

This paper cites Semantic residual prompts for continual learning.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Semantic residual prompts for continual learning

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:56.052264Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:41.055708Z digest=sha256:5fac8abfb75702c9cebaad411a4a47ed6bed7423ff8a1f56d302ba6aa4ecd0de

Observation 6e32edd3-7d65-4cff-867b-0aad9e513f3d · outbound

This paper cites Multi-domain multi- task rehearsal for lifelong learning.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Multi-domain multi- task rehearsal for lifelong learning

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:55.799111Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:41.235906Z digest=sha256:9d3d800b1e736ccafb189b5c4863cfaea1ec2525b637a76fc519cc3ce53dbd3f

Observation ab5d9594-1fa3-4350-9a12-5db1c8d4b6bc · outbound

This paper cites Exploring example influence in continual learning.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Exploring example influence in continual learning

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:55.291288Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:41.384164Z digest=sha256:5973bf7f19ae93e1e505bda9309089859f730a9dec183400177d1a1a8bfa8f69

Observation 9b251139-b4cc-4378-9ea7-1bfc4beb2aac · outbound

This paper cites Measuring asymmetric gradient discrepancy in parallel continual learning.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Measuring asymmetric gradient discrepancy in parallel continual learning

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:55.030671Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:41.574282Z digest=sha256:ce5b6a2aeee29312d9475f11c992e09d15c0615a897691c09f0a15a69ef26e41

Observation 5db16f86-a349-4ba3-83fa-eb82eecf4be6 · outbound

This paper cites MAPLE: Multi-modal prompt learning.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering MAPLE: Multi-modal prompt learning

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:54.732552Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:41.733658Z digest=sha256:1782293bd9a98cd5b5b1d0800e0d1abb87f83205bb1e57a8bbfd9de3d55f5bf3

Observation 43ad371d-77c6-4d4f-a749-2b9d63cc585f · outbound

This paper cites Overcoming language priors in visual question answering with adversarial regularization.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Overcoming language priors in visual question answering with adversarial regularization

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:54.412802Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:41.933587Z digest=sha256:2b2e85db3c82fdd320557b5e9f6d3b61d99968d7310d6b06bb63c0d46a7b8c9e

Observation 237b70e3-dc83-488d-a892-9b2c00d311a7 · outbound

This paper cites Making the v in VQA matter: Elevating the role of image understanding in visual question answering.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Making the v in VQA matter: Elevating the role of image understanding in visual question answering

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:54.060826Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:42.083469Z digest=sha256:9df01c59137b6846556b2c09358d661ee3003588ae242cf1bf98f598eb69e2ad

Observation 70209ef8-75c9-493f-a996-d6ae11ef9323 · outbound

This paper cites Lawrence Zitnick, and Devi Parikh.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Lawrence Zitnick, and Devi Parikh

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:53.736161Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:42.187884Z digest=sha256:d933ff8dc9424fbbc92d2ed791fa18fedccf4633c020d4a2251ec8ec77b5e4b9

Observation c80d7d0b-7d58-4398-8070-651ddba2b3c0 · outbound

This paper cites A lifelong learning perspective for mobile robot control.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering A lifelong learning perspective for mobile robot control

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:53.444496Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:42.329149Z digest=sha256:4f9070fe7b433376a0530317a899adaaf6d54d8efa898213b3bfedbcb0a6d332

Observation 5c70ba20-7bea-45a9-8d9e-2e75add3a03d · outbound

This paper cites Pre- venting zero-shot transfer degradation in continual learning of vision-language models.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Pre- venting zero-shot transfer degradation in continual learning of vision-language models

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:53.172915Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:42.506071Z digest=sha256:ce966126b00404e6db71f45c7b92b3773b9d2ce38b9864d8c75836e363d35974

Observation 21d07dd1-800e-4786-85b1-bb83db898b79 · outbound

This paper cites Bakker, Nicu Sebe, and Michael S.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Bakker, Nicu Sebe, and Michael S

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:52.778162Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:42.625308Z digest=sha256:8c7af3eb790b13def756fe48f8c675e7c3bf575e8e1fce72a853bb056e7846c7

Observation 6cfdf7fe-11d6-4319-99c8-b6162bfe8e5a · outbound

This paper cites Boosting continual learning of vision-language models via mixture-of-experts adapters.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Boosting continual learning of vision-language models via mixture-of-experts adapters

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:52.553431Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:42.809398Z digest=sha256:b418cbbe0821f062e616ce5e79d70b8d2402e0b2f80bd38a1d5160a8d490a5fc

Observation 3e396b1e-cf57-454d-9641-ba791695c299 · outbound

This paper cites Learn to grow: A continual structure learning framework for overcoming catastrophic forgetting.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Learn to grow: A continual structure learning framework for overcoming catastrophic forgetting

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:52.265906Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:42.913039Z digest=sha256:a155268a5eba203dca39720077fe589ad1c1a0c39f7a660bcfe59105e3aa0225

Observation 631255ab-0ad6-4160-b3c4-f0f9169afc88 · outbound

This paper cites Ex- perience replay for continual learning.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Ex- perience replay for continual learning

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:51.993430Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:43.051597Z digest=sha256:1cd9edfd3e18ec81c468b086aa8542d96e8329dd125904d7b811b76e3f1a9de9

Observation 6f3b90d0-62f3-4fae-8bd0-f18f9d6b6bbc · outbound

This paper cites Dark experience for general continual learning: A strong, simple baseline.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Dark experience for general continual learning: A strong, simple baseline

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:51.689768Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:43.197659Z digest=sha256:acc3b00ad0f055fab9c9b1e824e855146e2522acdfcc8f03e8b16e4bce581679

Observation 803b3c9d-a998-4371-8ec5-bca40dc484e1 · outbound

This paper cites A continual learning survey: Defying forgetting in classification tasks.IEEE Transactions on Pattern Analysis and Machine Intelligence, pages 3366–3385, 2021.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering A continual learning survey: Defying forgetting in classification tasks.IEEE Transactions on Pattern Analysis and Machine Intelligence, pages 3366–3385, 2021

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:51.397181Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:43.327033Z digest=sha256:36d7a0a91e19c7d855906da0a517bdf323733da0afdc5e54868bc8407f540428

Observation c174679f-b047-4d86-921b-77da94b15948 · outbound

This paper cites Yu, and Irwin King.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Yu, and Irwin King

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-07T14:18:43.480038Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:18:43.480038Z digest=sha256:0e056a5e07430451228356338bd68912be2dcd6ce63a7d898221e5daf0849ac8

Observation 743388c0-d14e-45d7-ae35-51a1893b90d8 · outbound

This paper cites Balanced multimodal learning via on-the-fly gradient modulation.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Balanced multimodal learning via on-the-fly gradient modulation

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:51.120558Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:43.549152Z digest=sha256:f9b12b6f8c96c97e5220a0d3880eb7e6f9bca30d9087ffc255444718fede635b

Observation cdb1a1a3-d0bf-42d0-a702-8bc1cae5276f · outbound

This paper cites Pre-trained models: Past, present and future.AI Open, pages 225–250, 2021.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Pre-trained models: Past, present and future.AI Open, pages 225–250, 2021

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:50.865018Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:43.646275Z digest=sha256:9b0b93d7d2c96643c35e20a1845237d9018d04e6fd9b7caea342f56658fff8a6

Observation 86c661f7-5eef-4423-b75d-78c4f288c359 · outbound

This paper cites an unresolved cited work.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Unresolved cited work

Reference 32

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:18:50.550263Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:43.718731Z digest=sha256:c75db8baa70b35efadace7ee0ee7856358b1d08e88115c80b02960b683ef22f2

Observation e3966b13-3e4a-4d4c-850c-bd9290508bb3 · outbound

This paper cites LXMERT: Learning Cross-Modality Encoder Representations from Transformers.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering LXMERT: Learning Cross-Modality Encoder Representations from Transformers

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-07T14:18:43.801881Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:18:43.801881Z digest=sha256:b9d83e776e4b53b64e8ebcd48be614026455536f7e4de954484ab160a54cd522

Observation 955dbc63-ca53-4d0c-aa9a-67732d5d63cb · outbound

This paper cites DyTox: Trans- formers for continual learning with dynamic token expansion.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering DyTox: Trans- formers for continual learning with dynamic token expansion

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:50.197997Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:43.925124Z digest=sha256:744379c9849d37caa8607312a9494a0fdb00822499fc1f8e13f022a684760fb2

Observation 4bff90a1-d510-4dca-94ec-7801bc613390 · outbound

This paper cites Learning transferable visual models from natural language supervision.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Learning transferable visual models from natural language supervision

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:49.892421Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:44.029603Z digest=sha256:c1d425617177899eb038d9ca32f5fb554333ec6d1dd222d7e04125cbfe652664

Observation 62044c85-dfe2-4f54-b81a-d161c3060f30 · outbound

This paper cites Understanding driving risks via prompt learning.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Understanding driving risks via prompt learning

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:49.565975Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:44.129858Z digest=sha256:e78755cb9cec35b5304d9a5e7cc0a8277c077194e42c9377346fa8160366515f

Observation 8bd7b5b4-bdea-432a-861b-01db032a8db2 · outbound

This paper cites Attention bottlenecks for multimodal fusion.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Attention bottlenecks for multimodal fusion

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:49.297569Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:44.250330Z digest=sha256:99a9b29c1d52430eeb0cd6168594f1e2fc9993e2cac3b186820120dcbe4c07e4

Observation 70997690-a4ce-45f6-9772-630cf5f68273 · outbound

This paper cites Difnet: Boosting visual information flow for image captioning.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Difnet: Boosting visual information flow for image captioning

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:48.980507Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:44.369136Z digest=sha256:c8d85bdffe43c7cffb4f68d7db3b0d067e2561ef9bcbde215d76198f93d6336c

Observation d494e25d-0efa-4917-8cee-caa28cd4a5f1 · outbound

This paper cites Aligning visual regions and textual concepts for semantic-grounded image representations.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Aligning visual regions and textual concepts for semantic-grounded image representations

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:48.663665Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:44.478499Z digest=sha256:d9bb6eef4d2b2dee671948783a0ede116bf3ff16ae5426e224916198e218c589

Observation 7bf90daf-328b-4d20-9e9a-b12e51906647 · outbound

This paper cites Masked autoencoders are scalable vision learners.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Masked autoencoders are scalable vision learners

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:48.441359Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:44.622402Z digest=sha256:39a6652d77ff4b5fd892a856b18a08f3f6b08cdadacb82dfcdedd972564bbd72

Observation cb88f53b-56bb-45d3-a44b-db000d993c3a · outbound

This paper cites A Survey on Masked Autoencoder for Self-supervised Learning in Vision and Beyond.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering A Survey on Masked Autoencoder for Self-supervised Learning in Vision and Beyond

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-07T14:18:44.745026Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:18:44.745026Z digest=sha256:8f024fb603d94714708e78e12628efbecba43224a31e1eb5d08ac582348ec5d6

Observation ccaa9d9f-cdee-4e79-bc59-91990f4f9e7f · outbound

This paper cites Can we gain more from orthogonality regularizations in training deep networks? InAdvances in Neural Information Processing Systems (NeurIPS), 2018.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Can we gain more from orthogonality regularizations in training deep networks? InAdvances in Neural Information Processing Systems (NeurIPS), 2018

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:48.119044Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:44.854051Z digest=sha256:e79250d7fe22b4e84b1f2a3e8e512e55c6f4b18287d2b0f9115469bab93ec3b9

Observation 96122ca3-70b4-4fb7-9c68-0b641f3927a0 · outbound

This paper cites NExT-QA: Next phase of question answering to explaining temporal actions.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering NExT-QA: Next phase of question answering to explaining temporal actions

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:47.810672Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:44.946111Z digest=sha256:631755602337c478611bc57129f45cfee2ae943e2a59323b456c3cfbdda9b4dd

Observation 72d88bc0-f0aa-417a-91b8-037b2f7322c4 · outbound

This paper cites A simple weight decay can improve generalization.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering A simple weight decay can improve generalization

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:47.551554Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:45.088368Z digest=sha256:fccbf4f3f1fdccc35dda33de7d6d763ee97f89fa8e8879462c87dc7876b8189c

Observation 2e79ac51-df0b-40c6-91ca-cc1e558b8d17 · outbound

This paper cites Bottom-up and top-down attention for image captioning and visual question answering.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Bottom-up and top-down attention for image captioning and visual question answering

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:47.282811Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:45.264873Z digest=sha256:d9af63a992fdaba2d268dbdd40fda2206e8f5604347057c02ad431a9a230072f

Observation 0aa209b1-8d7c-4312-9310-a85912551606 · outbound

This paper cites Visualizing data using t-SNE.Journal of Machine Learning Research, pages 2579–2605, 2008.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Visualizing data using t-SNE.Journal of Machine Learning Research, pages 2579–2605, 2008

Reference 46

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:46.956737Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:45.420900Z digest=sha256:b47336b8815751da21ddc9eac31090ea9a306b24af2e1ed17ba270700ffc67fc

Observation 3eb9922d-d7b6-4c2f-9173-1f5e80ce4b86 · outbound

This paper cites Scaling instruction-finetuned language models.Journal of Machine Learning Research, 2024.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Scaling instruction-finetuned language models.Journal of Machine Learning Research, 2024

Reference 47

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:46.672087Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:45.539148Z digest=sha256:260ed726d05789be9d5d6b9204c5bb01f77ae3ecd9bbb4c6632563ccea85120e

Observation f0ed1da2-ed8a-4d9b-a2b2-41744b569d0b · outbound

This paper cites Plus”, “Mean Pooling.

MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering Plus”, “Mean Pooling

Reference 48

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:18:46.411761Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T14:18:45.684227Z digest=sha256:c7e287eeb2a347e732c6e0f9766fa05cd17c9a44ebc21e06ece39aab389de436

Pith citing papers

Observation 2d7753f2-fd46-4f6c-a6d5-04b682a174bb · inbound

Group Preference Collapse in Personalized Multimodal Large Language Models cites this paper.

Group Preference Collapse in Personalized Multimodal Large Language Models MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-02T11:29:29.185783Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T11:29:29.185783Z digest=sha256:296dfc4936cfdb753b57a1fc5d42b9c7e46837fe2e799db5205e3635c3c3c333