Pith. sign in

Paper Citation Record · LEDGER

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models

As of 9 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2506.09638.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2506.09638 v1

Coverage vector

measured 42 of 42 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T04:46:48.850831Z

measured 43 of 43 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-06-28T01:52:44.785582Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-02T12:46:56.783735Z

Reference resolution

42 of 42 outbound references displayed

  • verified exact1
  • verified fuzzy25
  • unresolved16
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 3687621b-3200-4b01-a764-79c25aeb6402 · outbound

This paper cites GPT-4 Technical Report.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models GPT-4 Technical Report

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-07T04:46:48.684669Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:46:48.684669Z digest=sha256:1604365c5e8c89e84143749a5d34704072c3136fbb0f2622dbf049ef89ba200b

Observation 4286ba1d-0d28-4e5d-b288-a4e2601deb45 · outbound

This paper cites FedMBridge: Bridgeable multimodal federated learning.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models FedMBridge: Bridgeable multimodal federated learning

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:46:49.415097Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T04:46:48.689138Z digest=sha256:2e92a308d3331a92ffecc6f0e4dbcb42ba4581a214a402a3fb4a9eca295f2ca8

Observation 7276e55d-b06b-4886-bccd-984f9872456f · outbound

This paper cites An image is worth 16x16 words: Transformers for image recognition at scale, 2021.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models An image is worth 16x16 words: Transformers for image recognition at scale, 2021

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-07T04:46:48.693076Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:46:48.693076Z digest=sha256:ce1ffc4f8eb7e78fd6e1243ae4dff7666733a862d61f2978e4f9286ebd2fbb88

Observation daaea0cb-42f9-4519-86e3-fcb340cf2af3 · outbound

This paper cites Personalized federated learning with theoretical guarantees: A model-agnostic meta-learning approach.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Personalized federated learning with theoretical guarantees: A model-agnostic meta-learning approach

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:46:49.395750Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T04:46:48.697510Z digest=sha256:320824949f13b716dd69e7a3c81091f0939e8c5955869d2e5a3cc7d596941fff

Observation 558d49a0-913a-4979-ac04-943d7524c967 · outbound

This paper cites LLaMA-Adapter V2: Parameter-Efficient Visual Instruction Model.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models LLaMA-Adapter V2: Parameter-Efficient Visual Instruction Model

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-07T04:46:48.702039Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:46:48.702039Z digest=sha256:b5248d988bf9e16861b1bc844ffd343e23a5cf1615e0451849ce56df499c8511

Observation 05525e87-928d-4b40-92be-854987948b73 · outbound

This paper cites Exploring the vulnerabilities of federated learning: A deep dive into gradient inversion attacks.arXiv preprint arXiv:2503.11514, 2025.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Exploring the vulnerabilities of federated learning: A deep dive into gradient inversion attacks.arXiv preprint arXiv:2503.11514, 2025

Reference 6

Resolution
verified exact
raw_fallback, observed 2026-08-07T04:46:49.015685Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T04:46:48.706200Z digest=sha256:52d16b65a7e8f6f4bbfa75b72e4413af2b693a83e7a5c391b91733aa2cd49d58

Observation d94aa90f-a676-4eec-a61a-a57d319429b8 · outbound

This paper cites A new federated learning framework against gradient inversion attacks.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models A new federated learning framework against gradient inversion attacks

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:46:49.383880Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T04:46:48.710442Z digest=sha256:bf7b24214f2fcff44c1d59a49445177d73a646c2cf2e02f30930df28c32e21eb

Observation f88e9a82-ec7d-48d9-8f4b-8e7ce4bff44d · outbound

This paper cites Selective aggregation for low-rank adaptation in federated learning.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Selective aggregation for low-rank adaptation in federated learning

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:46:49.371984Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T04:46:48.714311Z digest=sha256:4e4bc7af92f24b9256064d959cc1ce5dd4c7b4b1773a7a5c92b31601fb7f8fe3

Observation d8e72b90-424c-4784-8947-f491ce13cc48 · outbound

This paper cites Measuring the effects of non-identical data distribu- tion for federated visual classification, 2019.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Measuring the effects of non-identical data distribu- tion for federated visual classification, 2019

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:46:49.359782Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T04:46:48.718522Z digest=sha256:3ef313d8c97c50c31773e7c065702db93b3d9414cea7a4aa6de6f1c24f9bfb32

Observation 14599aa7-b0d8-48e4-8a62-08b9b0d14aed · outbound

This paper cites Lora: Low-rank adaptation of large language models.ICLR, 1(2):3, 2022.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Lora: Low-rank adaptation of large language models.ICLR, 1(2):3, 2022

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-07T04:46:48.722162Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:46:48.722162Z digest=sha256:26c0f2db8691942ed581c2ebfd83ebe26be1804664f64326bde8906801f86714

Observation 1cbae2c3-cedd-4128-afa3-4f4bfcbe2b30 · outbound

This paper cites Fedlps: Heterogeneous federated learning for multiple tasks with local parameter sharing, 2024.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Fedlps: Heterogeneous federated learning for multiple tasks with local parameter sharing, 2024

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:46:49.340328Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T04:46:48.726332Z digest=sha256:357f44e40c1278a821d7c03692d60071585d2269150440103a3805d3abce5f6c

Observation ff54f841-c76d-44c9-92e9-604b57fc5664 · outbound

This paper cites an unresolved cited work.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-08-07T04:46:49.328507Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T04:46:48.730944Z digest=sha256:707a07d2f89231d2333b75a4736cf2f43314b0b1e7bc5a019c29c539ebcb5746

Observation fc7cd118-c8a0-42c2-941a-9ff54a03501a · outbound

This paper cites ReferItGame: Referring to objects in photographs of natural scenes.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models ReferItGame: Referring to objects in photographs of natural scenes

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:46:49.316564Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T04:46:48.735198Z digest=sha256:75ebba991551a5875dfe159d22c4d965b009ab145ab6b45a857bdd0bd1a9d8ab

Observation 61969c35-083c-417d-a109-145ccb1ae660 · outbound

This paper cites Federatedscope-llm: A comprehensive package for fine-tuning large language models in federated learning.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Federatedscope-llm: A comprehensive package for fine-tuning large language models in federated learning

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:46:49.304569Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T04:46:48.738823Z digest=sha256:7be44ce9633ef28e793f91c75655283a9c398a07683dc2a645694807e1eceddd

Observation 0d7733ea-24b1-4bcf-9f02-f63c684f800c · outbound

This paper cites A dataset of clinically generated visual questions and answers about radiology images.Scientific data, 5(1):1–10, 2018.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models A dataset of clinically generated visual questions and answers about radiology images.Scientific data, 5(1):1–10, 2018

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-07T04:46:48.742288Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:46:48.742288Z digest=sha256:e43b83978041f98393a37f8f1c786bc6d454ff6c76a168d88a98f007158b272b

Observation ed4a0e06-c688-453d-92da-1ed6e81bc56d · outbound

This paper cites Federated optimization in heterogeneous networks, 2020.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Federated optimization in heterogeneous networks, 2020

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:46:49.285106Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T04:46:48.745943Z digest=sha256:b960b06c2805ea46a1849c56b4a8fc702f7eaea3ea7e845228bfe6b922739785

Observation c80410a0-366b-4f71-990b-2e05fc27441e · outbound

This paper cites UnifiedMLLM: Enabling Unified Representation for Multi-modal Multi-tasks With Large Language Model.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models UnifiedMLLM: Enabling Unified Representation for Multi-modal Multi-tasks With Large Language Model

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-07T04:46:48.750294Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:46:48.750294Z digest=sha256:c1b23a0dceffc1beb3f06db20d64578f0b80dbf43d5f5e51100d190fcc61762a

Observation 6fcec27f-9c28-4ef9-95eb-ace020d99d1d · outbound

This paper cites Lawrence Zitnick, and Piotr Dollár.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Lawrence Zitnick, and Piotr Dollár

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-07T04:46:48.755470Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:46:48.755470Z digest=sha256:67b1da34b64fb32c3c6eb520ea5d4822f70566341cf063e6097817c5084519b4

Observation 17c332f1-4dad-48bd-8985-39e940a0f4fa · outbound

This paper cites Slake: A semantically-labeled knowledge-enhanced dataset for medical visual question answering, 2021.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Slake: A semantically-labeled knowledge-enhanced dataset for medical visual question answering, 2021

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:46:49.265909Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T04:46:48.759466Z digest=sha256:961bd13c9862da5cb5fe9dbc331da407d52ec0e9a8686776ab9eb7f6e0987a8e

Observation 8573775a-0fbf-48d7-a371-401010216341 · outbound

This paper cites Visual instruction tuning.NIPS, 36:34892– 34916, 2023.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Visual instruction tuning.NIPS, 36:34892– 34916, 2023

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:46:49.253255Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T04:46:48.763946Z digest=sha256:fc0abd0648b2867da7eead282e9fc4bee6ee9a39fde4be6347480d89223430e5

Observation c7be9ac6-7605-470e-874b-3dbd90e7733d · outbound

This paper cites Learn to explain: Multimodal reasoning via thought chains for science question answering, 2022.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Learn to explain: Multimodal reasoning via thought chains for science question answering, 2022

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-07T04:46:48.767754Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:46:48.767754Z digest=sha256:59a901531857b0acba0e676c363c58b3ad601d844f94f7e03f330600658e7a40

Observation 9eed584a-cd20-4b2e-b846-be141e2870c4 · outbound

This paper cites Fine-grained visual classification of aircraft, 2013.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Fine-grained visual classification of aircraft, 2013

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:46:49.232649Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T04:46:48.771667Z digest=sha256:2279ef2427dc9b3e1dab9b0990424b779baff7b4dc797c8f22fd4ac091a13ae9

Observation 5d58df5e-ae06-44c5-a59a-cf82b6fd8b79 · outbound

This paper cites Brendan McMahan, Eider Moore, Daniel Ramage, Seth Hampson, and Blaise Agüera y Arcas.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Brendan McMahan, Eider Moore, Daniel Ramage, Seth Hampson, and Blaise Agüera y Arcas

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:46:49.220202Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T04:46:48.776135Z digest=sha256:cfbce0027b1c11fcf12cc50922db514fa14740b8b9cc785d9b3052e62a732b40

Observation 421bfc29-05b1-4f7e-8f40-9dda2603b39b · outbound

This paper cites Introducing meta llama 3: The most capable openly available llm to date.Meta AI, 2024.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Introducing meta llama 3: The most capable openly available llm to date.Meta AI, 2024

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:46:49.207534Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T04:46:48.779836Z digest=sha256:de2f5028fa929d98e633f4240535da024e84874ac41a87c2d34bcc551d0e6927

Observation 5c311a02-a6b8-41c6-a168-db30a83f2495 · outbound

This paper cites Learning transferable visual models from natural language supervision.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Learning transferable visual models from natural language supervision

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-07T04:46:48.783497Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:46:48.783497Z digest=sha256:01c47bd7c1aec5096e1004f6126b31fbfca4c3a324b9b25657aeeab2fe94a3b2

Observation 5e48f7c5-2761-48e0-83c0-9592e2ac0fd5 · outbound

This paper cites Learning transferable visual models from natural language supervision, 2021.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Learning transferable visual models from natural language supervision, 2021

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-07T04:46:48.786814Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:46:48.786814Z digest=sha256:e758febec7daa573c6714a9c54bf0f99983a9ad8a4f8968e80046f190a6fae35

Observation 0e0f3a57-d0fa-4ca9-aa7f-93a902cdf445 · outbound

This paper cites Adaptive Federated Optimization.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Adaptive Federated Optimization

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-07T04:46:48.790571Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:46:48.790571Z digest=sha256:2da96ccd2e808c72c699753c0a544d29a3a32fc5022334968b5b0fea133f6101

Observation 9b994af4-a485-42c3-b943-df7836a4951a · outbound

This paper cites Brendan McMahan.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Brendan McMahan

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:46:49.180748Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T04:46:48.794830Z digest=sha256:6e62b85f2ffd0d48b0a9a726474684caa1b5f45d245b28511c93df1531d8447b

Observation cc5a492a-fd7d-48c7-80f0-a155200d9c34 · outbound

This paper cites Exploring models and data for image question answering, 2015.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Exploring models and data for image question answering, 2015

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:46:49.169097Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T04:46:48.798543Z digest=sha256:cb1471c0e50ab7fac69590ff27f682d08e714030ab90ae7715805b769db8063a

Observation 14ed9eac-a4d4-4169-a983-148c59da03fe · outbound

This paper cites Chameleon: Mixed-modal early-fusion foundation models, 2025.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Chameleon: Mixed-modal early-fusion foundation models, 2025

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-07T04:46:48.802233Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:46:48.802233Z digest=sha256:c32f5dbc43e23fb52900349f8b1c2d5ba10324703ecec8edf5e166849148d89a

Observation d3bc5996-47ec-47d4-a1f5-772b0e7cd7bb · outbound

This paper cites Gemini: A Family of Highly Capable Multimodal Models.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Gemini: A Family of Highly Capable Multimodal Models

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-07T04:46:48.806923Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:46:48.806923Z digest=sha256:008ab86773cd361b8e122fe9fde26618128c123c79afc87d38cfddb8636e3177

Observation 792201df-4f85-426e-9a7c-2f85b01f18a4 · outbound

This paper cites Show-o: One Single Transformer to Unify Multimodal Understanding and Generation.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Show-o: One Single Transformer to Unify Multimodal Understanding and Generation

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-07T04:46:48.811789Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:46:48.811789Z digest=sha256:2a024c50b55eae353ad171b158f6fb0d93e443d81f45acf9d7166c6753e002a3

Observation 41629199-3860-4d2d-9823-a4069c3ca8fe · outbound

This paper cites Pilot: Building the federated multimodal instruction tuning framework, 2025.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Pilot: Building the federated multimodal instruction tuning framework, 2025

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:46:49.149443Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T04:46:48.816565Z digest=sha256:9642d65c17225f35a29481d96f04e45fac248f817b2b346859cde9eb2b713d80

Observation 0a106ab8-970c-4955-9bf5-39ff41f19d14 · outbound

This paper cites FedMLLM: Federated Fine-tuning MLLM on Multimodal Heterogeneity Data.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models FedMLLM: Federated Fine-tuning MLLM on Multimodal Heterogeneity Data

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-07T04:46:48.820248Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:46:48.820248Z digest=sha256:006173cdbe526f40fbc8d1d934166d3369afa53e22c1e07c461f7821f825f4f9

Observation d98c9006-6fc1-4a8b-bf91-728615edf7a6 · outbound

This paper cites Fedmllm: Federated fine-tuning mllm on multimodal heterogeneity data, 2025.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Fedmllm: Federated fine-tuning mllm on multimodal heterogeneity data, 2025

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:46:49.137896Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T04:46:48.824111Z digest=sha256:2775ea0b6b46967c7200521617d1b0637dbdae241a96c13738f83ba6088575bd

Observation a9ac6d2c-1951-4bd6-b05f-5f200bbddce6 · outbound

This paper cites Fedllm- bench: Realistic benchmarks for federated learning of large language models.NIPS, 37:111106–111130, 2024.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Fedllm- bench: Realistic benchmarks for federated learning of large language models.NIPS, 37:111106–111130, 2024

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:46:49.126081Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T04:46:48.827827Z digest=sha256:c5d1f4ffc644828d8de22465757ead6365442a0c039da1f06b568cfc5f8efb2d

Observation ebc7a116-8e1c-4e09-a4f3-768290500b7f · outbound

This paper cites Openfedllm: Training large language models on decentralized private data via federated learning.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Openfedllm: Training large language models on decentralized private data via federated learning

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:46:49.113860Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T04:46:48.831723Z digest=sha256:f0c07ec662e1d12647da4dd6a49eb08b97c0527d9970c9cf0e4b676d0a0ed1e5

Observation 749aa389-b6ff-402c-9da6-e0a7d5239e37 · outbound

This paper cites Tackling data heterogeneity in federated learning via loss decomposition.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Tackling data heterogeneity in federated learning via loss decomposition

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:46:49.100515Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T04:46:48.835568Z digest=sha256:10ba2231aab79e654192592c0bb06a59221b7aaa62e009296d8bc109bb4850c9

Observation b18696cc-86a5-4604-a243-908a3b9b6f80 · outbound

This paper cites Fedtgp: Trainable global prototypes with adaptive- margin-enhanced contrastive learning for data and model heterogeneity in federated learning, 2024.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Fedtgp: Trainable global prototypes with adaptive- margin-enhanced contrastive learning for data and model heterogeneity in federated learning, 2024

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:46:49.088407Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T04:46:48.839218Z digest=sha256:43ea3eed9feb9c7b4c3e15df95bb30929c85288c2ad0d9539c13ada35f8fd3c2

Observation 16c968b5-ec23-4c8c-b4b1-e3af78ab5aa6 · outbound

This paper cites Mllm- llava-fl: Multimodal large language model assisted federated learning.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Mllm- llava-fl: Multimodal large language model assisted federated learning

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:46:49.076280Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T04:46:48.843309Z digest=sha256:2fe4425f7485ee5762aedc2713b0c3bd9b3ccab74d197249a370ccb02412f326

Observation b009af85-f999-4183-9a24-7a0db4f64bf3 · outbound

This paper cites Flhetbench: Benchmarking device and state heterogeneity in federated learning.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Flhetbench: Benchmarking device and state heterogeneity in federated learning

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:46:49.064475Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T04:46:48.847188Z digest=sha256:ce7660ac69270500235a1b86e22927b410d54088372d3f887be8b866f160b165

Observation c817fdf1-1cc3-47c7-80e7-c8b83804fafe · outbound

This paper cites Radgenome-chest ct: A grounded vision-language dataset for chest ct analysis, 2024.

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models Radgenome-chest ct: A grounded vision-language dataset for chest ct analysis, 2024

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:46:49.052242Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T04:46:48.850831Z digest=sha256:d2657c0c142210e410c243d914f49714fae1c256d9ab4413dff7313c9b0e99df

Pith citing papers

Observation 3c225ccd-48af-43ea-8c35-869ac0184beb · inbound

VTI-CoT: Visual-Textual Interleaved Chain of Thought for Video Reasoning cites this paper.

VTI-CoT: Visual-Textual Interleaved Chain of Thought for Video Reasoning FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models

Reference 50

Resolution
verified exact
arxiv_id, observed 2026-07-02T12:46:56.785169Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-28T01:52:44.785582Z digest=sha256:6a3444488b8fc087e7ba634778e82df26a818520d86d40df8df0574367eb2a3c