Pith. sign in

Paper Citation Record · LEDGER

Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

As of 16 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 34 inbound Pith citation observations for arXiv:2405.10292.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2405.10292 v3

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 34 of 34 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-15T06:32:42.880941+00:00

measured 34 of 34 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-15T20:59:41.116130Z

measured 1 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-08-05T02:28:24.338817Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

8
arxiv_reference, observed 2026-08-05T02:28:24.338817Z

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 354caf9c-1843-4282-97a9-d1b7c9a86b19 · inbound

Cambrian-1: A Fully Open, Vision-Centric Exploration of Multimodal LLMs cites this paper.

Cambrian-1: A Fully Open, Vision-Centric Exploration of Multimodal LLMs Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 146

Resolution
verified exact
arxiv_id, observed 2026-05-17T00:05:03.846403Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-05-17T00:05:03.547664Z digest=sha256:e14c77102d95809b1de8b95c75b8cde92ee37137150f2824825d76bf5f5b64e7

Observation 486a9b4b-31ee-43b4-a7e8-7f04da745aa0 · inbound

Generalist Virtual Agents: A Survey on Autonomous Agents Across Digital Platforms cites this paper.

Generalist Virtual Agents: A Survey on Autonomous Agents Across Digital Platforms Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-12T19:10:14.476685Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:10:14.476685Z digest=sha256:00f54a0f362ee02df4ce1a818a45556e567e0df77ba3088946383cb766b7fc42

Observation 685f869f-e7bc-4de9-9059-9fbdf4b8a96e · inbound

VisGraphVar: A Benchmark Generator for Assessing Variability in Graph Analysis Using Large Vision-Language Models cites this paper.

VisGraphVar: A Benchmark Generator for Assessing Variability in Graph Analysis Using Large Vision-Language Models Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 63

Resolution
unresolved
no resolver link, observed 2026-08-12T14:52:57.327620Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T14:52:57.327620Z digest=sha256:654e6937cee6e68aed0e7cbf0b88f61c168f0b09744397c75d305defa99d952e

Observation 4137cb0c-8afa-49a0-85d7-81fbf13774a8 · inbound

Large Language Model-Brained GUI Agents: A Survey cites this paper.

Large Language Model-Brained GUI Agents: A Survey Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 269

Resolution
verified exact
arxiv_id, observed 2026-05-19T11:08:27.881216Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-05-19T11:08:27.472508Z digest=sha256:8485d340de54981e8d1b1b32236d52dbc50dd963ad3fd16e482c827cb53e717e

Observation bc3804be-aeb5-4b4c-ac57-48e69c29ee40 · inbound

GRAPE: Generalizing Robot Policy via Preference Alignment cites this paper.

GRAPE: Generalizing Robot Policy via Preference Alignment Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-12T10:23:15.800790Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-12T10:23:15.800790Z digest=sha256:6524a4e870ffadf7831067d949343db1c826b064c2d35bdab8436ec16d617c7d

Observation 1f0dc90a-fa6e-47f6-9815-d97d33952d16 · inbound

Dynamic Cross-Modal Alignment for Robust Semantic Location Prediction cites this paper.

Dynamic Cross-Modal Alignment for Robust Semantic Location Prediction Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-11T16:40:38.920563Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T16:40:38.920563Z digest=sha256:af1bb22bfa67e5a7d94849ddf370aa317eeb9a72690012493809c865beca896e

Observation 5a7b1f18-ff53-4682-aed8-2f50cb567739 · inbound

Dynamic Cross-Modal Alignment for Robust Semantic Location Prediction cites this paper.

Dynamic Cross-Modal Alignment for Robust Semantic Location Prediction Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-11T16:40:38.914836Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T16:40:38.914836Z digest=sha256:12161b61da5b00a6b21b201ca669b3829bf84e198f3fdfc9fc7d1cd6ee70d345

Observation 81961021-753c-4c11-b087-7455143f4495 · inbound

Bridging Vision and Language: Modeling Causality and Temporality in Video Narratives cites this paper.

Bridging Vision and Language: Modeling Causality and Temporality in Video Narratives Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-11T15:44:54.848987Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T15:44:54.848987Z digest=sha256:e30c7ef3d859de228b6c9927a8fa3c173f4d13677f3af4194d199d220e689a37

Observation efdb86d5-6a57-4f20-8773-6fa05cfdb689 · inbound

Optimizing Vision-Language Interactions Through Decoder-Only Models cites this paper.

Optimizing Vision-Language Interactions Through Decoder-Only Models Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-11T15:41:07.467266Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T15:41:07.467266Z digest=sha256:e09056234e32cfbc233f5a169be1b6c097a5cc0d04602843c639fa634e1ffb37

Observation 13e4d032-0556-4830-963c-ac3152413ad6 · inbound

Temporal Contrastive Learning for Video Temporal Reasoning in Large Vision-Language Models cites this paper.

Temporal Contrastive Learning for Video Temporal Reasoning in Large Vision-Language Models Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-11T15:03:10.534778Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T15:03:10.534778Z digest=sha256:5bc3242f741f3deaf76f407ef449ae873f199d631452727e418fb6a4887599fe

Observation 14ef6d89-a516-4e00-8e59-0c5756570613 · inbound

Leveraging Retrieval-Augmented Tags for Large Vision-Language Understanding in Complex Scenes cites this paper.

Leveraging Retrieval-Augmented Tags for Large Vision-Language Understanding in Complex Scenes Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-11T15:02:23.290415Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T15:02:23.290415Z digest=sha256:42fb204a15687b6473e27f888d582002b9d9f57344261e133ca08f7b0906bc27

Observation 72f67eb6-1f26-478f-8704-989518038344 · inbound

Online Preference-based Reinforcement Learning with Self-augmented Feedback from Large Language Model cites this paper.

Online Preference-based Reinforcement Learning with Self-augmented Feedback from Large Language Model Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-11T06:05:40.332651Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T06:05:40.332651Z digest=sha256:de1d466e37dedb8b61dec21c26b958817aee9d27b39a13d5d73cd00a2077b1b6

Observation f0b0febd-18cd-41bb-9ee6-6268daf9c69d · inbound

Training Software Engineering Agents and Verifiers with SWE-Gym cites this paper.

Training Software Engineering Agents and Verifiers with SWE-Gym Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 11

Resolution
metadata mismatch
arxiv_id, observed 2026-05-18T05:20:40.538094Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-05-18T05:20:40.483057Z digest=sha256:9ad350722cc947b46745e4cdb931ef21ef1937b4a7585ae675eb431f1ecfbfee

Observation cc763e41-2d8b-49bc-a969-3b72d7af4a05 · inbound

An Overview and Discussion on Using Large Language Models for Implementation Generation of Solutions to Open-Ended Problems cites this paper.

An Overview and Discussion on Using Large Language Models for Implementation Generation of Solutions to Open-Ended Problems Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 105

Resolution
unresolved
no resolver link, observed 2026-08-10T22:51:52.548776Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:51:52.548776Z digest=sha256:0c56112b24a3c1663c29af669c8ce1a2402a9bc8c2c1b3daec83dcf31246de50

Observation f803b801-e120-4d73-accd-1777b2049def · inbound

Large language models for artificial general intelligence (AGI): A survey of foundational principles and approaches cites this paper.

Large language models for artificial general intelligence (AGI): A survey of foundational principles and approaches Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 296

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:13.212962Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:13.212962Z digest=sha256:f61e4593d51ceb74c098b5afa5c43d7faffa41d4d5346c62eb214c192f8352ab

Observation 44d5c870-070d-4de4-99e3-785240b86460 · inbound

Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning cites this paper.

Dynamic Knowledge Integration for Enhanced Vision-Language Reasoning Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-10T20:26:14.728488Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T20:26:14.728488Z digest=sha256:8782c2d1ffce431977db35452cfd96681699dad72a00fcdd7ae17e27fb75108b

Observation 6af1a7e6-4817-452c-8227-94dc0a889695 · inbound

Improving Vision-Language-Action Model with Online Reinforcement Learning cites this paper.

Improving Vision-Language-Action Model with Online Reinforcement Learning Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-10T11:39:56.180466Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T11:39:56.180466Z digest=sha256:e10274a7f18ec7fcb7d1f159a880a9f8020f4fbfa2acc75ebec4d5e95d344486

Observation 2c5a9231-ac47-4a73-8c04-215769c5d976 · inbound

RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception cites this paper.

RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-09T22:09:40.727564Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T22:09:40.727564Z digest=sha256:c51827512cd8dd1b075a6abe04696407b2729ee59b0ca065a9ee309a6565de68

Observation e7f93f0d-3498-41e3-b7d5-2d4e0b4658ce · inbound

CodeSteer: Symbolic-Augmented Language Models via Code/Text Guidance cites this paper.

CodeSteer: Symbolic-Augmented Language Models via Code/Text Guidance Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-09T12:16:27.442688Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T12:16:27.442688Z digest=sha256:6944db9cb8dd5038685197eed78d9a0f42b0136739e0e17dbaa826215e03235c

Observation d0f68463-bb30-4748-9bd5-897400fff841 · inbound

Digi-Q: Learning Q-Value Functions for Training Device-Control Agents cites this paper.

Digi-Q: Learning Q-Value Functions for Training Device-Control Agents Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-07T20:57:48.541871Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T20:57:48.541871Z digest=sha256:ee25d6bcc235fe2051f5d40aca50fd300bdce6054feca9ce7d969dc72244ab09

Observation e1b7d85e-be24-4f27-acb9-2c7dc0e7d20f · inbound

Sample Efficient Reinforcement Learning via Large Vision Language Model Distillation cites this paper.

Sample Efficient Reinforcement Learning via Large Vision Language Model Distillation Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-15T20:59:41.116130Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:59:41.116130Z digest=sha256:224c49d97d95a04c9dee15c4a751f174915917673b2740060687ec9c093f2e94

Observation bba994c9-ecbb-4d74-89c2-672229ac6d0a · inbound

Grounded Reinforcement Learning for Visual Reasoning cites this paper.

Grounded Reinforcement Learning for Visual Reasoning Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 87

Resolution
verified exact
arxiv_id, observed 2026-05-22T01:05:52.205820Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-05-22T01:05:18.801388Z digest=sha256:8e37385e65b214a57c87e9452850f72cec1fe2db3ad2baf41934386906f0a43c

Observation 53650ddf-b229-4629-83b1-d4d6810ccd85 · inbound

Thinking vs. Doing: Agents that Reason by Scaling Test-Time Interaction cites this paper.

Thinking vs. Doing: Agents that Reason by Scaling Test-Time Interaction Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-07T05:27:49.911434Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T05:27:49.911434Z digest=sha256:991f8520fa2d0751c6344207ed46265cf30391f0f0b1a9c3c7c5a3dd50a80674

Observation a4ff4c6b-9d2e-4e44-9182-ff5299d37b8d · inbound

HALO: Human Preference Aligned Offline Reward Learning for Robot Navigation cites this paper.

HALO: Human Preference Aligned Offline Reward Learning for Robot Navigation Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-06T05:41:42.254081Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:41:42.254081Z digest=sha256:d2297dcfcb29296bc56275b87462479126cc6ae9674cac236842d282e06df8c3

Observation b18ca34b-7c07-4afa-a6ef-4bc5352c6030 · inbound

UAV-VL-R1: Generalizing Vision-Language Models via Supervised Fine-Tuning and Multi-Stage GRPO for UAV Visual Reasoning cites this paper.

UAV-VL-R1: Generalizing Vision-Language Models via Supervised Fine-Tuning and Multi-Stage GRPO for UAV Visual Reasoning Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 14

Resolution
verified exact
arxiv_id, observed 2026-05-18T22:21:53.258075Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-05-18T22:17:41.758059Z digest=sha256:77d270d6e6e2ef680d9f9237b7f11ae435040ec2cdd112c6b83500c700aca990

Observation b3a8be4e-9ebd-45f0-a26e-e792535251c5 · inbound

TCPO: Thought-Centric Preference Optimization for Effective Embodied Decision-making cites this paper.

TCPO: Thought-Centric Preference Optimization for Effective Embodied Decision-making Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-15T16:11:01.036940Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T16:11:01.036940Z digest=sha256:529785399e4aa92828ffd5610e0519317e9d11ca904c7217d3b3cece8c3c7958

Observation 35288331-b6b7-471c-92c2-4973e245f65b · inbound

GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL cites this paper.

GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 74

Resolution
unresolved
no resolver link, observed 2026-08-02T20:51:45.970836Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-02T20:51:45.970836Z digest=sha256:bb9962c6909295af66f4e7b1f6e3e980dfebd8e4ccd8ba0817697b70b0538bba

Observation ae5a3308-4ade-4f84-ba32-d0d685819d3e · inbound

PRISM: Perception Reasoning Interleaved for Sequential Decision Making cites this paper.

PRISM: Perception Reasoning Interleaved for Sequential Decision Making Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 32

Resolution
metadata mismatch
arxiv_id, observed 2026-05-11T17:46:17.089189Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=arxiv_source observed=2026-05-08T17:07:16.531726Z digest=sha256:d657ce6438fa3d2485c03d9dedafe5791669a3206a57a178857aafcc58465d30

Observation 7cc824c7-d025-4952-8f58-3ee68f85ef0b · inbound

Reasoning Portability: Guiding Continual Learning for MLLMs in the RLVR Era cites this paper.

Reasoning Portability: Guiding Continual Learning for MLLMs in the RLVR Era Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 64

Resolution
verified exact
arxiv_id, observed 2026-05-20T13:33:19.441984Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-05-20T13:29:11.509966Z digest=sha256:8ba68cb350f28309dc246e348734f7969dfc13127c708679b2ddec03eeba732d

Observation c20353e4-cf20-4934-97b5-fc85df66e18a · inbound

Qwen-RobotWorld Technical Report: Unifying Embodied World Modeling through Language-Conditioned Video Generation cites this paper.

Qwen-RobotWorld Technical Report: Unifying Embodied World Modeling through Language-Conditioned Video Generation Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 234

Resolution
metadata mismatch
arxiv_id, observed 2026-07-03T17:18:43.955672Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=arxiv_source observed=2026-06-27T04:19:26.332718Z digest=sha256:26985e328942706c3993a4f326ee74cc18ddd346aa7e6061fa04d996f40f62d7

Observation 72adbdd6-61dc-484b-97e8-4343b05cb815 · inbound

Rank-Then-Act: Reward-Free Control from Frame-Order Progress cites this paper.

Rank-Then-Act: Reward-Free Control from Frame-Order Progress Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 30

Resolution
verified exact
arxiv_id, observed 2026-07-03T17:48:45.228474Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-07-03T17:42:44.309030Z digest=sha256:1b4efe47436a3bf717ee56a3533be9a4cc9439f3504a321d1d0a1eeda6fc4c35

Observation 577c25f7-95a5-4198-bcee-4fbe5d33cfec · inbound

Qwen-Audio-VAE Technical Report cites this paper.

Qwen-Audio-VAE Technical Report Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 241

Resolution
unresolved
no resolver link, observed 2026-07-14T03:31:19.309532Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-14T03:31:19.309532Z digest=sha256:932ebd5a109bd0efc5d485836a5a9ccd2b5222c092d65e9e660655998a59e99e

Observation f1f80f45-9484-4442-bc68-1e528424f735 · inbound

PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis cites this paper.

PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-08T17:13:25.992116Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T17:13:25.992116Z digest=sha256:06b38a52082bfa6352431ee2ed4f118185f9c0fe88e438a3b042a31ec0c4f237

Observation 9c3be8fd-6365-445b-83df-0b0e4e6de7e3 · inbound

PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis cites this paper.

PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-10T04:31:25.708096Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T04:31:25.708096Z digest=sha256:8aad571e0ab680aec1e5663f3b0657ba554022c059daee44c77b772d11098838