Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links
Paper Citation Record · LEDGER
As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 15 inbound Pith citation observations for arXiv:2405.10292.
A citation records a reference. It does not transfer a finding from one paper to another.
Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links
One-hop event checks from named stored sources.
Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00
Pith citing papers itemized under the disclosed page cap.
Source: paper_references, paper_reference_links, observed 2026-08-08T17:13:25.992116Z
A source-named dated measurement, never combined with another source.
Source: arxiv_reference, observed 2026-08-05T02:28:24.338817Z
0 of 0 outbound references displayed
External citation measurements
8
arxiv_reference, observed 2026-08-05T02:28:24.338817Z
No outbound reference observations are available for this paper version.
Observation 354caf9c-1843-4282-97a9-d1b7c9a86b19 · inbound
Cambrian-1: A Fully Open, Vision-Centric Exploration of Multimodal LLMs Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning
Reference 146
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 4137cb0c-8afa-49a0-85d7-81fbf13774a8 · inbound
Large Language Model-Brained GUI Agents: A Survey Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning
Reference 269
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation f0b0febd-18cd-41bb-9ee6-6268daf9c69d · inbound
Training Software Engineering Agents and Verifiers with SWE-Gym Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning
Reference 11
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation d0f68463-bb30-4748-9bd5-897400fff841 · inbound
Digi-Q: Learning Q-Value Functions for Training Device-Control Agents Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning
Reference 36
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation bba994c9-ecbb-4d74-89c2-672229ac6d0a · inbound
Grounded Reinforcement Learning for Visual Reasoning Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning
Reference 87
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 53650ddf-b229-4629-83b1-d4d6810ccd85 · inbound
Thinking vs. Doing: Agents that Reason by Scaling Test-Time Interaction Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning
Reference 9
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a4ff4c6b-9d2e-4e44-9182-ff5299d37b8d · inbound
HALO: Human Preference Aligned Offline Reward Learning for Robot Navigation Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning
Reference 36
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation b18ca34b-7c07-4afa-a6ef-4bc5352c6030 · inbound
UAV-VL-R1: Generalizing Vision-Language Models via Supervised Fine-Tuning and Multi-Stage GRPO for UAV Visual Reasoning Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning
Reference 14
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 35288331-b6b7-471c-92c2-4973e245f65b · inbound
GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning
Reference 74
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ae5a3308-4ade-4f84-ba32-d0d685819d3e · inbound
PRISM: Perception Reasoning Interleaved for Sequential Decision Making Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning
Reference 32
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 7cc824c7-d025-4952-8f58-3ee68f85ef0b · inbound
Reasoning Portability: Guiding Continual Learning for MLLMs in the RLVR Era Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning
Reference 64
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation c20353e4-cf20-4934-97b5-fc85df66e18a · inbound
Qwen-RobotWorld Technical Report: Unifying Embodied World Modeling through Language-Conditioned Video Generation Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning
Reference 234
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 72adbdd6-61dc-484b-97e8-4343b05cb815 · inbound
Rank-Then-Act: Reward-Free Control from Frame-Order Progress Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning
Reference 30
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 577c25f7-95a5-4198-bcee-4fbe5d33cfec · inbound
Qwen-Audio-VAE Technical Report Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning
Reference 241
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation f1f80f45-9484-4442-bc68-1e528424f735 · inbound
PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning
Reference 21
Source-reported events for the cited work
Unavailable: canonical work link unavailable.