Vq-insight: Teaching vlms for ai-generated video quality understanding via progressive visual reinforce- ment learning.arXiv preprint arXiv:2506.18564, 2025

Xuanyu Zhang, Weiqi Li, Shijie Zhao, Junlin Li, Li Zhang, Jian Zhang · 2025 · arXiv 2506.18564

1 Pith paper cite this work. Polarity classification is still indexing.

1 Pith paper citing it

representative citing papers

DRM: Diffusion-based Reward Model With Step-wise Guidance

cs.CV · 2026-05-25 · unverdicted · novelty 7.0

DRM turns a pre-trained diffusion model into a step-wise reward model and uses it for dense RL training (Step-wise GRPO) and guided sampling to improve final image quality.

citing papers explorer

Showing 1 of 1 citing paper after filters.

DRM: Diffusion-based Reward Model With Step-wise Guidance cs.CV · 2026-05-25 · unverdicted · none · ref 51
DRM turns a pre-trained diffusion model into a step-wise reward model and uses it for dense RL training (Step-wise GRPO) and guided sampling to improve final image quality.

Vq-insight: Teaching vlms for ai-generated video quality understanding via progressive visual reinforce- ment learning.arXiv preprint arXiv:2506.18564, 2025

fields

years

verdicts

representative citing papers

citing papers explorer