Review history
Aligning Frozen LLMs by Reinforcement Learning: An Iterative Reweight-then-Optimize Approach
-
2026-08-15 CONDITIONAL
-
2026-08-06 CONDITIONAL
Aligning Frozen LLMs by Reinforcement Learning: An Iterative Reweight-then-Optimize Approach