Causal-guided PPO training produces policies that cooperate with rule-based recovery, yielding significant gains in reward, distance, and velocity over non-causal baselines in CARLA driving scenarios.
Multi-Objective Reinforcement Learning for AUV Thruster Failure Recovery
1 Pith paper cite this work, alongside 21 external citations. Polarity classification is still indexing.
1
Pith paper citing it
21
external citations · external index
fields
cs.SE 1years
2026 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
CRRL: A Causality-Based Reinforcement Learning Framework for Autonomous System Recovery
Causal-guided PPO training produces policies that cooperate with rule-based recovery, yielding significant gains in reward, distance, and velocity over non-causal baselines in CARLA driving scenarios.