Pith. sign in

My fair bandit: Distributed learning of max-min fairness with multi-player bandits

1 Pith paper cite this work. Polarity classification is still indexing.

1 Pith paper citing it

fields

cs.LG 1

years

2024 1

verdicts

CONDITIONAL 1

representative citing papers

Fairness in Reinforcement Learning with Bisimulation Metrics

cs.LG · 2024-12-22 · conditional · novelty 6.0

Bisimulator uses bisimulation metrics to modify rewards and observations, letting unconstrained RL policies approximately satisfy demographic parity in lending and college admissions benchmarks.

citing papers explorer

Showing 1 of 1 citing paper.

  • Fairness in Reinforcement Learning with Bisimulation Metrics cs.LG · 2024-12-22 · conditional · none · ref 5

    Bisimulator uses bisimulation metrics to modify rewards and observations, letting unconstrained RL policies approximately satisfy demographic parity in lending and college admissions benchmarks.