Communication dans un congrès, AO, Informatique, Intelligence artificielle

StaQ: a Finite Memory Approach to Discrete Action Policy Mirror Descent

Alex Davey, Alena Shilova, Brahim Driss, Riad Akrour. StaQ: a Finite Memory Approach to Discrete Action Policy Mirror Descent. RLC 2026 - Third Reinforcement Learning Conference, Aug 2026, Montreal, Canada. ⟨hal-05710283⟩

Publié le