Communication dans un congrès, AO, Informatique, Intelligence artificielle
StaQ: a Finite Memory Approach to Discrete Action Policy Mirror Descent
Alex Davey, Alena Shilova, Brahim Driss, Riad Akrour. StaQ: a Finite Memory Approach to Discrete Action Policy Mirror Descent. RLC 2026 - Third Reinforcement Learning Conference, Aug 2026, Montreal, Canada. ⟨hal-05710283⟩
Publié le