IA
Lunar Lander · DQN
Agent d'apprentissage par renforcement qui apprend à poser un atterrisseur.
- Python
- PyTorch

Fiche
- Cadre
- Epitech · 2026
- Rôle
- Implémentation, entraînement, évaluation, documentation
- Méthode
- DQN discret (PyTorch, Gymnasium) · comparé à un agent aléatoire et à une heuristique · ablation du replay buffer · variante avec vent
Images

Agent DQN entraîné Récompense par épisode pendant l'entraînement