Evolutionary learning of interpretable decision trees

Résumés déjà disponibles dans d'autres langues : en

Auteurs : Leonardo Lucio Custode, Giovanni Iacca

arXiv: 2012.07723v1 - DOI (cs.LG)

66 pages, 31 figures, code available at: https://gitlab.com/leocus/ge_q_dts

Résumé : Reinforcement learning techniques achieved human-level performance in several tasks in the last decade. However, in recent years, the need for interpretability emerged: we want to be able to understand how a system works and the reasons behind its decisions. Not only we need interpretability to assess the safety of the produced systems, we also need it to extract knowledge about unknown problems. While some techniques that optimize decision trees for reinforcement learning do exist, they usually use greedy algorithms or they do not exploit the rewards given by the environment. This means that these techniques may easily get stuck in bad local optima. In this work, we propose a novel approach to interpretable reinforcement learning that uses decision trees. We use a two-level optimization approach that combines the advantages of evolutionary algorithms with the advantages of Q-learning. This way we decompose the problem in two sub-problems: the problem of finding a meaningful and useful decomposition of the state space, and the problem of associating an action to each state. We test our approach in three well-known reinforcement learning benchmarks and the results make our approach competitive with respect to the state of the art in both performance and interpretability. Finally, we perform an ablation study that confirms that using the two-level optimization approach gives us a boost in performance in non-trivial environments with respect to a one-layer optimization technique.

Soumis à arXiv le 14 Déc. 2020

Posez des questions sur cet article à notre assistant IA

Vous pouvez aussi discutez avec plusieurs papiers à la fois ici.

⚠La licence de l'article ne nous permet pas de nous appuyer sur son contenu et l'assistant IA ne peut se servir que des métadonnées de l'article plutôt que de l'article complet.

Instructions pour utiliser l'assistant IA ?

Résultats du processus de synthèse de l'article arXiv : 2012.07723v1

⚠La licence de cet article ne nous permet pas de nous appuyer sur son contenu et le processus de synthèse est ici effectué avec les métadonnées de l'article plutôt qu'avec l'article en tant que tel.

Résumé Complet
Points clés
Résumé vulgarisé
Article de blog

Le résumé n'est pas encore prêt

Les points clés ne sont pas encore prêts

Le résumé vulgarisé n'est pas encore prêt

L'article de blog n'est pas encore prêt

Créé le 14 Nov. 2024

Disponible dans d'autres langues : en

Évaluez la qualité du contenu généré par l'IA en votant

Note : 0

Le résumé précédent a été créé il y a plus d'un an et peut être réexécuté (si nécessaire) en cliquant sur le bouton Exécuter ci-dessous.

⚠La licence de cet article spécifique ne nous permet pas de nous appuyer sur son contenu et les outils de synthèse seront exécutés en utilisant les métadonnées de l'article plutôt que l'article complet. Cependant, l'outil produira quand même un bon résultat, et vous pouvez également essayer nos outils sur des papiers avec des licences plus ouvertes.

Evolutionary learning of interpretable decision trees

Posez des questions sur cet article à notre assistant IA

Résultats du processus de synthèse de l'article arXiv : 2012.07723v1

Articles similaires résumés avec nos outils d'IA