Au-delà de l'IA constitutionnelle : Évaluer les mécanismes de supervision évolutive et de débat pour l'alignement de l'AGI
Alors que le domaine de l'intelligence artificielle progresse rapidement vers l'Intelligence Artificielle Générale (AGI), le problème de l'alignement est passé d'une curiosité théorique à une priorité existentielle. Depuis des années, le paradigme dominant reposait sur des méthodes telles que l'apprentissage par renforcement à partir de retours humains...