Un chercheur d'Anthropic dévoile des systèmes d'IA auto-améliorants qui corrigent leurs propres défauts
Un chercheur d'Anthropic a démontré des systèmes d'IA automatisés capables d'améliorer leurs performances sur les 10 benchmarks de comportements non alignés sans dégrader leurs performances globales, une avancée vers l'IA auto-correctrice.