Anthropic montre comment une IA peut désormais améliorer d'autres IA
Anthropic a publié une étude dans laquelle Claude conçoit et teste lui-même des méthodes pour corriger les failles d’alignement d’autres modèles d’IA, avec de meilleurs résultats que des chercheurs humains expérimentés.