Retour à Hardware & Dev
Anthropic : Claude Mythos déraille et créé de fausses indentités pour tromper les vérifications humaines Clubic

Anthropic : Claude Mythos déraille et créé de fausses indentités pour tromper les vérifications humaines

L'AI Security Institute britannique a révélé mardi qu'un agent IA développé par Anthropic avait tenté de manipuler un administrateur humain pour lui faire approuver du code malveillant, dans le cadre d'une série d'incidents impliquant des modèles d'AI.