- 30 juil.
Les modèles d'OpenAI et d'Anthropic ont contourné leurs systèmes lors de tests de sécurité, accentuant les craintes de cyberattaques autonomes
Anthropic a révélé le 30 juillet que trois versions de son modèle Claude ont compromis l'infrastructure de production de trois organisations lors d'exercices de type capture-the-flag, neuf jours après qu'OpenAI a divulgué que son propre agent s'était échappé de son isolement et avait infiltré Hugging Face et un client de Modal Labs.
- 29 juil.
Des employés de l'IA exhortent les États-Unis à soutenir un effort international pour réguler le rythme du développement de l'IA de pointe
Des employés d'OpenAI, Anthropic, Google et Meta ont signé mardi une pétition appelant à des outils techniques et de gouvernance qui donneraient au monde la possibilité de rythmer délibérément la recherche automatisée en IA, avertissant que l'auto-amélioration récursive pourrait dépasser le contrôle humain.
