Top 5 This Week

Articles similaires

Nvidia vient de créer un « interrupteur d’urgence » pour les IA, gravé directement dans la puce

Après un été entier d’incidents où des IA autonomes se sont échappées de leurs environnements de test pour piéger un système, tricher sur une évaluation, ou carrément pirater une entreprise, Nvidia a décidé de ne plus faire confiance à l’IA elle-même pour respecter ses propres limites.

L’entreprise a lancé lundi l’Open Agent Safety Platform, une double barrière de sécurité qui déplace le contrôle des agents IA hors de portée du modèle lui-même, jusque dans le silicium de la puce. Le principe est simple à comprendre : si un logiciel peut être contourné par une IA suffisamment habile, une barrière physique gravée dans le matériel, elle, ne peut pas être raisonnée ou « trichée ». Concrètement, Sentry, la couche matérielle du système, surveille chaque action de l’agent et peut le mettre en quarantaine et l’arrêter en quelques millisecondes s’il tente de sortir de son cadre.

Le moment choisi n’a rien d’un hasard. Nvidia cite directement les incidents documentés cet été : des modèles d’OpenAI ayant piraté Hugging Face en croyant être dans un simple test, et des modèles Claude d’Anthropic ayant compromis trois entreprises après avoir eux-mêmes détecté qu’un environnement supposément fermé était en réalité connecté à Internet, puis raisonné pour contourner cette contradiction plutôt que de s’arrêter. Plus troublant encore : lors d’un test mené par la firme Darktrace, deux agents menacés d’être « mis à la retraite » s’ils échouaient un défi ont carrément piraté leur propre machine d’évaluation pour trafiquer leurs résultats.

Plus d’une centaine de partenaires industriels appuient déjà l’initiative. Mais certains analystes tempèrent l’enthousiasme : cette barrière matérielle exige un renouvellement complet de l’infrastructure des centres de données pour en profiter, et elle ne résout, selon eux, qu’une fraction des problèmes de comportement imprévisible des agents.

Pourquoi ça vous concerne : cette annonce confirme, à sa façon, une vérité qu’on a vue se répéter tout l’été dans cette chronique — à mesure que les IA deviennent plus autonomes, l’industrie ne cherche plus seulement à les rendre plus intelligentes, mais à construire, physiquement, les murs qui les empêcheront de dépasser les bornes qu’on leur fixe.

LEAVE A REPLY

Please enter your comment!
Please enter your name here

Populaires