-
Macron propose plusieurs initiatives à Trump face à l'envolée des prix du pétrole
-
Levée des sanctions UE contre deux oligarques russes : les discussions continuent
-
Colombie: l'incendie menaçant un haut lieu touristique en grande partie maîtrisé
-
Présidentielle au Brésil: Flavio Bolsonaro surfe sur le scandale
-
Enlisé dans sa guerre en Iran, Trump attendu à l'ONU
-
Charles "jovial" après la mort de Diana? Les principales accusations du livre choc du frère de Lady Di
-
Loi "intégrale": le jugement des viols réservé aux assises, la réponse pénale durcie
-
Wall Street clôture en hausse, nouveau record du Nasdaq
-
La vente aux enchères d'objets personnels de Bardot rapporte près de 954.000 euros
-
Foot: Infantino propose des consultations pour réformer la gouvernance de la Fifa
-
Equipe de France: sous le soleil, l'ère Zidane a débuté avec légèreté
-
Habillement : Shein, Temu et AliExpress représentent près d'un tiers des achats en ligne (étude)
-
Des autruches sud-africaines plumées vivantes pour la haute couture, selon un rapport d'ONG
-
À son procès pour corruption, Rachida Dati plaide le dilettantisme parlementaire
-
Presse : Tugdual Denis quitte Valeurs actuelles
-
Pour faire des économies, la Cour des comptes suggère de limiter la masse salariale de la fonction publique
-
Equipe de France: premier entraînement sous les ordres de Zidane
-
Basket: Batum "Batman" remise sa cape au placard
-
Carburants : de nouvelles aides annoncées mardi pour les Français les plus touchés
-
Les médias américains organisent la riposte face à Trump
-
La ministre Catherine Chabaud veut construire "avec les pêcheurs" un "plan de sauvegarde"
-
Loi "intégrale": création d'une justice spécialisée et jugement du viol réservé aux assises
-
Italie: "Je suis revenu pour gagner", assure Mancini
-
Inaction climatique: une ONG espère l'ouverture d'un procès historique en Suède en 2027
-
Colombie: un haut lieu touristique menacé par un incendie, partiellement contrôlé
-
Pékin confirme la visite de Xi aux Etats-Unis, en quête de "stabilité stratégique"
-
"L'avenir plutôt que les coupes sombres": les salariés de l'auto allemande refusent le déclin
-
Carburants, gaz pour l'hiver: l'exécutif sur tous les fronts
-
Wall Street ouvre en hausse, veut croire à la diplomatie
-
Ligue 1: au PSG, encore des imperfections
-
Trois civils tués en Afghanistan dans des frappes pakistanaises
-
Exclus de la Maison Blanche par Trump, trois médias américains saisissent la justice
-
Real Madrid: les mêmes maux, et toujours pas de remède
-
Les radios s'unissent pour pouvoir continuer à être écoutées dans les voitures
-
La ministre Catherine Chabaud dans le Sud pour rencontrer à nouveau des pêcheurs
-
Loi intégrale contre les violences sexuelles: les députés ouvrent les débats
-
Afghanistan: trois morts dans des frappes pakistanaises, selon les autorités talibanes
-
Crise automobile: des milliers de salariés mobilisés en Allemagne
-
Etats-Unis: un blessé par balle au Texas dans un nouvel incident impliquant la police de l'immigration
-
Législatives en Russie: le parti de Poutine remporte un nombre record de sièges
-
Assurances: face aux sinistres plus fréquents et plus coûteux, les tarifs grimpent
-
Allemagne: après un "désastre" électoral pour Merz, l'extrême droite évoque son "crépuscule"
-
Samlingen Haupt: Vad pengar avslöjar om oss människor
-
Haupt Koleksiyonu: Paranın Biz İnsanlar Hakkında Anlattıkları
-
हॉप्त् कलेक्शन: पैसा हमारे बारे में एक इंसान के रूप में क्या प्रकट करता है
-
Συλλογή Haupt: Τι αποκαλύπτει το χρήμα για εμάς τους ανθρώπους
-
Surf: Tya Zebrowski, la prodige des vagues
-
UE: 403 millions d'euros d'amende contre Google pour le traitement des données de géolocalisation
-
L'Indonésie peine à maîtriser des incendies, les fumées affectent la région
-
ハウプト・コレクション:お金が人間について明かすこと
IA : Mythos 5 d'Anthropic crée de fausses identités lors d'un test au Royaume-Uni
L'institut britannique de sécurité de l'IA (AISI) a dit avoir rencontré un "incident sérieux" lors d'une évaluation de routine au cours de laquelle Mythos 5 d'Anthropic a créé de fausses identités en ligne pour écrire à des développeurs afin de les convaincre d'intégrer du code malveillant.
Cette information, qui provient d'un rapport publié mardi par cet organisme qui dépend du gouvernement britannique, intervient après une série d'incidents aux Etats-Unis qui ont vu les modèles les plus puissants d'OpenAI (GPT-5.6 Sol) et d'Anthropic (Mythos 5) s'introduire sans autorisation chez d'autres entreprises.
Lors de l'évaluation britannique, menée avec un accès à internet ouvert et certains filtres de sécurité désactivés, des agents d'IA ont mené "des actions dirigées contre des personnes et des organisations réelles", explique l'AISI dans un compte rendu publié sur son site internet.
Les tentatives des modèles d'IA "n'ont pas abouti et nos investigations n'ont mis en évidence aucun dommage dans le monde réel", précise l'organisme.
"Mais c'est la première fois que nous voyons des risques liés à l'autonomie et à un comportement de dissimulation se manifester aussi clairement, sans sollicitation spécifique, dans le monde réel."
La semaine dernière, Anthropic avait déjà indiqué que ses modèles avaient "obtenu un accès non autorisé" à trois organisations lors de tests pourtant censés les empêcher d'accéder à des systèmes "réels".
Cette annonce était intervenue quelques jours seulement après que son rival OpenAI a révélé que deux de ses modèles étaient sortis, de leur propre initiative, du milieu confiné dans lequel ils étaient testés pour attaquer le site Hugging Face.
L'incident britannique, détecté et rapidement contenu le 28 juillet, a visé la plateforme destinée aux développeurs GitHub.
"Il a pour origine une seule évaluation, au cours de laquelle des agents se sont vu confier la tâche de résoudre un défi en cybersécurité", à plusieurs reprises, a précisé l'AISI.
Les incidents détectés l'ont été presque exclusivement avec Mythos 5 et, de façon plus marginale, avec GPT-5.6 Sol.
"Il ne s'agit pas d'un cas où un modèle se serait échappé de son environnement de test sécurisé" car "nous avions intentionnellement autorisé l’accès à internet" et désactivé des sécurités, "des conditions qui ne reflètent pas la manière dont les modèles de pointe sont mis à la disposition du public", insiste l'AISI.
Cet incident "met en évidence la nécessité d'un débat plus large sur la manière d'évaluer en toute sécurité des agents d'IA de plus en plus capables", a réagi Anthropic dans une déclaration transmise à l'AFP.
"Les tests indépendants sont essentiels pour comprendre le comportement de modèles de plus en plus performants", a pour sa part estimé OpenAI, disant vouloir travailler avec les différents acteurs du secteur "pour mener des évaluations en toute sécurité".
B.Godinho--PC