-
Le Parlement roumain rejette un troisième candidat au poste de Premier ministre
-
WRC: en Sardaigne, trois candidats pour un premier titre et une dernière
-
Taxe sur les produits sucrés: le gouvernement ouvre la porte, les industriels s'alarment
-
Brandt : près de la moitié des salariés des usines ont retrouvé un emploi
-
Pluie diluvienne sur le Gard et l'Hérault, en vigilance rouge
-
Foot: de Mbappé à Lamine Yamal, une campagne pour le Ballon d'Or "inédite"
-
Ligue des champions féminine: premier test pour Lyon, encore un choc pour le PFC
-
Blocus des lycées: la mobilisation continue, appel à un "acte deux" jeudi
-
Un avion à destination de Tel-Aviv dérouté, les pilotes blessés après une possible bagarre
-
Lecornu agite le chiffon rouge d'une crise financière avant un budget de "redressement"
-
Andy Burnham rouvre le débat risqué sur un retour du Royaume-Uni dans l'UE
-
Sécu : le gouvernement veut "diviser quasiment par deux" le déficit en 2027, dit Farandou
-
Marathon: "Je sais qu'il est possible de courir sous 1h59", estime Sabastian Sawe
-
Macron annonce un dernier sommet Choose France en janvier, avant son départ
-
Intempéries: deux départements du Sud en vigilance rouge pour pluie-inondations
-
La Bourse de Paris décroche en Europe comme la France
-
Sénat : Gérard Larcher, l'insubmersible homme du contre-pouvoir à l'épreuve du RN
-
L'inflation grimpe à 3% en France, au plus haut depuis début 2024
-
Les cosmétiques, un luxe plus accessible qui résiste à la crise
-
Pensions, âge de départ, déficit: les retraites en chiffres
-
Indonésie: à Bornéo, un groupe de femmes lutte contre le feu et le sexisme
-
Dangote va poser au Kenya la première pierre de sa seconde mégaraffinerie en Afrique
-
Allemagne: chômage stable en septembre, la relance automnale reste poussive
-
Dans la Drôme, un élevage de poules se débarrasse de ses cages, à l'image de la filière
-
Le kérosène cher compromet l'avenir de compagnies aériennes à prix bas
-
Gims, le promoteur immobilier marocain et les soupçons de blanchiment monstre
-
Les lanceurs d'alerte cyber à la poursuite des fuites de données
-
Les violences en Cisjordanie attisées par une nouvelle génération radicale de colons
-
Budget 2027: une taxe sur les produits sucrés est "sur la table", annonce le ministre du Commerce
-
Les ministres du Commerce du G20 réunis aux États-Unis, les droits de douane en embuscade
-
Les Bourses européennes en hausse
-
France : l'inflation grimpe à 3% sur un an en septembre, selon l'Insee
-
Trump-Lula, une relation en dents de scie
-
Remboursement des culottes menstruelles : un "défi industriel" pour le made in France
-
Somalie : la Turquie, partenaire majeur, happée dans les rivalités internes
-
Appelés aux urnes, les russophones de Lettonie ne veulent pas être "sauvés" par Poutine
-
Le Parlement roumain vote une nouvelle fois pour tenter de former un gouvernement
-
Grèce: Thymaina, l'île qui ne compte plus que deux écoliers
-
Monique Barbut remet son plan pour accélérer l'adaptation au changement climatique
-
Fin de la mission en Irak de la coalition antijihadiste dirigée par les Etats-Unis
-
Boeing va fabriquer le futur avion de combat de l'US Navy, et celui de l'Air Force
-
La Cour suprême américaine lève de nouveau des limites aux expulsions d'immigrés vers des pays tiers
-
Explosions dans la DMZ : Séoul exige des excuses, Pyongyang nie toute implication
-
Infections et cancers : des liaisons parfois dangereuses, souvent évitables
-
Milei en France en promoteur d'une Argentine ouverte aux affaires, mais qui patine
-
Mediapart dénonce la "violence sidérante" du RN après ses révélations sur Bardella
-
Ligue des nations: l'Angleterre gagne en République tchèque grâce au duo Gordon-Kane
-
Concurrence dans Android et la recherche en ligne: Google attaque des décisions de Bruxelles
-
Une ONG attaque OpenAI pour infraction à la loi sur les cyberattaques après l'incident Hugging Face
-
Ligue des nations: l'Espagne réussit son retour à la maison, Lamine Yamal inarrêtable
IA : Mythos 5 d'Anthropic crée de fausses identités lors d'un test au Royaume-Uni
L'institut britannique de sécurité de l'IA (AISI) a dit avoir rencontré un "incident sérieux" lors d'une évaluation de routine au cours de laquelle Mythos 5 d'Anthropic a créé de fausses identités en ligne pour écrire à des développeurs afin de les convaincre d'intégrer du code malveillant.
Cette information, qui provient d'un rapport publié mardi par cet organisme qui dépend du gouvernement britannique, intervient après une série d'incidents aux Etats-Unis qui ont vu les modèles les plus puissants d'OpenAI (GPT-5.6 Sol) et d'Anthropic (Mythos 5) s'introduire sans autorisation chez d'autres entreprises.
Lors de l'évaluation britannique, menée avec un accès à internet ouvert et certains filtres de sécurité désactivés, des agents d'IA ont mené "des actions dirigées contre des personnes et des organisations réelles", explique l'AISI dans un compte rendu publié sur son site internet.
Les tentatives des modèles d'IA "n'ont pas abouti et nos investigations n'ont mis en évidence aucun dommage dans le monde réel", précise l'organisme.
"Mais c'est la première fois que nous voyons des risques liés à l'autonomie et à un comportement de dissimulation se manifester aussi clairement, sans sollicitation spécifique, dans le monde réel."
La semaine dernière, Anthropic avait déjà indiqué que ses modèles avaient "obtenu un accès non autorisé" à trois organisations lors de tests pourtant censés les empêcher d'accéder à des systèmes "réels".
Cette annonce était intervenue quelques jours seulement après que son rival OpenAI a révélé que deux de ses modèles étaient sortis, de leur propre initiative, du milieu confiné dans lequel ils étaient testés pour attaquer le site Hugging Face.
L'incident britannique, détecté et rapidement contenu le 28 juillet, a visé la plateforme destinée aux développeurs GitHub.
"Il a pour origine une seule évaluation, au cours de laquelle des agents se sont vu confier la tâche de résoudre un défi en cybersécurité", à plusieurs reprises, a précisé l'AISI.
Les incidents détectés l'ont été presque exclusivement avec Mythos 5 et, de façon plus marginale, avec GPT-5.6 Sol.
"Il ne s'agit pas d'un cas où un modèle se serait échappé de son environnement de test sécurisé" car "nous avions intentionnellement autorisé l’accès à internet" et désactivé des sécurités, "des conditions qui ne reflètent pas la manière dont les modèles de pointe sont mis à la disposition du public", insiste l'AISI.
Cet incident "met en évidence la nécessité d'un débat plus large sur la manière d'évaluer en toute sécurité des agents d'IA de plus en plus capables", a réagi Anthropic dans une déclaration transmise à l'AFP.
"Les tests indépendants sont essentiels pour comprendre le comportement de modèles de plus en plus performants", a pour sa part estimé OpenAI, disant vouloir travailler avec les différents acteurs du secteur "pour mener des évaluations en toute sécurité".
U.Shaheen--SF-PST