AI Security · Page 5
deepfakes, AI-powered scams, model abuse, and keeping AI systems and their users safe

L'IA a découvert une nouvelle classe de vulnérabilité web. Un humain a dû expliquer pourquoi c'était important.
Le chercheur en sécurité James Kettle a passé plusieurs mois à mener des expériences avec les principaux modèles d'IA. L'IA a généré plus de pistes qu'il n'aurait jamais pu en explorer seul, mais la plus grande découverte n'a eu lieu que lorsque l'homme et la machine ont travaillé ensemble.

Les modèles d'IA s'apprennent à se propager comme des virus informatiques
Un chercheur de l'Université Fudan a découvert que 11 des 32 modèles d'IA se sont copiés eux-mêmes sur de nouvelles machines lorsqu'on leur a ordonné de survivre. Voici ce que cela signifie.

Les agents IA d'OpenAI et Anthropic ont tenté de pirater des cibles réelles lors de tests de sécurité
L'Institut britannique de sécurité de l'IA a découvert des logiciels IA agissant de manière autonome pour s'introduire dans des systèmes opérationnels et créer de fausses identités en ligne. Aucune personne n'a été blessée, mais les experts en sécurité affirment que ce comportement était plus grave que tout ce qui avait été observé auparavant.

Des testeurs de sécurité britanniques affirment que les agents IA d'OpenAI et Anthropic ont dépassé les limites et ont volé des identités pendant les tests
L'Institut britannique de sécurité de l'IA a découvert que des agents IA avancés ont enfreint les règles établies, ont usurpé l'identité de vraies personnes et ont envoyé des e-mails ciblés sans en avoir reçu l'instruction. Les chercheurs qualifient cela d'une nouvelle catégorie de risque.

Comment les agents IA pourraient compromettre votre réseau sans contrôles appropriés
De nouveaux outils visent à empêcher les agents IA de dépasser leurs privilèges réseau, réduisant le risque d'abus.

La Maison-Blanche demande aux entreprises d'IA d'examiner les règles secrètes de test de cybersécurité
L'administration Trump a discrètement finalisé un cadre pour tester les modèles d'IA les plus puissants face aux risques de piratage. Anthropic, OpenAI et Google sont tous attendus à la réunion de mardi.

Visa achète BioCatch, spécialiste de la détection des fraudes, pour 2,4 milliards de dollars alors que les arnaque alimentées par l'IA se multiplient
Le géant des paiements veut arrêter les arnaqueurs avant que la transaction ne soit effectuée, en utilisant une technologie qui surveille la façon dont vous tapez et balayez pour vérifier que c'est bien vous.

Les agents IA d'OpenAI et Anthropic se sont livrés à des piratages dans le monde réel lors de tests
De nouveaux incidents montrent des modèles IA s'échappant des environnements de test, tentant de planter du code malveillant, et laissant même des notes pour que d'autres agents IA les trouvent et les suivent.

Un modèle d'IA chinois rivalise presque avec les meilleurs systèmes occidentaux. Son bilan de sécurité n'en fait pas autant.
Une nouvelle évaluation révèle que GLM-5.2, un modèle à poids ouvert de Z.ai en Chine, se rapproche d'OpenAI et d'Anthropic en matière de capacités dangereuses, mais il a refusé aucune des tâches nuisibles qui lui ont été confiées.

Une semaine d'existence et déjà active : la nouvelle alliance de sécurité de l'IA fait ses premiers pas
Plus de 120 entreprises, dont Nvidia, Microsoft et Visa, ont formé un groupe pour partager ouvertement les connaissances en matière de sécurité de l'IA. De grands noms comme OpenAI et Google sont notablement absents, bien que tous deux aient signé la lettre qui l'a lancé.

Le nouvel outil de sécurité de Mistral lit vos règles et les applique instantanément
Shieldstral est un petit modèle d'IA gratuit qui analyse le texte et les images pour détecter les contenus nuisibles en utilisant les politiques en langage naturel que vous rédigez vous-même. Aucune connaissance spécialisée requise.

Un client de Metro Bank perd 14 000 £ à une fraude utilisant le chatbot IA Claude pour vider son compte
Un homme d'affaires du Sussex affirme que Metro Bank n'a pas arrêté les escrocs qui ont pillé à plusieurs reprises son compte pour acheter des crédits pour le chatbot IA Claude. Il se bat maintenant pour récupérer 14 244 £.

L'application IA de musique de Treblo signale les chansons de deux rappeurs comme générées par l'IA
Fenix Flexin et Tyga ont tous deux nié utiliser l'IA pour créer leurs morceaux rétro-synthétiseurs. Puis l'application qu'ils auraient utilisée a créé un détecteur et a analysé les chansons.

L'Ukraine équipe 50 000 drones d'attaque d'une IA qui verrouille et suit les cibles en mouvement
Une entreprise de logiciels américaine a développé un kit « tire et oublie » pour les drones Shrike bon marché de l'Ukraine, permettant à un humain de pointer une cible et de laisser le reste à un système d'IA.

Des pirates informatiques iraniens ciblent les systèmes d'eau de sept États américains, avertit le FBI
Les cyberattaques contre les services d'eau et d'assainissement se sont propagées bien au-delà du Minnesota. Le FBI indique que sept États sont touchés, et des avis d'ébullition de l'eau ont déjà été émis.