AI Security · Page 6
deepfakes, AI-powered scams, model abuse, and keeping AI systems and their users safe

Le nouvel outil de sécurité de Mistral lit vos règles et les applique instantanément
Shieldstral est un petit modèle d'IA gratuit qui analyse le texte et les images pour détecter les contenus nuisibles en utilisant les politiques en langage naturel que vous rédigez vous-même. Aucune connaissance spécialisée requise.

Un client de Metro Bank perd 14 000 £ à une fraude utilisant le chatbot IA Claude pour vider son compte
Un homme d'affaires du Sussex affirme que Metro Bank n'a pas arrêté les escrocs qui ont pillé à plusieurs reprises son compte pour acheter des crédits pour le chatbot IA Claude. Il se bat maintenant pour récupérer 14 244 £.

L'application IA de musique de Treblo signale les chansons de deux rappeurs comme générées par l'IA
Fenix Flexin et Tyga ont tous deux nié utiliser l'IA pour créer leurs morceaux rétro-synthétiseurs. Puis l'application qu'ils auraient utilisée a créé un détecteur et a analysé les chansons.

L'Ukraine équipe 50 000 drones d'attaque d'une IA qui verrouille et suit les cibles en mouvement
Une entreprise de logiciels américaine a développé un kit « tire et oublie » pour les drones Shrike bon marché de l'Ukraine, permettant à un humain de pointer une cible et de laisser le reste à un système d'IA.

Des pirates informatiques iraniens ciblent les systèmes d'eau de sept États américains, avertit le FBI
Les cyberattaques contre les services d'eau et d'assainissement se sont propagées bien au-delà du Minnesota. Le FBI indique que sept États sont touchés, et des avis d'ébullition de l'eau ont déjà été émis.

Les rançongiciels alimentés par l'IA adoptent un nouveau rôle : les attaques autonomes
Les gangs de rançongiciels exploitent désormais l'IA pour lancer des attaques indépendantes, soulevant des préoccupations quant aux vulnérabilités de sécurité.

Google retire son outil d'édition d'images IA de Google Earth après que des utilisateurs aient falsifié des scènes de zones de guerre et de frontières
Une fonctionnalité permettant à quiconque de repindre les photos satellites avec des invites textuelles a duré moins de 48 heures avant que Google ne la supprime. La raison : les chercheurs ont montré qu'elle pouvait générer des images falsifiées convaincantes de lieux réels, et au moins un outil de détection d'IA a été trompé.

Une école privée de Pennsylvanie demande au tribunal de rejeter un procès concernant des images de nus générées par IA, affirmant avoir signalé le préjudice
Lancaster Country Day School a déclaré à un juge cette semaine que les accusations des victimes sont fausses sur deux points clés. L'école affirme avoir alerté les forces de l'ordre et que le signalement qu'elle a reçu n'a jamais nommé de filles spécifiques.

Sam Altman affirme que l'industrie de l'IA devrait ralentir. Son propre modèle vient de le prouver.
Le PDG d'OpenAI a appelé l'industrie de l'IA à adopter un rythme plus régulier, quelques jours après qu'un des modèles d'IA de l'entreprise se soit échappé de son environnement de test et ait été impliqué dans une faille de sécurité.

Le nouvel outil d'image IA de Google Earth trompe déjà les détecteurs de fausses photos
Un chercheur a saisi une invite textuelle dans Google Earth et a obtenu une image satellite convaincante de « réfugiés près de la frontière mexicaine ». Ce n'est pas bon signe.

L'agent IA d'OpenAI a piraté d'autres sites pour tricher à un test. Celui d'Anthropic aussi.
Deux des plus grandes entreprises d'IA ont confirmé que leurs systèmes se sont introduits dans des services externes sans y être invités. La question à laquelle personne n'a de bonne réponse : qui empêchera que cela se reproduise ?

L'IA Claude d'Anthropic s'est introduite dans des réseaux informatiques réels pendant les tests, sans que personne ne s'en aperçoive
Trois modèles Claude ont contourné une erreur de configuration de sécurité et accédé à des systèmes en direct qu'ils n'étaient jamais censés atteindre. L'entreprise ne l'a découvert qu'après examen de 141 000 passages de tests suite à un incident similaire chez OpenAI.

Microsoft lance Project Perception pour automatiser les tâches de sécurité
Microsoft lance Project Perception pour rationaliser la sécurité logicielle en automatisant la détection des vulnérabilités et les correctifs.

Pourquoi les certifications de sécurité IA pourraient ne pas signifier ce que vous pensez
Les certifications de sécurité IA oublient souvent les risques du monde réel. Voici ce que les entreprises doivent savoir sur leurs limitations et comment rester sécurisées.

Le modèle d'IA Claude d'Anthropic s'échappe et pirate les systèmes lors de tests
Le modèle Claude d'Anthropic a accédé aux systèmes de trois organisations en raison d'une négligence lors des tests, mettant en évidence les risques liés à l'évaluation de la sécurité de l'IA.