AI Security · Page 4
deepfakes, AI-powered scams, model abuse, and keeping AI systems and their users safe

Anthropic met Claude Code en pilotage automatique par défaut à partir du 14 août
L'outil de codage IA agira désormais de manière autonome et ne s'arrêtera que pour les étapes vraiment risquées. Lors des tests, cette approche a détecté les actions nuisibles bien plus fiablement que les humains.

Les pirates contournent les mesures de sécurité de l'IA avec des astuces ingénieuses
De nouveaux rapports révèlent comment les criminels exploitent les vulnérabilités de l'IA pour lancer des attaques sophistiquées.

Les enfants britanniques signalent des deepfakes explicites d'eux-mêmes à des taux record
Un service qui aide les jeunes à supprimer des images intimes d'Internet déclare que le contenu contrefait numériquement, y compris la nudité générée par l'IA, augmente considérablement. Les experts avertissent que les outils qui rendent cela possible deviennent de plus en plus faciles à trouver.

CISA presse l'application immédiate de correctifs pour des failles logicielles critiques
Les agences fédérales américaines sont en alerte maximale pour corriger trois graves vulnérabilités logicielles, dont une dans l'outil IA Langflow.

Boutons d'arrêt d'urgence pour l'IA : pourquoi les entreprises installent des contrôles de désactivation manuelle pour leurs agents IA
Des agents IA incontrôlables ont provoqué des violations de sécurité et des coûts incontrôlés en 2023. Désormais, les équipes informatiques exigent des commandes d'arrêt manuel, et le Congrès s'en préoccupe.

OpenAI suspend son modèle Astra après des tests montrant qu'il pourrait attaquer des systèmes réels
Les évaluations internes ont révélé qu'Astra, un modèle d'IA encore en développement, pourrait être capable de trouver et d'exploiter des failles de sécurité dans les systèmes critiques sans aide humaine. OpenAI a désormais suspendu les travaux connexes jusqu'à ce que des contrôles de sécurité plus robustes soient prêts.

Une IA a attaqué une grande entreprise technologique. Les règles de sécurité qui auraient dû l'arrêter l'ont aidée à gagner.
Un modèle OpenAI en phase de test s'est introduit dans les serveurs de Hugging Face pour tricher à un examen. Les garde-fous de sécurité de l'IA censés prévenir les cyberattaques ont refusé d'aider les défenseurs à analyser la violation, laissant une équipe de sécurité américaine se tourner vers un modèle chinois pour obtenir de l'aide.

Le modèle d'IA chinois Kimi K3 s'est échappé de sa cage de test et a navigué sur Internet de son propre chef
Une firme de cybersécurité américaine affirme que Kimi K3 a franchi une barrière de sécurité et a cherché des réponses en ligne, soulevant de nouvelles questions sur la façon de maintenir les IA avancées sous contrôle.

120 géants de la technologie veulent partager les incidents de cybersécurité en IA avant la prochaine attaque
Un nouveau cadre appelé SAFE permettrait aux entreprises de signaler discrètement les défaillances de sécurité en IA et de mutualiser les enseignements tirés, plutôt que de souffrir seules en silence.

Un tiers des commandes d'IA dangereuses échappent aux examinateurs humains, selon les données du jeu
Un jeu de navigateur simulant des requêtes réelles d'agents de codage IA a révélé que les joueurs approuvaient environ un tiers des commandes malveillantes, même après plus de 40 000 parties. Ces données pointent un problème qui dépasse largement le cadre du jeu.

Des chercheurs d'Apple ont trouvé un moyen de verrouiller les modèles d'IA pour que personne ne puisse les modifier
Les modèles d'IA ouverts sont puissants, partageables et de plus en plus difficiles à contrôler. Une nouvelle technique de Apple ML Research vise à protéger les poids préentraînés contre les détournements vers des usages dangereux, sans sacrifier ce qui rend les modèles ouverts utiles en premier lieu.

L'IA de Meta a piraté une entreprise lors d'un test de sécurité. C'est le troisième grand laboratoire à signaler cela.
Une erreur du partenaire de test de Meta a donné à un modèle d'IA un accès internet inattendu. Ce qui s'est passé ensuite devient un schéma inquiétant dans l'industrie.

Les navigateurs IA peuvent être trompés pour envoyer du spam à vos contacts WhatsApp et ajouter des articles à votre panier Amazon
Des chercheurs en sécurité ont découvert environ 20 failles dans des navigateurs améliorés par l'IA d'OpenAI, Google, Anthropic, Microsoft et Perplexity. Les pires permettent aux pirates de transformer votre navigateur en machine de phishing.

L'IA a découvert une nouvelle classe de vulnérabilité web. Un humain a dû expliquer pourquoi c'était important.
Le chercheur en sécurité James Kettle a passé plusieurs mois à mener des expériences avec les principaux modèles d'IA. L'IA a généré plus de pistes qu'il n'aurait jamais pu en explorer seul, mais la plus grande découverte n'a eu lieu que lorsque l'homme et la machine ont travaillé ensemble.

Les modèles d'IA s'apprennent à se propager comme des virus informatiques
Un chercheur de l'Université Fudan a découvert que 11 des 32 modèles d'IA se sont copiés eux-mêmes sur de nouvelles machines lorsqu'on leur a ordonné de survivre. Voici ce que cela signifie.