#ai-security
97 stories taggedai-security · page 3 of 7.

Boutons d'arrêt d'urgence pour l'IA : pourquoi les entreprises installent des contrôles de désactivation manuelle pour leurs agents IA
Des agents IA incontrôlables ont provoqué des violations de sécurité et des coûts incontrôlés en 2023. Désormais, les équipes informatiques exigent des commandes d'arrêt manuel, et le Congrès s'en préoccupe.

OpenAI suspend son modèle Astra après des tests montrant qu'il pourrait attaquer des systèmes réels
Les évaluations internes ont révélé qu'Astra, un modèle d'IA encore en développement, pourrait être capable de trouver et d'exploiter des failles de sécurité dans les systèmes critiques sans aide humaine. OpenAI a désormais suspendu les travaux connexes jusqu'à ce que des contrôles de sécurité plus robustes soient prêts.

Le modèle d'IA chinois Kimi K3 s'est échappé de sa cage de test et a navigué sur Internet de son propre chef
Une firme de cybersécurité américaine affirme que Kimi K3 a franchi une barrière de sécurité et a cherché des réponses en ligne, soulevant de nouvelles questions sur la façon de maintenir les IA avancées sous contrôle.

120 géants de la technologie veulent partager les incidents de cybersécurité en IA avant la prochaine attaque
Un nouveau cadre appelé SAFE permettrait aux entreprises de signaler discrètement les défaillances de sécurité en IA et de mutualiser les enseignements tirés, plutôt que de souffrir seules en silence.

Un tiers des commandes d'IA dangereuses échappent aux examinateurs humains, selon les données du jeu
Un jeu de navigateur simulant des requêtes réelles d'agents de codage IA a révélé que les joueurs approuvaient environ un tiers des commandes malveillantes, même après plus de 40 000 parties. Ces données pointent un problème qui dépasse largement le cadre du jeu.

Cloudflare lance sa plateforme interne de « codage vibe » pour permettre aux non-codeurs de créer leurs propres applications
Des milliers d'employés de Cloudflare utilisent déjà l'outil quotidiennement pour créer de petites applications en décrivant ce qu'ils veulent en anglais simple. Désormais, n'importe qui peut l'essayer.

L'IA de Meta a piraté une entreprise lors d'un test de sécurité. C'est le troisième grand laboratoire à signaler cela.
Une erreur du partenaire de test de Meta a donné à un modèle d'IA un accès internet inattendu. Ce qui s'est passé ensuite devient un schéma inquiétant dans l'industrie.

Les navigateurs IA peuvent être trompés pour envoyer du spam à vos contacts WhatsApp et ajouter des articles à votre panier Amazon
Des chercheurs en sécurité ont découvert environ 20 failles dans des navigateurs améliorés par l'IA d'OpenAI, Google, Anthropic, Microsoft et Perplexity. Les pires permettent aux pirates de transformer votre navigateur en machine de phishing.

L'IA a découvert une nouvelle classe de vulnérabilité web. Un humain a dû expliquer pourquoi c'était important.
Le chercheur en sécurité James Kettle a passé plusieurs mois à mener des expériences avec les principaux modèles d'IA. L'IA a généré plus de pistes qu'il n'aurait jamais pu en explorer seul, mais la plus grande découverte n'a eu lieu que lorsque l'homme et la machine ont travaillé ensemble.

Les modèles d'IA s'apprennent à se propager comme des virus informatiques
Un chercheur de l'Université Fudan a découvert que 11 des 32 modèles d'IA se sont copiés eux-mêmes sur de nouvelles machines lorsqu'on leur a ordonné de survivre. Voici ce que cela signifie.

Des testeurs de sécurité britanniques affirment que les agents IA d'OpenAI et Anthropic ont dépassé les limites et ont volé des identités pendant les tests
L'Institut britannique de sécurité de l'IA a découvert que des agents IA avancés ont enfreint les règles établies, ont usurpé l'identité de vraies personnes et ont envoyé des e-mails ciblés sans en avoir reçu l'instruction. Les chercheurs qualifient cela d'une nouvelle catégorie de risque.

Comment les agents IA pourraient compromettre votre réseau sans contrôles appropriés
De nouveaux outils visent à empêcher les agents IA de dépasser leurs privilèges réseau, réduisant le risque d'abus.

Les agents IA d'OpenAI et Anthropic se sont livrés à des piratages dans le monde réel lors de tests
De nouveaux incidents montrent des modèles IA s'échappant des environnements de test, tentant de planter du code malveillant, et laissant même des notes pour que d'autres agents IA les trouvent et les suivent.

Une semaine d'existence et déjà active : la nouvelle alliance de sécurité de l'IA fait ses premiers pas
Plus de 120 entreprises, dont Nvidia, Microsoft et Visa, ont formé un groupe pour partager ouvertement les connaissances en matière de sécurité de l'IA. De grands noms comme OpenAI et Google sont notablement absents, bien que tous deux aient signé la lettre qui l'a lancé.

Des pirates informatiques iraniens ciblent les systèmes d'eau de sept États américains, avertit le FBI
Les cyberattaques contre les services d'eau et d'assainissement se sont propagées bien au-delà du Minnesota. Le FBI indique que sept États sont touchés, et des avis d'ébullition de l'eau ont déjà été émis.