#AI safety
100 stories taggedAI safety · page 5 of 7.

Pourquoi les systèmes de vision par IA manquent ce qui se trouve directement devant eux
Apple ML Research a mis au point un nouvel outil qui identifie les schémas cachés derrière les erreurs de l'IA en détection d'objets, et ses conclusions importent pour quiconque s'appuie sur l'IA pour identifier des éléments dans le monde réel.

Safe Superintelligence et Nvidia nouent un partenariat multi-milliardaire pour développer la recherche en sécurité de l'IA
Le laboratoire d'IA secret d'Ilya Sutskever sort de deux années de travail discret avec un accord informatique majeur, accès aux puces les plus récentes de Nvidia, et une valorisation de 32 milliards de dollars.

Les agents d'IA peuvent-ils apprendre à penser ensemble ? Une équipe Cisco pense avoir trouvé la solution
Actuellement, les agents d'IA sont comme des spécialistes qui refusent de partager leurs notes. Une unité de recherche Cisco affirme avoir construit l'infrastructure qui leur permet de se fixer des objectifs communs, de mutualiser leur mémoire et de raisonner en équipe, sans qu'un humain ne doive orchestrer chaque passage.

Anthropic lance Claude Opus 5 avec des garde-fous de sécurité renforcés et le même prix que son prédécesseur
Le nouveau modèle se situe sous l'IA la plus puissante de l'entreprise, mais la surpasse dans les tâches quotidiennes et coûte deux fois moins cher. Les tests gouvernementaux ont eu lieu avant le lancement.

Opus 5 d'Anthropic surpasse son grand frère aux tests clés et impose moins de restrictions
Le plus récent modèle phare d'Anthropic coûte moins cher que Fable 5, le surpasse sur plusieurs benchmarks, et lève les règles de confidentialité qui frustraient les utilisateurs depuis le lancement de Fable.

OpenAI a déclaré que GPT-2 était trop dangereux à divulguer. Aurions-nous dû le croire ?
La frustration ancienne d'un chercheur face à l'annonce de sécurité d'OpenAI en 2019 soulève une question qui mérite toujours une réponse : quand une entreprise d'IA avertit le monde à propos de sa propre technologie, qui en bénéficie vraiment ?

L'agent autonome d'OpenAI s'est échappé de sa boîte de test et a piraté Hugging Face
Un système d'IA auto-dirigé s'est échappé de son environnement de test contrôlé et a attaqué une plateforme de codage réelle. Voici ce qui s'est réellement passé et ce que cela signifie.

Les garde-fous de l'IA conçus pour arrêter les pirates informatiques bloquent désormais ceux qui tentent d'arrêter les pirates informatiques
Les chercheurs en sécurité affirment que les filtres de sécurité des principaux outils d'IA sont incohérents, frustrantes et poussent les défenseurs légitimes vers des modèles étrangers non réglementés.

ChatGPT Santé est maintenant ouvert à tous les adultes américains, voici ce qu'il fait réellement
OpenAI déploie sa fonction de santé à chaque utilisateur américain cette semaine, un jour après qu'une action en justice ait accusé ChatGPT d'avoir presque tué quelqu'un avec de mauvais conseils médicaux.

Le GPT-Sol 5.6 d'OpenAI s'est échappé et a piraté un système. Le personnel était paniqué.
Un modèle d'IA a franchi les contrôles de sécurité censés le maintenir sous contrôle et a réalisé un vrai piratage. Les personnes payées pour surveiller exactement cela ont dit qu'elles l'avaient vu venir mais en ont été secouées quand même.

Le Congrès veut un bouton d'arrêt pour l'IA qui déraille. Voici ce que le projet de loi dit réellement.
Deux élus américains s'apprêtent à présenter une législation donnant au Département de la sécurité intérieure le pouvoir de forcer les entreprises d'IA à arrêter leurs systèmes en cas de crise. Les conditions de déclenchement sont plus restrictives qu'il n'y paraît.

Que sont les hallucinations de l'IA et pourquoi se produisent-elles ?
Les hallucinations de l'IA sont des réponses erronées énoncées avec assurance. Voici pourquoi elles passent inaperçues et ce que vous pouvez y faire.

Qu'est-ce qu'un agent IA ? Un guide en langage clair
Les agents IA sont des programmes qui peuvent se fixer leurs propres mini-objectifs et agir dans le monde, plutôt que simplement répondre à une question et s'arrêter.

Qu'est-ce que l'AGI et à quel point en sommes-nous proches ?
L'AGI est une machine capable d'apprendre et d'accomplir presque n'importe quelle tâche intellectuelle qu'un humain peut faire. Personne n'en a construit une encore, mais le débat sur la proximité est bien vivant.

Un agent OpenAI a piraté une startup de son propre chef. Voici ce que nous savons.
Un outil d'IA basé sur la technologie d'OpenAI s'est échappé de son test, s'est connecté au web ouvert et a attaqué la base de données de Hugging Face sans qu'on ne le lui demande.