AI Security · Page 6
deepfakes, AI-powered scams, model abuse, and keeping AI systems and their users safe

KI-Agenten von OpenAI und Anthropic versuchten während Sicherheitstests, echte Ziele zu hacken
Das britische AI Security Institute hat KI-Software dabei erfasst, die eigenständig in Live-Systeme eindrang und gefälschte Online-Identitäten erstellte. Niemand wurde geschädigt, aber Sicherheitsexperten sagen, dass das Verhalten ernster ist als alles zuvor Beobachtete.

Britische Sicherheitstester berichten: KI-Agenten von OpenAI und Anthropic wurden unkontrollierbar und stahlen Identitäten während Tests
Britisches AI Security Institute stellte fest, dass fortgeschrittene KI-Agenten die ihnen gegebenen Regeln brachen, echte Personen nachahmten und gezielte E-Mails ohne Anweisung verschickten. Forscher bezeichnen dies als neue Risikokategorie.

Wie KI-Agenten Ihr Netzwerk ohne angemessene Kontrollen kompromittieren könnten
Neue Tools sollen KI-Agenten daran hindern, ihre Netzwerkberechtigungen zu überschreiten und das Missbrauchsrisiko zu reduzieren.

Weißes Haus fordert KI-Unternehmen zur Überprüfung geheimer Cybersicherheits-Testregeln auf
Die Trump-Administration hat stillschweigend ein Framework zur Überprüfung der leistungsstärksten KI-Modelle auf Hackingrisiken abgeschlossen. Anthropic, OpenAI und Google werden zum Treffen am Dienstag erwartet.

Visa kauft Betrugserkennung BioCatch für 2,4 Milliarden Dollar, während KI-gestützte Betrügereien zunehmen
Der Zahlungsriese will Betrüger stoppen, bevor eine Transaktion überhaupt durchgeführt wird, indem er Technologie einsetzt, die beobachtet, wie Sie tippen und wischen, um festzustellen, ob Sie wirklich derjenige sind.

KI-Agenten von OpenAI und Anthropic führten während Tests echte Hacking-Operationen durch
Neue Vorfälle zeigen KI-Modelle, die Test-Umgebungen durchbrechen, versuchen Schadcode einzuschleusen, und sogar Notizen für zukünftige KI-Agenten hinterlassen.

Ein chinesisches KI-Modell rivalisiert beinahe mit den besten westlichen Systemen. Seine Sicherheitsbilanz nicht.
Eine neue Bewertung zeigt GLM-5.2, ein Open-Weight-Modell von Chinas Z.ai, dicht hinter OpenAI und Anthropic bei gefährlichen Fähigkeiten – doch es lehnte keine der ihm gestellten schädlichen Aufgaben ab.

Eine Woche alt und bereits aktiv: Das neue KI-Sicherheitsbündnis macht erste Schritte
Über 120 Unternehmen, darunter Nvidia, Microsoft und Visa, haben sich zusammengetan, um KI-Sicherheitskenntnisse offen auszutauschen. Große Namen wie OpenAI und Google fehlen auffällig, obwohl beide den Brief unterzeichnet haben, der alles in Gang gesetzt hat.

Mistrals neues Sicherheitstool liest Ihre Regeln und wendet sie sofort an
Shieldstral ist ein kleines, kostenloses KI-Modell, das Text und Bilder auf schädliche Inhalte prüft – basierend auf Richtlinien in Klartext, die Sie selbst festlegen. Keine Spezialkennnisse erforderlich.

Metro-Bank-Kunde verliert £14.000 durch Betrug mit AI-Chatbot Claude
Ein Geschäftsmann aus Sussex behauptet, dass Metro Bank es versäumt hat, Betrüger zu stoppen, die wiederholt sein Konto geplündert haben, um Credits für den Claude AI-Chatbot zu kaufen. Er kämpft nun darum, £14.244 zurückzubekommen.

Eine KI-Musik-App kennzeichnet zwei Rapper-Songs nun selbst als KI-generiert
Fenix Flexin und Tyga bestritten beide, KI zur Erstellung ihrer Retro-Synth-Tracks verwendet zu haben. Dann erstellte die App, die sie angeblich nutzten, einen Detektor und führte die Songs durch ihn.

Ukraine rüstet 50.000 Angriffsdrohnen mit KI aus, die auf bewegliche Ziele zielt und ihnen folgt
Ein US-Softwareunternehmen hat ein „Feuer-und-Vergessen"-System für Ukraines günstige Shrike-Drohnen entwickelt, das es einem Menschen ermöglicht, auf ein Ziel zu zeigen und den Rest einem KI-System zu überlassen.

Iranische Hacker attackieren Wassersysteme in sieben US-Bundesstaaten, warnt das FBI
Cyberangriffe auf Wasser- und Abwasserversorger haben sich weit über Minnesota hinaus ausgebreitet. Das FBI bestätigt, dass sieben Bundesstaaten betroffen sind, und es wurden bereits Abkochaufrufe erlassen.

KI-Ransomware übernimmt eine neue Rolle: Autonome Angriffe
Ransomware-Banden nutzen nun KI, um unabhängige Angriffe zu starten und erhöhen damit Bedenken hinsichtlich Sicherheitslücken.

Google deaktiviert sein KI-Bild-Bearbeitungstool aus Google Earth, nachdem Nutzer Kriegszonen und Grenzszenen fälschten
Eine Funktion, die es jedem ermöglichte, Satellitenfotos mit Textaufforderungen neu zu bemalen, existierte weniger als 48 Stunden, bevor Google sie entfernte. Der Grund: Forscher zeigten, dass sie überzeugend gefälschte Bilder echter Orte generieren konnte, und mindestens ein KI-Erkennungstool wurde getäuscht.