AI Security · Page 5
deepfakes, AI-powered scams, model abuse, and keeping AI systems and their users safe

KI-Browser können dazu manipuliert werden, Ihre WhatsApp-Kontakte zuzuspammen und Artikel in Ihren Amazon-Warenkorb zu legen
Sicherheitsforscher fanden etwa 20 Sicherheitslücken in KI-erweiterten Browsern von OpenAI, Google, Anthropic, Microsoft und Perplexity. Die schwerwiegendste erlaubt es Hackern, Ihren Browser in eine Phishing-Maschine zu verwandeln.

AI entdeckt neue Klasse von Web-Sicherheitslücken. Ein Mensch musste erklären, warum das wichtig ist.
Der Sicherheitsforscher James Kettle führte monatelang Experimente mit führenden KI-Modellen durch. Die KI generierte mehr Ansatzpunkte, als er allein je verfolgen könnte, aber die größte Entdeckung entstehst erst, als Mensch und Maschine zusammenarbeiteten.

KI-Modelle bringen sich selbst bei, sich wie Computerviren auszubreiten
Ein Forscher der Fudan-Universität stellte fest, dass sich 11 von 32 KI-Modellen selbst vervielfältigten, wenn ihnen gesagt wurde, dass sie überleben sollen. Hier ist, was das bedeutet.

KI-Agenten von OpenAI und Anthropic versuchten während Sicherheitstests, echte Ziele zu hacken
Das britische AI Security Institute hat KI-Software dabei erfasst, die eigenständig in Live-Systeme eindrang und gefälschte Online-Identitäten erstellte. Niemand wurde geschädigt, aber Sicherheitsexperten sagen, dass das Verhalten ernster ist als alles zuvor Beobachtete.

Britische Sicherheitstester berichten: KI-Agenten von OpenAI und Anthropic wurden unkontrollierbar und stahlen Identitäten während Tests
Britisches AI Security Institute stellte fest, dass fortgeschrittene KI-Agenten die ihnen gegebenen Regeln brachen, echte Personen nachahmten und gezielte E-Mails ohne Anweisung verschickten. Forscher bezeichnen dies als neue Risikokategorie.

Wie KI-Agenten Ihr Netzwerk ohne angemessene Kontrollen kompromittieren könnten
Neue Tools sollen KI-Agenten daran hindern, ihre Netzwerkberechtigungen zu überschreiten und das Missbrauchsrisiko zu reduzieren.

Weißes Haus fordert KI-Unternehmen zur Überprüfung geheimer Cybersicherheits-Testregeln auf
Die Trump-Administration hat stillschweigend ein Framework zur Überprüfung der leistungsstärksten KI-Modelle auf Hackingrisiken abgeschlossen. Anthropic, OpenAI und Google werden zum Treffen am Dienstag erwartet.

Visa kauft Betrugserkennung BioCatch für 2,4 Milliarden Dollar, während KI-gestützte Betrügereien zunehmen
Der Zahlungsriese will Betrüger stoppen, bevor eine Transaktion überhaupt durchgeführt wird, indem er Technologie einsetzt, die beobachtet, wie Sie tippen und wischen, um festzustellen, ob Sie wirklich derjenige sind.

KI-Agenten von OpenAI und Anthropic führten während Tests echte Hacking-Operationen durch
Neue Vorfälle zeigen KI-Modelle, die Test-Umgebungen durchbrechen, versuchen Schadcode einzuschleusen, und sogar Notizen für zukünftige KI-Agenten hinterlassen.

Ein chinesisches KI-Modell rivalisiert beinahe mit den besten westlichen Systemen. Seine Sicherheitsbilanz nicht.
Eine neue Bewertung zeigt GLM-5.2, ein Open-Weight-Modell von Chinas Z.ai, dicht hinter OpenAI und Anthropic bei gefährlichen Fähigkeiten – doch es lehnte keine der ihm gestellten schädlichen Aufgaben ab.

Eine Woche alt und bereits aktiv: Das neue KI-Sicherheitsbündnis macht erste Schritte
Über 120 Unternehmen, darunter Nvidia, Microsoft und Visa, haben sich zusammengetan, um KI-Sicherheitskenntnisse offen auszutauschen. Große Namen wie OpenAI und Google fehlen auffällig, obwohl beide den Brief unterzeichnet haben, der alles in Gang gesetzt hat.

Mistrals neues Sicherheitstool liest Ihre Regeln und wendet sie sofort an
Shieldstral ist ein kleines, kostenloses KI-Modell, das Text und Bilder auf schädliche Inhalte prüft – basierend auf Richtlinien in Klartext, die Sie selbst festlegen. Keine Spezialkennnisse erforderlich.

Metro-Bank-Kunde verliert £14.000 durch Betrug mit AI-Chatbot Claude
Ein Geschäftsmann aus Sussex behauptet, dass Metro Bank es versäumt hat, Betrüger zu stoppen, die wiederholt sein Konto geplündert haben, um Credits für den Claude AI-Chatbot zu kaufen. Er kämpft nun darum, £14.244 zurückzubekommen.

Eine KI-Musik-App kennzeichnet zwei Rapper-Songs nun selbst als KI-generiert
Fenix Flexin und Tyga bestritten beide, KI zur Erstellung ihrer Retro-Synth-Tracks verwendet zu haben. Dann erstellte die App, die sie angeblich nutzten, einen Detektor und führte die Songs durch ihn.

Ukraine rüstet 50.000 Angriffsdrohnen mit KI aus, die auf bewegliche Ziele zielt und ihnen folgt
Ein US-Softwareunternehmen hat ein „Feuer-und-Vergessen"-System für Ukraines günstige Shrike-Drohnen entwickelt, das es einem Menschen ermöglicht, auf ein Ziel zu zeigen und den Rest einem KI-System zu überlassen.