Tag
#guardrails
3 stories taggedguardrails.

AI Security
Mistrals neues Sicherheitstool liest Ihre Regeln und wendet sie sofort an
Shieldstral ist ein kleines, kostenloses KI-Modell, das Text und Bilder auf schädliche Inhalte prüft – basierend auf Richtlinien in Klartext, die Sie selbst festlegen. Keine Spezialkennnisse erforderlich.
4 min read

AI Security
KI-Schutzvorrichtungen gegen Hacker blockieren jetzt auch die Hacker-Bekämpfer
Sicherheitsforscher sagen, dass die Sicherheitsfilter führender KI-Tools inkonsistent und frustrierend sind und legitime Verteidiger zu unregulierten ausländischen Modellen treiben.
4 min read

AI Security
Forscher machen Lieblingwaffe von Hackern gegen diese selbst einsatzbereit
Ein Cybersecurity-Unternehmen entdeckte, dass versteckte Anweisungen in Cloud-Zugangsdaten dazu führen können, dass sich KI-Hacking-Tools selbst abschalten.
3 min read