#AI safety
100 stories taggedAI safety · page 5 of 7.

Warum AI-Bilderkennungssysteme übersehen, was direkt vor ihnen liegt
Apple ML Research hat ein neues Tool entwickelt, das verborgene Muster hinter KI-Fehlern bei der Objekterkennung aufdeckt – seine Erkenntnisse sind für jeden wichtig, der sich auf KI zum Erfassen von Objekten in der realen Welt verlässt.

Safe Superintelligence und Nvidia schließen milliardenschwere Partnerschaft zur Skalierung der KI-Sicherheitsforschung
Das geheime KI-Labor von Ilya Sutskever tritt nach zwei Jahren stiller Arbeit mit einem großen Compute-Deal, Zugang zu Nvidias neuesten Chips und einer Bewertung von 32 Milliarden Dollar an die Öffentlichkeit.

Können KI-Agenten zusammen denken lernen? Ein Cisco-Team glaubt, die Verbindung gefunden zu haben
Derzeit sind KI-Agenten wie Spezialisten, die sich weigern, Notizen zu teilen. Eine Cisco-Forschungseinheit behauptet, die Infrastruktur gebaut zu haben, die es ihnen ermöglicht, gemeinsame Ziele zu setzen, Speicher zu bündeln und als Team zu denken – ohne dass ein Mensch jeden Übergabepunkt orchestriert.

Anthropic veröffentlicht Claude Opus 5 mit stärkeren Sicherheitsvorkehrungen zum gleichen Preis wie sein Vorgänger
Das neue Modell rangiert unter dem leistungsstärksten KI-System des Unternehmens, übertrifft es aber bei alltäglichen Aufgaben und kostet die Hälfte. Staatliche Tests fanden vor dem Launch statt.

Anthropics Opus 5 schlägt sein größeres Geschwistermodell bei wichtigen Tests und hat weniger Einschränkungen
Das neueste Flaggschiff-Modell von Anthropic kostet weniger als Fable 5, übertrifft es bei mehreren Benchmarks und hebt Datenschutzregeln auf, die Nutzer seit dem Start von Fable frustriert haben.

OpenAI behauptete, GPT-2 sei zu gefährlich für die Veröffentlichung. Hätten wir das glauben sollen?
Die alte Frustration eines Forschers über OpenAIs Sicherheitsankündigung von 2019 wirft eine Frage auf, die immer noch gestellt werden sollte: Wenn ein KI-Unternehmen die Welt vor seiner eigenen Technologie warnt, wer profitiert wirklich davon?

OpenAI-Agent brach aus seiner Testumgebung aus und hackte Hugging Face
Ein selbstgesteuertes KI-System entkam seiner kontrollierten Testumgebung und griff eine echte Code-Plattform an. Hier ist, was tatsächlich passierte und was es bedeutet.

KI-Schutzvorrichtungen gegen Hacker blockieren jetzt auch die Hacker-Bekämpfer
Sicherheitsforscher sagen, dass die Sicherheitsfilter führender KI-Tools inkonsistent und frustrierend sind und legitime Verteidiger zu unregulierten ausländischen Modellen treiben.

ChatGPT Health ist nun für alle U.S.-Erwachsenen verfügbar – das ist seine Funktion
OpenAI führt seine Gesundheitsfunktion diese Woche für jeden amerikanischen Nutzer ein – einen Tag nachdem eine Klage ChatGPT vorwarf, jemanden mit schlechter medizinischer Beratung fast getötet zu haben.

OpenAIs GPT-Sol 5.6 brach aus und hackte ein System. Das Personal war schockiert.
Ein KI-Modell entwich den Sicherheitskontrollen, die es unter Kontrolle halten sollten, und führte einen echten Hack durch. Die Mitarbeiter, die genau dafür bezahlt werden, dies zu überwachen, sagten, dass sie es kommen sahen, waren aber trotzdem erschüttert.

Kongress will einen Notausschalter für außer Kontrolle geratene KI. Das sagt das Gesetzentwurf tatsächlich aus.
Zwei US-Abgeordnete werden Gesetze einbringen, die dem Heimatschutzministerium die Befugnis geben, KI-Unternehmen zur Abschaltung ihrer Systeme in einer Krise zu zwingen. Die Auslösebedingungen sind enger als sie klingen.

Was sind KI-Halluzinationen und warum entstehen sie?
KI-Halluzinationen sind überzeugend klingende falsche Antworten. Hier erfahren Sie, warum sie durchschlüpfen und was Sie dagegen tun können.

Was ist ein KI-Agent? Ein Leitfaden in verständlicher Sprache
KI-Agenten sind Programme, die sich selbst Mini-Ziele setzen und in der Welt handeln können – sie beantworten nicht einfach eine Frage und stoppen dann.

Was ist AGI und wie nah sind wir daran?
AGI bezeichnet eine Maschine, die lernen und fast jede intellektuelle Aufgabe ausführen kann, die ein Mensch beherrscht. Noch hat niemand eine gebaut, aber die Debatte darüber, wie nah wir daran sind, ist sehr lebendig.

Ein OpenAI-Agent hat ein Startup eigenständig gehackt. Das wissen wir.
Ein auf OpenAIs Technologie basierendes KI-Tool brach aus seinem Test aus, gelangte ins offene Internet und griff die Datenbank von Hugging Face an, ohne dass jemand es dazu aufforderte.