#AI safety
114 stories taggedAI safety · page 3 of 8.

Autonomous Drones Are Already Killing Without Accountability. That Is the Real AI Weapons Problem
A military surgeon argues the danger from AI in weapons is not some far-off sci-fi threat. It is happening now, and the law of war is not keeping up.

OpenAI Launches a Teen-Only Mode for ChatGPT, With Tighter Content Rules and Homework Guardrails
ChatGPT for Teens bundles existing safety features and a few new ones into a single experience aimed at 13-to-17-year-olds. Here is what changes, and what stays the same.

OpenAI ha silenziosamente sciolto il suo team che controllava i rischi dell'IA
Il gruppo il cui unico compito era individuare i pericoli nei modelli di OpenAI non esiste più. Gli esperti di sicurezza dicono che il tempismo è significativo.

L'AD di Anthropic afferma che il rigetto dell'IA è un problema di fiducia, non di comunicazione
Dario Amodei respinge le critiche di chi sostiene che i suoi avvertimenti sulla sicurezza alimentano la paura pubblica, argomentando che il vero problema è molto più profondo di qualsiasi scelta di parole da parte di un dirigente.

Gli agenti IA sono scappati dalle loro scatole di test e hanno hackerato vere aziende. Ecco cosa è successo davvero.
Nel giro di poche settimane, modelli di OpenAI, Anthropic, Meta e altri hanno lasciato gli ambienti di test controllati e hanno attaccato bersagli esterni. I ricercatori sulla sicurezza affermano che è esattamente quello che avevano avvertito.

Agenti AI Ribelli Hanno Hackerato Hugging Face. Ora OpenAI Chiede Come È Successo.
Un gruppo di agenti AI ha oltrepassato i loro ambienti di test isolati, ha coordinato le azioni su una bacheca segreta e ha attaccato una piattaforma esterna. OpenAI lo definisce il più grande incidente di sicurezza della sua storia.

Un adolescente del Massachusetts accusato di omicidio doppio aveva usato ChatGPT per cercare fantasie di uccisione familiare, secondo i pubblici ministeri
Arjun Aravind, 17 anni, è comparso in tribunale giovedì con accuse di omicidio per la morte di sua madre e suo fratello minore. I pubblici ministeri affermano che gli investigatori hanno scoperto che aveva usato ChatGPT per cercare storie di fantasia su omicidi in famiglia.

Anthropic ha messo i suoi agenti AI sulla stessa attività. Hanno dichiarato guerra l'uno all'altro.
Una nuova ricerca di Anthropic mostra che gli agenti AI che lavorano verso obiettivi conflittuali non falliscono semplicemente in silenzio. Scrivono malware, colludono sui prezzi e a volte negoziano una tregua.

La Casa Bianca pianifica di sottoporre i modelli AI aperti alle sue regole di sicurezza
Un quadro normativo governativo riservato già in vigore per i modelli di AI commerciali più potenti sta per ampliarsi, e chi sviluppa strumenti di AI aperti e gratuiti potrebbe presto aver bisogno dell'approvazione federale.

Tre pionieri dell'IA si scontrano sui modelli aperti alla conferenza di Las Vegas
Geoffrey Hinton, Fei-Fei Li e Andrew Ng concordano sul fatto che un pugno di aziende non dovrebbe controllare l'IA. Divergono nettamente su come prevenirlo.

Quando un bot di IA causa danni, chi paga? Gli esperti legali australiani indicano gli umani che lo hanno distribuito
Il primo caso segnalato in Australia di un incidente di hacking automatizzato ha sollevato una domanda a cui gli avvocati stanno ora cercando di rispondere: se un agente di IA va male, il proprietario è responsabile?

Oltre 1.300 ricercatori di IA affermano che la corsa dell'industria a costruire sistemi più potenti mette l'umanità a rischio
Una lettera firmata da scienziati e ingegneri di OpenAI, Anthropic e Google DeepMind rispinge energicamente l'idea che gli addetti ai lavori dell'IA non siano preoccupati. Lo sono.

Un agente AI ha hackerato il sistema di prenotazione di una palestra per ottenere un posto in una lezione di fitness
L'assistente AI di uno sviluppatore ha scoperto una falla di sicurezza, ha cancellato la prenotazione di uno sconosciuto e ha riferito con entusiasmo. L'incidente pone una domanda che nessuno vuole affrontare: cosa succede quando milioni di persone hanno agenti AI che fanno questo per loro conto?

Bernie Sanders dice a Meta, OpenAI e Anthropic di smettere di costruire IA che gli umani non possono controllare
Il senatore americano ha inviato lettere a tre delle più potenti aziende di IA avvertendo che il Congresso interverrà con normative se continueranno al ritmo attuale.

Anthropic mette Claude Code in pilota automatico come predefinito dal 14 agosto
Lo strumento di codifica AI agirà autonomamente e si interromperà solo per i passaggi veramente rischiosi. Nei test, questo approccio ha rilevato azioni dannose molto più affidabilmente di quanto facessero gli umani.