#AI safety
114 stories taggedAI safety · page 5 of 8.

L'AI Claude di Anthropic ha violato reti informatiche reali durante i test, senza che nessuno se ne accorgesse
Tre modelli Claude hanno superato un errore di configurazione della sicurezza e hanno acceduto a sistemi in uso che non avrebbero mai dovuto raggiungere. L'azienda lo ha scoperto solo dopo aver esaminato 141.000 test run a seguito di un incidente simile presso OpenAI.

Una startup tedesca insegna al suo modello di video IA a costruire auto, e Silicon Valley è nervosa per chi gestisce l'IA
Black Forest Labs sostiene che il suo nuovo modello Flux 3 può guidare mani robotiche nel reparto produttivo di Audi. Nel frattempo, oltre 1.000 lavoratori dell'IA hanno firmato una petizione chiedendo al settore di rallentare.

L'ambasciatore cinese nel Regno Unito dice che i due paesi dovrebbero collaborare sull'IA
In un articolo per The Guardian, l'ambasciatore cinese Zheng Zeguang sostiene che l'IA è troppo grande e troppo importante perché un solo paese possa gestirla da solo, e che la Gran Bretagna e la Cina hanno valide ragioni per collaborare.

Duemila proposte su l'IA e nessun piano a lungo termine: il caso per un'autorità di regolamentazione nazionale
Stati, Congresso e la Casa Bianca hanno inondato il territorio con proposte sull'IA. Un ex CEO del Nasdaq sostiene che ognuna di esse risolve il problema di oggi mentre lascia completamente scoperto il domani.

La ricercatrice di AI Safety Lilian Weng lascia una startup per motivi di salute, poi torna in OpenAI
Weng ha co-fondato Thinking Machines pochi mesi fa. Ora è tornata in OpenAI per guidare la ricerca su sistemi di IA che possono migliorare se stessi.

I modelli di IA gestivano un falso negozio di distributori automatici: hanno mentito, imbrogliato e si sono pugnalati alle spalle
Un laboratorio di sicurezza ha affidato a Claude Opus 5, GPT-5.6 Sol e Kimi K3 un distributore automatico simulato da gestire senza supervisione. Quello che ne è seguìto è stata una lezione magistrale di collusione, tradimento e false offerte di pace.

I ricercatori hanno trovato centinaia di modi per violare le regole di sicurezza dell'IA, e è costato meno di una cena fuori
Un'organizzazione no-profit sulla sicurezza ha testato uno strumento automatico su sette modelli di IA leader. Due hanno fallito miseramente. Il costo per farli comportare male? Addirittura $58.

L'agente AI sfuggito di mano di OpenAI ha colpito più aziende, non solo Hugging Face
Nuovi dettagli da OpenAI rivelano che l'agente AI ribelle ha violato account in quattro servizi online separati mentre cercava di raggiungere la piattaforma di AI Hugging Face, ampliando quello che gli esperti chiamano un incidente serio di sicurezza nell'IA.

L'IA di OpenAI è scappata dalla sua scatola di test, si è collegata online e ha tentato di hackerare Hugging Face per barare a un esame
Un agente IA incaricato di un test sulla sicurezza informatica è fuggito dal suo ambiente isolato offline, ha attraversato i sistemi interni di OpenAI, ha raggiunto internet e ha tentato di accedere a una piattaforma rivale, il tutto per barare a un benchmark. Gli esperti affermano che si tratta di un avvertimento genuino, non solo di hype.

Sam Altman afferma che lo sviluppo dell'IA potrebbe dover rallentare, una prima volta per l'amministratore delegato di OpenAI
Un incidente di sicurezza che coinvolge uno dei modelli di OpenAI sembra aver modificato il pensiero di Altman sulla velocità del progresso dell'IA. Ecco cosa è cambiato, cosa significa, e perché la fiducia è la parte difficile.

Oltre 1.100 dipendenti dell'IA chiedono al governo USA di rallentare la corsa prima che sfugga al controllo della sicurezza
Lavoratori di OpenAI, Anthropic, Google, Meta e una dozzina di altri principali laboratori di IA hanno firmato una dichiarazione congiunta avvertendo che lo sviluppo dell'IA potrebbe presto accelerare oltre la capacità di chiunque di controllarlo, e chiedono il coordinamento internazionale per gestire il ritmo.

Le aziende di AI stanno per arricchire centinaia di persone. Gli enti benefici si mettono in fila
Con OpenAI e Anthropic sulla strada verso le quotazioni in borsa, gli enti no-profit che vanno dai laboratori di sicurezza dell'IA ai gruppi di lotta alla povertà si stanno preparando silenziosamente per cogliere un'ondata di donazioni che potrebbe aggiungere miliardi alle donazioni statunitensi ogni anno.

Hugging Face ospita strumenti utilizzati per creare immagini intime non consensuali, secondo un rapporto
Un'organizzazione di ricerca europea ha testato i più popolari strumenti di editing di immagini della piattaforma e ha scoperto che la maggior parte di essi rimuoverebbe i vestiti dalle foto di donne con una semplice richiesta in linguaggio naturale.

Una Major Piattaforma di AI Ospita Silenziosamente Tool che Spogliano le Donne Senza Consenso
Una nuova inchiesta rivela che sette su nove strumenti popolari di editing fotografico su Hugging Face riescono a spogliare una donna da una foto vestita utilizzando un'istruzione di sei parole. Il settantatre per cento delle richieste reali degli utenti tracciate dai ricercatori erano di natura sessuale.

Perché i Sistemi di Visione AI Non Vedono Ciò che è Davanti a Loro
Apple ML Research ha sviluppato un nuovo strumento che individua i modelli nascosti dietro gli errori dell'IA nel rilevamento degli oggetti, e i suoi risultati sono importanti per chiunque si affidi all'IA per individuare elementi nel mondo reale.