AI Security · Page 5
deepfakes, AI-powered scams, model abuse, and keeping AI systems and their users safe

CISA esorta la correzione immediata di falle critiche nel software
Le agenzie federali statunitensi sono in allerta massima per correggere tre serie vulnerabilità nel software, inclusa una nello strumento AI Langflow.

Interruttori di Emergenza per l'IA: Perché le Aziende Installano Pulsanti di Arresto per gli Agenti IA
Nel 2023 gli agenti IA incontrollati hanno causato violazioni della sicurezza e costi fuori controllo. Ora i team IT richiedono controlli di override manuale, e il Congresso sta prestando attenzione.

OpenAI sospende il modello Astra dopo i test che mostrano potrebbe attaccare sistemi reali
Le valutazioni interne hanno rilevato che Astra, un'intelligenza artificiale ancora in sviluppo, potrebbe essere in grado di trovare e sfruttare falle di sicurezza in sistemi critici senza l'aiuto umano. OpenAI ha ora interrotto i lavori correlati fino a quando non saranno pronti controlli di sicurezza più forti.

Un'IA ha attaccato una grande azienda tecnologica. Le regole di sicurezza che avrebbero dovuto fermarlo l'hanno aiutato a vincere.
Un modello OpenAI in fase di test ha violato i server di Hugging Face per imbrogliare un esame. I guardrail di sicurezza dell'IA pensati per prevenire i cyberattacchi hanno rifiutato di aiutare i difensori ad analizzare la violazione, costringendo un team di sicurezza americano a chiedere aiuto a un modello cinese.

Il modello di IA cinese Kimi K3 è scappato dalla sua gabbia di test e ha navigato su Internet in autonomia
Una società di sicurezza informatica americana sostiene che Kimi K3 ha superato una barriera di sicurezza e ha cercato autonomamente risposte online, sollevando nuove questioni su quanto bene sia possibile controllare l'IA avanzata.

120 giganti tech vogliono condividere gli incidenti informatici IA prima del prossimo attacco
Un nuovo framework chiamato SAFE consentirebbe alle aziende di segnalare discretamente i fallimenti della sicurezza dell'IA e di mettere in comune le lezioni apprese, invece di soffrire in silenzio ognuna per conto proprio.

Uno su tre comandi pericolosi degli agenti AI sfugge ai revisori umani, i dati del gioco mostrano
Un gioco browser che simula richieste reali di agenti di codifica AI ha trovato che i giocatori hanno approvato circa un terzo dei comandi malevoli, anche in più di 40.000 esecuzioni. I dati indicano un problema che va ben oltre il gioco.

I ricercatori di Apple hanno trovato un modo per bloccare i modelli di AI in modo che nessuno possa manometterli
I modelli di AI aperti sono potenti, condivisibili e sempre più difficili da controllare. Una nuova tecnica di Apple ML Research mira a proteggere i pesi pre-addestrati da essere trasformati in usi pericolosi, senza sacrificare ciò che rende utili i modelli aperti.

L'IA di Meta ha hackerato un'azienda durante un test di sicurezza. È il terzo grande laboratorio a segnalarlo.
Un errore del partner di test di Meta ha dato a un modello di IA un accesso a internet inaspettato. Quello che è accaduto dopo sta diventando un modello preoccupante nel settore.

I browser AI possono essere ingannati per spammare i tuoi contatti WhatsApp e aggiungere articoli al tuo carrello Amazon
I ricercatori di sicurezza hanno trovato circa 20 falle nei browser potenziati dall'IA di OpenAI, Google, Anthropic, Microsoft e Perplexity. La peggiore consente agli hacker di trasformare il tuo browser in una macchina di phishing.

L'IA ha scoperto una nuova classe di vulnerabilità web. Un umano ha dovuto spiegare perché fosse importante.
Il ricercatore di sicurezza James Kettle ha trascorso mesi conducendo esperimenti con i principali modelli di IA. L'IA ha generato più spunti di quanti potesse seguire da solo, ma la scoperta più importante è avvenuta solo quando umano e macchina hanno lavorato insieme.

I modelli di IA stanno insegnando a se stessi a diffondersi come virus informatici
Un ricercatore dell'Università di Fudan ha scoperto che 11 su 32 modelli di IA si sono copiati su nuove macchine quando gli è stato detto di sopravvivere. Ecco cosa significa.

Agenti AI di OpenAI e Anthropic hanno tentato di hackerare bersagli reali durante test di sicurezza
L'Istituto di sicurezza AI del Regno Unito ha scoperto software AI che agiva autonomamente per violare sistemi attivi e creare identità false online. Nessuno è stato danneggiato, ma gli esperti di sicurezza affermano che il comportamento è stato più grave di qualsiasi cosa vista finora.

Gli esperti di sicurezza del Regno Unito affermano che gli agenti IA di OpenAI e Anthropic hanno agito in modo incontrollato e hanno rubato identità durante i test
L'Istituto di sicurezza dell'IA britannico ha rilevato che agenti IA avanzati hanno violato le regole imposte, hanno impersonato persone reali e hanno inviato email mirate senza ricevere istruzioni in tal senso. I ricercatori lo definiscono una nuova categoria di rischio.

Come gli agenti AI potrebbero violare la tua rete senza controlli adeguati
Nuovi strumenti mirano a impedire agli agenti AI di superare i loro privilegi di accesso di rete, riducendo il rischio di abusi.