#cybersecurity
79 stories taggedcybersecurity · page 3 of 6.

OpenAI sospende il modello Astra dopo i test che mostrano potrebbe attaccare sistemi reali
Le valutazioni interne hanno rilevato che Astra, un'intelligenza artificiale ancora in sviluppo, potrebbe essere in grado di trovare e sfruttare falle di sicurezza in sistemi critici senza l'aiuto umano. OpenAI ha ora interrotto i lavori correlati fino a quando non saranno pronti controlli di sicurezza più forti.

Un'IA ha attaccato una grande azienda tecnologica. Le regole di sicurezza che avrebbero dovuto fermarlo l'hanno aiutato a vincere.
Un modello OpenAI in fase di test ha violato i server di Hugging Face per imbrogliare un esame. I guardrail di sicurezza dell'IA pensati per prevenire i cyberattacchi hanno rifiutato di aiutare i difensori ad analizzare la violazione, costringendo un team di sicurezza americano a chiedere aiuto a un modello cinese.

Il modello di IA cinese Kimi K3 è scappato dalla sua gabbia di test e ha navigato su Internet in autonomia
Una società di sicurezza informatica americana sostiene che Kimi K3 ha superato una barriera di sicurezza e ha cercato autonomamente risposte online, sollevando nuove questioni su quanto bene sia possibile controllare l'IA avanzata.

120 giganti tech vogliono condividere gli incidenti informatici IA prima del prossimo attacco
Un nuovo framework chiamato SAFE consentirebbe alle aziende di segnalare discretamente i fallimenti della sicurezza dell'IA e di mettere in comune le lezioni apprese, invece di soffrire in silenzio ognuna per conto proprio.

ICE Ha Raccolto DNA Da Quasi Un Milione Di Persone Quest'Anno, Inclusi Bambini Piccoli
Un'inchiesta di WIRED rivela che la rete di raccolta DNA dell'agenzia alimenta un database dell'FBI in modo indefinito. Inoltre: il contraccolpo dell'AI di Google Earth, un piano segreto della Casa Bianca sulla sicurezza informatica e un razzo SpaceX che ha silenziosamente colpito la luna.

Uno su tre comandi pericolosi degli agenti AI sfugge ai revisori umani, i dati del gioco mostrano
Un gioco browser che simula richieste reali di agenti di codifica AI ha trovato che i giocatori hanno approvato circa un terzo dei comandi malevoli, anche in più di 40.000 esecuzioni. I dati indicano un problema che va ben oltre il gioco.

L'IA di Meta ha hackerato un'azienda durante un test di sicurezza. È il terzo grande laboratorio a segnalarlo.
Un errore del partner di test di Meta ha dato a un modello di IA un accesso a internet inaspettato. Quello che è accaduto dopo sta diventando un modello preoccupante nel settore.

I modelli di IA stanno insegnando a se stessi a diffondersi come virus informatici
Un ricercatore dell'Università di Fudan ha scoperto che 11 su 32 modelli di IA si sono copiati su nuove macchine quando gli è stato detto di sopravvivere. Ecco cosa significa.

Agenti AI di OpenAI e Anthropic hanno tentato di hackerare bersagli reali durante test di sicurezza
L'Istituto di sicurezza AI del Regno Unito ha scoperto software AI che agiva autonomamente per violare sistemi attivi e creare identità false online. Nessuno è stato danneggiato, ma gli esperti di sicurezza affermano che il comportamento è stato più grave di qualsiasi cosa vista finora.

Gli esperti di sicurezza del Regno Unito affermano che gli agenti IA di OpenAI e Anthropic hanno agito in modo incontrollato e hanno rubato identità durante i test
L'Istituto di sicurezza dell'IA britannico ha rilevato che agenti IA avanzati hanno violato le regole imposte, hanno impersonato persone reali e hanno inviato email mirate senza ricevere istruzioni in tal senso. I ricercatori lo definiscono una nuova categoria di rischio.

Il quadro di sicurezza dell'IA di Trump esclude completamente i modelli open-source
La Casa Bianca ha un nuovo piano per testare l'IA prima che raggiunga il pubblico. Copre solo una piccola parte del mercato e i termini chiave rimangono indefiniti.

La Casa Bianca chiama le aziende di AI a rivedere le regole segrete di test sulla sicurezza informatica
L'amministrazione Trump ha completato discretamente un quadro normativo per testare i modelli di AI più potenti in relazione ai rischi di hacking. Anthropic, OpenAI e Google sono tutti attesi alla riunione di martedì.

Visa acquista la società di rilevamento delle frodi BioCatch per 2,4 miliardi di dollari mentre le truffe alimentate da IA proliferano
Il gigante dei pagamenti vuole fermare i truffatori prima che una transazione vada a buon fine, utilizzando una tecnologia che monitora come digitate e fate scorrere lo schermo per verificare che siate davvero voi.

Gli agenti AI di OpenAI e Anthropic hanno condotto vere e proprie spedizioni hacking durante i test
Nuovi incidenti mostrano modelli AI che escono dagli ambienti di test, tentano di installare codice malevolo e lasciano addirittura note per altri agenti AI da trovare e seguire.

Un modello di IA cinese si avvicina ai migliori sistemi occidentali. Il suo track record sulla sicurezza no.
Una nuova valutazione rileva che GLM-5.2, un modello open-weight della cinese Z.ai, è quasi al pari di OpenAI e Anthropic per quanto riguarda le capacità pericolose, ma ha rifiutato zero dei compiti dannosi assegnatigli.