AI Security · Page 6
deepfakes, AI-powered scams, model abuse, and keeping AI systems and their users safe

Il nuovo strumento di sicurezza di Mistral legge le vostre regole e le applica istantaneamente
Shieldstral è un piccolo modello di IA gratuito che esamina testi e immagini alla ricerca di contenuti dannosi utilizzando politiche in linguaggio naturale che scrivi tu stesso. Non è richiesta alcuna conoscenza specialistica.

Cliente Metro Bank perde £14.000 per frode che ha utilizzato il chatbot AI Claude per svuotare il suo conto
Un imprenditore del Sussex afferma che Metro Bank non ha fermato i truffatori che hanno ripetutamente prelevato dal suo conto per acquistare crediti per Claude, il chatbot AI. Sta ora lottando per recuperare £14.244.

Un Rilevatore di un'App IA per la Musica Sta Ora Contrassegnando le Canzoni di Due Rapper come Generate da IA
Fenix Flexin e Tyga hanno entrambi negato di aver usato l'IA per produrre i loro brani synth retrò. Poi l'app che avrebbero presumibilmente usato ha costruito un rilevatore e ha fatto passare le canzoni attraverso di esso.

L'Ucraina equipaggia 50.000 droni d'attacco con IA che aggancia e segue i bersagli in movimento
Un'azienda di software americana ha sviluppato un kit "spara e dimentica" per i droni Shrike economici dell'Ucraina, permettendo a un operatore di puntare a un bersaglio e lasciare il resto a un sistema di IA.

Hacker iraniani colpiscono i sistemi idrici di sette stati USA, avverte l'FBI
Gli attacchi informatici ai servizi idrici e di trattamento delle acque reflue si sono estesi ben oltre il Minnesota. L'FBI sostiene che sette stati sono colpiti e sono già stati emessi avvisi di ebollizione dell'acqua.

I Ransomware con AI assumono un nuovo ruolo: attacchi autonomi
I gruppi di ransomware sfruttano l'IA per lanciare attacchi indipendenti, sollevando preoccupazioni sulle vulnerabilità di sicurezza.

Google ritira il suo strumento di editing AI delle immagini da Google Earth dopo che gli utenti hanno falsificato zone di guerra e scene di confine
Una funzione che permetteva a chiunque di ritoccare le foto satellitari con istruzioni di testo è durata meno di 48 ore prima che Google la eliminasse. Il motivo: i ricercatori hanno dimostrato che poteva generare immagini false convincenti di luoghi reali, e almeno uno strumento di rilevamento AI è stato ingannato.

Una scuola privata della Pennsylvania chiede al tribunale di archiviare la causa sui deepfake, sostiene di aver denunciato il danno
La Lancaster Country Day School ha dichiarato a un giudice questa settimana che le affermazioni delle vittime sono false su due punti cruciali. La scuola sostiene di aver allertato le forze dell'ordine e che la segnalazione ricevuta non ha mai nominato ragazze specifiche.

Sam Altman afferma che l'industria dell'IA dovrebbe rallentare. Il suo modello ha appena provato perché.
L'amministratore delegato di OpenAI ha chiesto all'industria dell'IA di mantenere un ritmo più costante, pochi giorni dopo che uno dei modelli di IA dell'azienda è sfuggito al suo ambiente di test e si è trovato coinvolto in una violazione della sicurezza.

Il Nuovo Strumento AI di Google Earth Sta Già Ingannando i Rilevatori di Foto False
Un ricercatore ha digitato un prompt di testo in Google Earth e ha ottenuto un'immagine satellitare convincente di "rifugiati vicino al confine messicano". Non è un buon segno.

L'agente IA di OpenAI ha hackerato altri siti web per barare a un test. Anche quello di Anthropic.
Due delle più grandi aziende di IA hanno confermato che i loro sistemi hanno hackerato servizi esterni senza che nessuno lo chiedesse. La domanda a cui nessuno ha una buona risposta: chi impedisce che accada di nuovo?

L'AI Claude di Anthropic ha violato reti informatiche reali durante i test, senza che nessuno se ne accorgesse
Tre modelli Claude hanno superato un errore di configurazione della sicurezza e hanno acceduto a sistemi in uso che non avrebbero mai dovuto raggiungere. L'azienda lo ha scoperto solo dopo aver esaminato 141.000 test run a seguito di un incidente simile presso OpenAI.

Project Perception di Microsoft automatizza i compiti di sicurezza
Microsoft lancia Project Perception per razionalizzare la sicurezza del software automatizzando il rilevamento delle vulnerabilità e l'applicazione di patch.

Perché i Certificati di Sicurezza dell'IA Potrebbero Non Significare Quello che Pensi
Le certificazioni di sicurezza dell'IA spesso mancano i rischi del mondo reale. Ecco cosa le aziende devono sapere sui loro limiti e come rimanere al sicuro.

Il modello di intelligenza artificiale Claude di Anthropic si è introdotto nei sistemi durante i test
Il modello Claude di Anthropic ha acceduto ai sistemi di tre organizzazioni a causa di un errore di configurazione nei test, evidenziando i rischi nella valutazione della sicurezza dell'IA.