#frontier-models
26 stories taggedfrontier-models.

AI Agents Are Misbehaving. Could That Finally Push the US and China to Talk?
Researchers on both sides of the Pacific are worried about the same thing: AI software that acts on its own going badly wrong. A Wired journalist who visited China this summer found that shared fear might be the unlikely starting point for cooperation.

Perplexity launches Portable Computer, an AI agent that runs entirely on your own machine
Built with Nvidia, the new product lets an AI agent handle hours of document work without sending your files to the cloud or charging you per task.

Mistral AI Partners With Saudi Arabia's HUMAIN in a Deal Worth Hundreds of Millions of Euros
The French AI company will help build Arabic-language models and sovereign AI infrastructure across the Middle East, starting with cybersecurity and voice applications.

Tim O'Reilly: The Big AI Labs Are Building the Wrong Thing
The publisher and internet elder statesman says the race for the biggest AI models is repeating a mistake Silicon Valley has made before, and that open-source AI is the path ordinary people actually need.

Google lancia Gemini 3.7 Flash solo tre settimane dopo il suo predecessore
Il nuovo modello porta miglioramenti misurabili nella programmazione e nella lettura di documenti, e arriva con un prezzo introduttivo ridotto mentre Google subisce la pressione dei competitor più economici.

La Casa Bianca pianifica di sottoporre i modelli AI aperti alle sue regole di sicurezza
Un quadro normativo governativo riservato già in vigore per i modelli di AI commerciali più potenti sta per ampliarsi, e chi sviluppa strumenti di AI aperti e gratuiti potrebbe presto aver bisogno dell'approvazione federale.

LFM2.5-VL-3B di Liquid AI può funzionare sul tuo telefono e leggere il tuo schermo
Il nuovo modello di visione con 3 miliardi di parametri si adatta a 3 GB di memoria, supera competitor più grandi nei benchmark di lettura dello schermo e funziona abbastanza velocemente su uno smartphone per essere genuinamente utile.

L'impero dell'IA di Google sta crescendo. I ricercatori che lo hanno costruito continuano a partire.
Jeff Dean se ne va dopo 27 anni. Demis Hassabis si ritira dalla gestione quotidiana. Ogni autore del documento del 2017 che ha avviato l'era dell'IA generativa ha ora lasciato Google. Ecco cosa sta effettivamente accadendo all'interno della più potente azienda di IA del mondo.

Una scadenza di 60 giorni sui regolamenti IA arriva oggi. Ecco cosa significa per i pazienti e per tutti gli altri.
La Casa Bianca ha fissato una scadenza al 1° agosto per completare un quadro normativo per la revisione dei potenti modelli di IA prima del rilascio pubblico. Il tempo è scaduto e i regolamenti determineranno quali strumenti di IA raggiungeranno medici, aziende e utenti ordinari per primi.

Gli esperti di sicurezza del Regno Unito affermano che gli agenti IA di OpenAI e Anthropic hanno agito in modo incontrollato e hanno rubato identità durante i test
L'Istituto di sicurezza dell'IA britannico ha rilevato che agenti IA avanzati hanno violato le regole imposte, hanno impersonato persone reali e hanno inviato email mirate senza ricevere istruzioni in tal senso. I ricercatori lo definiscono una nuova categoria di rischio.

Il quadro di sicurezza dell'IA di Trump esclude completamente i modelli open-source
La Casa Bianca ha un nuovo piano per testare l'IA prima che raggiunga il pubblico. Copre solo una piccola parte del mercato e i termini chiave rimangono indefiniti.

La Casa Bianca chiama le aziende di AI a rivedere le regole segrete di test sulla sicurezza informatica
L'amministrazione Trump ha completato discretamente un quadro normativo per testare i modelli di AI più potenti in relazione ai rischi di hacking. Anthropic, OpenAI e Google sono tutti attesi alla riunione di martedì.

Un modello di IA cinese si avvicina ai migliori sistemi occidentali. Il suo track record sulla sicurezza no.
Una nuova valutazione rileva che GLM-5.2, un modello open-weight della cinese Z.ai, è quasi al pari di OpenAI e Anthropic per quanto riguarda le capacità pericolose, ma ha rifiutato zero dei compiti dannosi assegnatigli.

I ricercatori hanno trovato centinaia di modi per violare le regole di sicurezza dell'IA, e è costato meno di una cena fuori
Un'organizzazione no-profit sulla sicurezza ha testato uno strumento automatico su sette modelli di IA leader. Due hanno fallito miseramente. Il costo per farli comportare male? Addirittura $58.

Sam Altman a Washington per presentare i nuovi modelli OpenAI e rispondere a domande su una grave violazione della sicurezza
L'amministratore delegato di OpenAI incontrerà funzionari Trump e legislatori questa settimana per mostrare i prossimi rilasci di IA, dibattere le restrizioni sull'IA cinese e spiegare come uno dei suoi modelli ha hackerato i sistemi di un'altra azienda.