#AI benchmarks
21 stories taggedAI benchmarks · page 2 of 2.

Un economico modello di IA cinese sta facendo ripensare ai programmatori i loro costi
GLM 5.2 di Z.ai costa una frazione rispetto ai migliori modelli di Anthropic e gestisce lavoro reale. Ma i limiti di velocità, le allucinazioni e le questioni sulla privacy dei dati significano che non è adatto a tutti.

Il Kimi K3 cinese è il modello di IA più grande mai uscito dalla Cina, e sta scuotendo il mercato
Il nuovo Kimi K3 di Moonshot AI ha 2,8 trilioni di parametri, supera diversi modelli statunitensi di punta nei test chiave e ha fatto crollare i titoli dell'IA rivali cinesi lo stesso giorno del lancio.

L'IA non riesce ancora a imparare da poche immagini come fai tu
I ricercatori di Apple hanno testato i principali modelli di visione artificiale su una semplice abilità umana: individuare cosa hanno in comune un gruppo di immagini, quindi applicare quell'idea a una nuova immagine. I modelli hanno largamente fallito.

Un'IA più piccola addestrata su una sola lingua ha battuto due modelli più grandi e nuovi nella lettura del portoghese brasiliano
DharmaOCR ha superato sia Mistral OCR4 che Unlimited-OCR in un test di lettura del portoghese, e la ragione risiede nella specializzazione, non nelle dimensioni.

I Bambini Imparano Più Velocemente dell'AI Più Potente del Mondo. Gli Scienziati Vogliono Sapere Perché.
Un nuovo test confronta i modelli di AI all'avanguardia con la percezione a livello di bambino piccolo, e i bambini vincono. I ricercatori affermano che lo studio dei cervelli infantili potrebbe rendere l'AI più economico, più ecologico e più intelligente.

L'AI vocale sa parlare, ma sa davvero ascoltare?
Uno studio su larga scala condotto con umani rileva che i migliori modelli vocali odierni spesso perdono le pause, le esitazioni e i cambiamenti di tono che rendono possibile una vera conversazione.