#AI benchmarks
21 stories taggedAI benchmarks · page 2 of 2.

Un modèle d'IA chinois bon marché pousse les codeurs à repenser leurs factures
Le GLM 5.2 de Z.ai coûte une fraction des meilleurs modèles d'Anthropic et effectue un vrai travail. Mais les limitations de débit, les hallucinations et les questions de confidentialité des données signifient qu'il ne conviendra pas à tous.

Le Kimi K3 de la Chine est le plus grand modèle d'IA jamais produit en Chine, et il déstabilise le marché
Le nouveau Kimi K3 de Moonshot AI compte 2,8 billions de paramètres, surpasse plusieurs modèles américains de premier plan aux tests clés, et a provoqué la chute des actions d'IA rivales chinoises le jour même de son lancement.

L'IA ne peut toujours pas apprendre à partir de quelques images comme vous le faites
Des chercheurs d'Apple ont testé les principaux modèles de vision par IA sur une compétence humaine simple : identifier ce qu'un groupe d'images ont en commun, puis appliquer cette idée à une nouvelle image. Les modèles ont largement échoué.

Un modèle IA plus petit formé sur une seule langue a surpassé deux modèles plus grands et plus récents en lecture de portugais brésilien
DharmaOCR a surpassé à la fois Mistral OCR4 et Unlimited-OCR à un test de lecture en portugais, et la raison tient à la spécialisation, non à la taille.

Les bébés apprennent plus vite que les IA les plus puissantes du monde. Les chercheurs veulent savoir pourquoi.
Un nouveau test oppose des modèles d'IA de pointe à la perception au niveau des tout-petits, et ce sont les tout-petits qui gagnent. Les chercheurs affirment que l'étude des cerveaux des nourrissons pourrait rendre l'IA moins chère, plus écologique et plus intelligente.

L'IA vocale peut parler, mais peut-elle vraiment écouter ?
Une étude à grande échelle auprès d'humains révèle que les meilleurs modèles vocaux actuels ratent souvent les pauses, hésitations et changements de ton qui font fonctionner une vraie conversation.