#AI benchmarks
21 stories taggedAI benchmarks · page 2 of 2.

Um Modelo de IA Chinês Barato Está a Fazer Programadores Repensarem as Suas Contas
O GLM 5.2 da Z.ai custa uma fração dos melhores modelos da Anthropic e realiza trabalho real. Mas limites de taxa, alucinações e questões de privacidade de dados significam que não será adequado para todos.

O Kimi K3 da China é o Maior Modelo de IA a Sair da China até Agora, e Está a Abalar o Mercado
O novo Kimi K3 da Moonshot AI tem 2,8 biliões de parâmetros, supera vários modelos norte-americanos de topo em testes-chave, e fez as ações de IA rivais chinesas despencar no mesmo dia do lançamento.

A IA ainda não consegue aprender com algumas imagens da forma que você consegue
Investigadores da Apple testaram modelos de visão por IA líderes numa competência humana simples: identificar o que um grupo de imagens tem em comum e depois aplicar essa ideia a uma imagem nova. Os modelos falharam largamente.

Um Modelo de IA Mais Pequeno Treinado Numa Única Língua Venceu Dois Modelos Maiores e Mais Recentes em Leitura de Português Brasileiro
DharmaOCR obteve uma pontuação superior tanto ao Mistral OCR4 como ao Unlimited-OCR num teste de leitura em português, e a razão prende-se com o foco, não com o tamanho.

Os Bebés Aprendem Mais Rápido do Que a IA Mais Poderosa do Mundo. Cientistas Querem Saber Porquê.
Um novo teste compara modelos de IA de ponta com a perceção ao nível de crianças pequenas, e as crianças vencem. Investigadores afirmam que estudar o cérebro de bebés poderia tornar a IA mais barata, mais ecológica e mais inteligente.

A IA de Voz Consegue Falar, Mas Consegue Realmente Ouvir?
Um estudo humano em grande escala constata que os melhores modelos de voz atuais frequentemente perdem as pausas, hesitações e mudanças de tom que tornam a conversa real possível.