#AI benchmarks
21 stories taggedAI benchmarks · page 2 of 2.

Un Económico Modelo de IA Chino Hace que los Programadores Reconsideren sus Facturas
GLM 5.2 de Z.ai cuesta una fracción de los mejores modelos de Anthropic y realiza trabajo real. Pero los límites de velocidad, las alucinaciones y las preocupaciones sobre privacidad de datos significan que no será adecuado para todos.

El Kimi K3 de China es el modelo de IA más grande que ha salido de China hasta ahora, y está agitando el mercado
El nuevo Kimi K3 de Moonshot AI tiene 2,8 billones de parámetros, supera varios modelos estadounidenses de primer nivel en pruebas clave, e hizo que las acciones de empresas rivales de IA china se desplomaran el mismo día de su lanzamiento.

La IA Aún No Puede Aprender de Pocas Imágenes Como Tú Puedes
Investigadores de Apple probaron modelos líderes de visión por IA en una habilidad humana simple: identificar qué tienen en común un grupo de imágenes y luego aplicar esa idea a una imagen nueva. Los modelos fracasaron en gran medida.

Un modelo de IA más pequeño entrenado en un idioma superó a dos modelos más grandes y nuevos en la lectura de portugués brasileño
DharmaOCR obtuvo puntuaciones superiores tanto a Mistral OCR4 como a Unlimited-OCR en una prueba de lectura de portugués, y la razón se reduce a enfoque, no tamaño.

Los bebés aprenden más rápido que los sistemas de IA más potentes del mundo. Los científicos quieren saber por qué.
Una nueva prueba enfrenta modelos de IA de vanguardia contra la percepción a nivel de niño pequeño, y los niños ganan. Los investigadores afirman que estudiar el cerebro infantil podría hacer que la IA sea más económica, más ecológica e inteligente.

La IA de voz puede hablar, ¿pero realmente puede escuchar?
Un estudio humano a gran escala encuentra que los mejores modelos de voz actuales a menudo pierden las pausas, vacilaciones y cambios de tono que hacen funcionar la conversación real.