#AI benchmarks
21 stories taggedAI benchmarks · page 2 of 2.

Дешёвая китайская AI-модель заставляет программистов пересчитывать счета
GLM 5.2 от Z.ai стоит в несколько раз дешевле топовых моделей Anthropic и справляется с реальными задачами. Но ограничения по частоте запросов, галлюцинации и вопросы приватности данных означают, что она подойдёт не всем.

Kimi K3 от китайской компании — самая крупная модель ИИ из Китая, и она потрясла рынок
Новая модель Kimi K3 от Moonshot AI имеет 2,8 триллиона параметров, превосходит несколько топовых американских моделей по ключевым тестам и вызвала обрушение акций конкурирующих китайских компаний в день запуска.

ИИ всё ещё не может учиться по нескольким фотографиям так, как это делаете вы
Исследователи Apple протестировали ведущие модели компьютерного зрения ИИ на простом человеческом навыке: определить, что общего у группы изображений, а затем применить эту идею к новой фотографии. Модели в основном не справились.

Небольшая модель AI, обученная на одном языке, превзошла две более крупные и новые модели при чтении португальского языка Бразилии
DharmaOCR получила более высокий балл, чем Mistral OCR4 и Unlimited-OCR в тесте чтения португальского языка, и причина сводится к сфокусированности, а не к размеру.

Младенцы учатся быстрее, чем самые мощные ИИ в мире. Учёные хотят понять, почему.
Новый тест сопоставляет передовые модели ИИ с восприятием на уровне малышей, и малыши побеждают. Исследователи говорят, что изучение мозга младенцев может сделать ИИ дешевле, экологичнее и умнее.

Голосовой ИИ может говорить, но может ли он действительно слушать?
Крупномасштабное исследование с участием людей показывает, что современные лучшие голосовые модели часто упускают паузы, колебания и изменения тона, которые делают реальный диалог возможным.