Дешёвая китайская AI-модель заставляет программистов пересчитывать счета

GLM 5.2 от Z.ai стоит в несколько раз дешевле топовых моделей Anthropic и справляется с реальными задачами. Но ограничения по частоте запросов, галлюцинации и вопросы приватности данных означают, что она подойдёт не всем.

AI2Day Newsdesk· 3 min read
A modern kitchen table viewed from above, 16:9 framing, with a smartphone, a tablet, and a pair of reading glasses resting side by side, soft natural morning li
Share

Ключевые моменты

  • Z.ai выпустила GLM 5.2 16 июня 2025 года — большую языковую модель с 753 миллиардами параметров, но только 40 миллиардами активными одновременно, что обеспечивает более быстрый ответ.
  • Z.ai взимает $4,40 за миллион выходных токенов (фрагменты текста, которые генерирует модель), это менее одной пятой цены сопоставимого предложения Claude Opus 4.8 от Anthropic.
  • GLM 5.2 — это модель с открытыми весами, что означает, что любая организация с собственным оборудованием может скачать и запустить её без каких-либо платежей Z.ai.
  • Индекс AI Index в Стэнфорде показал, что китайские лаборатории создали чуть более половины заметных AI-моделей в 2025 году по сравнению с американскими лабораториями, что выросло с примерно трети в 2023 году.
  • На собственных тестах Z.ai GLM 5.2 выполнила только 13 процентов задач в SWE-Marathon, сложном долгосрочном тесте кодирования, тогда как Claude Opus 4.8 от Anthropic удвоила этот результат.

Зейн Хасан — инженер AI в Together AI, человек, который отслеживает каждый потраченный доллар на AI-инструменты. Его система проста: сложные задачи отправляются топовой модели, простые — дешёвому решению. Сейчас его выбор для простых задач — GLM 5.2.

GLM 5.2 разработана Z.ai, лабораторией из Пекина. Модель стоит $4,40 за миллион выходных токенов при использовании API Z.ai (интерфейс программирования, соединение, которое позволяет приложению взаимодействовать с моделью). Это менее одной пятой цены Claude Opus 4.8 от Anthropic и примерно одна десятая цены модели Fable от Anthropic для программирования. Первым об этом сообщил IEEE Spectrum AI; выпуск состоялся 16 июня 2025 года.

Это также модель с открытыми весами, что означает, что Z.ai опубликовала лежащие в основе данные модели, так что любой, у кого достаточно вычислительных мощностей, может скачать её и запустить бесплатно.

GLM 5.2 действительно достаточно хороша, чтобы ей доверять?

Для многих задач — да, но с чёткими ограничениями. Дэвид Никс, главный инженер в базирующейся в Денвере компании MetaRouter, говорит, что GLM 5.2 достаточно близка к топовым американским моделям, чтобы справляться с 10-20 процентами его ежедневной нагрузки на AI. В первую очередь он использует её для фронтенд-дизайна (создание визуальной части веб-сайтов и приложений).

Хасан говорит, что модель сохраняет связную линию рассуждений на протяжении часов диалога, то, с чем более старые дешёвые модели боролись уже после пяти-пятнадцати обменов репликами.

Не все получили гладкие результаты. Сай Киран Мядарам, инженер-программист в базирующейся в Бангалоре компании Indhic AI, исчерпал свою еженедельную квоту токенов Z.ai за три дня. Он также столкнулся с галлюцинациями (когда AI уверенно выдаёт неправильные или придуманные ответы) и чрезмерным планированием простых исправлений. С тех пор он вернулся к Codex от OpenAI.

Вопрос приватности реален. GLM 5.2 поступает из Китая, и некоторые американские компании беспокоятся о том, что чувствительный код или бизнес-данные будут проходить через серверы, связанные с Китаем. Вариант с открытыми весами — практическое решение: разместите модель на собственном оборудовании, и ваши данные никогда не покинут ваше здание. Большинство топовых американских моделей не предлагают такой вариант; они доступны только через API без возможности самостоятельного хостинга.

Тесты рисуют смешанную картину. Собственный исследовательский отчёт Z.ai показывает, что GLM 5.2 отстаёт от Opus 4.8 от Anthropic в большинстве тестов программирования, хотя она почти соответствует Opus 4.8 в некоторых более коротких агентивных тестах кодирования (тесты, где агент AI, программное обеспечение, выполняющее многоэтапные задачи самостоятельно, решает реальные задачи программирования).

Более важная история, утверждает Хасан, заключается в том, что большинство команд разработчиков не имеют понятия, во что на самом деле обходятся их AI-инструменты на проект. Когда компания платит, инженеры естественно выбирают самую мощную модель. GLM 5.2 не заменит лучшие американские модели для самых сложных задач. Но для рутинной работы разница в цене достаточно велика, чтобы обратить на неё внимание.

© 2026 AI2Day