Hitech logo

Кейсы

Загадочная модель Ox Alpha оказалась разработкой китайской Z.AI

TODO:
Екатерина ШемякинскаяСегодня, 01:50 PM

Компания Z.AI подтвердила, что именно она разработала модель, которая под названием Ox Alpha неожиданно вышла в лидеры по популярности на OpenRouter в конце августа. Теперь она получила официальное название GLM-5.3-Flash. Компания позиционирует ее как недорогую модель для программирования и автономных ИИ-агентов и заявляет, что по некоторым возможностям она приближается к Claude Opus 4.8.

Самые интересные технологические и научные новости выходят в нашем телеграм-канале Хайтек+. Подпишитесь, чтобы быть в курсе.

Ox Alpha появилась на OpenRouter без указания разработчика и быстро стала самой популярной моделью недели. До момента раскрытия Ox Alpha успела набрать более 503 тыс. уникальных пользователей и обработать 44 трлн токенов только на OpenCode. Z.AI позже объяснила, что таким образом тестировала модель под анонимным названием и собирала отзывы пользователей до официального запуска. GLM-5.3-Flash умеет работать не только с текстом, но также с изображениями и видео.

Главное преимущество новинки — цена. Z.AI планирует брать $0,15 за миллион входных токенов и $0,50 за миллион выходных. Для сравнения, самая дешёвая модель Anthropic Claude Haiku 4.5 стоит $1 и $5 соответственно. При этом Z.AI утверждает, что её модель значительно превосходит предыдущую GLM-5.2 на ряде тестов программирования и агентных задач и приближается к Claude Opus 4.8. Например, на DeepSWE v1.1 она получила 63,4 балла против 46,2 у GLM-5.2.

Добиться такого соотношения цены и производительности Z.AI пытается в том числе за счет архитектуры модели. GLM-5.3-Flash содержит 320 млрд параметров, но при работе активирует только 18 млрд. Она использует гибридную архитектуру с разреженным и линейным вниманием, которая снижает вычислительные затраты при обработке длинного контекста. По сравнению с GLM-5.3 модель в три раза сокращает вычисления для механизма внимания и в 4,4 раза — объем памяти, необходимый для хранения промежуточных данных при обработке контекста.

Еще одна особенность — модель тестировалась и запускалась на китайских ИИ-чипах.

Z.AI заявляет, что весь трафик анонимной Ox Alpha в период тестирования обслуживался на отечественных ускорителях. Компания также построила собственную инфраструктуру для работы модели на китайских чипах и утверждает, что после оптимизации смогла примерно втрое повысить производительность по сравнению с исходным вариантом.

Z.AI также открыла веса GLM-5.3-Flash, то есть разработчики могут самостоятельно запускать модель и адаптировать ее под свои задачи. Это продолжает стратегию китайских ИИ-компаний, которые выпускают модели с открытыми весами и делают ставку на сочетание высокой производительности и низкой стоимости.

Выпуск Ox Alpha усиливает растущую угрозу со стороны дешевых и эффективных моделей из Китая, которые могут отнять реальную долю рынка у таких дорогостоящих компаний, как OpenAI и Anthropic.