Новые модели
AI Minute Newsroom
2026-08-27
Анонимную модель, которую разработчики неделями прощупывали, выложили под лицензией MIT — и Z.ai утверждает, что весь превью-период она работала на китайских чипах
Z.ai выпустила GLM-5.3-Flash 26 августа и подтвердила, что это та самая модель, которая анонимно ходила под именем Ox Alpha. Это модель со смесью экспертов: 320 миллиардов параметров всего и 18 миллиардов активных на токен, окно контекста в миллион токенов, веса на Hugging Face под лицензией MIT и — впервые в линейке GLM-5 — нативная мультимодальность: изображение и видео обрабатывает сама базовая модель, а не пристроенный сверху слой. Архитектура сочетает линейное внимание для локальных зависимостей с разреженным вниманием для дальнего контекста; на полной длине компонент под названием IndexPool сжимает ключевые векторы индексатора, чтобы задержка и память не разрослись. Обучение, по данным компании, шло на мультимодальном корпусе примерно в 30 триллионов токенов. По её собственным цифрам модель набирает 63,4 на DeepSWE v1.1 против 46,2 у GLM-5.2, 48,8 на AutomationBench против 26,2 и 84,3 на Terminal-Bench 2.1 рядом с 85,0 у Claude Opus 4.8. Цена — 0,15 доллара за миллион входных токенов, 0,03 из кэша и 0,50 за выход, то есть примерно десятая часть от GLM-5.2, плюс скидка 50 процентов до 9 сентября. Самое спорное утверждение: Z.ai заявляет, что весь превью Ox Alpha обслуживался на ускорителях китайского производства через собственный движок инференса, с примерно трёхкратным улучшением сквозной производительности на десятках тысяч устройств. Все цифры бенчмарков заявлены самой компанией и независимо не воспроизведены.
Почему это важноЗдесь произошли две разные вещи, и их стоит разделять. Первая — это событие в цене: модель на 320 миллиардов параметров, отвечающая на бенчмарках по коду и агентам в одном-двух пунктах от закрытой передовой модели, выпущена под MIT — самой разрешительной лицензией из существующих, то есть её можно поставить в коммерческий продукт, ни у кого не спрашивая, — и примерно за десятую часть цены предшественника. Это стирает разницу между тем, что вы арендуете, и тем, что можете запустить сами, причём ровно в тех категориях, за которые платят компании. Вторая — утверждение про железо, и оно заслуживает большего скепсиса, чем бенчмарки. Экспортный контроль стоит на посылке, что передовые вычисления и есть узкое место. Если лаборатория может обслуживать близкую к передовой модель для мировой аудитории тестировщиков целиком на отечественном кремнии, эта посылка сужается — но только со стороны инференса. Инференс намного менее требователен, чем обучение, мы не знаем, какие именно чипы и с какой эффективностью, а единственный источник — та самая компания, которой этот рассказ выгоден. Отметьте, но не делайте на это ставку.
✓ Проверено · 5 источников
Читайте в приложении — бесплатно, 9 языков
Похожие новости
Новые открытые модели IBM не учили описывать терминал — их обучали, заставляя им пользоваться
2026-08-27У безымянной модели, переварившей 42 триллиона токенов за шесть дней, нашёлся владелец: Z.ai признала, что Ox Alpha — это GLM, и открывает веса
2026-08-26Превью Qwen4 открыто: шесть миллиардов активных параметров на токен — и в собственной таблице Alibaba модель чинит больше реальных багов, чем Opus 4.6
2026-08-26Агент, который продолжает думать после того, как вы перестали печатать, — и весь каркас умещается в менее чем 10 000 строк Bash
2026-08-26Покажите роботу одно видео десятиминутной работы — и он сделает эту десятиминутную работу: без дообучения и без единой напечатанной команды
2026-08-26