aiminute. ← Все новости ИИ
Новые модели 2026-08-17

Zhipu не строила новую модель. Она продолжила обучать старую — и утверждает, что программирование стало лучше на 50 процентов

Zhipu не строила новую модель. Она продолжила обучать старую — и утверждает, что программирование стало лучше на 50 процентов

Zhipu выпустила GLM-5.3 14 августа. Необычно здесь то, чем модель не является: базовая модель не изменилась по сравнению с GLM-5.2 — та же архитектура «смеси экспертов» примерно на 744 миллиарда параметров, из которых около 40 миллиардов активны на токен. Весь заявленный прирост получен на этапе дообучения: более длительный прогон, в десятки раз больше сред с длинным контекстом и более разнообразные их типы. Zhipu сообщает, что способность к программированию выросла примерно на 50 процентов относительно GLM-5.2, что модель занимает первое место среди моделей с открытыми весами на Terminal Bench 3.0 и Agents' Last Exam и набирает 84,5 процента в тесте безопасности CyberGym. В собственном Code Bench компания ставит GLM-5.3 на 31,4 процента против 29,5 процента у Claude Opus 4.8, причём GLM-5.3 израсходовала около 50 000 выходных токенов, а Opus — около 120 000. Большинство этих цифр — собственные замеры Zhipu. Веса ещё не опубликованы: компания обещает выложить их примерно через две недели после релиза, когда завершит работу по укреплению безопасности.

Почему это важноДва года рецепт лучшей модели был один: более крупная, заново обученная база. Здесь утверждается обратное — базу можно не трогать и получить большой скачок только за счёт того, на чём вы дообучаете её потом. Это заметно дешевле и вполне повторимо для небольшой лаборатории. Но к величине скачка стоит относиться осторожно, пока веса не открыты: почти все эти цифры получила и обнародовала та самая компания, которая продаёт модель, и снаружи их пока никто не проверял.
#Программирование

✓ Проверено · 3 источников

WhatsApp X Telegram
Читайте в приложении — бесплатно, 9 языков

Похожие новости

Слух: анонимная модель, бесплатно возглавившая тест по программированию, якобы является невыпущенным флагманом Zhipu
2026-08-21
Дешёвая рабочая лошадка DeepSeek научилась видеть — и на агентных задачах, где нужны глаза, заявляет о приближении к лучшему у Anthropic
2026-08-21
Nvidia платит 6 миллиардов долларов за машину, которая строит модели конкурента, — и нанимает 109 человек, которые ею управляли
2026-08-21
Четыре часа и один GPU, чтобы улучшить способ обучения ИИ: лучший агент набрал 0,25 из 1 — а большинство даже не попробовали
2026-08-21
Покажите роботу один раз — от трёх до двенадцати секунд — и он выполнит работу верно 59 раз из 100 вовсе без обучения
2026-08-21