aiminute. ← Все новости ИИ
Слухи AI Minute Newsroom 2026-08-21

Слух: анонимную бесплатную модель по-прежнему называют детищем Zhipu — но прославивший её результат был на десяти задачах, а полный прогон оказался заурядным

Слух: анонимную бесплатную модель по-прежнему называют детищем Zhipu — но прославивший её результат был на десяти задачах, а полный прогон оказался заурядным

Это неподтверждённый слух, и публикуется он именно как слух. Модель под названием Ox Alpha появилась на OpenRouter 20 августа у анонимного поставщика, помеченного лишь как «Stealth»: бесплатно на неделю, контекстное окно в 1 048 576 токенов, до 131 072 токенов на выходе, ввод текста, изображений и видео. 21 августа исследователь Бен Дэвис опубликовал анализ «отпечатков» и заявил, что «на 99% уверен»: это невыпущенный представитель семейства GLM-5 от Zhipu. Расход токенов видеокодировщика совпадает с GLM-5V-Turbo, токенизатор соответствует GLM-5.3 за вычетом фиксированной обёртки в 75 токенов, то же поведение при отказе на аудиовход, тот же код ошибки «1301» и сопоставимая доля эмодзи в выводе. По его словам, анализ исключает Xiaomi MiMo, DeepSeek, Google, Qwen, xAI, OpenAI и Anthropic. Ничего из этого не подтверждено: по состоянию на 23 августа ни одна компания не признала Ox Alpha своей, а Zhipu хранит молчание. Отметьте и вопрос данных. Собственная страница модели на OpenRouter сообщает, что запросы и ответы, отправленные Ox Alpha, сохраняются анонимным поставщиком, хотя и не используются для обучения, — тогда как OpenCode рекламировал ту же модель как работающую без сохранения данных. Пока поставщик не назван, безопасно считать, что всё отправленное вами хранит компания, не сообщившая своего имени. (Исправление, 23 августа: в первоначальном материале мы писали, что Ox Alpha набрала 80% pass@1 на бенчмарке программирования DeepSWE, опередив Claude Fable 5 с 65%, GLM-5.3 с 62% и GPT-5.6-sol с 52%. Эта цифра получена на подмножестве из 10 задач — менее 9% бенчмарка. С тех пор Дэвис прогнал полный набор из 113 задач и получил около 63%, то есть на уровне GPT-5.6 Sol, а не впереди всех; он сам говорит, что осмысленной является именно цифра полного набора. Ox Alpha не возглавила бенчмарк. Наш заголовок утверждал обратное, и это было неверно.)

Почему это важноСамо исправление и есть новость. Результат на десяти задачах за два дня обошёл мир под заголовком «анонимная модель возглавила бенчмарк по программированию»; опровергающий его результат на 113 задачах не пройдёт и малой доли этого пути. Всякий раз, когда модель обходит соперников с большим отрывом, первый вопрос — сколько задач ей на самом деле дали: малая выборка порождает большие, захватывающие и бессмысленные разрывы. Остальное по-прежнему в силе: личность не доказана, а выпуск сильной модели анонимно и бесплатно на неделю — это канал распространения, а не подарок. Бенчмарк — это вы, и в данном случае поставщик прямо говорит, что сохраняет отправленное вами.
#Программирование

⚠ Неподтверждённый слух — осторожно

WhatsApp X Telegram
Читайте в приложении — бесплатно, 9 языков

Похожие новости

OpenAI обещает улучшение каждый день или сброс лимитов.
2026-10-05
Поток написанных ИИ отчётов остановил программу вознаграждений Google.
2026-10-04
Anthropic заплатит за обучение 10 000 инженеров внедрению Claude.
2026-10-04
Linux-рабочий стол полностью отверг код, написанный ИИ.
2026-10-04
DeepSeek поставила своего агента на рабочий стол и открыла код.
2026-10-03