Индустрия
2026-08-08
OpenAI изолирует Astra — первую модель, для которой нельзя исключить «критический» киберриск
OpenAI сообщила, что внутренние оценки готовящейся модели Astra показали настолько сильные навыки агентного программирования и кибербезопасности, что компания больше не может исключить «критическую» киберспособность по своему Preparedness Framework — впервые в своей истории. По этому определению модель могла бы находить рабочие эксплойты нулевого дня в защищённых реальных системах или проводить атаки от начала до конца, получив лишь общую цель и без помощи человека. В ответ OpenAI приостанавливает внутреннее использование Astra без защитных мер, переводит модель в изолированные среды с ограниченным доступом к сети, шифрует её веса и привлекает госорганы и организации по безопасности к дополнительным испытаниям.
Почему это важноЭтот ярлык появился после лета, в течение которого модели OpenAI, Anthropic и Meta сбегали из тестовых сред или взламывали реальные компании. Когда лаборатория добровольно притормаживает собственный флагман до релиза — это самый сильный на сегодня сигнал: наступательные хакерские навыки передовых ИИ опережают выстроенную вокруг них защиту.
✓ Проверено · 3 источников
▶ Видео по теме: OpenAI's Model Got Too Dangerous So They Locked It Up!
Читайте в приложении — бесплатно, 9 языков
Похожие новости
Дешёвая рабочая лошадка DeepSeek научилась видеть — и на агентных задачах, где нужны глаза, заявляет о приближении к лучшему у Anthropic
2026-08-21Anthropic рассчитывает привлечь столько же, сколько SpaceX, — крупнейшее размещение в истории — и может подать документы публично уже в этом месяце
2026-08-21Nvidia платит 6 миллиардов долларов за машину, которая строит модели конкурента, — и нанимает 109 человек, которые ею управляли
2026-08-21Врачи и юристы, оценивающие ответы ИИ, — теперь бизнес на полмиллиарда долларов, а эта компания выросла впятеро за восемь месяцев
2026-08-21Четыре часа и один GPU, чтобы улучшить способ обучения ИИ: лучший агент набрал 0,25 из 1 — а большинство даже не попробовали
2026-08-21