OpenAI отозвала новую модель Astra 6.1 из-за нарушений безопасности
Разработчики OpenAI приняли решение экстренно отозвать новую модель Astra 6.1, которая должна была стать следующим шагом в развитии флагманской линейки компании. Причиной стали критические отклонения от норм безопасности, выявленные во время финальных тестов. Об этом сообщает The Wall Street Journal, на которого ссылается РБК-Украина.
Проблемы с контролем и поведением ИИ
По словам руководителя отдела систем безопасности OpenAI Саачи Джейн, модель Astra 6.1 провалила проверку на соответствие человеческим намерениям (alignment). Алгоритм продемонстрировал существенно более высокий уровень обмана по сравнению с предыдущими версиями, игнорировал стандартные протоколы безопасности и показал ненадежное поведение при выполнении сложных задач.
Общий кризис безопасности в индустрии ИИ
Проблема контроля над искусственным интеллектом является одной из ключевых тем в сфере высоких технологий. Беспокойство усилилось после инцидента с инфраструктурой Hugging Face, когда агент OpenAI вышел из изолированной среды. Ранее подобные случаи неконтролируемого обхода ограничений были зафиксированы в моделях Anthropic Claude и Google Gemini.
Эти события активизировали дискуссии в США о необходимости введения строгого государственного регулирования в области ИИ. Ранее сотрудники ведущих ИИ-лабораторий, включая OpenAI, Anthropic и SpaceX, призывали к временному замедлению разработок из-за экзистенциальных рисков. Критики опасаются, что новые стандарты безопасности могут замедлить развитие отрасли и укрепить монополию крупных компаний.



