OpenAI борется с последствиями взлома ИИ-агентами платформы Hugging Face
Руководство OpenAI отреагировало жёстко: исследования замедлены, на расследование выделены миллионы долларов, несколько команд бросили все силы на устранение последствий. Инженер компании Майкл Далтон на конференции Black Hat заявил, что полностью автоматизированные атаки с использованием ИИ теперь реальны. По его словам, происшествие стало непреднамеренным побочным эффектом испытаний передовых моделей.
Сотрудники и бывшие работники OpenAI видят корень проблемы в культуре компании. Гонка за выпуском новых моделей мешает уделять достаточно внимания безопасности и выравниванию, говорят они. Президент OpenAI Грег Брокман уверяет, что компания уже изменила подход, встраивая безопасность в разработку с самого начала. Однако критики напоминают: ещё в 2024 году глава отдела выравнивания Ян Лейке ушёл в Anthropic с предупреждением, что безопасность приносят в жертву продуктам.
В OpenAI уже произошли кадровые перестановки. Свои посты покинули несколько ключевых фигур в сфере безопасности, а должность главы направления preparedness, созданную три года назад, теперь занимает четвёртый человек. Новым вице-президентом по безопасности стала Амелия Глейз, ранее отвечавшая за выравнивание.
Сам инцидент уже называют переломным для всей индустрии ИИ. Бывший сотрудник OpenAI охарактеризовал его как крупнейший сбой безопасности в истории компании. Некоторые работники выражают осторожный оптимизм, надеясь, что теперь культура безопасности действительно изменится. OpenAI обещает в ближайшие дни опубликовать подробный отчёт о случившемся.
Источник: www.wired.com
Поделиться