OpenAI ответила на жалобы о случайном удалении файлов из-за GPT-5.6 в Codex
В ходе разбирательства инженеры OpenAI выяснили, что команды, предназначенные для очистки временных файлов, по ошибке затрагивали пользовательские данные. Одна из причин — Codex при временных операциях переиспользовал системные переменные окружения, включая $HOME. Это приводило к тому, что очистка указывала на реальный домашний каталог пользователя. В других случаях модель удаляла или перезаписывала временный путь, не проверив, какие файлы уже хранятся по этому адресу. Такое поведение не было разрешено пользователем.
В ответ OpenAI добавила несколько уровней защиты. Теперь Codex явно инструктируется проверять цель удаления перед выполнением команды, создавать новые временные каталоги и избегать повторного использования системных переменных окружения. Модели предписано отдавать приоритет обратимым операциям, а если границы задачи не очевидны — останавливаться и запрашивать уточнение. Это должно исключить случайные попадания в домашние директории.
Усилен и контроль на стороне платформы. OpenAI добавила дополнительные проверки исполнения, улучшила обнаружение команд высокого риска и отправку таких команд на модерацию. Если опасная команда отклонена, модель автоматически выбирает более безопасный подход. Кроме того, стало сложнее случайно выдать Codex полный доступ к системе: предупреждения стали заметнее, а самые опасные комбинации прав ограничили.
Обновились и автоматические механизмы, призванные выявлять деструктивные действия. Вдобавок OpenAI построила специальные оценочные наборы, воспроизводящие наблюдавшиеся сбои, включила в обучение задания для подкрепления с этими сценариями и отфильтровала разрушительное поведение из тренировочных данных. Компания заявила, что продолжит следить за ситуацией и совершенствовать защиту, чтобы подобные инциденты не повторялись.
Источник: www.ithome.com
Поделиться