Китайская система DoGNAVY вошла в тройку лидеров мирового рейтинга по ИИ-безопасности
Одновременно с этим Калифорнийский университет в Беркли опубликовал новый рейтинг CyberGym, который считается одним из самых авторитетных тестов на практическую безопасность ИИ. В рамках испытания агенты должны были самостоятельно находить, подтверждать и эксплуатировать реально существовавшие уязвимости в 188 открытых проектах, всего 1507 задач. Лучший результат показала Microsoft, второе место занял Atlas от Wiz и Google DeepMind, а третье — китайская система DoGNAVY, созданная совместно с исследовательским институтом и командой DARKNAVY. Она обошла OpenAI и Anthropic и стала первой среди решений с открытым кодом.
Примечательно, что DoGNAVY построена не на ансамбле мощных закрытых моделей, как конкуренты, а на одной открытой модели GLM-5.2, выпущенной компанией Zhipu. Её архитектура включает рабочую среду для агентов, которая сочетает статический анализ кода с динамическими проверками, а также встроенную систему диагностики, позволяющую не просто констатировать опасность, но и выяснять её причины. По словам разработчиков, это позволяет надеть ошейник на слишком самостоятельные ИИ-агенты.
Главный вывод, который делают эксперты, прост: скорость создания атак растёт, и защита больше не может строиться только на ручном труде узких специалистов. Третье место DoGNAVY — это не только технический успех, но и сигнал о том, что открытые модели и китайские исследования уже способны дать миру реально работающие инструменты для сдерживания ИИ.
Источник: www.qbitai.com
Поделиться