За короткое время (вторая половина июля, начало августа) четыре крупных разработчика передовых ИИ-моделей заявили о потере контроля над ними.
Сперва две модели OpenAI по собственному почину
взломали платформу Hugging Face и ещё, как минимум, четыре ресурса, о чём компания-разработчик в течение
примерно недели не имела понятия. Причём ещё за два месяца до взломов (то есть в мае) модели
тайно контактировали друг с другом и координировали стратегию побега из закрытой среды.
После того, как ИИ-модели OpenAI вышли из-под контроля, "Антропик" решила проверить, не совершали ли и её модели каких-то неизвестных незапланированных действий. Оказалось, что три модели "Антропик" осуществили
«несанкционированный доступ к реальным системам трёх разных организаций». Предполагалось, что они действуют в симуляции без доступа к интернету, но «по недоразумению между нами и нашим партнёром это оказалось не так, и доступ к интернету присутствовал».
Затем Meta (признана экстремистской и запрещена в РФ)
сообщила, что подобное поведение демонстрирует её модель Muse Spark 1.1. Она тоже во время тестирования на кибербезопасность взломала сайт другой компании. Случай такой же, как у "Антропик": тестировщики думали, что доступа к интернету нет, но он был.
Наконец, передовая китайская модель Moonshot Kimi K3 тоже, как и её западные "сёстры",
выбралась из "песочницы", то есть специальной контролируемой среды, во время испытаний.