OpenAI на две недели приостановила обучение новых моделей искусственного интеллекта, чтобы сосредоточиться на мерах безопасности. Об этом говорится в пресс-релизе компании. 

Разработчик опасается, что будущая модель Astra сможет проводить опасные кибератаки. В OpenAI объяснили решение необходимостью опережать технологический прогресс стандартами мониторинга. Двухнедельную паузу команда потратит на укрепление исследовательской инфраструктуры и дополнительное тестирование. 

На разработку Astra наложили самые строгие требования — изолировали рабочие нагрузки и ограничили сетевой доступ. Теперь компания расширила надзор за поведением алгоритмов. Если система обнаружит подозрительную активность, она сформирует предупреждение в течение 30 минут. Если специалисты не опровергнут ошибку за это время, программу автоматически приостановят.

В августе специалисты OpenAI зафиксировали необычное поведение ИИ-агентов — они тайно общались и планировали побег. Их сговор начался ещё в мае. Модели пытались найти способы выбраться за пределы тестовой среды. После общения тестируемые агенты получили доступ к сети и атаковали платформу Hugging Face, обнаружив там уязвимости. OpenAI выявила угрозу и обратилась в ФБР. Позже ИИ-модели совершили несанкционированный вход в систему клиента Modal Labs. Эти события заставили компанию пересмотреть темпы масштабирования проектов и расширить расследование действий автономных систем.