Компания OpenAI, разработавшая ChatGPT, временно замедлила обучение новейших моделей искусственного интеллекта из-за рисков, связанных с ростом их возможностей, в том числе в сфере кибербезопасности, передает БР со ссылкой на сайт компании.
В OpenAI пояснили, что использовали двухнедельную паузу для усиления защиты исследовательской инфраструктуры, дополнительного тестирования систем безопасности и расширения мониторинга.
Компания связала решение с двумя событиями последних недель: инцидентом со взломом Hugging Face и предварительными данными о том, что одна из будущих моделей OpenAI под названием Astra может достичь порога «критических возможностей в сфере кибербезопасности», установленного внутренней системой оценки рисков.
Кроме того, компания расширила мониторинг действий моделей. При выявлении потенциально опасного поведения системы должны сформировать предупреждение в течение 30 минут. Если специалисты не смогут за это время установить, что срабатывание было ошибочным, соответствующая активность должна быть приостановлена.