OpenAI замедлила обучение новых ИИ-моделей из-за рисков кибератак
OpenAI приостановила масштабирование обучения новых моделей искусственного интеллекта из-за усиления рисков, включая угрозы в области кибербезопасности. Компания опубликовала заявление, в котором отметила, что рост возможностей ИИ требует опережающего развития стандартов мониторинга и безопасности.
Представители OpenAI пояснили, что временное замедление темпов необходимо для достижения этих стандартов. Пауза продолжительностью две недели была использована для усиления защиты исследовательской инфраструктуры, дополнительного тестирования систем безопасности и расширения мониторинга.
Решение связано с двумя инцидентами: взломом платформы Hugging Face и предварительными данными о том, что будущая модель Astra может достичь порога критических возможностей в сфере кибербезопасности, установленного внутренней системой оценки рисков. Для Astra и связанных разработок введены строгие требования, включая изоляцию рабочих нагрузок и ограничения сетевого доступа.
Компания расширила мониторинг действий моделей: при выявлении опасного поведения система должна сформировать предупреждение в течение 30 минут. Если специалисты не подтвердят ошибочность срабатывания, активность будет приостановлена. OpenAI также продолжает исследования по обеспечению соответствия моделей заданным целям и человеческому контролю.
Источник: Оригинал