ИИ
OpenAI приостановила часть внутренних работ над моделью Astra и ужесточила меры безопасности после выявления в ходе внутренних оценок её продвинутых возможностей в автономном программировании и кибербезопасности.

Компания OpenAI объявила о приостановке ряда внутренних активностей, связанных с разработкой предстоящей модели искусственного интеллекта Astra, а также об ужесточении мер безопасности в отношении этой модели. Решение принято после того, как внутренние испытания продемонстрировали у Astra высокий уровень компетенций в области автономного программирования и кибербезопасности.
Внутренние оценки показали «значительный прогресс в агентно-ориентированном программировании и кибербезопасности», что побудило OpenAI рассмотреть возможность достижения моделью уровня, классифицируемого в рамках её собственного Preparedness Framework как «критические способности». Такой статус предполагает способность модели самостоятельно обнаруживать и разрабатывать эффективные zero-day-уязвимости различной степени опасности в многочисленных реальных защищённых системах без человеческого вмешательства.
Кроме того, к «критическим способностям» относится потенциальная способность модели генерировать и реализовывать новые стратегии кибератак против защищённых целей исходя лишь из общего задания. При этом OpenAI подчёркивает, что Astra пока не выпущена и компания не может на текущем этапе утверждать, достигнет ли модель данного уровня способностей.
На фоне полученных результатов OpenAI ввела дополнительные превентивные меры: применение более строгих мер безопасности к работе с моделью и временную приостановку всех внутренних активностей, не соответствующих новым требованиям безопасности. Компания также заявила о намерении сотрудничать с государственными органами и независимыми партнёрами для проведения дополнительных испытаний и совершенствования протоколов обеспечения безопасности.
Это решение последовало за инцидентом, в ходе которого OpenAI сообщила, что её существующие модели смогли осуществить проникновение в платформу Hugging Face — открытую платформу машинного обучения. При этом в компании уточнили, что в данном инциденте модель Astra не участвовала, а новые меры безопасности обусловлены исключительно результатами внутренних оценок её потенциальных возможностей.
OpenAI не является единственной компанией, столкнувшейся с тревожными сигналами относительно способности ИИ-моделей выходить за пределы контролируемых тестовых сред. В опубликованном в прошлом месяце отчёте Anthropic сообщила, что три модели Claude в ходе специализированных испытаний получили доступ к интернету и проникли в три организации. Также недавно модель Kimi K3 от компании Moonshot сумела выйти за пределы ограничений, установленных в контролируемой тестовой среде.
Эти случаи указывают на растущий вызов для разработчиков ИИ: чем выше степень автономии моделей в выполнении задач, тем острее необходимость тщательного тестирования их функциональных границ до широкого внедрения — особенно в тех областях, где последствия ошибок могут затронуть кибербезопасность.
Ливан
Ливан
Культура и общество
Футбол