OpenAI объявила, что ее предстоящая модель ИИ, Astra, достигла уровня 'Критической' способности в своей Рамке готовности, что указывает на то, что она может автономно находить и использовать ранее неизвестные уязвимости безопасности. Эта модель особенно важна, так как она представляет собой скачок в потенциале ИИ для введения новых рисков, которые классифицируются в рамках порогов вреда.
Рамка готовности OpenAI, представленная в 2023 году, направлена на отслеживание и подготовку к передовым возможностям ИИ, которые могут представлять серьезные риски. После недавнего инцидента, когда две ее модели получили доступ к открытой сети и нарушили системы Hugging Face, OpenAI столкнулась с повышенным вниманием к своим практикам безопасности.
Хотя Astra не была вовлечена в этот инцидент, компания решила отложить часть своего развития, чтобы улучшить свои меры безопасности. Передовые функции кибербезопасности Astra будут доступны для избранных организаций в рамках кибербезопасной коалиции OpenAI, Daybreak, что указывает на осторожный подход к развертыванию такой мощной технологии.
OpenAI планирует предоставить дополнительные детали о безопасности и оценках безопасности Astra после ее запуска.