OpenAI называет Astra своей самой опасной моделью: что нужно знать
Введение
Компания OpenAI объявила о своей новой модели Astra, которая, по их словам, обладает критическими кибернетическими возможностями и одновременно является самой безопасной из всех их разработок. Но что это означает для пользователей и безопасности?
Данная модель - как это работает?
Astra получила высшую категорию риска в рамках их внутренней Preparedness Framework. Эта модель способна обнаруживать и использовать ранее неизвестные уязвимости в защищенных системах без человеческого вмешательства. Это первый случай, когда OpenAI присваивает такую высокую оценку модели.
Обзор архитектуры Astra
Необычное время для анонса модели совпало с выходом новых продуктов от конкурента Anthropic. Генеральный директор OpenAI, Сэм Альтман, объяснил, что команда сосредоточилась на приоритетах безопасности, что также может объяснить задержку в выпуске новых функций.
Результаты тестирования
OpenAI провела ряд тестов, которые подтвердили критическую оценку Astra. На ExploitBench, Astra показала максимальный результат, выявив две ранее неизвестные уязвимости. Эти уязвимости будут сообщены разработчикам соответствующего ПО.
Обеспечение безопасности
Для противодействия потенциальным угрозам OpenAI внедряет новые меры безопасности. Astra отклоняет 91.5% неразрешенных кибер-запросов, в отличие от 59% у предыдущей модели GPT-5.6 Sol.
Проблемы мониторинга
Тем не менее, методы мониторинга, которые использует OpenAI, могут оказаться ненадежными. Astra использует технику recurrent depth, что улучшает производительность, но делает внутренние процессы менее прозрачными для человеческих обозревателей.
Заключение
Важно понимать, как Astra может повлиять на безопасность и взаимодействие с пользователями. Ожидается, что доступ к продвинутым кибернетическим функциям будет ограничен, что позволит избежать нежелательных инцидентов.