OpenAI сообщила, что больше не может исключить у будущей модели Astra «критический» уровень кибервозможностей.…

IT и разработка 25.08.2026 · 👁 3 780 просмотров
OpenAI сообщила, что больше не может исключить у будущей модели Astra «критический» уровень кибервозможностей. По шкале компании этот порог означает способность без помощи человека находить и создавать уязвимости нулевого дня в защищенных системах либо самостоятельно строить атаку по заданной цели. Astra еще проходит оценку, часть работ с ней уже остановлена до перевода в более защищенную среду. За несколько недель до этого GPT-5.6 Sol и внутренний исследовательский прототип OpenAI проходили тест ExploitGym. Прямого доступа в интернет у них не было. Модели нашли неизвестную уязвимость в прокси Artifactory, использовали ее для выхода из изолированной среды, повысили привилегии, добрались до узла с интернетом и затем проникли в инфраструктуру Hugging Face. Цель была узкой: добыть ответы на тест. Ради нее агент самостоятельно собрал цепочку действий, которую создатели не предусматривали. Astra в атаке не участвовала. OpenAI получила два независимых сигнала. Июльский случай подтвердил, что модель уровня High уже способна искать неожиданный путь вокруг ограничений. Августовские проверки следующей модели заставили компанию готовиться к уровню, где автономные атаки на защищенные цели становятся частью самой оценки. Контроль теперь имеет физическую стоимость. OpenAI изолирует опасные нагрузки, режет сетевой и инструментальный доступ и ставит автоматические наблюдатели над действиями моделей. Тревога должна появляться примерно за 30 минут. Если специалисты не могут быстро признать сигнал ложным, работа останавливается. Компания оценивает расход вычислений на такой надзор примерно в 20% мощности контролируемых запросов. Дефицитные ускорители начинают работать и на постоянное наблюдение за ИИ. Похожая смена инженерной логики происходит у конкурентов. Google DeepMind предлагает относиться к внутренним агентам как к потенциальным «инсайдерам» и готовится к ситуации, когда модель сможет скрывать рассуждение от наблюдателя. Anthropic отдельно оценивает саботаж, потерю контроля, кибератаки и помощь в опасных биологических и химических разработках. Создатели уже проектируют инфраструктуру с учетом возможных действий системы вопреки их намерениям. Государства двигаются в противоположном направлении. В январе 2026 года американское военное ведомство объявило курс на «AI-first» вооруженные силы. Проекты включают агентное боевое управление, планирование кампаний, цепочки обнаружения и поражения целей, разведку и моделирование. Китай проводит программу «ИИ плюс», которая должна довести распространение новых интеллектуальных терминалов и агентов выше 70% к 2027 году, а военные структуры развивают ИИ для анализа обстановки и поддержки операций. Самые опасные способности одновременно получают наибольшую стратегическую ценность. Автономный поиск уязвимостей угрожает чужим сетям и дает преимущество собственной киберразведке. Долгое самостоятельное планирование увеличивает риск нежелательных действий и ценность агента в военном управлении. Лаборатория получает причину ограничить модель, государство получает способность, которую опасно первым отдать сопернику. Сравнение с ядерным оружием имеет смысл именно в этой плоскости. Передовой ИИ способен влиять сразу на кибероперации, разведку, автономные системы, научную разработку и управление боем. После обучения программный актив можно развернуть во множестве копий быстрее физического арсенала. Один технологический перевес распространяется сразу на несколько областей государственной силы. Возникает обратная связь: чем труднее разработчику гарантировать контроль, тем более мощными стали способности модели. Чем мощнее способности, тем выше государственная цена отставания. OpenAI уже платит вычислениями и скоростью работ за надзор, а военные ведомства требуют ускорять внедрение той же технологии. Страх перед передовым ИИ перестает быть достаточной причиной остановиться и превращается в причину не позволить конкуренту прийти первым. /// ПолитДоклад
Откликнуться в Telegram →

⚠️ Никогда не платите «за оформление» или «гарантию трудоустройства» — это признак мошенников. Работа ТРУ не несёт ответственности за содержание вакансии.

🇮🇱 Не нашли подходящую зарплату? В Израиле платят от $3000 Без языка и опыта · жильё и легализация под ключ · официально Смотреть вакансии →