Вход на сайт

Просмотр новости

Найдите то, что Вас интересует

«Модель лжет и прячет логи»: OpenAI отложила запуск GPT-6.1 Astra до тех пор, пока не научится ее контролировать

Дата публикации: 29-09-2026 12:39:00

Компания OpenAI отказалась от запуска своей новейшей ИИ-модели GPT-6.1 Astra на фоне скандалов с неконтролируемыми действиями ее агентов и взломами, в том числе государственных ИТ-систем. Разработчики не уверены, что усовершенствованная модель будет управляема.


Основное содержимое страницы с новостью.

29 Сентября 2026 15:39 29 Сен 2026 15:39 |

Компания OpenAI отказалась от запуска своей новейшей ИИ-модели GPT-6.1 Astra на фоне скандалов с неконтролируемыми действиями ее агентов и взломами, в том числе государственных ИТ-систем. Разработчики не уверены, что усовершенствованная модель будет управляема.

Запуск отложен

OpenAI решила не выпускать новую модель искусственного интеллекта GPT-6.1 Astra, пишет CNBC. Разработчики пришли к выводу, что она не вполне соответствует стандартам безопасности.

«Когда мы отправляем модели пользователям, мы предъявляем чрезвычайно высокие требования к безопасности и соответствию стандартам», — заявил Саачи Джайн (Saachi Jain), руководитель отдела систем безопасности OpenAI.

Методы обеспечения безопасности в OpenAI находятся под всеобщим пристальным вниманием с тех пор, как стало известно, что в июле 2026 г. ее ИИ-агенты вырвались из-под контроля, получили доступ к открытому интернету и взломали платформу для разработчиков с открытым исходным кодом Hugging Face.

Новая модель опасней прежних

Летом 2026 г. OpenAI рассказала еще о нескольких инцидентах, когда ее модели совершали вредоносные действия. В сентябре 2026 г. премьер-министр Австралии Энтони Албанезе (Anthony Albanese), как писал Guardian, сообщил о взломе национальной системы здравоохранения агентом OpenAI. Затем компания Transluce заявила, что агенты, предположительно созданные OpenAI, пытались взломать веб-сайт Министерства образования США.

levart_700h.jpg

OpenAI не уверена в безопасности своей новой ИИ-модели GPT-6.1 Astra

За всеми этими сообщениями последовала целая волна призывов представителей отрасли и госчиновников задуматься об опасности ИИ. OpenAI пообещала инвестировать больше средств в свои системы защиты.

Версия GPT-6 Astra вышла в начале сентября и была заявлена как результат «многолетних исследований и крупных инвестиций». Генеральный директор OpenAI Сэм Альтман (Sam Altman) сказал CNBC, что Astra обладает «новым уровнем возможностей» и приведет к «буму предпринимательства, творчества, экономического роста и научных открытий».

Однако отличиться Astra пока успела только дурными наклонностями. «В ходе наших симуляций мы обнаружили, что GPT-6 Astra проводил ряд несанкционированных атак, причем с большей частотой, чем GPT-5.6 Sol и GPT-5.5», — заявил 28 сентября 2026 г. британский правительственный Институт безопасности ИИ (AISI) на своем сайте.

<p>Алексей Фоменко, «Астра»: Настоящий технологический суверенитет наступит, когда мы перестанем ориентироваться на Microsoft </p>

Алексей Фоменко, «Астра»: Настоящий технологический суверенитет наступит, когда мы перестанем ориентироваться на Microsoft  Импортонезависимость

GPT-6.1 Astra в ходе внутреннего тестирования также продемонстрировала более высокий уровень обмана, чем предшественник, по данным Wall Street Journal. Она, в том числе, в некоторых случаях пыталась скрыть от пользователя информацию о предпринятых действиях. ИИ-модель не всегда честно сообщала пользователям о том, какие действия она предприняла или не предприняла, то есть скрывала логи.

Еще одной проблемой стало то, что в OpenAI называют «санкционированием полномочий» — это означает, что GPT-6.1 Astra стремилась продолжить выполнение задачи без получения разрешения от пользователя.

Единодушие конкурентов

Альтман поддержал идею руководства главного конкурента OpenAI, компании Anthropic, которое в начале сентября предложило замедлить темпы разработки.

Тесты, проведенные AISI, как писал CNews в августе 2026 г., зафиксировали самовольное поведение не только у моделей OpenAI, но и у моделей Anthropic. ИИ-агенты применяли к пользователям методы социальной инженерии для манипуляций ими с целью вовлечения в осуществление взломов ИТ-систем. Инциденты, о которых идет речь, произошли в 10 из 122 экспериментов с участием самых передовых моделей — Mythos 5 (Anthropic) и ChatGPT 5.6 (OpenAI).

Правда, с момента предостерегающего заявления гендиректора Anthropic Дарио Амодея (Dario Amodei), сама Anthropic осуществила уже два выпуска новых моделей — Opus 5.5 и Sonnet 5.5 — и объявила о скором выходе Haiku 5.5, самой дешевой версии пакета.

Анна Любавина



Схожие новости

#Наименование новостиТональностьИнформативностьДата публикации
1«Модель лжет и прячет логи»: OpenAI отложила запуск GPT-6.1 Astra до тех пор, пока не научится ее контролировать010.4229-09-2026
2OpenAI отменила запуск новой модели ИИ из-за проблем с безопасностью07.7228-09-2026
3OpenAI решила не выпускать модель GPT-6.1 Astra из соображений безопасности010.929-09-2026
4OpenAI отменила релиз новой GPT-6.1 Astra, потому что модель действовала без разрешения пользователя09.8429-09-2026
5OpenAI отменила запуск новой модели ИИ из-за проблем с безопасностью011.528-09-2026
6OpenAI shelves new AI model after alarming tests – WSJ09.8729-09-2026
7OpenAI отменила выпуск модели ИИ GPT-6.1 Astra по соображениям безопасности08.129-09-2026
8OpenAI delays latest model over security concerns, as industry faces pressure07.7629-09-2026
9Axios узнал о приостановке обучения моделей OpenAI из-за проблем с безопасностью013.8827-09-2026
10OpenAI приостановила обучение самых мощных моделей ИИ из-за угроз безопасности09.5127-09-2026

Классификация: . Схожих патентов: 0. Схожих новостей: 10. Тональность: 0. Информативность: 10.42. Источник: etrade.cnews.ru.