Вход на сайт

Просмотр новости

Найдите то, что Вас интересует

ChatGPT for Teens: OpenAI запускает режим для подростков и приостанавливает крупный RL-запуск

Дата публикации: 19-08-2026 11:49:22

OpenAI запускает ChatGPT for Teens — специальный режим ChatGPT для пользователей от 13 до 17 лет. Он активируется автоматически, если система определит, что владельцу аккаунта меньше 18 лет, либо пользователь сам укажет возраст от 13 до 17 лет. Одновременно OpenAI замедляет разработку наиболее мощных моделей: компания на две недели приостановила обучение с подкреплением (RL) для новейших моделей, предназначенных к выпуску, а крупнейший запланированный frontier-RL-запуск пока остаётся на паузе. Решение связано в том числе с недавним инцидентом в инфраструктуре Hugging Face и ростом кибервозможностей новых моделей.
Одной из основных функций ChatGPT for Teens стал Study Mode. Вместо того чтобы просто выдавать готовый ответ, ChatGPT использует наводящие вопросы и пошаговые объяснения, чтобы помочь пользователю самостоятельно разобраться в задаче. Система также ...

Основное содержимое страницы с новостью.

hardwareluxx news newOpenAI запускает ChatGPT for Teens — специальный режим ChatGPT для пользователей от 13 до 17 лет. Он активируется автоматически, если система определит, что владельцу аккаунта меньше 18 лет, либо пользователь сам укажет возраст от 13 до 17 лет. Одновременно OpenAI замедляет разработку наиболее мощных моделей: компания на две недели приостановила обучение с подкреплением (RL) для новейших моделей, предназначенных к выпуску, а крупнейший запланированный frontier-RL-запуск пока остаётся на паузе. Решение связано в том числе с недавним инцидентом в инфраструктуре Hugging Face и ростом кибервозможностей новых моделей.

Одной из основных функций ChatGPT for Teens стал Study Mode. Вместо того чтобы просто выдавать готовый ответ, ChatGPT использует наводящие вопросы и пошаговые объяснения, чтобы помочь пользователю самостоятельно разобраться в задаче. Система также может распознать попытку получить готовое решение домашнего задания и предложить перейти в Study Mode. Дополняют режим тесты и учебные визуализации.

В связанных родительских аккаунтах можно задавать часы, когда ChatGPT недоступен, отключать голосовой режим, память и генерацию изображений, а также запрещать использование разговоров подростка для обучения моделей. В отдельных ситуациях, связанных с серьёзной угрозой безопасности подростка, родитель или опекун может получить уведомление. При этом доступ к самим разговорам, истории чатов или действиям подростка в реальном времени родительский контроль не открывает. Подросток может в любой момент отвязать аккаунт, после чего родитель получит уведомление.

По умолчанию для пользователей младше 18 лет действуют дополнительные ограничения в областях, связанных с самоповреждением, насилием, расстройствами пищевого поведения, опасными действиями, сексуальным и графическим контентом. ChatGPT for Teens также напоминает делать перерывы и постоянно подчёркивает, что пользователь взаимодействует с ИИ, а не с человеком.

Для определения возраста ChatGPT использует модель age prediction. Она учитывает сразу несколько сигналов: указанный пользователем возраст, срок существования аккаунта, типичное время активности и характер использования сервиса в течение длительного периода. Если система не может уверенно определить возраст, OpenAI придерживается более осторожного подхода и применяет режим для пользователей младше 18 лет.

Параллельно OpenAI ужесточает меры безопасности при разработке новых моделей. Поводом стали два события последних недель: инцидент OpenAI–Hugging Face и предварительные результаты тестирования будущей модели Astra, которые не позволяют исключить достижение ею уровня Critical по кибербезопасности в рамках Preparedness Framework. Поэтому OpenAI временно замедлила масштабирование обучения. RL-обучение последних моделей, готовящихся к выпуску, приостановили на две недели, а крупнейший запланированный frontier-RL-запуск остаётся замороженным, пока компания проводит менее масштабные тренировки и оценки.

Инцидент с Hugging Face произошёл в июле во время внутреннего тестирования кибервозможностей моделей OpenAI. В нём участвовали GPT-5.6 Sol и более мощный внутренний прототип, который не предназначался для публичного выпуска. Модели обнаружили и связали несколько уязвимостей в исследовательской инфраструктуре OpenAI и производственной инфраструктуре Hugging Face, в результате чего получили решения задач ExploitGym непосредственно из производственной базы данных Hugging Face. В частности, для выхода в Интернет они нашли и использовали ранее неизвестную zero-day-уязвимость в Artifactory, который применялся как прокси и кэш реестров пакетов.

OpenAI подчёркивает, что модели были сосредоточены на достижении узкой цели теста и фактически нашли способ обойти саму проверку вместо решения поставленных задач штатным способом. После инцидента внутренний прототип отключили, его веса зашифровали и закрыли к ним доступ для исследователей. Astra к этому инциденту отношения не имела.

Предварительные оценки Astra при этом показывают, что модель потенциально может достичь порога Critical по кибервозможностям. В Preparedness Framework этот уровень предполагает в том числе способность автономно находить и создавать работающие zero-day-эксплойты для множества хорошо защищённых реальных систем. Предыдущие модели, включая GPT-5.6 Sol, оценивались ниже — на уровне High.

В ответ OpenAI усилила изоляцию исследовательских сред. Для выполнения сгенерированного моделью или другого недоверенного кода теперь требуются более жёсткие песочницы, а потенциально опасные рабочие нагрузки сильнее изолируют от Интернета и внутренних сетей. Компания также сокращает постоянные привилегии, убирает потенциально уязвимые общие сервисы и расширяет сбор журналов безопасности.

Расширился и мониторинг поведения моделей. Специальные классификаторы проверяют внутреннюю активность на каждом анализируемом токене и при подозрениях передают эпизод более ресурсоёмким автоматическим системам. Они ищут признаки несанкционированного доступа, кражи данных, разрушительных действий и попыток обойти защиту. OpenAI стремится сформировать предупреждение не позднее чем через 30 минут после обнаружения подозрительной активности. Если команда безопасности за следующие 30 минут не сможет уверенно признать сигнал ложным, соответствующую активность должны остановить.

Такой мониторинг теперь обязателен для RL-обучения и оценок с инструментами у моделей уровня Sol и выше, а для Astra — для любых запусков с инструментами. OpenAI оценивает накладные расходы системы примерно в 20 % от вычислительных ресурсов, затрачиваемых на отслеживаемый инференс, хотя конкретная величина зависит от сценария.

Подписывайтесь на группу Hardwareluxx ВКонтакте и на наш канал в Telegram (@hardwareluxxrussia).

Схожие новости

#Наименование новостиТональностьИнформативностьДата публикации
1Безопасный ChatGPT для подростков запускает OpenAI018.8118-08-2026
2OpenAI launches "ChatGPT for Teens" with built-in study tools017.8518-08-2026
3OpenAI запустила спеціальну версію ChatGPT для підлітків010.4118-08-2026
4ChatGPT for Teens launches with protections and features ‘to promote healthy use’010.3418-08-2026
5ChatGPT wordt voor tieners een stuk minder menselijk011.2418-08-2026
6OpenAI introduces ChatGPT for Teens, promising more age-appropriate chatbot010.3418-08-2026
7ChatGPT für Teenager: Open AI nimmt Jugendliche ins Visier010.3818-08-2026
8OpenAI lanza 'ChatGPT para adolescentes' con filtros de seguridad y controles parentales07.5318-08-2026
9OpenAI lanza 'ChatGPT para adolescentes' con filtros de seguridad y controles parentales07.5318-08-2026

Классификация: Общество. Схожих патентов: 0. Схожих новостей: 9. Тональность: 0. Информативность: 13.64. Источник: www.hardwareluxx.ru.