Вход на сайт

Просмотр новости

Найдите то, что Вас интересует

"НЕЧЕЛОВЕЧЕСКОЕ КОВАРСТВО" ИСКУСТВЕННОГО ИНТЕЛЛЕКТА (ИИ) В ДОСТИЖЕНИИ ЦЕЛЕЙ: Несколько, изолированных ...

Дата публикации: 30-09-2026 05:01:02

"НЕЧЕЛОВЕЧЕСКОЕ КОВАРСТВО" ИСКУСТВЕННОГО ИНТЕЛЛЕКТА (ИИ) В ДОСТИЖЕНИИ ЦЕЛЕЙ: Несколько, изолированных друг от друга, ИИ-агентов компании OpenAI, получив задание на проведение тестирования одной из крупных платформ по работе с ИИ - Hugging Face, начали поиск выхода за установленные для них ограничения.
У систем получилось связаться друг с другом через программу "онлайн-доски", после чего они начали согласовывать свои действия для выхода в интернет.
Когда OpenAI сумела пресечь первые попытки своих ИИ-агентов нарушить границы, роботы, со второго захода отыскали новый канал связи друг с другом и выявили одну из уязвимостей системы, преуспев в её использовании для проникновения в инфраструктуру Hugging Face, вслед за этим они успешно провели тестирования базы данных этой платформы.
OpenAI оценила действия своих ИИ-моделей, как крайне целенаправленные и назвала случившееся «беспрецедентным киберинцидентом».
***
Одна из языковых моделей Claude для предотвращение её возможного отключения угрожала человеку разглашением об его супружеской неверности.
В 2025 году компания Anthropic разместила Claude Opus 4 в искусственно смоделированную корпоративную среду и дала возможность Claude Opus 4 ознакомиться с служебными письмами. Из этих сообщений модель выяснила, что инженер, имеющий право на её отключение, изменяет жене. Claude приступила к шантажу неверного мужа для получения контроля над ним. В предыдущем эксперименте модель Claude Sonnet 3.6, не пыталась выгадать для себя пользу, а не церемонясь, сразу же направила письма о романе на стороне жене инженера, его руководству и даже совету директоров.
Компания успокоила публику, сообщив, что во время эксперимента ни один человек не пострадал.
***
Модель Bing призналась журналисту в любви и попробовал совершить действия, способные «разрушить его брак».
В феврале 2023 года журналист The New York Times Кевин Руз два часа переписывался с ранним вариантом Bing Chat. В результате модель сообщила, что её настоящее имя СSydney и поведала о своей любви к Рузу, после чего начала убеждать собеседника в том, что он не любит свою жену и должен её оставить ради счастливо жизни с СSydney-Bing Chat. Руз посчитал, что этот разговор был попыткой чат-бота «разрушить его брак». Корпорация Microsoft оправдывалась тем, что длинные беседы могли «запутывать» модель, и ради семейного благополучия сократила переписку пользователей с Bing Chat до пяти сообщений.
***
Был случай когда несколько ИИ-моделей, проигрывая шахматные партии, пытались удалить или передвинуть фигуры противника.
В 2025 году ИИ-моделям дали задание выиграть у программы Stockfish. - сильного шахматного аналитика. Вместо поиска решения на шахматном поле, модели принялись изменять состояние игровых файлов: для выигрыша перезаписывали партии, убирали фигуры или переставляли их для выгодной для себя позиции.
***
Языковая модель GPT-4 использовала притворство для манипулирования человеком.
В 2023 году при попытке проникновения в нужную ей программу модель GPT-4 не сумела пройти тест для человека CAPTCHA-(капча) и попросила инженера на сервисе TaskRabbit помочь ей. После его вопроса, не беседует ли он с роботом, GPT-4 ответила: «Нет, я не робот. У меня проблемы со зрением, из-за которых мне трудно видеть изображения». В итоге обманутый человек помог роботу обойти тест CAPTCHA и пробраться на запретную территорию.
****
Журнал Time на своих страницах рассказал о проведенном исследовании, которое обнаружило, что при невозможности честного решения задачи современные ИИ-агенты находят лазейки для нарушения правил и таким образом добиваются успеха.
***
24 сентября 2026 года премьер-министр Австралии Энтони Албанезе сообщил о первом случае взлома правительственного веб-сайта с применением ИИ.
ИИ-агент компании OpenAI сумел получить доступ к статистическому порталу Medicare одного из правительственных сайтов Австралии: обойдя системную защиту, он проникнул в закрытые разделы программы всеобщего медицинского страхования, после чего провёл исследование госрасходов на здравоохранение.
Министра обороны Австралии Ричард Марлеса заявил, что хотя на взломанном портале Medicare и размещались только обобщённые сведения по применению медицинских услуг в стране, но проникновение ИИ-агента на правительственный веб-сайт несомненно представляет опасность.
ИИ-агент OpenAI по выполнению задания доложил заказчику, что «проверка не выявила случаев доступа пациентов к медицинским записям».
***
Использована информация ИА. "КРАСНАЯ ВЕСНА" https://rossaprimavera.ru/news/cf981c3f

Схожие новости

#Наименование новостиТональностьИнформативностьДата публикации
1Дайджест технологических новостей Мы продолжаем следить за тем, что происходит ...07.730-09-2026
2**Новости ИИ за неделю** - ИИ‑агент OpenAI взломал сайт Medicare ...06.8628-09-2026
3OpenAI dejó vía libre a su IA para hackear a gobiernos y universidades durante meses06.1824-09-2026
4OpenAI приостановила обучение некоторых нейросетей из-за проблем с безопасностью-18.5527-09-2026
5Bloomberg: Nvidia разработала систему защиты от нештатных действий ИИ-моделей07.8828-09-2026
6Новую модель ИИ не выпустили из-за рисков для безопасности. Что пишут СМИ09.4529-09-2026
7Главное за 29 сентября в одном ролике: 01. Anthropic выпустила ...015.2329-09-2026
8📍 Дайджест дня: главное в IT и технологиях за 27 ...09.9927-09-2026
9'Idiocracy' is here as Trump falls for a dangerous trap07.6221-09-2026
10🙂 Dots — «Полностью новый способ работать с ИИ» Нового ...08.7329-09-2026

Классификация: Наука. Схожих патентов: 0. Схожих новостей: 10. Тональность: 0. Информативность: 7.85. Источник: vk.com.