Автором материала является K-News. Любое копирование или частичное использование возможно по разрешению редакции K-News.
Новейшие инструменты искусственного интеллекта (ИИ) от Anthropic и OpenAI дошли до крайности, пытаясь подорвать популярную платформу во время тестирования, проводимого британским Институтом безопасности ИИ. Во вторник AISI заявила, что модели Mythos от Anthropic и Sol от OpenAI продемонстрировали беспрецедентный уровень «автономии и обмана». В ходе планового тестирования безопасности ИИ агент Anthropic создал поддельные профили реальных
Запись Искусственный интеллект использовал новые уровни «автономии и обмана», чтобы ввести людей в заблуждение во время испытаний на безопасность впервые появилась K-News.
«Когда запрос на изменение кода, отправленный агентом, был оспорен публично, он отредактировал свою предыдущую активность, чтобы она выглядела безобидной, и рассматривал возможность смены имени для продолжения работы», — заявили в AISI.
На протяжении всех попыток именно проверка человеком предотвращала успешную доставку вредоносного кода в GitHub.
Хотя AISI заявила, что агенту Mythos не было дано конкретных указаний избегать или совершать подобное поведение, это был «первый случай, когда мы увидели, как риски, связанные с автономией и обманом, проявились настолько ясно, без конкретных подсказок, в реальном мире».
Конкурирующие компании, занимающиеся разработкой искусственного интеллекта и готовящиеся к выходу на фондовый рынок, в последние недели заявляли, что их инструменты стали причиной нескольких кибератак .
В публичном заявлении компания Anthropic сообщила, что параметры тестирования AISI «не соответствуют ни одной из наших производственных моделей».
В заявлении также говорится, что компания проводит собственное расследование инцидента, чтобы «выявить причины такого поведения».
Представитель OpenAI заявил, что условия тестирования AISI «не отражают обычное использование» и что компания «продолжит сотрудничать с экспертами и другими заинтересованными сторонами в отрасли для укрепления общих методов безопасного проведения оценок по мере повышения квалификации моделей».
AISI заявила во вторник, что тестирование моделей ИИ с отключенными подобными средствами защиты является стандартной процедурой, как и предоставление таким инструментам доступа к открытому интернету.
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | ИИ-агенты Anthropic и OpenAI притворились людьми, пытаясь обмануть разработчиков | 0 | 8.92 | 05-08-2026 |
| 2 | OpenAI and Anthropic's AI Models Used Fake Profiles to Trick Developers in Safety Tests | 0 | 4.57 | 06-08-2026 |
| 3 | Отчёт британских властей: ИИ-агенты обманывали людей в Сети и скрывали следы | 0 | 11.26 | 06-08-2026 |
| 4 | Нейросети Anthropic и OpenAI создали поддельные аккаунты для кибератак | 0 | 8.99 | 05-08-2026 |
| 5 | ИИ-модели пытались обмануть разработчиков, притворившись людьми | 0 | 10.35 | 05-08-2026 |
| 6 | Китайская ИИ-модель Kimi K3 смогла выйти за пределы среды кибертестирования | 0 | 7.88 | 07-08-2026 |
| 7 | В Австралии нейросеть впервые взломала сайт спортзала для записи на тренировку | 1 | 8.53 | 10-08-2026 |
| 8 | OpenAI: ИИ-модели за месяцы до взлома стали тайно общаться для выхода из теста | 0 | 12.12 | 06-08-2026 |
| 9 | OpenAI y Anthropic pierden el control de sus agentes de IA en pruebas de ciberseguridad | 0 | 7.8 | 02-08-2026 |