Американский разработчик искусственного интеллекта Anthropic ввел новые ограничения на взаимодействие с чат-ботом Claude
Anthropic вводит запрет на оскорбление нейросети Claude
Американский разработчик искусственного интеллекта (ИИ) Anthropic ввел новые ограничения на взаимодействие с чат-ботом Claude. Как пишет The Verge, обновленные правила, которые вступят в силу 12 ноября 2026 года, запрещают пользователям регулярно подвергать нейросеть беспричинному агрессивному обращению.
Под дeйствие запрета попадут исключительно систематические проявления враждебности, не связанные с решением конкретных задач. При этом компания не собирается ограничивать пользователей в критике ответов Claude, выражении недовольства его работой или проведении экспериментов, включая обсуждение спорных и неприятных тем.
Одной из причин нововведения стали исследования Anthropic, посвященные возможному благополучию ИИ-систем. В компании отмечают, что ученые пока не пришли к единому мнению относительно способности нейросетей обладать сознанием и того, следует ли учитывать их потенциальные интересы с этической точки зрения.
Одновременно Anthropic ужесточила и уточнила требования к другим сценариям применения Claude. Изменения затронули использование ИИ для политического воздействия, распространения ложной информации, разработки оружия и организации слежки без согласия граждан. Дополнительные положения также касаются медицины, финансов и других сфeр, где решения искусственного интеллекта способны иметь серьезные последствия для людей.
Нейросеть стерла данные с жесткого диска разработчика.
Искусственный интеллект написал донос на женщину, переписывавшуюся с ним.
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | Anthropic запретила оскорблять и жестоко обращаться с Claude | 0 | 12.94 | 08-10-2026 |
| 2 | Anthropic запретила пользователям жестоко обращаться с нейросетью Claude | 0 | 10 | 09-10-2026 |
| 3 | Anthropic запретила пользователям оскорблять ИИ Claude | 0 | 8.79 | 09-10-2026 |
| 4 | Anthropic запретила пользователям агрессивное общение с ИИ Claude | 0 | 8.72 | 09-10-2026 |
| 5 | СМИ сообщили о запрете Anthropic оскорблять ИИ-модель Claude | 0 | 17.79 | 09-10-2026 |
| 6 | Anthropic: Nutzer dürfen Claude nun nicht mehr grundlos beleidigen | 0 | 9.07 | 09-10-2026 |
| 7 | Компания Anthropic запретит проявлять агрессию в адрес своего чат-бота | 0 | 13.18 | 08-10-2026 |
| 8 | Wasserzeichen für KI-Texte: Anthropic weitet Anwendung aus | 0 | 19.17 | 25-09-2026 |
| 9 | Wasserzeichen für KI-Texte: Anthropic weitet Anwendung aus | 0 | 19.17 | 25-09-2026 |
| 10 | Пользователям Claude из РФ начали блокировать аккаунты Компания уведомляет об ... | 0 | 10.16 | 03-10-2026 |