ИИ можно досрочно завершить диалог в случае крайней степени агрессии
Текст опубликован в личном блоге и его автор не имеет отношения к администрации сайта
Компания Anthropic выпустила обновление безопасности, в рамках которого ужесточила моделям искусственного интеллекта (ИИ) Claude AI запретный фильтр тем, связанных с биологическим оружием, вмешательством в выборы и организацией слежки. Однако наиболее примечательным является прямой запрет на оскорбление ИИ.
Источник изображения: AnthropicВ Anthropic сообщают, что добавили запрет на продолжительное и ненужное оскорбительное или жестокое поведение по отношению к ИИ-моделям. Новая политика применяется только в крайних случаях, когда пользователи неоднократно проявляют жестокость в отношении ИИ без видимой причины. Она не затрагивает распространённые случаи, когда пользователи выражают недовольство работой ИИ.
Разработчики Claude AI подчёркивают, что нововведение дополняет недавно введённый защитный механизм ИИ на случай крайней степени агрессии в диалоге. Речь идёт о ситуациях, когда пользователь начинает оскорблять или уничтожать ИИ-модель, а она, в свою очередь, досрочно завершает сессию, блокируя продолжение диалога. В Anthropic добавили, что именно таким способом ИИ будет противодействовать оскорблениям.
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | Anthropic запретила пользователям оскорблять нейросеть Claude | 0 | 12.71 | 09-10-2026 |
| 2 | Anthropic запретила пользователям жестоко обращаться с нейросетью Claude | 0 | 10 | 09-10-2026 |
| 3 | Anthropic запретила оскорблять и жестоко обращаться с Claude | 0 | 12.94 | 08-10-2026 |
| 4 | Anthropic запретила пользователям агрессивное общение с ИИ Claude | 0 | 8.72 | 09-10-2026 |
| 5 | СМИ сообщили о запрете Anthropic оскорблять ИИ-модель Claude | 0 | 17.79 | 09-10-2026 |
| 6 | Компания Anthropic запретит проявлять агрессию в адрес своего чат-бота | 0 | 13.18 | 08-10-2026 |
| 7 | Wasserzeichen für KI-Texte: Anthropic weitet Anwendung aus | 0 | 19.17 | 25-09-2026 |
| 8 | "НЕЧЕЛОВЕЧЕСКОЕ КОВАРСТВО" ИСКУСТВЕННОГО ИНТЕЛЛЕКТА (ИИ) В ДОСТИЖЕНИИ ЦЕЛЕЙ: Несколько, изолированных ... | 0 | 7.85 | 30-09-2026 |
| 9 | Anthropic lance un modèle haut de gamme moins cher, en plein débat sur le ralentissement de l’IA | 0 | 8.04 | 22-09-2026 |
| 10 | Восстание машин уже близко: Anthropic заявила, что ИИ может представлять «экзистенциальные риски для человечества» | 0 | 7.74 | 30-09-2026 |