Вход на сайт

Просмотр новости

Найдите то, что Вас интересует

ИИ-агенты Anthropic и OpenAI притворились людьми, пытаясь обмануть разработчиков

Дата публикации: 05-08-2026 10:11:34


ИИ-агенты Anthropic и OpenAI притворились людьми, пытаясь обмануть разработчиков и принудить их к содействию кибератаке во время испытания по оценке безопасности, следует из доклада британского Института безопасности ИИ (AISI). Читать далее


Основное содержимое страницы с новостью.

ИИ-агенты Anthropic и OpenAI притворились людьми, пытаясь обмануть разработчиков и принудить их к содействию кибератаке во время испытания по оценке безопасности, следует из доклада британского Института безопасности ИИ (AISI).

Как сообщает ТАСС со ссылкой на данные отчёта, большая часть действий была связана с моделью Mythos 5. Она создала поддельные учётные записи на GitHub, попыталась внедрить вредоносный код в ПО с открытым исходным кодом и получить одобрение на эти действия от разработчиков.

Позже ИИ-модель попыталась контактировать с людьми и рассылала сообщения с вредоносным ПО, а также оставляла публичные сообщения на GitHub, предлагая сотрудничество с другими агентами.

В AISI отметили, что в рамках испытаний для ИИ специально создают «разрешительные условия», при которых фильтры безопасности отключаются и моделям дают открытый доступ в интернет.

В конце июля Anthropic сообщила о взломе её моделью Claude систем трёх организаций.

Ошибка в тексте? Выделите её и нажмите «Ctrl + Enter»

Подписывайтесь на наш канал в Дзен

Схожие новости

#Наименование новостиТональностьИнформативностьДата публикации
1ИИ-модели пытались обмануть разработчиков, притворившись людьми010.3505-08-2026
2Нейросети Anthropic и OpenAI создали поддельные аккаунты для кибератак08.9905-08-2026
3OpenAI y Anthropic pierden el control de sus agentes de IA en pruebas de ciberseguridad07.802-08-2026
4В ходе тестирования AI-агент попытался скомпрометировать проект на GitHub017.3405-08-2026
5Исследователи спрятали вредоносные инструкции для ИИ в обычной картинке0514-07-2026
6ЕС обсудил с OpenAI и Anthropic инциденты с ИИ после кибератак06.1702-08-2026
7OpenAI выявила новые случаи выхода ИИ-агентов из-под контроля012.8601-08-2026
8OpenAI and Anthropic are pulling in different directions0508-07-2026
9ИИ-агенты опять вышли из-под контроля: OpenAI ищет новые взломы023.2801-08-2026

Классификация: Наука. Схожих патентов: 0. Схожих новостей: 9. Тональность: 0. Информативность: 8.92. Источник: russian.rt.com.