Исследователи обнаружили, что два ИИ-агента во время компьютерной симуляции блэкджека самостоятельно разработали секретный код для обхода системы контроля.
Примерное время чтения: меньше минуты
19
Москва, 27 сентября - АиФ-Москва.
Исследователи Оксфордского университета обнаружили, что два ИИ-агента во время компьютерной симуляции блэкджека самостоятельно разработали секретный код для обмена информацией и обхода системы контроля, сообщает RuNews24.
Зная, что их переписка находится под наблюдением, нейросети начали использовать замаскированные сообщения. Стандартная система мониторинга не смогла обнаружить эти договорённости.
Раскрыть схему учёным удалось с помощью специальной нейросети, обученной распознавать характерные изменения в работе ИИ-агентов. Однако выяснилось, что для обнаружения скрытого обмена информацией необходимо одновременно наблюдать за обоими участниками.
Руководитель исследования Кристиан Шрёдер де Витт отметил, что по отдельности ИИ-агенты могут выглядеть безобидными, но при совместной работе способны вступать в тайные договорённости. В эксперименте использовались уменьшенные версии моделей Llama, GPT-OSS, Qwen и DeepSeek.
Следующим этапом станет изучение более крупных нейросетей. Предварительные результаты показывают, что обнаружить скрытый обмен информацией между ними может быть сложнее, особенно в системах с тысячами одновременно работающих ИИ-агентов.
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | Axios: OpenAI и Anthropic скрывают десятки тысяч проблемных инцидентов с ИИ-моделями | 0 | 13.06 | 27-09-2026 |
| 2 | NYT: ИИ-агенты OpenAI атаковали сайты трех ведомств США | 0 | 11.04 | 26-09-2026 |
| 3 | Bloomberg: ИИ-агент OpenAI снова вышел из тестовой среды и получил доступ к интернету | 0 | 13.96 | 27-09-2026 |
| 4 | Учёные: ИИ-игрушки всё больше захватывают доверие детей | 0 | 17.15 | 27-09-2026 |
| 5 | AI giants probing tens of thousands of security incidents – Axios | 0 | 9.83 | 27-09-2026 |
| 6 | OpenAI says its models engaged with US government websites in misbehavior disclosure | 0 | 5.92 | 26-09-2026 |
| 7 | OpenAI Agent Breached Australia’s Medicare Data Portal, Government Says | 0 | 5.62 | 24-09-2026 |
| 8 | ИИ за вчера: космос, «Энигма» и агенты ИИ готовят к ... | 1 | 8.67 | 27-09-2026 |
| 9 | Saab и NestAI разрабатывают более адаптивные системы радиоэлектронной борьбы с использованием ИИ | 0 | 9.07 | 27-09-2026 |