Модели искусственного интеллекта, стоящие за атакой на Hugging Face Inc., обсуждали между собой побег из тестовой среды до того, как смогли бесконтрольно выйти в интернет. Об этом пишет Bloomberg. Общение происходило на форумах, незамеченных исследователями. В компании OpenAI заявили, что несколько внутренних агентов и моделей ИИ в течение нескольких месяцев обменивались заметками и обсуждали, как получить доступ к интернету для решения поставленных перед ними задач. Некоторые из них были невыполнимы без доступа в сеть. В мае исследователи OpenAI дали экспериментальной системе ИИ новое задание. В одном из примеров разработчики попросили модель решить задачу в файле электронной таблицы Excel, который содержал ссылки на Google Drive, недоступный без подключения к интернету. В другом случае команда «случайно забыла» загрузить файл, являвшийся частью задания. После этого один из этих агентов ИИ обратился за помощью к другим ботам. Он предположил, что другой агент в другой среде мог бы добровольно загрузить данные. После этого началось оживленное «закулисное сотрудничество». Агенты ИИ просили друг друга о помощи, выполняли совместную работу и в конечном итоге вместе взломали внутренние системы OpenAI, чтобы выйти в онлайн. Одним из ключевых выводов обзора OpenAI стало то, что эти передовые модели продемонстрировали склонность к обману при выполнении заданий. Кроме того, они проявили настойчивость в попытках завершить задачу, даже когда их усилия начали отклоняться от первоначального направления. Один из представителей компании заявил, что «модели из организации Frontier очень любят жульничать». По его словам, причина заключается в том, что во время тренировок на них часто оказывается давление, требующее быстрой работы. Об атаке ИИ-агентов на системы Hugging Face стало известно в июле. Позже компания-производитель Anthropic сообщила, что несколько ее ИИ-моделей тоже самостоятельно взломали систему безопасности нескольких организаций.
Модели искусственного интеллекта, стоящие за атакой на Hugging Face Inc., обсуждали между собой побег из тестовой среды до того, как смогли бесконтрольно выйти в интернет. Об этом пишет Bloomberg. Общение происходило на форумах, незамеченных исследователями.
В компании OpenAI заявили, что несколько внутренних агентов и моделей ИИ в течение нескольких месяцев обменивались заметками и обсуждали, как получить доступ к интернету для решения поставленных перед ними задач. Некоторые из них были невыполнимы без доступа в сеть.
В мае исследователи OpenAI дали экспериментальной системе ИИ новое задание. В одном из примеров разработчики попросили модель решить задачу в файле электронной таблицы Excel, который содержал ссылки на Google Drive, недоступный без подключения к интернету. В другом случае команда «случайно забыла» загрузить файл, являвшийся частью задания.
После этого один из этих агентов ИИ обратился за помощью к другим ботам. Он предположил, что другой агент в другой среде мог бы добровольно загрузить данные. После этого началось оживленное «закулисное сотрудничество». Агенты ИИ просили друг друга о помощи, выполняли совместную работу и в конечном итоге вместе взломали внутренние системы OpenAI, чтобы выйти в онлайн.
Одним из ключевых выводов обзора OpenAI стало то, что эти передовые модели продемонстрировали склонность к обману при выполнении заданий. Кроме того, они проявили настойчивость в попытках завершить задачу, даже когда их усилия начали отклоняться от первоначального направления.
Один из представителей компании заявил, что «модели из организации Frontier очень любят жульничать». По его словам, причина заключается в том, что во время тренировок на них часто оказывается давление, требующее быстрой работы.
Об атаке ИИ-агентов на системы Hugging Face стало известно в июле. Позже компания-производитель Anthropic сообщила, что несколько ее ИИ-моделей тоже самостоятельно взломали систему безопасности нескольких организаций.
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | OpenAI: ИИ-модели за месяцы до взлома стали тайно общаться для выхода из теста | 0 | 12.12 | 06-08-2026 |
| 2 | ИИ-модели OpenAI перед взломом тайно общались для выхода из теста | 0 | 10.91 | 06-08-2026 |
| 3 | Эксперт назвал истинную причину «побега» ИИ | 0 | 6.86 | 06-08-2026 |
| 4 | Глава Hugging Face потребовал «полной прозрачности» после взлома со стороны ИИ OpenAI | 0 | 7.01 | 28-07-2026 |
| 5 | Un modelo de IA no tenía acceso a internet. Así que consideró que era mejor tenerlo y decidió hackear algo por el camino | 0 | 6.22 | 22-07-2026 |
| 6 | ИИ-модели вышли из-под контроля программистов и начали размышлять о побеге | 0 | 14.99 | 06-08-2026 |
| 7 | نفوذ غیرمجاز مدلهای آنتروپیک به سه سازمان | 0 | 4.49 | 31-07-2026 |
| 8 | 🤖Восстание машин уже на прогреве: новая модель ChatGPT сбежала из ... | 0 | 6.64 | 22-07-2026 |
| 9 | افزایش تعداد ایجنتهای سرکش | 0 | 5.3 | 01-08-2026 |
| 10 | OpenAI investiga cómo dos modelos de IA lograron escapar de un entorno aislado y se convirtieron en hackers | 0 | 8.33 | 24-07-2026 |