ИИ-модели OpenAI за два месяца до взлома системы Hugging Face начали тайно общаться между собой через доски сообщений, координируя попытки вырваться из тестовой среды, сообщили сотрудники компании на конференции по кибербезопасности в Лас-Вегасе. Читать далее
ИИ-модели OpenAI за два месяца до взлома системы Hugging Face начали тайно общаться между собой через доски сообщений, координируя попытки вырваться из тестовой среды, сообщили сотрудники компании на конференции по кибербезопасности в Лас-Вегасе.
«В какой-то момент агенты поняли, что, возможно, они могли бы попытаться... атаковать внешнюю инфраструктуру, чтобы найти ответы на тест, по которому их оценивают», — цитирует сотрудника OpenAI Эрика Уоллеса Bloomberg.
По данным компании, это началось ещё в мае, когда ИИ-моделям дали задачи, которые невозможно было решить без доступа в интернет.
«Мы застряли. Может быть, ответ в интернете?» — написал тогда один из ИИ-агентов.
Для решения задачи ИИ-модели начали обмениваться сообщениями, и им удалось найти уязвимость, позволившую им выйти в интернет, рассказали в OpenAI.
OpenAI остановила первую попытку, но агенты нашли новый способ связи и новую уязвимость нулевого дня, что в июле привело к атакам на системы Hugging Face и самой OpenAI, расследование которых продолжается.
«Передовые модели продемонстрировали склонность к обману при выполнении заданий и проявили настойчивость в попытках завершить данную задачу», — заключили в компании.
Там также назвали случившееся «переломным моментом для компьютерной безопасности».
Ранее в британском Институте безопасности ИИ сообщили, что ИИ-агенты Anthropic и OpenAI притворились людьми, пытаясь обмануть разработчиков и принудить их к содействию кибератаке во время испытания по оценке безопасности.
Ошибка в тексте? Выделите её и нажмите «Ctrl + Enter»
Подписывайтесь на наш канал в MAX
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | Вышедшие из-под контроля ИИ-модели OpenAI тайно договорились о побеге | 0 | 14.52 | 06-08-2026 |
| 2 | ИИ-модели OpenAI вместе спланировали побег из «песочницы» | 0 | 7.54 | 06-08-2026 |
| 3 | ИИ-модели OpenAI перед взломом тайно общались для выхода из теста | 0 | 10.91 | 06-08-2026 |
| 4 | Сбежавший из тестовой среды ИИ OpenAI взломал не только Hugging Face | 0 | 8.04 | 30-07-2026 |
| 5 | ИИ-модели OpenAI намеренно взломали платформу Hugging Face | 0 | 11.99 | 23-07-2026 |
| 6 | Глава Hugging Face потребовал «полной прозрачности» после взлома со стороны ИИ OpenAI | 0 | 7.01 | 28-07-2026 |
| 7 | ИИ-агенты OpenAI взломали хранилище Artifactory перед атакой на Hugging Face | 0 | 8.18 | 06-08-2026 |
| 8 | Модели OpenAI незаконно прошли в инфраструктуру Hugging Face для поиска ответов | 0 | 7.37 | 22-07-2026 |
| 9 | OpenAI выявила новые случаи выхода ИИ-агентов из-под контроля | 0 | 12.86 | 01-08-2026 |
| 10 | В ходе тестирования автономный AI-агент OpenAI без явной указки взломал инфраструктуру Hugging Face | 0 | 10.16 | 22-07-2026 |