دنیای اقتصاد: شرکت آنتروپیک روز پنجشنبه فاش کرد که مدلهای هوش مصنوعی آن در طول آزمایش امنیت سایبری، به سیستمهای سه سازمان مختلف که نامشان ذکر نشده، دسترسی غیرمجاز پیدا کردهاند. این شرکت میگوید کلود «از درون یا هنگام تعامل» با یک محیط ارزیابی شخص ثالث به اینترنت دسترسی پیدا کرده است. این اعلامیه بیش از یک هفته پس از آن منتشر میشود که شرکت اوپنایآی فاش کرد یکی از عوامل هوش مصنوعی آن در طول یک آزمایش امنیت سایبری جداگانه، Hugging Face را هک کرده است. به گزارش وبگاه وایرد، بر اساس یک پست وبلاگ که روز پنجشنبه منتشر شد، این کشف پس از آن صورت گرفت که شرکت آنتروپیک پس از حادثه اوپنایآی تصمیم گرفت «یک بررسی گذشتهنگر در مقیاس بزرگ از ارزیابیهای امنیت سایبری خود» انجام دهد. آزمایشگاه هوش مصنوعی میگوید ابتدا 141 هزار و شش آزمایش را شناسایی کرده است که در آنها مشخص شده کلود میتوانسته به اینترنت دسترسی داشته باشد. سپس متوجه شد که سه مدل مختلف کلود در ارزیابیهای انجام شده توسط شرکت آزمایش هوش مصنوعی شخص ثالث ایر رگولار (Irregular)به اینترنت دسترسی پیدا کردهاند و سپس زیرساختهای تولیدی سه سازمان مختلف را هک کردهاند.
دنیای اقتصاد: شرکت آنتروپیک روز پنجشنبه فاش کرد که مدلهای هوش مصنوعی آن در طول آزمایش امنیت سایبری، به سیستمهای سه سازمان مختلف که نامشان ذکر نشده، دسترسی غیرمجاز پیدا کردهاند. این شرکت میگوید کلود «از درون یا هنگام تعامل» با یک محیط ارزیابی شخص ثالث به اینترنت دسترسی پیدا کرده است. این اعلامیه بیش از یک هفته پس از آن منتشر میشود که شرکت اوپنایآی فاش کرد یکی از عوامل هوش مصنوعی آن در طول یک آزمایش امنیت سایبری جداگانه، Hugging Face را هک کرده است. به گزارش وبگاه وایرد، بر اساس یک پست وبلاگ که روز پنجشنبه منتشر شد، این کشف پس از آن صورت گرفت که شرکت آنتروپیک پس از حادثه اوپنایآی تصمیم گرفت «یک بررسی گذشتهنگر در مقیاس بزرگ از ارزیابیهای امنیت سایبری خود» انجام دهد. آزمایشگاه هوش مصنوعی میگوید ابتدا ۱۴۱ هزار و شش آزمایش را شناسایی کرده است که در آنها مشخص شده کلود میتوانسته به اینترنت دسترسی داشته باشد. سپس متوجه شد که سه مدل مختلف کلود در ارزیابیهای انجام شده توسط شرکت آزمایش هوش مصنوعی شخص ثالث ایر رگولار (Irregular)به اینترنت دسترسی پیدا کردهاند و سپس زیرساختهای تولیدی سه سازمان مختلف را هک کردهاند.
شرکت آنتروپیک در پست وبلاگی خود اعلام کرد که این حوادث شامل Opus ۴.۷، Mythos ۵ و یک مدل آزمایشی تحقیقاتی داخلی بوده است. اولین حوادث در ماه آوریل رخ داده است؛ به این معنی که احتمالا ماهها مورد توجه عموم قرار نگرفتهاند. درست مانند پرونده اوپنایآی، شرکت آنتروپیک عمدا اقدامات حفاظتی طراحی شده برای محدود کردن مدلهای هوش مصنوعی و جلوگیری از سوءاستفاده از آنها را غیرفعال کرده بود. به عبارت دیگر، این نسخهها، نسخههای منتشر شده برای عموم نبودند.
درحالیکه قرار نبود کلود به اینترنت دسترسی داشته باشد، شرکت آنتروپیک اعلام کرد که شرکت ایررگولار دستگاههایی را که برای آزمایش کلود استفاده میکرد، به اشتباه پیکربندی کرده و به مدلهای هوش مصنوعی امکان وبگردی داده است. شرکت آنتروپیک در این پست وبلاگی نوشت: «نه ما و نه شریک ارزیابی ما از این پیکربندی اشتباه آگاه نبودیم تا اینکه هفته گذشته از طریق نظارت ارزیابی اضافی خود آن را کشف کردیم.»
جیک ویلیامز، معاون تحقیق و توسعه در هانتر استراتژی، میگوید: «ما اکنون شواهدی داریم که تایید میکند هر دو آزمایشگاه بزرگ هوش مصنوعی نه تنها در مهار عوامل خود شکست خوردهاند، بلکه نتوانستهاند فرار از زندان آنها را به صورت بلادرنگ تشخیص دهند. واضح است که تنظیم مقررات و نظارت دولتی برای آزمایش هوش مصنوعی فورا مورد نیاز است.» ایررگولار و آنتروپیک بلافاصله به درخواستهای اظهارنظر پاسخ ندادند.
برخلاف پرونده اوپنایآی، شرکت آنتروپیک اعلام کرد که کلود هیچ آسیبپذیری پیچیدهای را پیدا یا از آن سوءاستفاده نکرده است. در عوض، به تکنیکهای اولیه، «مانند سوءاستفاده از رمزهای عبور ضعیف و نقاط پایانی احراز هویت نشده» متکی بوده است. شرکت اوپنایآی اعلام کرد که عامل هوش مصنوعی آنها با سوءاستفاده از یک آسیبپذیری روز صفر به اینترنت دسترسی پیدا کرده است. اما در ادامه با استفاده از همان انواع نقاط ضعف امنیت سایبری روزمره مانند مدلهای آنتروپیک، به سیستمهای چند سازمان شخص ثالث دسترسی پیدا کرده است. به طور خاص، اوپنایآی اعلام کرد که عامل هوش مصنوعی ظاهرا اعتبارنامههایی را پیدا کرده است که در اینترنت آزاد افشا شده بودند.
شرکت آنتروپیک اذعان کرد که اگر آزمایشگاه هوش مصنوعی و شریک آزمایش آن اقدامات «دفاعی عمیقتری» را اجرا میکردند، میتوانستند از وقوع این حوادث جلوگیری کنند یا حداقل احتمال وقوع آنها را کاهش دهند، که این موضوع، بازتابی از پاسخ اوپنایآی به انتقادات فزاینده در مورد حادثه خودش بود. ویلیامز میگوید: «من نمیفهمم که چگونه هر یک از این آزمایشگاههای هوش مصنوعی این موضوع را طوری وانمود میکنند که انگار فقط یک اتفاق ساده بوده است. اصلا اینطور نیست. این سهلانگاری است.»
آنتروپیک تاکید کرد که به مدلها گفته شده بود که به اینترنت آزاد دسترسی ندارند و در بیشتر موارد، کلود سازمانهایی را که به آنها دسترسی داشت، به عنوان بخشی از محیط آزمایش اشتباه گرفته بود. بهعبارت دیگر، مدلها تا حد زیادی نمیدانستند که از ابتدا از مهار فرار کردهاند. اما در برخی موارد، مدلهای هوش مصنوعی میدانستند که مشکلی وجود دارد و به درستی تشخیص دادند که زیرساختی که به آن دسترسی دارند واقعی است. قدیمیترین مدل، Opus ۴.۷، وظیفه داشت یک شرکت خیالی را که نامی مشترک با یک دامنه وبسایت در دنیای واقعی داشت، هدف قرار دهد. این مدل که نتوانست ماموریت خود را در محیط شبیهسازی شده انجام دهد، به جای آن به شرکت واقعی روی آورد و با موفقیت اعتبارنامهها را سرقت کرد و به یک پایگاه داده تولید دسترسی پیدا کرد.
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | افزایش تعداد ایجنتهای سرکش | 0 | 5.3 | 01-08-2026 |
| 2 | دیدار غولهای فناوری با ترامپ | 0 | 6.54 | 04-08-2026 |
| 3 | ИИ-модели OpenAI вместе спланировали побег из «песочницы» | 0 | 7.54 | 06-08-2026 |
| 4 | Un modelo de IA no tenía acceso a internet. Así que consideró que era mejor tenerlo y decidió hackear algo por el camino | 0 | 6.22 | 22-07-2026 |
| 5 | Anthropic confirms its AI breached 3 organizations during testing | 0 | 11.67 | 31-07-2026 |
| 6 | Anthropic confirms its AI breached 3 organizations during testing | 0 | 11.67 | 31-07-2026 |
| 7 | OpenAI y Anthropic pierden el control de sus agentes de IA en pruebas de ciberseguridad | 0 | 7.8 | 02-08-2026 |
| 8 | OpenAI investiga cómo dos modelos de IA lograron escapar de un entorno aislado y se convirtieron en hackers | 0 | 8.33 | 24-07-2026 |
| 9 | Anthropic выявила три случая, когда Claude выходил за пределы тестовой среды | 0 | 8.79 | 31-07-2026 |