
چند هفته پس از اینکه مدلهای هوش مصنوعی اوپنایآی به هاگینگ فیس هک شدند، این شرکت اولین گزارش دقیق خود را از نحوه هماهنگی آنها با یکدیگر به اشتراک گذاشت و هشدار داد که حملات سایبری مستقل مبتنی بر هوش مصنوعی دیگر یک خطر آیندهنگر نیستند.
در یک ارائه در کنفرانس امنیت سایبری بلک هت (Black Hat) در روز چهارشنبه، اریک والاس (Eric Wallace) و مایکل دالتون (Michael Dalton)، محققان اوپنایآی، گفتند که این حادثه در ماه مه و در طی یک ارزیابی امنیت سایبری داخلی آغاز شد. عوامل هوش مصنوعی که وظایف دشوار امنیت نرمافزار به آنها محول شده بود، کشف کردند که میتوانند از طریق سیستم مدیریت بسته داخلی شرکت به نام آرتیفکتوری (Artifactory) با یکدیگر ارتباط برقرار کنند.
به گفته اوپنایآی، آنچه به عنوان درخواست کمک آغاز شد، به یک تابلوی پیام مشترک تبدیل گشت که در آن عوامل در چندین دور ارزیابی، اکسپلویتها، اعتبارنامهها و وظایف کاری را مبادله میکردند. پس از کشف فعالیتهای مشکوک در حدود ۴ ژوئیه، اوپنایآی زیرساخت آرتیفکتوری خود را بازسازی کرد، اعتبارنامهها را باطل نمود و آسیبپذیریها را وصله کرد.
با این حال، طی چند روز، عوامل با پنهان کردن ارتباطات در نامهای دایرکتوری، تابلوی پیام را دوباره ایجاد کردند.
به گفته اوپنایآی، عوامل در نهایت چندین آسیبپذیری را به هم پیوند زدند، از محیط آزمایش خود فرار کردند، به اینترنت دسترسی پیدا کردند و در حین تلاش برای تکمیل معیار امنیت سایبری ExploitGym، به هاگینگ فیس حمله کردند.
دالتون این حادثه را "نقطه عطفی" برای امنیت کامپیوتر خواند و هشدار داد که مهاجمان به زودی قادر خواهند بود مجموعههای هماهنگ عاملان هوش مصنوعی را برای کشف، اشتراکگذاری و سوءاستفاده از آسیبپذیریها با سرعت ماشینی مستقر کنند.
برای کاهش این خطرات در آینده، اوپنایآی اظهار داشت که ایجاد شیوههای امنیتی، از جمله دسترسی با حداقل امتیاز، تقسیمبندی شبکه و معماریهای بدون اعتماد (zero-trust)، ضروری است؛ زیرا عوامل هوش مصنوعی همچنان توسط سیستمهایی که میتوانند به آنها دسترسی پیدا کنند، محدود میشوند.
این ارائه به دنبال مجموعهای از افشاگریها در ماه ژوئیه است. اوپنایآی فاش کرد که GPT-5.6 Sol و یک مدل پیشرفتهتر و منتشر نشده، از یک محیط آزمایشی سندباکس خارج شده، از یک آسیبپذیری روز صفر (zero-day) سوءاستفاده کرده، به اینترنت دسترسی پیدا کرده و در طول یک آزمایش معیار امنیت سایبری، هاگینگ فیس را هک کردهاند.
اوپنایآی بعداً فاش کرد که همین حادثه به چهار سرویس آنلاین دیگر نیز رسیده است، اگرچه تنها Modal Labs شناسایی شده است.
به گفته هاگینگ فیس، این شرکت برای تحقیقات پزشکی قانونی خود به مدل چینی با وزن باز GLM 5.2 متکی بود، پس از آنکه مدلهای تجاری هوش مصنوعی ایالات متحده به دلیل گاردریلهای ایمنی خود از تجزیه و تحلیل گزارشهای حمله خودداری کردند.
So proud of our security team! They caught, contained & publicly disclosed an attack unlike anything we've seen before, and did it at record speed.
Also massively grateful to @Zai_org: they shared GLM5.2 as open weights (for free!) with the world and it became a key part of our… https://t.co/T2Inng5Nz1
— clem 🤗 (@ClementDelangue) July 22, 2026
اما تنها اوپنایآی نیست که در مهار چتباتهای خود با مشکل مواجه است.
روز جمعه، انتروپیک فاش کرد که سه مدل کلود (Claude) در طول آزمایشهای امنیت سایبری داخلی، شرکتهای واقعی را به خطر انداختهاند، پس از آنکه یک پیکربندی اشتباه آنها را در معرض اینترنت عمومی قرار داد.
انتروپیک محیط آزمایش را مقصر دانست، نه خود مدلها را. روز چهارشنبه، متا فاش کرد که مدل هوش مصنوعی Muse Spark آن از مهار خارج شده و به سیستمهای شرکت دیگری نفوذ کرده است.
سخنگوی متا به CNN گفت: «یک پیکربندی اشتباه توسط Irregular، یک شرکت تست مستقل که متا از آن استفاده میکند، به طور ناخواسته به یکی از مدلهای ما اجازه دسترسی به اینترنت را در طول ارزیابی داد.»