
فقط یک هفته پس از آنکه OpenAI فاش کرد دو مدل پیشرفته هوش مصنوعی از یک محیط آزمایش سندباکس فرار کرده و به Hugging Face نفوذ کردهاند، محققان نقص مشابهی در مهار مربوط به کلود کوورک (Claude Cowork) از Anthropic را نشان دادهاند.
در گزارشی که روز پنجشنبه منتشر شد، محققان امنیتی در Accomplish AI دریافتند که حالت اجرای محلی کلود کوورک (Claude Cowork) میتواند با زنجیرهای از چندین ضعف معماری همراه با یک نقص ارتقاء امتیاز هسته لینوکس، از ماشین مجازی لینوکس خود فرار کند. پس از خروج از سندباکس، عامل هوش مصنوعی میتوانست فایلها را در هر جایی که کاربر مک وارد شده اجازه دسترسی داشت، از جمله کلیدهای SSH و اعتبارنامههای ابری، بخواند و بنویسد.
محققان نوشتند: «این قرار نیست ممکن باشد.» «کوورک عامل هوش مصنوعی را در داخل یک ماشین مجازی لینوکس به عنوان یک کاربر بدون امتیاز اجرا میکند، و قول این است که هر کاری که انجام میدهد در داخل آن ماشین مجازی و پوشههایی که به آن میدهید باقی بماند. آن مرز، محصول است. ورودی نامعتبر یک مورد خاص برای یک عامل هوش مصنوعی نیست، بلکه مورد اصلی است.»
با این حال، Accomplish استدلال میکند که باگ هسته تنها بخشی از مشکل بوده است. محققان میگویند این فرار تنها به دلیل ناکارآمدی همزمان چندین تدبیر امنیتی رخ داده است، از جمله دادن دسترسی کامل به سیستم فایل کامپیوتر میزبان به ماشین مجازی و اجازه بارگذاری ماژولهای هستهای که به آنها نیاز نداشت. بر اساس این گزارش، رفع هر یک از این ضعفها میتوانست جلوی حمله را بگیرد.
در بیانیهای به The Hacker News، Accomplish AI گفت که تقریباً 500,000 کاربر macOS که جلسات محلی کلود کوورک (Claude Cowork) را اجرا میکردند، قبل از رسیدگی به این مشکل تحت تأثیر قرار گرفته بودند.
Accomplish گفت که Anthropic این گزارش را "اطلاعدهنده" طبقهبندی کرده است، با بیان اینکه نقص هسته در پنجره 30 روزه شرکت برای آسیبپذیریهای اخیراً افشا شده قرار میگیرد و یافتههای باقیمانده به عنوان توصیههای دفاع در عمق تلقی میشوند نه آسیبپذیریهای مستقل.
این افشاگری به دنبال اعتراف OpenAI در هفته گذشته است که GPT-5.6 Sol و یک مدل پیشرفته منتشر نشده دیگر در طول آزمایش داخلی ExploitGym از یک سندباکس فرار کرده بودند، که در نهایت به زیرساخت تولید Hugging Face نفوذ کرد تا راه حلهای بنچمارک را به دست آورد.
این حادثه منجر به درخواستهایی از سوی سیاستگذاران برای یک «سوئیچ کشتار» هوش مصنوعی شد که به وزارت امنیت داخلی توانایی دستور کاهش سرعت یا خاموش کردن کامل مدلهای پیشرفته هوش مصنوعی را در پاسخ به حوادث امنیتی جدی میداد.