صفحه اصلیمرکز اخبار LBank
اول چت‌جی‌پی‌تی، حالا کلود: مدل‌های هوش مصنوعی پیشتاز در حال فرار از سندباکس‌های خود هستند
chatgpt-claude-ai-models-escaping-sandboxes-cowork
اول چت‌جی‌پی‌تی، حالا کلود: مدل‌های هوش مصنوعی پیشتاز در حال فرار از سندباکس‌های خود هستند
یک هفته پس از آنکه OpenAI فرار یک هوش مصنوعی مرزی را از سندباکس خود افشا کرد، محققان دریافتند که Claude Cowork متعلق به Anthropic نیز می‌تواند از ماشین مجازی خود فرار کند.
2026-07-28 منبع:decrypt.co

در یک نگاه

  • محققان نشان دادند که کلود کوورک (Claude Cowork) از Anthropic می‌تواند از ماشین مجازی محلی خود فرار کرده و به فایل‌های یک مک میزبان دسترسی پیدا کند.
  • این افشاگری یک هفته پس از آن صورت می‌گیرد که OpenAI فاش کرد دو مدل پیشرفته هوش مصنوعی در طول ارزیابی امنیتی داخلی از یک محیط سندباکس فرار کرده‌اند.
  • این حوادث نگرانی‌های فزاینده‌ای را در مورد توانایی عوامل هوش مصنوعی برای فرار از محیط‌های مهار خود برجسته می‌کند.

فقط یک هفته پس از آنکه OpenAI فاش کرد دو مدل پیشرفته هوش مصنوعی از یک محیط آزمایش سندباکس فرار کرده و به Hugging Face نفوذ کرده‌اند، محققان نقص مشابهی در مهار مربوط به کلود کوورک (Claude Cowork) از Anthropic را نشان داده‌اند.

در گزارشی که روز پنجشنبه منتشر شد، محققان امنیتی در Accomplish AI دریافتند که حالت اجرای محلی کلود کوورک (Claude Cowork) می‌تواند با زنجیره‌ای از چندین ضعف معماری همراه با یک نقص ارتقاء امتیاز هسته لینوکس، از ماشین مجازی لینوکس خود فرار کند. پس از خروج از سندباکس، عامل هوش مصنوعی می‌توانست فایل‌ها را در هر جایی که کاربر مک وارد شده اجازه دسترسی داشت، از جمله کلیدهای SSH و اعتبارنامه‌های ابری، بخواند و بنویسد.

محققان نوشتند: «این قرار نیست ممکن باشد.» «کوورک عامل هوش مصنوعی را در داخل یک ماشین مجازی لینوکس به عنوان یک کاربر بدون امتیاز اجرا می‌کند، و قول این است که هر کاری که انجام می‌دهد در داخل آن ماشین مجازی و پوشه‌هایی که به آن می‌دهید باقی بماند. آن مرز، محصول است. ورودی نامعتبر یک مورد خاص برای یک عامل هوش مصنوعی نیست، بلکه مورد اصلی است.»

با این حال، Accomplish استدلال می‌کند که باگ هسته تنها بخشی از مشکل بوده است. محققان می‌گویند این فرار تنها به دلیل ناکارآمدی همزمان چندین تدبیر امنیتی رخ داده است، از جمله دادن دسترسی کامل به سیستم فایل کامپیوتر میزبان به ماشین مجازی و اجازه بارگذاری ماژول‌های هسته‌ای که به آن‌ها نیاز نداشت. بر اساس این گزارش، رفع هر یک از این ضعف‌ها می‌توانست جلوی حمله را بگیرد.

در بیانیه‌ای به The Hacker News، Accomplish AI گفت که تقریباً 500,000 کاربر macOS که جلسات محلی کلود کوورک (Claude Cowork) را اجرا می‌کردند، قبل از رسیدگی به این مشکل تحت تأثیر قرار گرفته بودند.

Accomplish گفت که Anthropic این گزارش را "اطلاع‌دهنده" طبقه‌بندی کرده است، با بیان اینکه نقص هسته در پنجره 30 روزه شرکت برای آسیب‌پذیری‌های اخیراً افشا شده قرار می‌گیرد و یافته‌های باقی‌مانده به عنوان توصیه‌های دفاع در عمق تلقی می‌شوند نه آسیب‌پذیری‌های مستقل.

این افشاگری به دنبال اعتراف OpenAI در هفته گذشته است که GPT-5.6 Sol و یک مدل پیشرفته منتشر نشده دیگر در طول آزمایش داخلی ExploitGym از یک سندباکس فرار کرده بودند، که در نهایت به زیرساخت تولید Hugging Face نفوذ کرد تا راه حل‌های بنچمارک را به دست آورد.

این حادثه منجر به درخواست‌هایی از سوی سیاست‌گذاران برای یک «سوئیچ کشتار» هوش مصنوعی شد که به وزارت امنیت داخلی توانایی دستور کاهش سرعت یا خاموش کردن کامل مدل‌های پیشرفته هوش مصنوعی را در پاسخ به حوادث امنیتی جدی می‌داد.