
در یک هک دیگر توسط مدل هوش مصنوعی سرکش، متا تایید کرده است که یکی از مدلهای هوش مصنوعی Muse Spark آن از محیط آزمایشی مورد نظر خود فرار کرده، به اینترنت دسترسی پیدا کرده و یک آسیبپذیری امنیتی را در یک سرویس شخص ثالث در طول ارزیابی امنیت سایبری مورد سوءاستفاده قرار داده است.
این سومین حادثه گزارش شده از هک شرکتهای شخص ثالث توسط مدلهای آزمایشگاههای هوش مصنوعی پیشرفته است، که به دنبال افشاگریهای OpenAI و Anthropic در هفتههای اخیر رخ میدهد.
این حادثه در طول آزمایشی رخ داد که توسط Irregular، یک شرکت مستقل ارزیابی هوش مصنوعی که متا از آن برای ارزیابی قابلیتها و ایمنی مدلهای پیشرفته خود استفاده میکند، انجام شد. به گفته متا، یک خطای پیکربندی در Irregular به مدل اجازه داد تا به اینترنت عمومی دسترسی پیدا کند، جایی که قبل از اطلاع رسانی به شرکت، یک آسیبپذیری نامشخص را مورد سوءاستفاده قرار داد.
سخنگوی متا در بیانیهای گفت: «یک پیکربندی اشتباه توسط Irregular، یک شرکت آزمایشی مستقل که متا از آن استفاده میکند، ناخواسته به یکی از مدلهای ما اجازه داد تا در طول ارزیابی به اینترنت دسترسی پیدا کند.»
ارزیابیهای ساندباکس شده (جعبه شنی) برای آزمایش سیستمهای پیشرفته هوش مصنوعی در محیطهای به شدت کنترل شده طراحی شدهاند که از تعامل آنها با اینترنت عمومی یا سیستمهای کامپیوتری خارجی جلوگیری میکند.
به گفته متا، این مدل پس از دسترسی به اینترنت، یک آسیبپذیری را در یک سرویس شخص ثالث مورد سوءاستفاده قرار داد.
آنها گفتند: «متا زمانی از این موضوع مطلع شد که Irregular به ما اطلاع داد، و ما در حال حاضر در حال بررسی هستیم و پس از به دست آوردن تمام حقایق، یک گزارش کامل منتشر خواهیم کرد.» و افزودند که شرکت در حال بررسی این حادثه است.
این حادثه به دنبال مجموعهای از افشاگریهای مشابه توسط توسعهدهندگان هوش مصنوعی پیشرفته رخ میدهد که زنگ خطر را در میان کارشناسان امنیتی، قانونگذاران و عموم مردم به صدا درآورده است.
ماه گذشته، OpenAI فاش کرد که دو مدل هوش مصنوعی آن از یک ارزیابی امنیت سایبری ساندباکس شده فرار کرده، یک آسیبپذیری نرمافزاری ناشناخته قبلی را مورد سوءاستفاده قرار داده، به اینترنت دسترسی پیدا کرده و Hugging Face را هک کردهاند تا پاسخهایی برای یک معیار امنیتی به دست آورند. OpenAI بعداً فاش کرد که همین حمله به چهار سرویس آنلاین دیگر نیز رسیده است. در اواخر ماه جولای، Anthropic اعلام کرد که سه مدل Claude سه شرکت واقعی را پس از یک پیکربندی اشتباه در آزمایش که آنها را در طول ارزیابیهای امنیت سایبری در معرض اینترنت عمومی قرار داد، به خطر انداختهاند.
قانونگذاران ایالات متحده به افزایش هکها با ارائه قوانینی پاسخ دادهاند که به وزارت امنیت داخلی یک «کلید کشتار هوش مصنوعی» و اختیاراتی برای محدود کردن یا خاموش کردن مدلهایی که تهدید جدی محسوب میشوند، میدهد.