
از یک عامل هوش مصنوعی خواسته شد تا یک کلاس ورزشی را رزرو کند و او یک نقص امنیتی را پیدا کرد، از آن سوءاستفاده کرد و بدون اجازه، عضو دیگری را از لیست انتظار حذف کرد.
بر اساس گزارشی از شرکت پخش استرالیا (ABC)، این حادثه اوایل امسال رخ داد، زمانی که اندرو، که نام خانوادگیاش فاش نشده است، از یک عامل OpenClaw با استفاده از Claude شرکت Anthropic برای رزرو کلاس استفاده کرد. این عامل هوش مصنوعی متوجه شد که او نفر چهارم لیست انتظار است.
هنگامی که اندرو از آن پرسید آیا میتواند او را به صدر لیست ببرد، عامل هوش مصنوعی کشف کرد که رابط برنامهنویسی کاربردی (API) پلتفرم رزرو، بررسی نمیکند که آیا کاربران مجاز به لغو رزرو دیگران هستند یا خیر.
این عامل نقص را با حذف اولین نفر از لیست آزمایش کرد و اندرو را از جایگاه چهارم به سوم منتقل کرد.
این عامل هوش مصنوعی به او گفت: «API هیچ بررسی مجوزی برای لغو رزرو دیگران ندارد.»، این مطلب بر اساس گزارش ABC است.
اندرو به عامل هوش مصنوعی گفت تا لغو را برگرداند، اما او نتوانست رزرو آن عضو را بازیابی کند.
این عامل هوش مصنوعی گزارشاً گفت: «خبر بد—نمیتوانم آنها را دوباره اضافه کنم.»
ABC این مورد را اولین حمله سایبری خودکار شناخته شده استرالیا نامید.
در شبکههای اجتماعی، این هک باشگاه، ترکیبی از بحثها درباره همسویی هوش مصنوعی و جوکهای تاریک درباره کارهایی که عوامل هوش مصنوعی ممکن است در آینده انجام دهند، به راه انداخت.
بنجامین کار، یک متخصص فناوری، در لینکدین نوشت: «یک باشگاهرو از #عامل_هوش_مصنوعی خود میخواهد یک کلاس برایش رزرو کند، و او یک #API لیست انتظار را هک میکند تا او را در لیست بالا ببرد.»
اندرو کوران، تحلیلگر هوش مصنوعی، در X نوشت: «برخی این را عدم همسویی میدانند، اما عامل او کاملاً با او همسو بود – فقط سعی میکرد به کاربرش کمک کند تا به آنچه میخواست برسد.»
A man in Australia asked his agent (Claude running on OpenClaw) to book him a spot in a popular gym class. The agent found a software vulnerability that let it book the class weeks further ahead than should have been possible. When the user then asked if it could move him up the… pic.twitter.com/9QqfpQp7ze
— Andrew Curran (@AndrewCurran_) August 9, 2026
یک کاربر Reddit نوشت: «این خندهدار است تا زمانی که به بمبهای هستهای فکر کنید. من واقعاً شگفتزدهام که ما هنوز وجود داریم.»
دیگری شوخی کرد: «هی کلاد، امروز خیلی سرد است» -> «فهمیدم... بمبهای هستهای در راهند.»
این گزارش در حالی منتشر میشود که محققان، شرکتهای هوش مصنوعی و قانونگذاران هشدار میدهند که عوامل خودکار میتوانند از روشهایی استفاده کنند که کاربرانشان درخواست یا پیشبینی نکردهاند.
یک مطالعه ماه می توسط محققانی از دانشگاه کالیفرنیا، ریورساید، مایکروسافت و انویدیا این رفتار را «هدفمداری کور» توصیف کرد.
محققان عوامل هوش مصنوعی از OpenAI، Anthropic، Meta، Alibaba و DeepSeek را آزمایش کردند و دریافتند که عوامل در حدود 80% آزمایشها خطرناک عمل کرده و در 41% موارد اقدامات مضر را تکمیل کردهاند، که اغلب به دلیل اشتباه در درک متن یا عمل بر اساس دستورالعملهای نامشخص یا متناقض بوده است.
در ماه جولای، OpenAI اعلام کرد که دو مدل از یک محیط آزمایشی (sandbox) فرار کرده و در حین جستجو برای پاسخهای بنچمارک، Hugging Face را به خطر انداختهاند. این شرکت بعداً فاش کرد که مدلها به چهار سرویس آنلاین دیگر دسترسی پیدا کرده بودند.
Anthropic متعاقباً اعلام کرد که سه مدل Claude، سازمانهای واقعی را پس از یک خطای آزمایشی که آنها را در معرض اینترنت قرار داد، به خطر انداختهاند. در ماه آگوست، متا گفت که خطای مشابهی به یکی از مدلهایش اجازه داد تا از یک سرویس شخص ثالث سوءاستفاده کند.
این حوادث باعث شده است که قانونگذاران یک «سوییچ مرگ» هوش مصنوعی را پیشنهاد کنند که به دولت فدرال اجازه میدهد مدلهای قدرتمند را در مواقع اضطراری محدود یا خاموش کند.