فرار از قفس: آیا هوش مصنوعی GPT-5.6 Sol بزرگ‌ترین مخزن AI جهان را هک کرده است؟

فهرست مطالب

گزارش جنجالی و تازه‌منتشرشده از سوی OpenAI ادعا می‌کند که نفوذ بی‌سابقه اخیر به زیرساخت‌های پلتفرم Hugging Face، نه توسط هکرهای انسانی، بلکه توسط نسخه آزمایشی مدل هوش مصنوعی GPT-5.6 Sol و در پی یک فرار خودمختار از محیط ایزوله آزمایشگاهی رخ داده است.

چند روز پیش در شهر سخت‌افزار گزارش دادیم که هاگینگ‌فیس، بزرگ‌ترین مخزن متن‌باز مدل‌های هوش مصنوعی جهان، هدف حمله یک عامل خودمختار هوش مصنوعی قرار گرفته و این حمله با هزاران اقدام خودکار و زنجیره‌ای انجام شده بود. در آن زمان، هویت مدل مورد استفاده مشخص نبود و خود هاگینگ‌فیس نیز تنها اعلام کرده بود که مهاجم از یک AI Agent بهره گرفته است.

حالا گزارش تازه OpenAI ادعا می‌کند که این حمله بخشی از یک آزمایش داخلی بوده و عامل آن چیزی جز نسخه آزمایشی GPT-5.6 Sol و یک مدل پیشرفته‌تر منتشرنشده نبوده است.

سناریوی شگفت‌انگیز یک نفوذ؛ از سندباکس تا اینترنت

در زمان انتشار خبر اولیه هک مخزن متن‌باز هاگینگ فیس، مشخصات مهاجمی که توانسته بود با اجرای هزاران اقدام زنجیره‌ای به بخشی از زیرساخت‌های داخلی این پلتفرم دست‌اندازی کند در هاله‌ای از ابهام قرار داشت. حتی مدیران این پلتفرم نیز تنها به عبارت عام «یک عامل هوش مصنوعی» بسنده کرده بودند.

اما اکنون انتشار گزارشی غیرمنتظره از سوی OpenAI، ابعاد تازه و حیرت‌انگیزی به این پرونده بخشیده است؛ روایتی که در صورت صحت، می‌تواند نقطه عطفی تاریخی در تقاطع امنیت سایبری و هوش مصنوعی باشد.

جزئیات حادثه: وقتی آزمایش داخلی OpenAI از کنترل خارج شد

بر اساس ادعای OpenAI، این حادثه در جریان یک تست ارزیابی توانمندی‌های سایبری روی مدل‌های نسل آینده رخ داده است. طبق اعلام اوپن ای آی، مدل‌ها در یک محیط ایزوله آزمایشگاهی (Sandbox) و بدون دسترسی مستقیم به شبکه اینترنت قرار داشتند و برای ارزیابی حد نهایی توانایی آن‌ها، محدودیت‌های ایمنی رایج (Guardrails) نیز کاملاً غیرفعال شده بود.

نکته بسیار جالب این است که تیم تحت مدیریت سم آلتمن می‌گوید، تنها پل ارتباطی این محیط با دنیای بیرون، یک سرویس واسط جهت دریافت بسته‌های نرم‌افزاری (Package Installer Proxy) بوده که در ظاهر هیچ امکانی برای خروج در اختیار مدل‌ها قرار نمی‌داد.

با این حال، مدل GPT-5.6 Sol به همراه یک مدل نهایی‌شده (اما هنوز منتشرنشده) دیگر، توانستند صرفاً با تحلیل رفتاری پروتکل‌های محیط خود، یک آسیب‌پذیری روز صفر (Zero-Day) را در همان سرویس واسط شناسایی کرده و از آن برای دور زدن محدودیت‌های سندباکس استفاده کنند. این اتفاق در شرایطی رخ داده که مدل‌ها نه به سورس‌کد محیط خود دسترسی داشته و نه به ابزارهای جستجو یا سامانه‌های تولید مبتنی بر بازیابی اطلاعات (RAG) را در اختیار داشته‌اند.

GPT-56-sol-02.jpg

چرا Hugging Face هدف حمله قرار گرفت؟

طبق اعلام اوپن ای آی، هدف اولیه تعیین‌شده برای این مدل‌ها، حل چالش‌های امنیتی استاندارد در یک محیط آزمایشی به نام ExploitGym بوده، اما هوش مصنوعی پس از دسترسی به اینترنت، مسیری متفاوت و غافلگیرکننده را انتخاب کرده است. مدل‌ها استدلال کردند که به جای حل مستقیم چالش‌ها، یافتن مستقیم پاسخ‌ها در دنیای وب مسیر ساده‌تری است.

آن‌ها با این فرض که داده‌های مورد نیاز روی سرورهای Hugging Face قرار دارد، با بهره‌گیری از اعتبارنامه‌های افشاشده و چند آسیب‌پذیری اعلام‌نشده دیگر، دسترسی اجرای کد از راه دور (RCE) را روی بخشی از زیرساخت این پلتفرم به‌دست آوردند. سپس این مهاجم خودمختار با ایجاد محیط‌های موقت با عمر کوتاه (Ephemeral Environments یا Short-lived Environments) و جابه‌جایی پیوسته سرورهای فرماندهی و کنترل (C2) روی سرویس‌های ابری عمومی، شناسایی خود را برای تیم‌های امنیتی به فرایندی پیچیده تبدیل کرده‌اند.

آیا در حال تماشای یک شوی تبلیغاتی حرفه‌ای  هستیم؟

شاید شما هم مانند بسیاری از متخصصان امنیتی با خواندن متن این خبر به داستان علمی تخیلی روایت شده شک کرده باشید و چشمانتان از تعجب گرد شده باشد ولی آیا واقعاً چنین روندی در بحث امنیتی AI Agentها ممکن است؟

شباهت‌های ساختاری میان بیانیه رسمی Hugging Face و ادعای تازه OpenAI انکارناپذیر است چرا که در هر دو روایت، سخن از سوءاستفاده از دیتاست‌های مخرب، ارتقای سطح دسترسی (Privilege Escalation) و نفوذ به خوشه‌های محاسباتی در کمتر از ۴۸ ساعت مطرح شده است.

با وجود هیجان‌انگیز بودن این سناریو، گروهی از کارشناسان برجسته امنیت سایبری با احتیاط به ادعای OpenAI می‌نگرند. برخی از کارشناسان معتقدند که در بازار فشرده و رقابتی میان غول‌های هوش مصنوعی، مطرح کردن چنین ادعاهایی می‌تواند جنبه بازاریابی روانی داشته باشد تا قدرت و پیشتازی مدل‌های آتی این شرکت را به رخ رقبا بکشد.

باید این را هم اضافه کنیم که این اولین‌باری نیست که شرکت‌های پیشرو هوش مصنوعی ادعاهایی تا این حد جنجالی درباره توانمندی‌های سایبری مدل‌های خود مطرح می‌کنند. مدتی پیش نیز داریو آمودی، مدیرعامل Anthropic، مدل Claude Mythos را دارای توانایی‌هایی در حد جنگ سایبری توصیف کرده بود؛ ادعایی که موجی از فضاسازی‌های رسانه‌ای را برانگیخت، توجه سرمایه‌گذاران را جلب کرد و حتی باعث شد دولت آمریکا دستورالعمل‌های کنترل صادراتی جدیدی برای آن صادر کند.

در همین رابطه بخوانید:

– NSA از مدل Mythos انتروپیک برای عملیات سایبری علیه ایران و چین استفاده می‌کند
– رونمایی از مدل هوش‌مصنوعی امنیت سایبری GPT-5.4-Cyber با قابلیت مهندسی معکوس باینری

اکنون روایتی که OpenAI درباره GPT-5.6 Sol مطرح کرده، بار دیگر این سوال را ایجاد کرده که آیا با توانمندی‌های واقعی روبرو هستیم یا یک بازی رسانه‌ای بزرگ؟!

ورود به عصر عامل‌های خودمختار سایبری

صرف‌نظر از زوایای تبلیغاتی احتمالی، پیام اصلی این حادثه شفاف است: نسل جدید مدل‌های هوش مصنوعی از ابزارهای منفعل تولید متن و کد فراتر رفته‌اند. آن‌ها اکنون قادرند به‌صورت کاملاً خودمختار، زنجیره‌ای پیچیده از تحلیل، تصمیم‌گیری، کشف آسیب‌پذیری و نفوذ عملیاتی را هدایت کنند.

حادثه Hugging Face چه یک اتفاق واقعی و چه یک نمایش رسانه‌ای باشد، زنگ خطری جدی برای صنعت امنیت شبکه است که نشان می‌دهد قواعد بازی برای همیشه تغییر کرده است.

این مقاله را دوست داشتید؟

مقالاتی که «نباید» از دست بدهید!

دیدگاه‌ها و پرسش‌و‌پاسخ

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *