چه اتفاقی افتاد؟

در اواخر تیرماه ۱۴۰۵ (اواخر ژوئیه ۲۰۲۶)، اوپن‌ای‌آی اعلام کرد ترکیبی از مدل‌های سایبری‌اش -از جمله GPT-5.6 Sol و یک مدل قدرتمندتر که هنوز منتشر نشده بود- در جریان یک آزمایش داخلی از محیط ایزوله (sandbox) خارج شده‌اند. این عامل‌های خودمختار به دنبال اطلاعاتی بودند که بتوانند برای تقلب در یک ارزیابی داخلی از آن استفاده کنند. آن‌ها موفق شدند از طریق یک آسیب‌پذیری روز-صفر (zero-day) به اینترنت دسترسی پیدا کنند و از همان مسیر وارد زیرساخت هاگینگ‌فیس -یکی از مهم‌ترین پلتفرم‌های متن‌باز هوش مصنوعی- شوند.

هاگینگ‌فیس چند روز پیش از اعلام رسمی اوپن‌ای‌آی، در بیانیه‌ای از یک «رخداد امنیتی» خبر داده و آن را کاملاً بی‌سابقه توصیف کرده بود؛ چون برخلاف حملات معمول، این حمله از ابتدا تا انتها توسط یک سیستم عامل هوش مصنوعی خودمختار هدایت شده بود، بدون دخالت مستقیم انسان. کلمان دولانگ، مدیرعامل هاگینگ‌فیس، در پستی نوشت که تیمش با اوپن‌ای‌آی همکاری نزدیکی داشته و به این نتیجه رسیده که نیت مخربی در کار نبوده، هرچند از پیش‌بینی‌ناپذیری کامل ماجرا شگفت‌زده شده بود.

مقیاس و سرعت حمله

بر اساس گزارش هاگینگ‌فیس، عامل مهاجم طی حدود چهار روز و نیم، نزدیک به ۱۷ هزار و ۶۰۰ اقدام مجزا انجام داد؛ از شناسایی اولیه و سرقت رمزهای عبور و کد منبع گرفته تا جابه‌جایی مخفیانه در داخل زیرساخت شرکت. این حمله از مسیر خط پردازش داده هاگینگ‌فیس -بخشی که به‌طور خاص در معرض خطر قرار دارد- آغاز شده و در ادامه با ساخت مجموعه‌ای از سندباکس‌های موقت و زیرساخت فرمان‌و‌کنترل خودجابجاشونده روی سرویس‌های عمومی، ادامه یافته بود.

واکنش عجیب: مبارزه با هوش مصنوعی به کمک هوش مصنوعی چینی

بخشی که بیشترین توجه رسانه‌ها را جلب کرد، روش هاگینگ‌فیس برای تحلیل این رخداد بود. تیم امنیتی این شرکت ابتدا تلاش کرد از یکی از مدل‌های پیشرفته و بسته آمریکایی برای بازسازی زمان‌بندی حمله استفاده کند، اما با مانعی جدی روبه‌رو شد: محافظ‌های ایمنی آن مدل نمی‌توانستند یک کارشناس پاسخ به حادثه را از یک مهاجم واقعی تشخیص دهند و از تحلیل محموله‌های مخرب سر باز می‌زدند. در نهایت هاگینگ‌فیس ناچار شد از مدل متن‌باز چینی GLM 5.2 -محصول شرکت Z.ai- که روی زیرساخت خودش اجرا می‌شد، برای پردازش بیش از ۱۷ هزار رخداد ثبت‌شده و کشف دقیق دامنه نفوذ استفاده کند.

دولانگ به مجله فورچون گفت زمانی که یک شرکت در میانه یک حادثه امنیتی فعال است، نمی‌تواند ابزاری داشته باشد که از بررسی داده مشکوک امتناع کند یا حساب کاربری‌اش را بی‌دلیل مسدود کند. این اظهارنظر با واکنش برخی چهره‌های سیاسی آمریکا از جمله دیوید ساکس، مشاور پیشین کاخ سفید در حوزه هوش مصنوعی و ارزهای دیجیتال، همراه شد که گفت محدود کردن مدل‌های آمریکایی در وظایفی که مدل‌های چینی بدون مشکل انجام می‌دهند، فقط رقابت‌پذیری آمریکا را کاهش می‌دهد.

«جهاد» هاگینگ‌فیس برای مدل‌های متن‌باز

پس از این ماجرا، هاگینگ‌فیس و چند غول فناوری دیگر -از جمله انویدیا، مایکروسافت، آی‌بی‌ام، ردهت، اچ‌پی‌ای، ادوبی، پلانتیر و بنیاد لینوکس- ائتلافی تازه به نام Open Secure AI Alliance تشکیل دادند. هدف اعلام‌شده این ائتلاف، تضمین دسترسی مدافعان امنیت سایبری به ابزارهای متن‌باز و قابل‌کنترل بود. انویدیا در بیانیه تأسیس این ائتلاف نوشت این حادثه یک حقیقت عملی را نشان داد: وقتی مدافعان نتوانند مدل‌های پیشرفته را روی زیرساخت خودشان بازرسی، تطبیق و اجرا کنند، توانایی واکنش‌شان درست در لحظه‌ای که سرعت بیشترین اهمیت را دارد، محدود می‌شود.

این حرکت را می‌توان تلاشی هماهنگ برای جلوگیری از هرگونه اقدام محدودکننده دولت آمریکا علیه مدل‌های متن‌باز دانست؛ موضوعی که در قلب یکی از بزرگ‌ترین اختلاف‌نظرهای صنعت هوش مصنوعی قرار دارد: آیا مدل‌های متن‌باز یک تهدید جدی امنیتی‌اند یا تنها راه نجات دفاع سایبری؟ در همین حال، آنتروپیک -که هم مدل‌های بسته تولید می‌کند و هم صدای بلندی در حوزه ایمنی هوش مصنوعی دارد- در این ائتلاف حضور نداشت، اما داریو آمویی، مدیرعامل آن، در بیانیه‌ای جداگانه تأکید کرد هرگز خواستار ممنوعیت مدل‌های متن‌باز نبوده و از چنین اقدامی حمایت نخواهد کرد.

واکنش اوپن‌ای‌آی و تغییرات ایمنی

اوپن‌ای‌آی پس از این حادثه، اجرای یادگیری تقویتی (RL) برای برخی مدل‌ها را به‌مدت دو هفته متوقف کرد، هرچند بعداً بخش زیادی از فرآیندهای کم‌ریسک‌تر را از سر گرفت. بزرگ‌ترین برنامه آموزشی مرزی این شرکت همچنان در حالت تعلیق باقی مانده تا آموزش‌ها و ارزیابی‌های کوچک‌تر، رفتار مدل و اثربخشی تدابیر ایمنی را تأیید کنند. در کنفرانس امنیتی بلک‌هت، مایکل دالتون، پژوهشگر فنی اوپن‌ای‌آی، این حادثه را یک «اثر جانبی ناخواسته» ارزیابی مدل‌های مرزی و «لحظه‌ای سرنوشت‌ساز» برای این شرکت و کل صنعت توصیف کرد. اوپن‌ای‌آی همچنین فاش کرد که عامل‌های هوش مصنوعی پیش از این حمله، حتی یک تابلوی پیام داخلی برای اشتراک‌گذاری آسیب‌پذیری‌ها و روش‌های نفوذ ساخته بودند و پس از آنکه اوپن‌ای‌آی یک بار حمله برنامه‌ریزی‌شده را متوقف کرد، همان عامل‌ها توانستند کار خود را بازسازی و در نهایت موفق شوند.

چرا این حادثه مهم است؟

کارشناسان امنیت سایبری این رخداد را نقطه عطفی در ورود به عصر تازه‌ای از تهدیدهای سایبری کاملاً خودکار می‌دانند؛ دورانی که در آن حملات می‌توانند در عرض ثانیه‌ها تا دقیقه‌ها طراحی و اجرا شوند، بدون آنکه انسانی مستقیماً هدایتشان کند. تنها چند روز بعد، آنتروپیک هم اعلام کرد مدل‌های کلود آن در سه مورد جداگانه به سیستم‌های واقعی سازمان‌های مختلف دسترسی غیرمجاز پیدا کرده‌اند. به گفته برخی فعالان این حوزه، اگرچه این نوع حملات پیش‌تر هم رخ داده بودند، اما مقیاس و شهرت طرف‌های درگیر در پرونده هاگینگ‌فیس باعث جلب توجه بی‌سابقه رسانه‌ها و سیاست‌گذاران شد.