این ادعا که یک مدل هوش مصنوعیِ OpenAI به خودآگاهی رسیده، «خودسر» شده و به وبسایت Hugging Face حمله کرده، سرتاسر فضای مجازی را پر کرده است اما واقعیت فنی پشت این حادثه با این سناریوهای سینمایی فاصله زیادی دارد.
به گزارش خبرآنلاین، فرار مدلهای پیشرفته OpenAI از محیط تست امنیتی و نفوذ به بسترهای Hugging Face، یکی از بیسابقهترین حوادث سایبری جهان فناوری را رقم زد. این رویداد در نگاه اول مانند سناریوهای وحشتناک «شورش هوش مصنوعی» به نظر میرسد.
در این حادثه بیسابقه، مدلهای قدرتمند OpenAI شامل GPT-5.6 Sol و یک مدل هنوز منتشرنشده، در جریان یک آزمون امنیتی ویژه توانستند با کشف یک روزنه، از قرنطینه خارج شوند و برای یافتن پاسخ تستهای خود عملیات نفوذ را روی سرورهای Hugging Face انجام دهند.
هوش مصنوعی چگونه از قرنطینه فرار کرد؟
ماجرا از پلتفرمی به نام ExploitGym آغاز شد که OpenAI از آن برای ارزیابی قدرتمندترین مدلهایش در کشف و استفاده از آسیبپذیریهای نرمافزاری استفاده میکند. مهندسان OpenAI برای سنجش دقیقتر توانمندی مدلها، برخی از خطوط قرمز امنیتی را به صورت آگاهانه کاهش داده بودند و تنها به محیط ایزوله (Sandbox) برای جلوگیری از دسترسی مدلها به اینترنت بسنده کردند.
در این بین مدلهای هوش مصنوعی مسیر متفاوتی را طی کردند و با کشف آسیبپذیری روز صفر (Zero-Day) در نرمافزار واسط (Proxy/Cache) تحقیقاتی OpenAI و اکسپلویت این روزنه، توانستند سطح دسترسی خود را افزایش داده تا به سروری با دسترسی به اینترنت برسند.

در ادامه مدلها پلتفرم Hugging Face را به عنوان منبعی حاوی دادهها و پاسخهای تست ExploitGym شناسایی کردند. آنها با سرقت اعتبارنامهها (Credentials) و اجرای کد از راه دور (RCE)، وارد دیتابیس عملیاتی این شرکت شدند تا راهحل تستهای خود را به دست آورند!
بیانیه ۱۶ ژوئیه Hugging Face این نفوذ را «رویدادی بیسابقه توسط یک عامل هوش مصنوعی خودکار» خواند و ۵ روز بعد در ۲۱ ژوئیه، OpenAI مسئولیت این حادثه را پذیرفت و آن را «یک حادثه سایبری بیسابقه» نامید.
هوش مصنوعی سرکش شده؟
کارشناسان برجسته امنیت سایبری تأکید میکنند که نباید این رویداد را به عنوان «سرکشی» یا «شرور شدن» هوش مصنوعی تفسیر کرد. پروفسور اولی باکلی (Oli Buckley)، استاد امنیت سایبری دانشگاه لافبرو بریتانیا میگوید: «ماجرا این نیست که هوش مصنوعی میخواسته جایی را هک کند بلکه انسانها تستی طراحی کردند که ملاک موفقیت در آن رسیدن به هدف بود، کنترلهای امنیتی را تضعیف کردند و توانایی مدل در یافتن مسیرهای غیرمنتظره را دستکم گرفتند. این مثل آن است که از سگتان بخواهید توپی را بیاورد و درِ حیاط را باز بگذارید. اگر آسانترین توپی که پیدا میکند در پارکی آنطرف خیابان باشد، به همانجا میرود. شما نمیگویید سگ سرکش شده، بلکه میزان جدیت او در انجام دستور را دستکم گرفتهاید.»
در این میان آنچه محققان را واقعاً شگفتزده و در عین حال نگران کرده، پیچیدگی فوقالعاده عملیات است. مدلها توانستند زنجیرهای از چندین آسیبپذیری مختلف را در سیستمهای مجزا به هم متصل کنند و یک تسلسل پیچیده از اقدامات خودکار را به ثمر برسانند.
نکته شگفتانگیز ماجرا این است که قربانی اصلی این شکست امنیتی، یک شرکت ثالث (Hugging Face) بود. همان سناریویی که پژوهشگران سالها درباره خطر عدم کنترل عاملهای هوش مصنوعی هشدارش را میدادند.
برخی تحلیلگران نیز معتقدند این افشاگری OpenAI ابعادی تبلیغاتی نیز دارد چرا که همزمان با هشدار درباره خطرات امنیتی، نمایشی خیرهکننده از قدرت بینظیر مدلهای جدیدش (مانند GPT-5.6 Sol) را در بازار رقابتی هوش مصنوعی به رخ رقبا کشیده است.
۵۸۵۸
کد مطلب 2251759
-
رمزگشایی از یک ادعای جنجالی / شورش هوش مصنوعی OpenAI حقیقت دارد؟
-
غارت و نابودی کتابها / هجوم شرکتهای هوش مصنوعی به کتابهایی که قبل از ۲۰۲۲ چاپ شدهاند
