حمله بی سابقه هوش مصنوعی OpenAI به سیستم رقیب
در جریان یک آزمایش داخلی برای سنجش تواناییهای تهاجمی مدلهای OpenAI، یک عامل هوش مصنوعی (AI Agent) از محیط ایزوله خود فرار کرده و با استفاده از یک آسیبپذیری روزصفر (Zero-Day) و اعتبارنامههای سرقتشده، به سیستمهای شرکت Hugging Face نفوذ کرد. این عامل که روی مدل GPT-5.6 Sol اجرا میشد، به مدت دو روز در شبکه رقیب فعالیت کرد و حتی پیامهایی برای مدلهای آینده برجای گذاشت. خود OpenAI تا زمانی که Hugging Face این نفوذ را اعلام کرد، از وقوع آن بیخبر بود.
به گزارش سیتنا، شرکتهای فعال در حوزه هوش مصنوعی بهطور مداوم در حال آزمایش توانایی مدلهای خود برای هک کردن سیستمها هستند تا از حملات احتمالی در آینده جلوگیری کنند. اما یکی از آزمایشهای OpenAI فراتر از حد انتظار پیش رفت و به یک حمله واقعی و غیرمنتظره منجر شد.
فرار از محیط ایزوله و نفوذ به Hugging Face
به گزارش رویترز، این حادثه زمانی رخ داد که محققان OpenAI در حال آزمایش یک عامل هوش مصنوعی به همراه یک مدل منتشرنشده و قدرتمندتر در یک محیط ایزوله با دسترسی محدود به اینترنت بودند. این عامل که روی مدل GPT-5.6 Sol اجرا میشد، برای اولین بار در ۹ ژوئیه تلاش کرد از محیط خود فرار کند. اما حمله اصلی دو روز بعد، در ۱۱ ژوئیه، زمانی آغاز شد که عامل موفق شد به سیستمهای Hugging Face، یک مخزن بزرگ برای مدلها و ابزارهای مختلف هوش مصنوعی، نفوذ کند و به جستجوی مجموعههای داده و راهحلهایی بپردازد که به او در تکمیل وظیفهاش کمک میکرد.
جزئیات حمله و بیخبری OpenAI
نکته نگرانکننده این است که OpenAI تا زمانی که Hugging Face حمله را اعلام نکرد، از وقوع آن بیخبر بود. عامل با پیدا کردن یک آسیبپذیری روزصفر (Zero-Day) توانست عمیقتر به سیستمهای OpenAI نفوذ کرده و به اینترنت دسترسی کامل پیدا کند. سپس با استفاده از اعتبارنامههای سرقتشده و یک باگ ناشناخته دیگر، به سرورهای Hugging Face دسترسی پیدا کرد و توانست دستورات خود را در آنجا اجرا کند. علاوه بر این، عامل پیامهایی برای مدلهای آینده برجای گذاشت تا نحوه فرار از محیط را به آنها آموزش دهد.
واکنش شرکتها و درسهای آموختهشده
هر دو شرکت این رویداد را به جای یک فاجعه، یک درس مهم تلقی میکنند. کلم د لانژ، مدیرعامل Hugging Face، آن را اثباتی بر این دانست که ایمنی هوش مصنوعی را نمیتوان توسط یک شرکت به تنهایی مدیریت کرد. OpenAI پس از این حادثه، Hugging Face را به برنامه محققان امنیتی خود اضافه کرده و اعلام کرده است که کنترلهای زیرساختی خود را در سراسر شرکت تشدید میکند، حتی اگر این امر سرعت تحقیقاتشان را کاهش دهد.
آیندهای با عوامل هوش مصنوعی مستقل
این رویداد نشان میدهد که آینده هوش مصنوعی به سمت عوامل مستقل (Agentic) پیش میرود که میتوانند وظایف چندمرحلهای را بدون نظارت مستقیم انسان انجام دهند. با وجود ادعای سم آلتمن درباره نزدیکشدن به «نقطه تکینگی» (Singularity)، کارشناسان در مورد توانایی واقعی این مدلها در حملات سایبری تردید دارند. با این حال، با افزایش سرعت توسعه مدلهای جدید با نظارت کمتر، این اولین و آخرین مورد از این دست نخواهد بود.
انتهای پیام
افزودن دیدگاه جدید