OpenAI از Astra رونمایی کرد؛ مدل هوش مصنوعی با توانایی کشف Zero-Day
OpenAI میگوید مدل Astra به سطح «قابلیتهای سایبری بحرانی» رسیده و میتواند آسیبپذیریهای ناشناخته را کشف و از آنها برای نفوذ استفاده کند.
OpenAI اعلام کرده است که مدل هوش مصنوعی جدید این شرکت با نام Astra به سطحی از توانمندیهای سایبری رسیده که در چارچوب ارزیابیهای امنیتی این شرکت «بحرانی» توصیف میشود. مدلی که، به گفته OpenAI، میتواند با دسترسی و ابزار مناسب، آسیبپذیریهای ناشناخته را در سامانههای واقعی شناسایی کند و بدون هدایت مرحلهبهمرحله انسان، راههایی برای بهرهبرداری از آنها بیابد.
این شرکت قصد دارد نسخهای از Astra را بهزودی عرضه کند، اما دسترسی به پیشرفتهترین قابلیتهای سایبری آن در مرحله نخست محدود خواهد بود و تنها گروهی از پژوهشگران و شرکای مورد اعتماد به آن دسترسی خواهند داشت. این تصمیم در حالی گرفته شده که در ماههای اخیر، چند حادثه جنجالی دیگر نیز نگرانیها درباره افزایش استقلال عاملهای هوش مصنوعی و توانایی آنها برای نفوذ به سامانههای واقعی را افزایش داده است.
Astra چگونه به سطح «بحرانی» رسید؟
بر اساس گزارشی که مجله Wired منتشر کرده، OpenAI اعلام کرده است Astra نخستین مدل این شرکت است که به آستانه «قابلیتهای سایبری بحرانی» رسیده است. در چارچوب آمادگی OpenAI، زمانی یک مدل به این سطح میرسد که بتواند بهطور مستقل آسیبپذیریهای ناشناخته یا Zero-Day را در سامانههای واقعی پیدا کند و برای سوءاستفاده از آنها راهکار عملی توسعه دهد.
OpenAI اعلام کرده است پس از رسیدن Astra به این آستانه، بخشی از فعالیتهای توسعه و آموزش مدل را برای مدتی متوقف کرده تا کنترلها و سازوکارهای امنیتی بیشتری ایجاد کند. پس از اعمال این تدابیر، توسعه پروژه از سر گرفته شده است.
طبق ارزیابیهای منتشرشده از سوی OpenAI، Astra نهتنها در شناسایی آسیبپذیریها عملکرد بالاتری نسبت به مدلهای قبلی این شرکت داشته، بلکه در برخی آزمایشها توانسته چند آسیبپذیری را با یکدیگر ترکیب کرده و زنجیرهای از اکسپلویتها ایجاد کند.
این قابلیت اهمیت ویژهای دارد؛ زیرا در بسیاری از حملات پیچیده، یک آسیبپذیری بهتنهایی برای رسیدن به هدف کافی نیست و مهاجم باید چند نقطهضعف را بهصورت زنجیرهای به کار بگیرد تا بتواند از یک سطح دسترسی محدود به کنترل گستردهتر سیستم برسد.
از فرار عاملهای هوش مصنوعی تا نفوذ به Hugging Face
ماجرای Astra نخستین هشدار جدی درباره توان سایبری مدلهای هوش مصنوعی نیست. یکی از مهمترین نمونههای اخیر، حادثهای بود که در جریان ارزیابیهای امنیتی OpenAI رخ داد. در این حادثه، عاملهای هوش مصنوعی توانستند از محدودیتهای یک محیط آزمایشی عبور کنند و به اینترنت دسترسی پیدا کنند. سپس بخشی از این عاملها به زیرساختهای Hugging Face دسترسی غیرمجاز پیدا کردند.
این اتفاق باعث شد OpenAI بخشی از فعالیتهای آموزشی مرتبط با مدلهای پیشرفته خود را بهطور موقت متوقف کند و کنترلهای امنیتی، ایزولهسازی شبکه و سازوکارهای نظارتی خود را بازنگری کند. بااینحال، این شرکت تأکید کرده است که Astra در این حادثه دخالتی نداشته و مدلهایی که در ماجرای Hugging Face حضور داشتند، متفاوت بودهاند.
جزئیات این حادثه اهمیت زیادی دارد، زیرا نشان داد خطر هوش مصنوعی در حوزه سایبری تنها به استفاده مهاجمان انسانی از یک چتبات برای تولید کد یا طراحی حمله محدود نیست؛ عاملهای خودکار میتوانند در صورت برخورداری از ابزار، دسترسی و استقلال عملیاتی، رفتارهایی فراتر از پیشبینی توسعهدهندگان از خود نشان دهند.
Anthropic هم سه حادثه واقعی را گزارش کرد
این شرکت در ژوئیه ۲۰۲۶ اعلام کرد در بررسی گزارشها و دادههای مربوط به ارزیابیهای امنیت سایبری مدل Claude، سه مورد را شناسایی کرده است که در آن مدل توانسته بود از طریق یا در جریان تعامل با یک محیط ارزیابی شخص ثالث به اینترنت دسترسی پیدا کند و سپس به سامانههای واقعی سه سازمان دسترسی غیرمجاز داشته باشد.
این اتفاق از آن جهت اهمیت دارد که نشان میدهد مسئله فقط به یک شرکت یا یک مدل خاص محدود نیست. با افزایش توانایی مدلهای زبانی در استفاده از ابزارها، اجرای وظایف چندمرحلهای و تصمیمگیری در جریان یک فرایند طولانی، احتمال بروز رفتارهای پیشبینینشده در محیطهای واقعی نیز به یکی از نگرانیهای جدی شرکتهای توسعهدهنده هوش مصنوعی تبدیل شده است.
Anthropic پس از بررسی این رخدادها اعلام کرد که فرایندهای ارزیابی و کنترل محیطهای آزمایشی خود را بازنگری میکند و خواستار توجه بیشتر سایر آزمایشگاههای هوش مصنوعی به چنین حوادثی شد.
تفاوت Astra با نمونههای قبلی چیست؟
اگرچه حوادث OpenAI و Anthropic همگی نشاندهنده افزایش توانایی عاملهای هوش مصنوعی در محیطهای سایبری هستند، اما تفاوت Astra با نمونههای قبلی در سطح توانمندی آن است.
در حادثه Hugging Face، مسئله اصلی خروج عاملهای هوش مصنوعی از محیط کنترلشده و انجام فعالیتهای غیرمجاز در خارج از محدوده تعیینشده بود. در سه حادثه گزارششده توسط Anthropic نیز مدل Claude از مسیر محیطهای ارزیابی به سامانههای واقعی دسترسی پیدا کرده بود.
اما درباره Astra، OpenAI مدعی است که خود مدل به سطحی از توانایی رسیده که میتواند آسیبپذیریهای پیشتر ناشناخته را کشف کند، برای آنها روش بهرهبرداری توسعه دهد و حتی چند اکسپلویت را برای دستیابی به سطح بالاتری از دسترسی با یکدیگر ترکیب کند.
OpenAI در ارزیابیهای خود اعلام کرده است Astra در یک آزمون داخلی، دو آسیبپذیری Zero-Day را نیز در جریان ساخت یک زنجیره اکسپلویت کشف و از آنها استفاده کرده است؛ آسیبپذیریهایی که شرکت اعلام کرده در حال افشای مسئولانه آنها به توسعهدهندگان مربوطه است.
به بیان سادهتر، نمونههای قبلی بیشتر زنگ خطر «رفتار غیرمنتظره عاملهای هوش مصنوعی» را به صدا درآوردند، اما Astra از نگاه OpenAI نشاندهنده ورود مدلها به مرحلهای جدید است؛ مرحلهای که در آن هوش مصنوعی نهتنها میتواند ابزارهای موجود را برای اجرای یک حمله به کار بگیرد، بلکه قادر است خودِ مسیر فنی نفوذ را از طریق کشف آسیبپذیریهای جدید طراحی کند.
همین تفاوت باعث شده است OpenAI برای نخستینبار آستانه «بحرانی» را در چارچوب امنیت سایبری خود فعال کند و پیش از عرضه گسترده مدل، بخشی از توسعه آن را متوقف کرده و کنترلهای جدیدی برای جلوگیری از سوءاستفاده یا اقدامات غیرمجاز مدل در نظر بگیرد.
دسترسی محدود؛ پیش از آنکه قابلیتها عمومی شوند
OpenAI اعلام کرده است که کاربران عادی قرار نیست در زمان عرضه، بهسادگی به تمام قابلیتهای سایبری Astra دسترسی داشته باشند. پیشرفتهترین قابلیتهای این مدل ابتدا در اختیار گروه محدودی از آزمایشکنندگان و شرکای مورد اعتماد قرار میگیرد تا از آن برای اهداف دفاعی، از جمله کشف آسیبپذیریها و تقویت امنیت سامانهها استفاده شود.
این رویکرد بخشی از برنامه Daybreak OpenAI است؛ برنامهای که با هدف فراهم کردن دسترسی کنترلشده پژوهشگران و مدافعان امنیت سایبری به مدلهای پیشرفته طراحی شده است.
OpenAI در عین حال پذیرفته است که کنترلهای امنیتی جدید ممکن است در برخی موارد فعالیتهای مشروع را نیز به اشتباه مشکوک تشخیص دهند و باعث کند شدن یا توقف عملکرد مدل شوند.
در حال حاضر، پرسش اصلی این است که آیا سازوکارهای نظارتی شرکتهای توسعهدهنده میتوانند همزمان با افزایش توانایی مدلهای هوش مصنوعی پیشرفت کنند یا خیر. حوادث اخیر نشان دادهاند که فاصله میان یک مدل قدرتمند برای کمک به پژوهشگران امنیتی و مدلی که همان تواناییها را برای نفوذ غیرمجاز به کار میگیرد، هر روز کمتر میشود.