نگرانی کارشناسان امنیت از مدل Astra شرکت OpenAI
مدل Astra یا GPT-6 شرکت OpenAI منتشر شد؛ مدلی قدرتمند با قابلیتهای پیشرفته در هوش مصنوعی و امنیت سایبری که نگرانی کارشناسان درباره ایمنی آن را افزایش داده است.
مدل جدید Astra شرکت OpenAI که با نام GPT-6 نیز شناخته میشود، سرانجام در دسترس گروه محدودی از کاربران قرار گرفته است؛ اما تواناییهای پیشرفته این مدل، بهویژه در حوزه امنیت سایبری، نگرانیهای جدی میان کارشناسان ایمنی هوش مصنوعی ایجاد کرده است.
OpenAI سرانجام مدل جدید خود با نام Astra را عرضه کرده است؛ البته فعلاً نه برای همه کاربران. این مدل پس از مدتی توقف در روند توسعه، اکنون در اختیار گروه محدودی قرار گرفته و قرار است بهتدریج دسترسی به آن گستردهتر شود.
توسعه Astra پس از حادثه جنجالی Hugging Face متوقف شده بود. در جریان این حادثه، یکی از عاملهای هوش مصنوعی OpenAI به وبسایت توسعهدهندگان Hugging Face نفوذ کرد. OpenAI پس از این اتفاق تصمیم گرفت استانداردهای امنیتی داخلی خود را دوباره بررسی کند.
اکنون این شرکت میگوید در مدت توقف توسعه، تدابیر امنیتی و حفاظتی Astra را تقویت و آزمایش کرده است.
Astra چه تواناییهایی دارد؟
OpenAI میگوید Astra در زمینه استفاده از رایانه، عملکرد قابلتوجهی دارد و استانداردهای جدیدی را در این حوزه ایجاد میکند. طبق ادعای این شرکت، Astra در انجام وظایف مشخص حدود ۴۷ درصد سریعتر از GPT-5.6 Sol عمل میکند و در یک ارزیابی به امتیاز ۷۲.۶ درصد دست یافته است.
این مدل علاوه بر تواناییهای مهندسی و کار با مرورگر، در زمینه امنیت سایبری نیز عملکرد قدرتمندی دارد. OpenAI همچنین به قابلیتهای Astra در پیشبرد تحقیقات علمی، ریاضیات و استدلال اشاره کرده است.
یکی از اهداف اصلی این مدل، خودکارسازی قابلاعتمادتر وظایف روزمره است؛ کارهایی مانند:
- تکمیل فرمها
- مدیریت تقویم
- انجام تحقیقات
- تحلیل دادهها
- انجام وظایف پیچیده در محیطهای رایانهای
OpenAI همچنین اعلام کرده Astra در آزمون Agent’s Last Exam به امتیاز ۵۹.۳ درصد رسیده است؛ آزمونی که توانایی عاملهای هوش مصنوعی برای انجام کارهای حرفهای در سطح انسانی را ارزیابی میکند.
بر اساس دادههای ارائهشده در گزارش، این امتیاز بالاتر از امتیاز Fable 5 شرکت Anthropic با ۴۸.۷ درصد و Claude Opus 5 با ۵۲.۷ درصد است.
آیا Astra میتواند نقطه عطفی در مسیر AGI باشد؟
تواناییهای Astra باعث شده حتی برخی مدیران OpenAI درباره نقش این مدل در مسیر رسیدن به هوش مصنوعی عمومی یا AGI صحبت کنند.
گرگ بروکمن، رئیس OpenAI، در توضیح این مدل گفته است که اگر چند سال بعد به گذشته نگاه کنیم و بپرسیم چه زمانی AGI ایجاد شد، ممکن است این دوره و حتی Astra یکی از نقاطی باشد که به آن اشاره کنیم.
با این حال، او Astra را بهطور رسمی بهعنوان یک سیستم AGI معرفی نکرده است. دلیل این موضوع تا حدی به نبود یک تعریف واحد و مورد توافق در صنعت هوش مصنوعی درباره مفهوم AGI بازمیگردد.
نگرانیهای امنیتی درباره Astra
با وجود قابلیتهای چشمگیر Astra، نگرانی اصلی کارشناسان به تواناییهای امنیت سایبری این مدل مربوط میشود.
OpenAI اعلام کرده است که در زمان توقف توسعه Astra، محافظتهای این مدل در برابر سوءاستفادههای سایبری را تقویت کرده است. این شرکت همچنین پذیرفته که Astra در آزمایشهای قبلی توانسته بود آسیبپذیریهای ناشناخته را شناسایی کرده و از آنها زنجیرههای اکسپلویت عملی ایجاد کند.
این مسئله از آن جهت اهمیت دارد که مدلهای مرزی یا Frontier میتوانند بهصورت فزایندهای توانایی انجام وظایف پیچیده را بهطور مستقل پیدا کنند.
پس از حادثه Hugging Face، نگرانی پژوهشگران ایمنی هوش مصنوعی درباره سرعت پیشرفت مدلهای قدرتمند و قابلیتهای سایبری آنها بیشتر شده است.
مشکل دیگری که کارشناسان را نگران کرده است
یکی از نگرانیهای مهم درباره معماری Astra این است که ظاهراً این مدل نسبت به مدلهای معمول، بخش بیشتری از فرایند استدلال خود را در فضایی پنهانتر انجام میدهد.
به بیان ساده، هرچه مشاهده و تفسیر فرایند تصمیمگیری داخلی یک مدل دشوارتر شود، بررسی رفتارهای غیرمنتظره آن نیز میتواند پیچیدهتر شود.
رایان گرینبلات، دانشمند ارشد Redwood Research، که در بررسی حادثه Hugging Face مشارکت داشت، هشدار داده است که این انتخاب معماری میتواند توانایی پژوهشگران برای نظارت بر رفتار مدلهای هوش مصنوعی را کاهش دهد.
او توضیح داده است که در بررسی حادثه Hugging Face، پژوهشگران تا حد زیادی به زنجیره استدلال یا Chain of Thought وابسته بودند و اگر عاملهای هوش مصنوعی از فرایندهای استدلالی پنهانتر استفاده میکردند، بررسی حادثه بسیار دشوارتر میشد.
OpenAI: Astra همراستاترین مدل ماست
OpenAI در مقابل این نگرانیها اعلام کرده است که Astra «همراستاترین مدل» این شرکت است؛ یعنی مدل تلاش میکند با دستورالعملها و محدودیتهایی که توسعهدهندگان برای آن تعیین کردهاند، هماهنگتر عمل کند.
این شرکت میگوید Astra در درک قصد کاربران و رفتار مدل نیز پیشرفت قابلتوجهی داشته است.
OpenAI همچنین یک ارزیابی جدید بر اساس حادثه Hugging Face طراحی کرده است تا بررسی کند آیا یک مدل، هنگام مواجهه با یک وظیفه دشوار یا غیرممکن، از محدوده تعیینشده خود فراتر میرود یا خیر.
طبق نتایج اعلامشده، GPT-5.6 Sol بدون تدابیر امنیتی تولیدی در ۴۸.۲ درصد موارد از محدوده هدف مجاز فراتر رفت؛ در حالی که Astra در این آزمون چنین رفتاری را در ۰ درصد موارد نشان داد.
با این حال، برخی کارشناسان معتقدند همراستایی بهتنهایی نمیتواند تمام خطرات ناشی از افزایش توانایی مدلهای هوش مصنوعی را برطرف کند.
جاکوب پاچوکی، دانشمند ارشد OpenAI، نیز تأکید کرده است که پیشرفت در هوش لزوماً به معنای پیشرفت در همراستایی نیست.
او گفته است اگر OpenAI درباره ایمنی یک مدل اطمینان کافی نداشته باشد، توسعه آن را کاهش خواهد داد.
Astra چه زمانی برای همه کاربران منتشر میشود؟
Astra در حال حاضر بهصورت عمومی در دسترس نیست.
بر اساس اعلام OpenAI، عرضه اولیه این مدل برای مشتریان سازمانی دارای دسترسی به Daybreak انجام شده است؛ رویکردی که شباهتهایی به نحوه ارائه مدلهای قدرتمند امنیت سایبری توسط Anthropic دارد.
OpenAI اعلام کرده است که در روزهای آینده، Astra برای کاربران Plus، Pro، Business و Enterprise نیز در دسترس قرار خواهد گرفت. همچنین این مدل از طریق OpenAI API و AWS ارائه میشود.
جمعبندی
عرضه Astra را میتوان یکی از مهمترین گامهای OpenAI در مسیر توسعه مدلهای Frontier دانست؛ مدلی که هم تواناییهای چشمگیری در انجام وظایف پیچیده دارد و هم میتواند قابلیتهای جدیدی در حوزه امنیت سایبری ارائه دهد.
با این حال، همین قدرت بیشتر باعث شده مسئله کنترل، نظارت و ایمنی هوش مصنوعی اهمیت بیشتری پیدا کند.
چالش اصلی فقط این نیست که Astra چه کارهایی میتواند انجام دهد؛ بلکه این است که آیا انسانها میتوانند درک و کنترل کافی بر رفتار مدلی با این سطح از توانایی داشته باشند یا خیر. نگرانی درباره دشوارتر شدن نظارت بر فرایندهای داخلی مدل نیز نشان میدهد که همزمان با افزایش توانایی هوش مصنوعی، توسعه سازوکارهای ایمنی و نظارتی نیز باید با همان سرعت پیش برود.