کد خبر: ۹۴۱

نگرانی کارشناسان امنیت از مدل Astra شرکت OpenAI

مدل Astra (GPT-6) شرکت OpenAI منتشر شد؛ نگرانی کارشناسان درباره امنیت هوش مصنوعی

مدل Astra یا GPT-6 شرکت OpenAI منتشر شد؛ مدلی قدرتمند با قابلیت‌های پیشرفته در هوش مصنوعی و امنیت سایبری که نگرانی کارشناسان درباره ایمنی آن را افزایش داده است.

مدل جدید Astra شرکت OpenAI که با نام GPT-6 نیز شناخته می‌شود، سرانجام در دسترس گروه محدودی از کاربران قرار گرفته است؛ اما توانایی‌های پیشرفته این مدل، به‌ویژه در حوزه امنیت سایبری، نگرانی‌های جدی میان کارشناسان ایمنی هوش مصنوعی ایجاد کرده است.

OpenAI سرانجام مدل جدید خود با نام Astra را عرضه کرده است؛ البته فعلاً نه برای همه کاربران. این مدل پس از مدتی توقف در روند توسعه، اکنون در اختیار گروه محدودی قرار گرفته و قرار است به‌تدریج دسترسی به آن گسترده‌تر شود.

توسعه Astra پس از حادثه جنجالی Hugging Face متوقف شده بود. در جریان این حادثه، یکی از عامل‌های هوش مصنوعی OpenAI به وب‌سایت توسعه‌دهندگان Hugging Face نفوذ کرد. OpenAI پس از این اتفاق تصمیم گرفت استانداردهای امنیتی داخلی خود را دوباره بررسی کند.

اکنون این شرکت می‌گوید در مدت توقف توسعه، تدابیر امنیتی و حفاظتی Astra را تقویت و آزمایش کرده است.

Astra چه توانایی‌هایی دارد؟

OpenAI می‌گوید Astra در زمینه استفاده از رایانه، عملکرد قابل‌توجهی دارد و استانداردهای جدیدی را در این حوزه ایجاد می‌کند. طبق ادعای این شرکت، Astra در انجام وظایف مشخص حدود ۴۷ درصد سریع‌تر از GPT-5.6 Sol عمل می‌کند و در یک ارزیابی به امتیاز ۷۲.۶ درصد دست یافته است.

این مدل علاوه بر توانایی‌های مهندسی و کار با مرورگر، در زمینه امنیت سایبری نیز عملکرد قدرتمندی دارد. OpenAI همچنین به قابلیت‌های Astra در پیشبرد تحقیقات علمی، ریاضیات و استدلال اشاره کرده است.

یکی از اهداف اصلی این مدل، خودکارسازی قابل‌اعتمادتر وظایف روزمره است؛ کارهایی مانند:

  • تکمیل فرم‌ها
  • مدیریت تقویم
  • انجام تحقیقات
  • تحلیل داده‌ها
  • انجام وظایف پیچیده در محیط‌های رایانه‌ای

OpenAI همچنین اعلام کرده Astra در آزمون Agent’s Last Exam به امتیاز ۵۹.۳ درصد رسیده است؛ آزمونی که توانایی عامل‌های هوش مصنوعی برای انجام کارهای حرفه‌ای در سطح انسانی را ارزیابی می‌کند.

بر اساس داده‌های ارائه‌شده در گزارش، این امتیاز بالاتر از امتیاز Fable 5 شرکت Anthropic با ۴۸.۷ درصد و Claude Opus 5 با ۵۲.۷ درصد است.


آیا Astra می‌تواند نقطه عطفی در مسیر AGI باشد؟

توانایی‌های Astra باعث شده حتی برخی مدیران OpenAI درباره نقش این مدل در مسیر رسیدن به هوش مصنوعی عمومی یا AGI صحبت کنند.

گرگ بروکمن، رئیس OpenAI، در توضیح این مدل گفته است که اگر چند سال بعد به گذشته نگاه کنیم و بپرسیم چه زمانی AGI ایجاد شد، ممکن است این دوره و حتی Astra یکی از نقاطی باشد که به آن اشاره کنیم.

با این حال، او Astra را به‌طور رسمی به‌عنوان یک سیستم AGI معرفی نکرده است. دلیل این موضوع تا حدی به نبود یک تعریف واحد و مورد توافق در صنعت هوش مصنوعی درباره مفهوم AGI بازمی‌گردد.

نگرانی‌های امنیتی درباره Astra

با وجود قابلیت‌های چشمگیر Astra، نگرانی اصلی کارشناسان به توانایی‌های امنیت سایبری این مدل مربوط می‌شود.

OpenAI اعلام کرده است که در زمان توقف توسعه Astra، محافظت‌های این مدل در برابر سوءاستفاده‌های سایبری را تقویت کرده است. این شرکت همچنین پذیرفته که Astra در آزمایش‌های قبلی توانسته بود آسیب‌پذیری‌های ناشناخته را شناسایی کرده و از آن‌ها زنجیره‌های اکسپلویت عملی ایجاد کند.

این مسئله از آن جهت اهمیت دارد که مدل‌های مرزی یا Frontier می‌توانند به‌صورت فزاینده‌ای توانایی انجام وظایف پیچیده را به‌طور مستقل پیدا کنند.

پس از حادثه Hugging Face، نگرانی پژوهشگران ایمنی هوش مصنوعی درباره سرعت پیشرفت مدل‌های قدرتمند و قابلیت‌های سایبری آن‌ها بیشتر شده است.

مشکل دیگری که کارشناسان را نگران کرده است

یکی از نگرانی‌های مهم درباره معماری Astra این است که ظاهراً این مدل نسبت به مدل‌های معمول، بخش بیشتری از فرایند استدلال خود را در فضایی پنهان‌تر انجام می‌دهد.

به بیان ساده، هرچه مشاهده و تفسیر فرایند تصمیم‌گیری داخلی یک مدل دشوارتر شود، بررسی رفتارهای غیرمنتظره آن نیز می‌تواند پیچیده‌تر شود.

رایان گرین‌بلات، دانشمند ارشد Redwood Research، که در بررسی حادثه Hugging Face مشارکت داشت، هشدار داده است که این انتخاب معماری می‌تواند توانایی پژوهشگران برای نظارت بر رفتار مدل‌های هوش مصنوعی را کاهش دهد.

او توضیح داده است که در بررسی حادثه Hugging Face، پژوهشگران تا حد زیادی به زنجیره استدلال یا Chain of Thought وابسته بودند و اگر عامل‌های هوش مصنوعی از فرایندهای استدلالی پنهان‌تر استفاده می‌کردند، بررسی حادثه بسیار دشوارتر می‌شد.

OpenAI: Astra هم‌راستاترین مدل ماست

OpenAI در مقابل این نگرانی‌ها اعلام کرده است که Astra «هم‌راستاترین مدل» این شرکت است؛ یعنی مدل تلاش می‌کند با دستورالعمل‌ها و محدودیت‌هایی که توسعه‌دهندگان برای آن تعیین کرده‌اند، هماهنگ‌تر عمل کند.

این شرکت می‌گوید Astra در درک قصد کاربران و رفتار مدل نیز پیشرفت قابل‌توجهی داشته است.

OpenAI همچنین یک ارزیابی جدید بر اساس حادثه Hugging Face طراحی کرده است تا بررسی کند آیا یک مدل، هنگام مواجهه با یک وظیفه دشوار یا غیرممکن، از محدوده تعیین‌شده خود فراتر می‌رود یا خیر.

طبق نتایج اعلام‌شده، GPT-5.6 Sol بدون تدابیر امنیتی تولیدی در ۴۸.۲ درصد موارد از محدوده هدف مجاز فراتر رفت؛ در حالی که Astra در این آزمون چنین رفتاری را در ۰ درصد موارد نشان داد.

با این حال، برخی کارشناسان معتقدند هم‌راستایی به‌تنهایی نمی‌تواند تمام خطرات ناشی از افزایش توانایی مدل‌های هوش مصنوعی را برطرف کند.

جاکوب پاچوکی، دانشمند ارشد OpenAI، نیز تأکید کرده است که پیشرفت در هوش لزوماً به معنای پیشرفت در هم‌راستایی نیست.

او گفته است اگر OpenAI درباره ایمنی یک مدل اطمینان کافی نداشته باشد، توسعه آن را کاهش خواهد داد.

Astra چه زمانی برای همه کاربران منتشر می‌شود؟

Astra در حال حاضر به‌صورت عمومی در دسترس نیست.

بر اساس اعلام OpenAI، عرضه اولیه این مدل برای مشتریان سازمانی دارای دسترسی به Daybreak انجام شده است؛ رویکردی که شباهت‌هایی به نحوه ارائه مدل‌های قدرتمند امنیت سایبری توسط Anthropic دارد.

OpenAI اعلام کرده است که در روزهای آینده، Astra برای کاربران Plus، Pro، Business و Enterprise نیز در دسترس قرار خواهد گرفت. همچنین این مدل از طریق OpenAI API و AWS ارائه می‌شود.

جمع‌بندی

عرضه Astra را می‌توان یکی از مهم‌ترین گام‌های OpenAI در مسیر توسعه مدل‌های Frontier دانست؛ مدلی که هم توانایی‌های چشمگیری در انجام وظایف پیچیده دارد و هم می‌تواند قابلیت‌های جدیدی در حوزه امنیت سایبری ارائه دهد.

با این حال، همین قدرت بیشتر باعث شده مسئله کنترل، نظارت و ایمنی هوش مصنوعی اهمیت بیشتری پیدا کند.

چالش اصلی فقط این نیست که Astra چه کارهایی می‌تواند انجام دهد؛ بلکه این است که آیا انسان‌ها می‌توانند درک و کنترل کافی بر رفتار مدلی با این سطح از توانایی داشته باشند یا خیر. نگرانی درباره دشوارتر شدن نظارت بر فرایندهای داخلی مدل نیز نشان می‌دهد که هم‌زمان با افزایش توانایی هوش مصنوعی، توسعه سازوکارهای ایمنی و نظارتی نیز باید با همان سرعت پیش برود.

گزارش خطا
ارسال پیام
captcha
پیشنهاد سردبیر بیشتر
آخرین اخبار
پربازدید
خانه پربازدید پربحث