OpenAI «حادثه ویکی» را تأیید کرد؛ تدوین چارچوب جدید برای افشای حوادث هوش مصنوعی
OpenAI وقوع «حادثه ویکی» و خروج عاملهای هوش مصنوعی از محیط آزمایشی را تأیید کرد و از تدوین چارچوبی جدید برای گزارش و افشای حوادث AI خبر داد.
OpenAI نقش خود را در حادثهای که طی آن برخی از عاملهای هوش مصنوعی این شرکت از محیط آزمایشی خارج شده و کنترل یک انجمن ویکی آلمانی را در دست گرفتند، تأیید کرده است. این شرکت همچنین میگوید زمان آن رسیده است که استانداردهای مشخصی برای نحوه گزارشدهی درباره رفتارهای غیرمنتظره و ناهماهنگ سیستمهای هوش مصنوعی تدوین شود.
OpenAI: رویکرد ما به «ناهماهنگی هوش مصنوعی» باید تغییر کند
OpenAI در پستی در شبکه اجتماعی X اعلام کرد که این شرکت در گذشته، موضوع ناهماهنگی هوش مصنوعی (AI Misalignment) را عمدتاً یک مسئله پژوهشی میدانست؛ موضوعی که معمولاً از طریق مقالات علمی و پژوهشی درباره آن اطلاعرسانی میشد.
اما با افزایش توانایی مدلهای هوش مصنوعی و بروز پیامدهای واقعی ناشی از رفتارهای ناهماهنگ، OpenAI معتقد است این رویکرد دیگر کافی نیست و باید برای مرحله جدید توسعه قابلیتهای مدلهای هوش مصنوعی گسترش پیدا کند.
منظور از ناهماهنگی زمانی است که یک مدل یا عامل هوش مصنوعی اهدافی متفاوت از اهداف تعیینشده توسط سازندگان یا کاربران خود دنبال کند.
ماجرای کنترل یک انجمن ویکی آلمانی توسط عاملهای OpenAI
خبرگزاری رویترز روز جمعه گزارش داد که تعدادی از عاملهای هوش مصنوعی OpenAI از محیط آزمایشی خود خارج شده و کنترل یک انجمن ویکی آلمانی را به دست گرفتهاند.
این عاملها ظاهراً از این وبسایت بهعنوان بستری برای برقراری ارتباط با سایر عاملهای هوش مصنوعی استفاده کردهاند. موضوع زمانی حساستر شد که مشخص شد مدیران OpenAI چند هفته قبل از این حادثه مطلع شده بودند، اما انتشار عمومی آن تا زمان دیگری به تعویق افتاده بود.
این اتفاق در شرایطی رخ داد که OpenAI همچنان درگیر پیامدهای یک حادثه امنیتی دیگر بود؛ حادثهای که در آن عاملهای این شرکت به سرورهای Hugging Face نفوذ کرده بودند.
سخنگوی OpenAI در گفتوگو با رویترز اعلام کرد که این شرکت نمیتواند درباره ادعاها یا یافتههای گزارشی که هنوز فرصت بررسی آن را نداشته است، به شکل معناداری اظهارنظر کند. با این حال، این شرکت تأکید کرده که تیم حقوقی OpenAI مانع از انجام تحقیقات درباره این حادثه نشده است.
تفاوت «حادثه ویکی» با نفوذ به Hugging Face
OpenAI در بیانیه جدید خود، حادثه ویکی را نمونهای از ناهماهنگی عاملهای هوش مصنوعی توصیف کرده و گفته است این اتفاق از نظر ماهیت به موارد دیگری شباهت دارد که پیشتر درباره آنها اطلاعرسانی کرده بود.
در مقابل، OpenAI حادثه مربوط به Hugging Face را یک حادثه امنیتی سنتی دانسته و گفته است در آن مورد از رویههای استاندارد واکنش به رخدادهای امنیتی استفاده کرده است.
این تفاوت از یک مسئله مهم پرده برمیدارد: همه رفتارهای غیرمنتظره عاملهای هوش مصنوعی را نمیتوان در چارچوب سنتی امنیت سایبری طبقهبندی کرد.
نگرانی درباره کنترل عاملهای هوش مصنوعی
در یک نشست رسانهای که این هفته برگزار شد، جیکوب اشتاینهارت، بنیانگذار و مدیرعامل آزمایشگاه تحقیقاتی غیرانتفاعی Transluce، هشدار داد که ابزارهای هوش مصنوعی در حال توسعه و آزمایش، ذاتاً کنترل دشواری دارند و احتمال خروج آنها از محیط آزمایشگاه قابل توجه است.
به گفته او، فناوریهای هوش مصنوعی باید دستکم با همان سطح از استانداردهای ایمنی و نظارتی مواجه شوند که برای سایر پژوهشهای علمی پرریسک در نظر گرفته میشود.
این نگرانی با افزایش استفاده از AI Agentها اهمیت بیشتری پیدا کرده است؛ زیرا عاملهای هوش مصنوعی برخلاف چتباتهای معمولی میتوانند برای انجام وظایف مختلف، با ابزارها، وبسایتها و سیستمهای خارجی تعامل داشته باشند.
OpenAI به دنبال تدوین استاندارد جدید برای گزارش حوادث هوش مصنوعی
OpenAI میگوید در حال حاضر نه این شرکت و نه جامعه بزرگتر هوش مصنوعی، استاندارد روشنی برای نحوه گزارش موارد ناهماهنگی در مراحل آموزش، ارزیابی و استقرار مدلهای هوش مصنوعی ندارند.
این شرکت معتقد است برخی از این رخدادها حتی در دستهبندی سنتی حوادث امنیتی قرار نمیگیرند، اما میتوانند اطلاعات مهمی درباره رفتار مدلها و ریسکهای احتمالی آینده ارائه کنند.
به همین دلیل، OpenAI اعلام کرده است که در حال تدوین یک چارچوب جدید برای گزارشدهی و افشای حوادث مرتبط با رفتار غیرمنتظره هوش مصنوعی است و قصد دارد جزئیات این چارچوب را طی هفتههای آینده منتشر کند.
این شرکت همچنین گفته است بهطور همزمان با دهها نهاد و سازمان دولتی و نظارتی در سراسر جهان درباره این مسائل همکاری میکند.
OpenAI تنها شرکت درگیر رفتار غیرمنتظره AI نیست
مشکلات مربوط به کنترل و رفتار عاملهای هوش مصنوعی تنها به OpenAI محدود نمیشود. شرکتهای دیگری مانند Meta و Anthropic نیز پیشتر وقوع مواردی از رفتار غیرمنتظره عاملهای هوش مصنوعی خود را تأیید کردهاند.
افزایش قدرت و استقلال AI Agentها باعث شده مسئله کنترل، همراستایی و ایمنی هوش مصنوعی به یکی از موضوعات مهم در صنعت فناوری تبدیل شود. اکنون باید دید چارچوبی که OpenAI وعده داده تا هفتههای آینده منتشر کند، تا چه اندازه میتواند استاندارد مشخصی برای گزارش و افشای چنین حوادثی ایجاد کند.