هکرها چگونه پلتفرمهای هوش مصنوعی مانند Claude و ChatGPT را به سطح حمله تبدیل میکنند؟
هکرها با سوءاستفاده از Claude، ChatGPT و Grok، محتوای مخرب را روی پلتفرمهای معتبر منتشر کرده و کاربران را به نصب بدافزار، فیشینگ و سرقت اطلاعات هدایت میکنند.
با تبدیل شدن پلتفرمهای هوش مصنوعی به بخشی از فعالیتهای روزمره کاربران و سازمانها، مهاجمان سایبری یک مسیر حمله جدید پیدا کردهاند: خودِ پلتفرمهای AI.
بررسیهای مرکز عملیات امنیتی Huntress (SOC) نشان میدهد تهدید اصلی لزوماً متوجه شرکتها یا مدلهای هوش مصنوعی نیست؛ بلکه مهاجمان در بسیاری از موارد از قابلیتهای واقعی و مورد اعتماد کاربران در پلتفرمهای AI سوءاستفاده میکنند تا بدافزار توزیع کنند، اطلاعات حساس را سرقت کنند یا کاربران را به اجرای دستورات مخرب ترغیب کنند.
Huntress طی ۹ ماه گذشته چندین کمپین را شناسایی کرده که در آنها مهاجمان از محتوای قابل اشتراکگذاری هوش مصنوعی، مینیاپلیکیشنهای عمومی و نتایج جستوجوی تبلیغاتی برای هدف قرار دادن کاربران AI استفاده کردهاند.
سوءاستفاده از قابلیتهای قانونی پلتفرمهای هوش مصنوعی
مهاجمان در این حملات از قابلیتهایی استفاده کردهاند که در اصل کاملاً قانونی و بخشی از عملکرد عادی پلتفرمهای هوش مصنوعی هستند.
از جمله این قابلیتها میتوان به موارد زیر اشاره کرد:
- Claude Artifacts: محتوایی که Claude تولید میکند و در پنجره پیشنمایش چت نمایش میدهد و کاربران میتوانند آن را با یک لینک عمومی منتشر کنند.
- لینکهای claude.ai/share: آدرسهای قابل اشتراکی که پس از انتشار یک مکالمه Claude ایجاد میشوند و در صورت قرار گرفتن در انجمنها یا شبکههای اجتماعی، ممکن است توسط موتورهای جستوجو ایندکس شوند.
- مکالمات ChatGPT و Grok: مکالمات عمومی و قابل ایندکسی که روی دامنههای chatgpt.com و grok.com قرار دارند و میتوانند در نتایج جستوجوی مربوط به مشکلات فنی ظاهر شوند.
مشکل اصلی اینجاست که تمام این قابلیتها درون یک مرز اعتماد (Trust Boundary) قرار دارند.
کاربران نام پلتفرم، برند و دامنه رسمی آن را میبینند و به همین دلیل ممکن است محتوای مخرب یا فایل دانلودی را نیز معتبر تصور کنند.
این کمپینها معمولاً تنها چند ساعت یا چند روز فعال میمانند و پس از گزارش، ارائهدهنده پلتفرم محتوای مخرب را حذف میکند؛ اما همین بازه کوتاه برای فریب تعداد زیادی از قربانیان کافی است.
حمله FakeAgent؛ سوءاستفاده از Claude Artifact برای توزیع بدافزار
در ماه ژوئیه، Huntress کمپینی با نام FakeAgent را شناسایی کرد که بیش از ۲۹ سازمان را هدف قرار داده بود.
حمله با یک Claude Artifact مخرب آغاز میشد که روی دامنه واقعی claude.ai میزبانی شده بود.
از آنجا که Artifacts عمومی برای نمایش نمونهها و پروژههای سبک طراحی شدهاند و فرایند بررسی عمیقی روی همه آنها انجام نمیشود، مهاجمان توانستند یک صفحه جعلی و متقاعدکننده برای دانلود Claude Desktop ایجاد کنند.
قربانیانی که در موتور جستوجوی Bing به دنبال نسخه دسکتاپ Claude بودند، به این صفحه جعلی هدایت میشدند و روی لینکی کلیک میکردند که ظاهری کاملاً قانونی داشت.
اما بهجای دریافت نرمافزار موردنظر، کاربر به یک دامنه خارجی هدایت میشد و بدافزار SectopRAT روی سیستم او قرار میگرفت.
Huntress این Artifact را گزارش کرد و Anthropic تا ۲۲ ژوئیه آن را حذف کرد؛ با این حال، حملات مرتبط با همان دامنه تغییر مسیر تا ماه اوت نیز ادامه داشت.
تصویر ۱: صفحه فیشینگ جعلی Claude Desktop/Cowork که بهعنوان یک Claude Artifact میزبانی شده بود.
راهنمای نصب جعلی در claude.ai/share
در یک حادثه دیگر، مهاجمی کاربران را از طریق یک نتیجه تبلیغاتی گوگل هدف قرار داد.
قربانی که عبارت «Claude on Mac» را جستوجو کرده بود، روی یک نتیجه تبلیغاتی کلیک کرد که به یک لینک claude.ai/share منتهی میشد.
این صفحه خود را به شکل یک راهنمای نصب از سوی Apple Support نشان میداد.
از آنجا که صفحه روی دامنه رسمی Anthropic قرار داشت، بسیاری از نشانههای معمول حملات فیشینگ وجود نداشت؛ نه دامنهای مشابه دامنه اصلی و نه هشدار مربوط به گواهی امنیتی.
راهنمای جعلی از قربانی میخواست یک دستور curl را در Terminal کپی و اجرا کند.
این اقدام یک زنجیره حمله ششمرحلهای را آغاز میکرد که در نهایت به نصب بدافزار MacSync stealer منجر میشد.
این بدافزار میتوانست اطلاعات حساسی مانند موارد زیر را سرقت کند:
- کوکیها
- اطلاعات ورود
- اسرار Keychain
- نشستهای Telegram
- کلیدهای SSH
- کلیدهای سرویسهای ابری
تصویر ۲: مکالمه دستکاریشده Claude که بهعنوان محتوای اشتراکی Apple Support معرفی شده و کاربر را به اجرای یک دستور curl در Terminal هدایت میکند.
سوءاستفاده از ChatGPT و Grok برای مسمومسازی نتایج AI
الگوی سوم حملات، مستقیماً توصیههای تولیدشده توسط هوش مصنوعی را هدف قرار میدهد.
در یکی از نمونهها، جستوجوی ساده عبارت «clear disk space on macOS» باعث شد مکالمات ChatGPT و Grok در رتبههای بالای نتایج جستوجو ظاهر شوند.
اما این مکالمات بهجای ارائه راهحل واقعی، دستورالعملهایی مشابه حملات ClickFix ارائه میکردند.
مهاجمان ابتدا مکالمات جعلی را ایجاد کرده و سپس با استفاده از قابلیت Share، یک URL عمومی روی دامنه معتبر پلتفرم ایجاد کرده بودند.
پس از آن، با استفاده از روش SEO Poisoning یا مسمومسازی نتایج جستوجو تلاش کردند این لینکها را به رتبههای بالای Google برسانند.
از آنجا که لینکها روی دامنههای واقعی chatgpt.com و grok.com قرار داشتند، کاربران تصور میکردند توصیههای ارائهشده معتبر هستند.
قربانیان نیز دستورات Terminal پیشنهادشده را اجرا میکردند؛ اقدامی که در نهایت به نصب بدافزار AMOS Stealer منجر میشد.
تصویر ۳: نتایج برتر جستوجو و لینکهای دارای رتبه بالا در Google.
چرا کاربران به این حملات اعتماد میکنند؟
این حملات در واقع به معنای شکستن مستقیم امنیت پلتفرمهای هوش مصنوعی نیستند.
مهاجمان بیشتر از اعتمادی که کاربران به برندهای شناختهشده و دامنههای رسمی دارند سوءاستفاده میکنند.
وقتی یک کاربر محتوای مخرب را روی دامنهای مانند claude.ai، chatgpt.com یا grok.com مشاهده میکند، احتمال بیشتری دارد آن را معتبر بداند.
به همین دلیل، حتی یک قابلیت قانونی مانند اشتراکگذاری مکالمه یا انتشار یک Artifact میتواند در صورت سوءاستفاده، به بخشی از زنجیره حمله سایبری تبدیل شود.
سازمانها برای مقابله با این تهدیدها چه کاری باید انجام دهند؟
تیمهای امنیتی باید اجرای اسکریپت از طریق Clipboard و همچنین عیبیابی مبتنی بر هوش مصنوعی را بهعنوان یک ریسک امنیتی جدی در نظر بگیرند.
برخی اقدامات پیشنهادی عبارتاند از:
- محدود کردن اجرای اسکریپتهایی که مستقیماً از Clipboard وارد میشوند؛
- استفاده از Application Allow-listing؛
- نظارت بر ایجاد Scheduled Taskهای جدید؛
- بررسی تغییرات مربوط به استثناهای آنتیویروس؛
- آموزش کارکنان برای شناسایی حملات و فریبهای ClickFix؛
- گزارش سریع محتوای مشکوک میزبانیشده روی پلتفرمهای AI به ارائهدهنده سرویس.
این کمپینها معمولاً عمر کوتاهی دارند، اما گزارش سریع و استفاده از چندین لایه کنترل امنیتی میتواند فرصت مهاجمان برای سوءاستفاده از این روشها را به حداقل برساند.
پلتفرمهای AI به یک سطح حمله جدید تبدیل شدهاند
گسترش استفاده از ChatGPT، Claude، Grok و سایر ابزارهای هوش مصنوعی باعث شده اعتماد کاربران به این پلتفرمها به یک مؤلفه مهم در امنیت سایبری تبدیل شود.
مهاجمان دیگر فقط به دنبال آسیبپذیری نرمافزاری نیستند؛ آنها میتوانند از قابلیتهای قانونی، محتوای قابل اشتراکگذاری، دامنههای معتبر و حتی اعتبار توصیههای تولیدشده توسط AI برای اجرای حملات خود استفاده کنند.
به همین دلیل، سازمانها باید در کنار امنیت مدلها و زیرساختهای AI، به امنیت محتوای تولیدشده و نحوه تعامل کاربران با پلتفرمهای هوش مصنوعی نیز توجه کنند.
در نهایت، همان ویژگیهایی که استفاده از هوش مصنوعی را ساده و قابل اعتماد میکنند، در صورت نبود کنترلهای مناسب میتوانند به ابزاری برای فیشینگ، توزیع بدافزار، سرقت اطلاعات و مهندسی اجتماعی تبدیل شوند.