کد خبر: ۷۵۸

کلاهبرداری دیپ‌فیک؛ چگونه هوش مصنوعی چهره و صدای افراد را جعل می‌کند؟

دیپ فیک

کلاهبرداری دیپ‌فیک چگونه با جعل چهره و صدای مدیران، کارمندان و خانواده‌ها را فریب می‌دهد؟ بررسی پرونده Arup و راهکارهای مقابله با این تهدید.

هانا حیدری
خبرنگار:
هانا حیدری

یک تماس تصویری در سال ۲۰۲۴ برای شرکت مهندسی Arup به قیمت حدود ۲۵.۶ میلیون دلار تمام شد؛ کارمند این شرکت تصور می‌کرد در یک جلسه ویدئویی با مدیر مالی و چند مدیر ارشد دیگر صحبت می‌کند، اما تمام افراد حاضر در آن سوی تماس، نسخه‌های ساخته‌شده با هوش مصنوعی بودند.

این حادثه حالا به یکی از شناخته‌شده‌ترین نمونه‌های کلاهبرداری دیپ‌فیک تبدیل شده است؛ نمونه‌ای که نشان می‌دهد در عصر هوش مصنوعی، حتی دیدن چهره و شنیدن صدای یک فرد نیز دیگر برای احراز هویت او کافی نیست.

مسئله البته به یک شرکت انگلیسی محدود نمی‌شود. در ایران نیز پلیس فتا اخیراً درباره افزایش کلاهبرداری‌هایی هشدار داده که در آن‌ها مجرمان با استفاده از هوش مصنوعی و شبیه‌سازی صدای افراد، خود را جای اعضای خانواده یا نزدیکان قربانی جا می‌زنند و با ایجاد موقعیت‌های اضطراری، از آن‌ها درخواست انتقال فوری پول می‌کنند.

بیشتر بخوانید: صدای فرزندتان را شنیدید؟ شاید کلاهبردار پشت خط باشد! / هشدار پلیس فتا درباره دیپ‌فیک

سرقت ۲۵ میلیون دلاری با یک تماس ویدئویی جعلی

ماجرای Arup در ژانویه ۲۰۲۴ آغاز شد؛ زمانی که یکی از کارکنان بخش مالی دفتر هنگ‌کنگ این شرکت پیامی دریافت کرد که به‌ظاهر از سوی مدیر مالی شرکت در بریتانیا ارسال شده بود. موضوع پیام، یک تراکنش محرمانه بود و کارمند برای بررسی آن وارد یک تماس ویدئویی شد.

آنچه باعث شد کارمند به درخواست مهاجمان اعتماد کند، حضور ظاهری مدیر مالی و چند مدیر ارشد دیگر در تماس بود. چهره‌ها و صداها برای او آشنا بودند و جلسه نیز شبیه یک نشست واقعی به نظر می‌رسید.

این کارمند ۱۵ انتقال وجه انجام داد که مجموع آن‌ها به حدود ۲۰۰ میلیون دلار هنگ‌کنگ، معادل ۲۵.۶ میلیون دلار آمریکا، رسید. Fortune بعدها تأیید کرد که در این حادثه از تصاویر و صداهای جعلی استفاده شده و هیچ‌یک از سیستم‌های داخلی شرکت هک نشده بودند؛ در واقع، مهاجمان به‌جای نفوذ مستقیم به زیرساخت، از مهندسی اجتماعی تقویت‌شده با هوش مصنوعی استفاده کرده بودند.

نکته مهم در این رویداد این بود که مهاجم برای سرقت پول نیازی به نفوذ به شبکه شرکت نداشت؛ کافی بود بتواند کارمند را متقاعد کند که دستور انتقال پول از سوی فردی معتبر صادر شده است.

چرا تشخیص دیپ‌فیک برای انسان‌ها دشوار شده است؟

یکی از خطرناک‌ترین تصورات درباره دیپ‌فیک این است که کاربران می‌توانند با توجه به حرکات غیرطبیعی صورت، کیفیت صدا، تأخیر تصویر یا سایر نشانه‌های ظاهری، محتوای جعلی را تشخیص دهند. با این حال، تحقیقات علمی دانشگاه کالج لندن خلاف این تصور را نشان می‌دهند.

پژوهشگران دانشگاه کالج لندن در مطالعه‌ای که روی ۵۲۹ نفر انجام دادند، دریافتند افراد تنها در ۷۳ درصد موارد توانستند صدای تولیدشده با هوش مصنوعی را از صدای واقعی تشخیص دهند. حتی ارائه آموزش و نمونه‌های دیپ‌فیک نیز تنها تا حد محدودی در عملکرد افراد بهبود ایجاد کرد.

مطالعه‌ای گسترده‌تر که در سال ۲۰۲۴ نتایج ۵۶ پژوهش و بیش از ۸۶ هزار شرکت‌کننده را بررسی کرد، تصویر نگران‌کننده‌تری ارائه داد. میانگین دقت کلی انسان‌ها در تشخیص دیپ‌فیک‌ها حدود ۵۵.۵۴ درصد بود؛ رقمی که از نظر آماری تفاوت معناداری با شانس تصادفی نداشت. دقت تشخیص در ویدئو نیز حدود ۵۷.۳۱ درصد گزارش شد.

به این ترتیب، آموزش کارکنان برای شناسایی نشانه‌های ظاهری دیپ‌فیک می‌تواند مفید باشد، اما نمی‌تواند به‌تنهایی یک کنترل امنیتی قابل اتکا محسوب شود.

وقتی «دیدن» و «شنیدن» دیگر سند هویت نیست

در گذشته، یکی از ساده‌ترین روش‌های تأیید هویت این بود که فرد را ببینیم یا صدای او را بشنویم. اما هوش مصنوعی همین دو مؤلفه را به نقطه آسیب‌پذیر تبدیل کرده است.

امروز مهاجم می‌تواند از تصاویر، ویدئوها، سخنرانی‌ها و فایل‌های صوتی عمومی یک مدیر استفاده کند و نسخه‌ای مصنوعی از چهره و صدای او بسازد. بنابراین اگر کارمند بر اساس این گزاره تصمیم بگیرد که «چهره‌اش را دیدم و صدایش را شناختم»، ممکن است در همان مسیری قرار گرفته باشد که مهاجم طراحی کرده است.

به بیان ساده‌تر، دیپ‌فیک مشکل احراز هویت را از تشخیص «فرد کیست؟» به تشخیص «آیا این ارتباط واقعاً از کانال معتبر انجام شده است؟» تغییر داده است.

تهدید جدید؛ کارمند جعلی وارد سازمان می‌شود

خطر دیپ‌فیک تنها به تماس‌های جعلی و انتقال پول محدود نیست. مهاجمان می‌توانند از جعل هویت برای ورود به خود سازمان نیز استفاده کنند.

شرکت امنیت سایبری KnowBe4 در سال ۲۰۲۴ اعلام کرد فردی را استخدام کرده که هویت واقعی او جعلی بود. این فرد با استفاده از اطلاعات هویتی یک شهروند واقعی آمریکا، تصویر تقویت‌شده با هوش مصنوعی و سایر اطلاعات ساختگی توانسته بود مراحل استخدام را پشت سر بگذارد.

KnowBe4 حتی یک لپ‌تاپ و کلید احراز هویت FIDO در اختیار این فرد قرار داد. اما پس از روشن شدن دستگاه، تلاش‌هایی برای نصب بدافزار سرقت رمز عبور و دستکاری لاگ‌های سیستم شناسایی شد و مشخص شد فرد به شبکه‌ای از عملیات کارکنان جعلی کره شمالی مرتبط بوده است.

وزارت دادگستری آمریکا نیز در پرونده‌های مرتبط اعلام کرده است که کارکنان فناوری اطلاعات کره شمالی با استفاده از هویت‌های جعلی یا سرقت‌شده، موقعیت جغرافیایی خود را پنهان کرده و به‌صورت دورکاری در شرکت‌های مختلف جهان استخدام شده‌اند؛ در برخی موارد نیز از دسترسی شغلی خود برای دستیابی غیرمجاز به اطلاعات و شبکه‌های شرکت‌ها استفاده کرده‌اند.

در چنین شرایطی، دیپ‌فیک دیگر فقط یک ابزار تولید محتوای جعلی نیست؛ بلکه می‌تواند بخشی از یک زنجیره سرقت هویت، مهندسی اجتماعی و نفوذ سازمانی باشد.

ایران هم در معرض کلاهبرداری با جعل صدا قرار دارد

اگرچه نمونه‌ای با ابعاد مالی حادثه Arup در ایران گزارش نشده، اما نشانه‌های استفاده از جعل صوتی مبتنی بر هوش مصنوعی در کلاهبرداری‌های داخلی نیز دیده می‌شود.

رئیس پلیس فتا تهران بزرگ در مرداد ۱۴۰۵ درباره کلاهبرداری با شبیه‌سازی صدای نزدیکان هشدار داد و اعلام کرد مجرمان با استفاده از دیپ‌فیک می‌توانند صدای افراد را شبیه‌سازی کنند و با ایجاد موقعیت‌هایی مانند تصادف، بیماری یا گرفتاری، قربانی را برای انتقال فوری پول تحت فشار قرار دهند.

این شیوه نشان می‌دهد که الگوی حمله در ایران نیز به سمت سوءاستفاده از اعتماد صوتی حرکت کرده است؛ یعنی مهاجم به‌جای اینکه قربانی را با یک پیام متنی ناشناس متقاعد کند، از صدای فردی آشنا برای ایجاد احساس اعتماد و فوریت استفاده می‌کند.

راهکار مقابله با دیپ‌فیک چیست؟

شاید این پرسش برای شما نیز ایجاد شود که اگر دیگر نمی‌توان به چهره و صدا اعتماد کرد، راه‌حل چیست؟

پاسخ کارشناسان امنیت سایبری به یک اصل ساده بازمی‌گردد: احراز هویت باید مستقل از همان کانالی انجام شود که مهاجم قادر به جعل آن است.

برای مثال، اگر مدیرعامل در یک تماس تصویری از کارمند بخواهد مبلغی را انتقال دهد، تأیید این درخواست نباید از طریق همان تماس انجام شود. کارمند می‌تواند از یک شماره رسمی و از پیش ثبت‌شده با مدیر تماس بگیرد یا از یک سامانه داخلی مستقل برای تأیید درخواست استفاده کند.

برای تراکنش‌های حساس، حتی بهتر است تأیید دوم نیز در فرایند قرار گیرد؛ به این معنا که انتقال وجه بدون تأیید یک فرد مجاز دیگر امکان‌پذیر نباشد.

همچنین توصیه می‌شود در صورتی که تماسی از خانواده، دوستان یا آشنایان برای واریز وجه فوری داشتید، قبل از هرگونه اقدامی در این خصوص، با خود فرد تماس بگیرید و موضوع را مطرح کنید تا احتمال هرگونه کلاهبرداری از میان برداشته شود.

عبارت محرمانه؛ یک راهکار قدیمی برای یک تهدید جدید

یکی از روش‌های ساده‌ای که می‌تواند در کنار سایر کنترل‌ها مورد استفاده قرار گیرد، استفاده از عبارت محرمانه شفاهی است.

در این روش، اعضای یک تیم یا سازمان یک عبارت تصادفی و محرمانه دارند که در شرایط حساس برای احراز هویت از آن استفاده می‌کنند. اگر فردی در تماس ویدئویی یا صوتی ادعا کند مدیرعامل یا مدیر ارشد سازمان است، کارمند می‌تواند بدون تکیه بر چهره و صدا، درخواست کند عبارت محرمانه را بیان کند.

البته این روش تنها زمانی مؤثر است که عبارت محرمانه واقعاً مخفی بماند و استفاده از آن برای تراکنش‌های حساس بدون استثنا باشد. اگر مهاجم بتواند با ایجاد فشار یا اعلام «فوری بودن» درخواست، کارمند را وادار کند این مرحله را کنار بگذارد، کنترل امنیتی به‌طور کامل بی‌اثر خواهد شد.

کلید سخت‌افزاری؛ جایی که دیپ‌فیک نمی‌تواند آن را جعل کند

در کنار پروتکل‌های سازمانی، استفاده از احراز هویت مقاوم در برابر فیشینگ نیز اهمیت دارد.

آژانس امنیت سایبری و زیرساخت آمریکا (CISA) استفاده از FIDO/WebAuthn را به‌عنوان یکی از روش‌های در دسترس برای احراز هویت مقاوم در برابر فیشینگ توصیه می‌کند. این روش می‌تواند از طریق کلیدهای فیزیکی یا قابلیت‌های تعبیه‌شده در رایانه و تلفن همراه اجرا شود.

مزیت چنین راهکاری این است که مهاجم نمی‌تواند با جعل چهره، صدا یا یک پیام مدیر، عامل احراز هویت را شبیه‌سازی کند. به همین دلیل، برای تراکنش‌های مالی و دسترسی‌های حساس، ترکیب چند روش مختلف می‌تواند بسیار مؤثرتر از اتکا به یک نشانه واحد باشد.

روش‌های ترکیبی مؤثر عبارت‌اند از:

  • احراز هویت مقاوم در برابر فیشینگ مانند FIDO2؛
  • عبارت محرمانه اختصاصی برای تراکنش‌های حساس؛
  • تأیید درخواست از یک کانال مستقل؛
  • تأیید دو نفره برای انتقال‌های مالی بزرگ؛
  • محدود کردن دسترسی کارکنان بر اساس نقش؛
  • الزام به رعایت پروتکل حتی در شرایط اضطراری.

یک قانون ساده؛ «فوری» نباید به معنای «بدون احراز هویت» باشد

شاید مهم‌ترین درس پرونده Arup این باشد که مهاجم برای شکست سیستم امنیتی به فناوری پیچیده نیاز ندارد؛ کافی است بتواند فرایند تصمیم‌گیری انسان را دور بزند.

در حملات مهندسی اجتماعی، ایجاد حس فوریت یکی از ابزارهای اصلی مهاجم است. وقتی درخواست با عباراتی مانند «همین الان انجام بده»، «محرمانه است» یا «وقت نداریم» همراه می‌شود، احتمال اینکه کارمند از کنترل‌های امنیتی عبور کند افزایش می‌یابد.

بنابراین سازمان‌ها باید یک اصل روشن داشته باشند:

هیچ مقام سازمانی، حتی مدیرعامل، نباید بتواند با ایجاد فشار یا اعلام فوریت، فرایند احراز هویت و تأیید تراکنش را دور بزند.

در نهایت، مسئله اصلی در عصر دیپ‌فیک این نیست که آیا یک فرد در تماس تصویری شبیه مدیرعامل است یا صدایش مانند اوست. مسئله این است که هویت او از طریق یک مسیر مستقل، قابل اعتماد و مقاوم در برابر جعل تأیید شده باشد.

چراکه در دنیایی که هوش مصنوعی می‌تواند چهره و صدای مدیرعامل را بازسازی کند، شاید یکی از مؤثرترین راه‌های دفاعی، نه یک مدل هوش مصنوعی پیچیده، بلکه یک پروتکل ساده و قدیمی باشد که هیچ‌کس اجازه عبور از آن را ندارد.

گزارش خطا
ارسال پیام
captcha
پیشنهاد سردبیر بیشتر
آخرین اخبار
پربازدید
خانه پربازدید پربحث