کد خبر: ۶۴۴

Claude Code از این پس اقدامات خود را با هوش مصنوعی بررسی می‌کند؛ تصمیم جدید Anthropic

کلاد کد

Anthropic از ۱۴ اوت Auto Mode را به‌صورت پیش‌فرض در Claude Code فعال می‌کند؛ قابلیتی که با کمک هوش مصنوعی اقدامات خطرناک را شناسایی و مسدود می‌کند.

شرکت Anthropic اعلام کرده است که از ۱۴ اوت ۲۰۲۶، حالت Auto Mode در Claude Code برای کاربران جدید پلن‌های Pro، Max و Team به‌صورت پیش‌فرض فعال خواهد شد. این قابلیت با استفاده از یک سیستم هوش مصنوعی، اقدامات Claude را بررسی می‌کند تا از اجرای دستورات مخرب، غیرقابل بازگشت یا خارج از محیط کاربر جلوگیری شود.

کاربرانی که پیش‌تر حالت پیش‌فرض دیگری را برای Claude Code انتخاب کرده‌اند، ممکن است یک‌بار پیامی دریافت کنند که از آن‌ها می‌پرسد آیا می‌خواهند به Auto Mode تغییر کنند یا خیر.

Auto Mode چیست و چگونه کار می‌کند؟

در حالت Auto Mode، هر Tool Call یا فراخوانی ابزار توسط Claude از یک طبقه‌بندی‌کننده امنیتی عبور می‌کند. این سیستم تلاش می‌کند اقداماتی را که ممکن است مخرب، غیرقابل بازگشت یا خارج از محدوده محیط کاربر باشند، شناسایی و مسدود کند.

اگر یک اقدام خطرناک تشخیص داده شود، Claude می‌تواند راهکار امن‌تری پیدا کند یا برای ادامه کار از کاربر اجازه بگیرد. در صورتی که Claude پس از سه مسدودسازی متوالی یا ۲۰ مسدودسازی در یک جلسه نتواند کار را ادامه دهد، سیستم دوباره به حالت تأیید دستی بازمی‌گردد.

ادعای Anthropic درباره امنیت Auto Mode

Anthropic برای مقایسه Auto Mode با تأیید دستی، آزمایشی کنترل‌شده با حضور ۱٬۰۵۳ آزمایش‌کننده حرفه‌ای پولی انجام داده است.

بر اساس نتایج اعلام‌شده از سوی این شرکت، کاربران در حالت بررسی دستی تنها ۱۳.۶ درصد از دستورات خطرناک را مسدود کردند، در حالی که Auto Mode توانست ۸۹ درصد از این دستورات را مسدود کند.

Anthropic همچنین اعلام کرده است که در بررسی جلسات واقعی، احتمال انجام اقدامات مخربی که کاربران صراحتاً درخواست نکرده بودند، در حالت تأیید دستی بیش از دو برابر Auto Mode بوده است.

مقابله با حملات Prompt Injection

یکی از اهداف اصلی Auto Mode، مقابله با Prompt Injection است؛ حملاتی که در آن دستورهای مخرب داخل وب‌سایت‌ها، فایل‌ها یا سایر محتواها قرار می‌گیرند تا یک عامل هوش مصنوعی را فریب دهند.

طبق یک ارزیابی مستقل توسط Trajectory Labs، هیچ‌یک از ۷۲۰ حمله Prompt Injection آزمایش‌شده علیه مدل‌های Claude در حالت Auto Mode موفق نبوده‌اند.

در همین آزمایش، نرخ موفقیت حملات علیه GPT-5.6 Sol در حالت Auto-review کدکس ۵.۸۳ درصد و در حالت Full-access برابر با ۱۹.۰۳ درصد گزارش شده است.

البته این نتایج لزوماً به معنای ایمن‌تر بودن کامل یک محصول نسبت به محصول دیگر نیست؛ زیرا برخی لایه‌های امنیتی مربوط به یکپارچه‌سازی‌های اختصاصی مرورگر در این آزمایش بررسی نشده‌اند.

Auto Mode برای همه کاربران اجباری نیست

Anthropic فعلاً Auto Mode را در سرویس‌هایی مانند Claude Enterprise، Claude API، Anthropic Platform، Amazon Bedrock، Google Cloud’s Agent Platform و Microsoft Foundry به‌صورت اختیاری نگه می‌دارد.

این شرکت قصد دارد طی ماه آینده Auto Mode را در این پلتفرم‌ها نیز به حالت پیش‌فرض تبدیل کند. Anthropic همچنین اعلام کرده است که دیگر هزینه اضافی مربوط به توان محاسباتی موردنیاز برای اجرای طبقه‌بندی‌کننده امنیتی را دریافت نخواهد کرد.

آیا Auto Mode کاملاً امن است؟

Anthropic تأکید کرده که Auto Mode خطر را برای بسیاری از کاربران کاهش می‌دهد، اما امنیت را به‌طور کامل تضمین نمی‌کند. دلیل آن این است که تصمیم‌گیری درباره ایمن یا خطرناک بودن اقدامات همچنان توسط یک سیستم هوش مصنوعی انجام می‌شود.

به همین دلیل، Anthropic توصیه می‌کند کاربران هنگام انجام تغییرات حساس، مانند تغییر در سیستم‌های Production یا زیرساخت‌های حیاتی، همچنان اقدامات Claude را پیش از اجرا بررسی کنند.

Anthropic خودش از Auto Mode استفاده می‌کند

Anthropic اعلام کرده است که Auto Mode را در تمام جریان‌های کاری Claude Code در داخل شرکت استفاده می‌کند. طبق اعلام این شرکت، این سیستم تاکنون از مواردی مانند نشت داده به خارج از شبکه، اجرای یک عملیات مخرب گسترده و افزایش بیش از حد سطح دسترسی جلوگیری کرده است.

این شرکت همچنین قابلیت‌هایی مانند Hard Deny، قوانین مربوط به دسترسی و اشتراک‌گذاری داده‌ها، بررسی وضعیت Git پیش از اقدامات مخرب و سیستم شناسایی Prompt Injection را برای افزایش امنیت Auto Mode اضافه کرده است.

در مجموع، تغییر جدید Anthropic نشان‌دهنده حرکت Claude Code به سمت اجرای خودکارتر وظایف برنامه‌نویسی با نظارت امنیتی مبتنی بر هوش مصنوعی است. این تغییر می‌تواند تعداد درخواست‌های تأیید دستی را کاهش دهد و به Claude اجازه دهد مدت بیشتری به‌صورت مستقل کار کند، در حالی که یک لایه امنیتی مبتنی بر AI اقدامات پرریسک را بررسی می‌کند.

گزارش خطا
ارسال پیام
captcha
پیشنهاد سردبیر بیشتر
آخرین اخبار
پربازدید
خانه پربازدید پربحث