Claude Code از این پس اقدامات خود را با هوش مصنوعی بررسی میکند؛ تصمیم جدید Anthropic
Anthropic از ۱۴ اوت Auto Mode را بهصورت پیشفرض در Claude Code فعال میکند؛ قابلیتی که با کمک هوش مصنوعی اقدامات خطرناک را شناسایی و مسدود میکند.
شرکت Anthropic اعلام کرده است که از ۱۴ اوت ۲۰۲۶، حالت Auto Mode در Claude Code برای کاربران جدید پلنهای Pro، Max و Team بهصورت پیشفرض فعال خواهد شد. این قابلیت با استفاده از یک سیستم هوش مصنوعی، اقدامات Claude را بررسی میکند تا از اجرای دستورات مخرب، غیرقابل بازگشت یا خارج از محیط کاربر جلوگیری شود.
کاربرانی که پیشتر حالت پیشفرض دیگری را برای Claude Code انتخاب کردهاند، ممکن است یکبار پیامی دریافت کنند که از آنها میپرسد آیا میخواهند به Auto Mode تغییر کنند یا خیر.
Auto Mode چیست و چگونه کار میکند؟
در حالت Auto Mode، هر Tool Call یا فراخوانی ابزار توسط Claude از یک طبقهبندیکننده امنیتی عبور میکند. این سیستم تلاش میکند اقداماتی را که ممکن است مخرب، غیرقابل بازگشت یا خارج از محدوده محیط کاربر باشند، شناسایی و مسدود کند.
اگر یک اقدام خطرناک تشخیص داده شود، Claude میتواند راهکار امنتری پیدا کند یا برای ادامه کار از کاربر اجازه بگیرد. در صورتی که Claude پس از سه مسدودسازی متوالی یا ۲۰ مسدودسازی در یک جلسه نتواند کار را ادامه دهد، سیستم دوباره به حالت تأیید دستی بازمیگردد.
ادعای Anthropic درباره امنیت Auto Mode
Anthropic برای مقایسه Auto Mode با تأیید دستی، آزمایشی کنترلشده با حضور ۱٬۰۵۳ آزمایشکننده حرفهای پولی انجام داده است.
بر اساس نتایج اعلامشده از سوی این شرکت، کاربران در حالت بررسی دستی تنها ۱۳.۶ درصد از دستورات خطرناک را مسدود کردند، در حالی که Auto Mode توانست ۸۹ درصد از این دستورات را مسدود کند.
Anthropic همچنین اعلام کرده است که در بررسی جلسات واقعی، احتمال انجام اقدامات مخربی که کاربران صراحتاً درخواست نکرده بودند، در حالت تأیید دستی بیش از دو برابر Auto Mode بوده است.
مقابله با حملات Prompt Injection
یکی از اهداف اصلی Auto Mode، مقابله با Prompt Injection است؛ حملاتی که در آن دستورهای مخرب داخل وبسایتها، فایلها یا سایر محتواها قرار میگیرند تا یک عامل هوش مصنوعی را فریب دهند.
طبق یک ارزیابی مستقل توسط Trajectory Labs، هیچیک از ۷۲۰ حمله Prompt Injection آزمایششده علیه مدلهای Claude در حالت Auto Mode موفق نبودهاند.
در همین آزمایش، نرخ موفقیت حملات علیه GPT-5.6 Sol در حالت Auto-review کدکس ۵.۸۳ درصد و در حالت Full-access برابر با ۱۹.۰۳ درصد گزارش شده است.
البته این نتایج لزوماً به معنای ایمنتر بودن کامل یک محصول نسبت به محصول دیگر نیست؛ زیرا برخی لایههای امنیتی مربوط به یکپارچهسازیهای اختصاصی مرورگر در این آزمایش بررسی نشدهاند.
Auto Mode برای همه کاربران اجباری نیست
Anthropic فعلاً Auto Mode را در سرویسهایی مانند Claude Enterprise، Claude API، Anthropic Platform، Amazon Bedrock، Google Cloud’s Agent Platform و Microsoft Foundry بهصورت اختیاری نگه میدارد.
این شرکت قصد دارد طی ماه آینده Auto Mode را در این پلتفرمها نیز به حالت پیشفرض تبدیل کند. Anthropic همچنین اعلام کرده است که دیگر هزینه اضافی مربوط به توان محاسباتی موردنیاز برای اجرای طبقهبندیکننده امنیتی را دریافت نخواهد کرد.
آیا Auto Mode کاملاً امن است؟
Anthropic تأکید کرده که Auto Mode خطر را برای بسیاری از کاربران کاهش میدهد، اما امنیت را بهطور کامل تضمین نمیکند. دلیل آن این است که تصمیمگیری درباره ایمن یا خطرناک بودن اقدامات همچنان توسط یک سیستم هوش مصنوعی انجام میشود.
به همین دلیل، Anthropic توصیه میکند کاربران هنگام انجام تغییرات حساس، مانند تغییر در سیستمهای Production یا زیرساختهای حیاتی، همچنان اقدامات Claude را پیش از اجرا بررسی کنند.
Anthropic خودش از Auto Mode استفاده میکند
Anthropic اعلام کرده است که Auto Mode را در تمام جریانهای کاری Claude Code در داخل شرکت استفاده میکند. طبق اعلام این شرکت، این سیستم تاکنون از مواردی مانند نشت داده به خارج از شبکه، اجرای یک عملیات مخرب گسترده و افزایش بیش از حد سطح دسترسی جلوگیری کرده است.
این شرکت همچنین قابلیتهایی مانند Hard Deny، قوانین مربوط به دسترسی و اشتراکگذاری دادهها، بررسی وضعیت Git پیش از اقدامات مخرب و سیستم شناسایی Prompt Injection را برای افزایش امنیت Auto Mode اضافه کرده است.
در مجموع، تغییر جدید Anthropic نشاندهنده حرکت Claude Code به سمت اجرای خودکارتر وظایف برنامهنویسی با نظارت امنیتی مبتنی بر هوش مصنوعی است. این تغییر میتواند تعداد درخواستهای تأیید دستی را کاهش دهد و به Claude اجازه دهد مدت بیشتری بهصورت مستقل کار کند، در حالی که یک لایه امنیتی مبتنی بر AI اقدامات پرریسک را بررسی میکند.