آنتروپیک نخستینبار در ماه مارس حالت خودکار Claude Code را بهصورت آزمایشی معرفی کرد. این قابلیت با هدف ایجاد تعادل میان سرعت انجام وظایف و کنترل کاربر طراحی شده است. در این حالت، Claude Code میتواند بدون درخواست تأیید کاربر برای هر مرحله به فعالیت خود ادامه دهد و تنها زمانی برای دریافت مجوز متوقف میشود که تشخیص دهد اقدام موردنظر ممکن است برگشتناپذیر، مخرب یا خارج از محیط کاری تعیینشده باشد.
حالت خودکار عملکرد بهتری از بررسی انسانی نشان داد
Anthropic میگوید نتایج آزمایشهای انجامشده نشان داده است که حالت خودکار در برخی سناریوها میتواند حتی عملکرد ایمنی بهتری نسبت به بررسی دستی داشته باشد.
در این آزمایش که با مشارکت ۱۰۵۳ کاربر پولی انجام شد، حالت خودکار توانست ۸۹ درصد از اقدامات مخرب را شناسایی کند؛ در حالی که بررسی انسانی تنها ۱۳٫۶ درصد از این اقدامات را تشخیص داد.
یکی از دلایل این اختلاف میتواند عادت کاربران به تأیید درخواستهای Claude Code باشد. طبق دادههای آنتروپیک، کاربران در ۹۷ درصد موارد، درخواستهای مجوز این ابزار را تأیید میکنند. در نتیجه، نظارت انسانی لزوماً به معنای بررسی دقیق و مستقل تمام اقدامات پیشنهادی هوش مصنوعی نیست.
بوریس چرنی، رئیس Claude Code، نیز در شبکه اجتماعی ایکس اعلام کرده است که خود او و تیمش ماههاست بهطور انحصاری از حالت خودکار استفاده میکنند و بازگشت به سیستم درخواست مجوز را دشوار میدانند.
قابلیتهای ایمنی جدید برای Claude Code
آنتروپیک همزمان با فعالسازی پیشفرض حالت خودکار، از توسعه قابلیتهای ایمنی جدید برای Claude Code نیز خبر داده است.
یکی از این قابلیتها، غربالگری سریع حملات تزریق فرمان (Prompt Injection) است که میتواند به شناسایی تلاشها برای وادار کردن مدل به انجام اقدامات ناخواسته کمک کند.
این شرکت همچنین امکان تعریف قوانین قابل تنظیم برای رد قطعی برخی اقدامات را اضافه میکند. این قوانین میتوانند برای جلوگیری از فعالیتهایی مانند استخراج یا انتقال غیرمجاز دادهها مورد استفاده قرار گیرند.
با فعال شدن پیشفرض حالت خودکار، Claude Code میتواند نقش مستقلتری در فرایند برنامهنویسی ایفا کند؛ با این حال، Anthropic همچنان محدودیتهایی را برای اقدامات پرخطر در نظر گرفته است تا میان خودکارسازی بیشتر و حفظ امنیت محیط توسعه تعادل برقرار شود.
