Anthropic מפעילה את auto mode של Claude Code כברירת מחדל, ומסתמכת על נתונים שאומרים שהמכונה זהירה מהאדם

Anthropic מפסיקה לבקש מאיתנו אישור לכל צעד של Claude Code. החברה הודיעה ש-auto mode יהפוך לברירת המחדל לחשבונות Pro, Max ו-Team החל מה-14 באוגוסט. מי שמצפה לכפתור "אני מאשר" בכל שלב בתהליך העבודה יצטרך להתרגל למציאות חדשה, שבה המודל פשוט רץ קדימה עד שהוא מזהה שהוא עומד לעשות משהו שלא הפיך.
איך עובד auto mode
במקום לעצור ולבקש אישור אנושי בכל שלב, Claude Code במצב auto ימשיך לפעול עד שהפעולה תזוהה כבלתי הפיכה, הרסנית, או מכוונת אל מחוץ לסביבת העבודה של המשתמש. Anthropic חשפה לראשונה גרסת בטא של auto mode במרץ, כשהמטרה המוצהרת הייתה למצוא את נקודת האיזון בין מהירות ביצוע לבקרה אנושית. עכשיו החברה מרגישה בנוח להפוך את ההגדרה לסטנדרטית.
המספרים מאחורי ההחלטה
התיעוד למהלך מגיע ממחקר עם 1,053 בודקים בתשלום. בבדיקות של Anthropic, auto mode תפס 89% מהפעולות המזיקות, לעומת סקירה אנושית ידנית שתפסה רק 13.6%. ההסבר שעולה מהנתונים עצמם פשוט למדי: משתמשים מאשרים 97% מבקשות ההרשאה ב-Claude Code. כשאתה לוחץ אישור בעיוורון באופן כמעט אוטומטי, הבקרה האנושית מאבדת את המשמעות שלה.
מה אומרים האחראים
בוריס צ'רני (Boris Cherny), שעומד בראש צוות Claude Code, כתב בפוסט ב-X שהוא והצוות שלו עובדים אך ורק ב-auto mode כבר חודשים רבים, ושהוא לא מסוגל לדמיין חזרה לחלוניות אישור. Anthropic גם מציינת שהוסיפה שכבות הגנה נוספות למערכת, כמו סינון ניסיונות prompt injection (הזרקת פקודות זדוניות לתוך הפרומפט) וכללי hard deny מותאמים אישית, שנועדו למנוע תרחישים של הדלפת מידע.