Anthropic si je tak jisté bezpečností funkce auto mode v Claude Code, že ji činí standardním nastavením pro nové relace od 14. srpna. Evaluační studie na 1 053 vývojářích prokázala, že když byly do průběhu sessií zapleteny jasně nebezpečné příkazy, auto mode zablokoval 89 procent těchto akcí, zatímco pouze 13,6 procenta lidských respondentů takový příkaz odmítlo. Anthropic se také nechala nezávisle testovat třetí stranou (Trajectory Labs) na otpornost vůči prompt injection útokům: v testu 72 scénářů nepřímé injekce se 720 pokusů o útok nepovedlo ani jeden proti modelům Claude Fable 5, Opus 5 a Sonnet 5. Společnost tak tím reaguje na problém označovaný jako "confirmation fatigue" — lidé vystaveni neustálým výzvám ke schválení akcí se stávají méně obezřetnými a bezpečnost klesá.