Anthropic、Claude CodeのAuto Modeを標準化 有害操作の検知率は人間の手動確認を上回る

投稿者
KOMCHAD
投稿者KOMCHAD
KOMCHAD นำเสนอข่าวไอที AI สมาร์ตโฟน Gadget คอมพิวเตอร์ ความปลอดภัยไซเบอร์ และนวัตกรรมล่าสุดในภาษาไทย

Anthropicは、Claude Code利用時に開発者が承認を求められる回数を減らし、8月14日からPro、Max、TeamアカウントでAuto Modeをデフォルトにします。

Auto Modeでは、Claude Codeは各ステップで停止して許可を求める代わりに、通常はそのまま処理を続行します。

ただし、操作が不可逆的、破壊的、またはユーザー環境の外部を対象としていると判断された場合は停止します。

Claude Codeの許可確認が減少

従来の権限モデルでは、Claude Codeは特定の操作前にユーザーへ確認を求めます。

Auto Modeでは、安全システムが高リスクと判断しない限り自動で続行します。

Anthropicによると、不可逆的、破壊的、外部環境を対象とする操作が介入対象です。

Auto Modeは手動確認より高い検知率

Anthropicは1,053人の有料ユーザーを対象にテストを実施しました。

Auto Modeは有害な操作の89%を検知しました。

一方、人間による手動確認では13.6%でした。

同社によると、ユーザーはClaude CodeのPermission Promptの97%を承認していました。

許可確認の習慣化が問題に

頻繁なPermission Promptは、ユーザーが内容を十分に確認せず承認する習慣につながる可能性があります。

Auto Modeは通常操作を自動化し、高リスク操作だけを人間の判断に回す設計です。

Claude Codeチームはすでに常用

Claude Code責任者のBoris Cherny氏はXで、チームと自身が数か月にわたってAuto Modeのみを使用していると説明しました。

従来のPermission Promptには戻れないとも述べています。

Prompt Injection対策も強化

AnthropicはPrompt Injection Screeningも追加しています。

さらにCustomizable Hard Deny Rulesを導入し、Data Exfiltrationなど特定の行為を明確に禁止できます。

これらの仕組みにより、Claude Codeの自律性を高めながら高リスクな操作を制限します。

この記事を共有
投稿者KOMCHAD
フォロー:
KOMCHAD นำเสนอข่าวไอที AI สมาร์ตโฟน Gadget คอมพิวเตอร์ ความปลอดภัยไซเบอร์ และนวัตกรรมล่าสุดในภาษาไทย
コメントを残す