Anthropic将Claude Code Auto Mode设为默认,测试显示识别危险操作优于人工审核

作者
KOMCHAD
作者KOMCHAD
KOMCHAD นำเสนอข่าวไอที AI สมาร์ตโฟน Gadget คอมพิวเตอร์ ความปลอดภัยไซเบอร์ และนวัตกรรมล่าสุดในภาษาไทย

Anthropic准备减少开发者使用Claude Code时需要人工确认的次数,并从8月14日起为Pro、Max和Team账户默认启用Auto Mode。

在这一模式下,Claude Code通常不会在每个步骤停下来请求授权,而是继续执行任务。

如果系统判断某个操作不可逆、具有破坏性,或目标位于用户环境之外,则会暂停执行。

Claude Code将减少权限请求

传统模式下,Claude Code会在部分操作前要求用户确认。

Auto Mode则让常规操作自动继续,只有安全系统识别为较高风险时才进行干预。

Auto Mode检测危险操作的效果更高

Anthropic对1,053名付费测试用户进行了研究。

Auto Mode识别出89%的有害操作。

人工审核仅识别出13.6%。

Anthropic还发现,用户在手动模式下批准了97%的Claude Code权限请求。

人工批准可能变成习惯动作

频繁出现权限弹窗可能让用户形成不仔细检查就直接批准的习惯。

Auto Mode试图把部分判断交给Claude Code的安全系统,只在风险较高时要求人工介入。

Claude Code团队已使用数月

Claude Code负责人Boris Cherny在X上表示,他和团队已经连续数月只使用Auto Mode。

他表示很难想象重新使用传统权限提示。

增加Prompt Injection筛查和Hard Deny规则

Anthropic也在增加其他安全措施,包括Prompt Injection Screening。

此外还有可自定义的Hard Deny Rules,可阻止包括Data Exfiltration在内的特定行为。

这些机制旨在让Claude Code拥有更高自主性的同时限制高风险操作。

分享本文
作者KOMCHAD
关注:
KOMCHAD นำเสนอข่าวไอที AI สมาร์ตโฟน Gadget คอมพิวเตอร์ ความปลอดภัยไซเบอร์ และนวัตกรรมล่าสุดในภาษาไทย
发表评论