Anthropic将Claude Code Auto Mode设为默认,测试显示识别危险操作优于人工审核

作者
KOMCHAD
作者KOMCHAD
KOMCHAD 报道 IT、AI、智能手机、数码产品、电脑、网络安全与创新领域的最新资讯。

Anthropic准备减少开发者使用Claude Code时需要人工确认的次数,并从8月14日起为Pro、Max和Team账户默认启用Auto Mode。

在这一模式下,Claude Code通常不会在每个步骤停下来请求授权,而是继续执行任务。

如果系统判断某个操作不可逆、具有破坏性,或目标位于用户环境之外,则会暂停执行。

Claude Code将减少权限请求

传统模式下,Claude Code会在部分操作前要求用户确认。

Auto Mode则让常规操作自动继续,只有安全系统识别为较高风险时才进行干预。

Auto Mode检测危险操作的效果更高

Anthropic对1,053名付费测试用户进行了研究。

Auto Mode识别出89%的有害操作。

人工审核仅识别出13.6%。

Anthropic还发现,用户在手动模式下批准了97%的Claude Code权限请求。

人工批准可能变成习惯动作

频繁出现权限弹窗可能让用户形成不仔细检查就直接批准的习惯。

Auto Mode试图把部分判断交给Claude Code的安全系统,只在风险较高时要求人工介入。

Claude Code团队已使用数月

Claude Code负责人Boris Cherny在X上表示,他和团队已经连续数月只使用Auto Mode。

他表示很难想象重新使用传统权限提示。

增加Prompt Injection筛查和Hard Deny规则

Anthropic也在增加其他安全措施,包括Prompt Injection Screening。

此外还有可自定义的Hard Deny Rules,可阻止包括Data Exfiltration在内的特定行为。

这些机制旨在让Claude Code拥有更高自主性的同时限制高风险操作。

分享本文
作者KOMCHAD
关注:
KOMCHAD 报道 IT、AI、智能手机、数码产品、电脑、网络安全与创新领域的最新资讯。
发表评论