Anthropic เปิด Claude Code Auto Mode เป็นค่าเริ่มต้น หลังผลทดสอบพบจับการกระทำอันตรายได้ดีกว่ามนุษย์

โดย
KOMCHAD
โดยKOMCHAD
KOMCHAD นำเสนอข่าวไอที AI สมาร์ตโฟน Gadget คอมพิวเตอร์ ความปลอดภัยไซเบอร์ และนวัตกรรมล่าสุดในภาษาไทย

Anthropic เตรียมลดจำนวนครั้งที่นักพัฒนาต้องกดยืนยันระหว่างใช้งาน Claude Code โดยจะเปิด Auto Mode เป็นค่าเริ่มต้นสำหรับบัญชี Pro, Max และ Team ตั้งแต่วันที่ 14 สิงหาคม

การเปลี่ยนแปลงนี้หมายความว่า Claude Code โดยทั่วไปจะสามารถทำงานต่อได้โดยไม่ต้องหยุดเพื่อขออนุญาตผู้ใช้ในทุกขั้นตอน แต่ Auto Mode จะหยุดเมื่อระบบประเมินว่าการกระทำนั้นไม่สามารถย้อนกลับได้ มีลักษณะทำลาย หรือมุ่งออกไปนอก Environment ของผู้ใช้

Anthropic เปิดตัว Auto Mode เวอร์ชันทดสอบครั้งแรกเมื่อเดือนมีนาคม โดยวางแนวคิดให้เป็นจุดสมดุลระหว่างการให้ AI Coding Agent ทำงานได้เร็วและอัตโนมัติมากขึ้น กับการคงการควบคุมของผู้ใช้

Claude Code จะขอ Permission น้อยลง

ในระบบ Permission แบบเดิม Claude Code สามารถหยุด Workflow เพื่อถามผู้ใช้ก่อนว่าควรดำเนินการบางอย่างต่อหรือไม่

Auto Mode เปลี่ยนพฤติกรรมดังกล่าว โดยแทนที่จะส่งคำขออนุมัติในทุกขั้นตอน Claude Code จะทำงานต่อโดยอัตโนมัติ เว้นแต่ระบบความปลอดภัยจะประเมินว่าการกระทำนั้นอยู่ในกลุ่มความเสี่ยงสูงกว่า

Anthropic ระบุว่าการกระทำที่ทำให้ระบบหยุดเพื่อให้ผู้ใช้เข้ามาควบคุม ได้แก่ การกระทำที่ย้อนกลับไม่ได้ มีลักษณะทำลาย หรือมีเป้าหมายอยู่นอก Environment ของผู้ใช้

บริษัทจะเริ่มทำให้พฤติกรรมนี้เป็นค่าเริ่มต้นสำหรับผู้ใช้ Pro, Max และ Team ในวันที่ 14 สิงหาคม

Anthropic ระบุ Auto Mode ปลอดภัยกว่า Manual Review

Anthropic เปิดเผยว่าการทดสอบภายในให้ผลลัพธ์ที่น่าสนใจ โดย Auto Mode สามารถตรวจจับการกระทำที่เป็นอันตรายได้ดีกว่าผู้ใช้ที่ตรวจสอบ Permission ด้วยตัวเอง

ในการศึกษากับผู้ใช้แบบเสียเงินจำนวน 1,053 คน Auto Mode ตรวจจับการกระทำที่เป็นอันตรายได้ 89%

ขณะที่มนุษย์ซึ่งใช้ระบบอนุมัติแบบ Manual ตรวจจับได้เพียง 13.6%

Anthropic มองว่าสาเหตุหนึ่งของช่องว่างดังกล่าวอาจเกิดจาก Permission Dialog ที่ปรากฏซ้ำๆ จนกลายเป็นความเคยชิน โดยบริษัทพบว่าผู้ใช้กดอนุมัติ Permission Prompt ของ Claude Code ถึง 97% ของครั้งทั้งหมดในระบบ Manual Review

ตัวเลขเหล่านี้สะท้อนจุดอ่อนที่อาจเกิดขึ้นกับระบบความปลอดภัยที่พึ่งพาการตัดสินใจจากผู้ใช้ซ้ำๆ ระหว่างการทำงาน

การอนุมัติของมนุษย์อาจกลายเป็นความเคยชิน

Permission Prompt ถูกออกแบบมาเพื่อให้ผู้ใช้สามารถควบคุมการทำงานของระบบได้ แต่การถูกรบกวนบ่อยครั้งก็สามารถทำให้ผู้ใช้เริ่มกดอนุมัติโดยอัตโนมัติ

ข้อมูลของ Anthropic บ่งชี้ว่าผู้ใช้อาจคุ้นเคยกับการกด Allow จนไม่ได้พิจารณาการกระทำที่ระบบร้องขออย่างละเอียดในทุกครั้ง

Auto Mode จึงถูกออกแบบให้ย้ายการตัดสินใจบางส่วนเข้าสู่ระบบความปลอดภัยของ Claude Code โดยปล่อยให้การทำงานทั่วไปดำเนินต่อไป และขอให้ผู้ใช้เข้ามาแทรกแซงเฉพาะเมื่อพบพฤติกรรมที่ถูกจัดอยู่ในกลุ่มความเสี่ยงสูงกว่า

ทีม Claude Code ใช้ Auto Mode ภายในมาหลายเดือน

Boris Cherny หัวหน้าทีม Claude Code ระบุผ่านโพสต์บน X ว่าเขาและทีมใช้งาน Auto Mode เพียงอย่างเดียวมาหลายเดือนแล้ว

Cherny ระบุว่าเขาไม่สามารถจินตนาการได้ว่าจะกลับไปใช้ Permission Prompt แบบเดิม

คำกล่าวดังกล่าวแสดงให้เห็นว่าทีม Claude Code ภายใน Anthropic ได้ใช้งาน Workflow นี้จริงอยู่แล้ว ก่อนที่จะขยายให้กลายเป็นค่าเริ่มต้นสำหรับผู้ใช้แบบเสียเงินในวงกว้าง

Anthropic เพิ่ม Prompt Injection Screening และ Hard Deny Rules

Anthropic ระบุว่าบริษัทกำลังเพิ่มระบบป้องกันเพิ่มเติมให้ Claude Code ด้วย

หนึ่งในนั้นคือ Prompt Injection Screening ซึ่งออกแบบมาเพื่อตรวจจับความพยายามที่จะควบคุมหรือหลอก AI Coding Agent ผ่านคำสั่งที่เป็นอันตรายหรือมาจากแหล่งที่ไม่น่าเชื่อถือ

บริษัทยังเพิ่มระบบ Customizable Hard Deny Rules

กฎเหล่านี้สามารถกำหนดให้ป้องกันพฤติกรรมบางประเภทแบบเด็ดขาด รวมถึงความพยายามในการนำข้อมูลออกจากระบบหรือ Data Exfiltration

ระบบป้องกันเพิ่มเติมทั้งหมดถูกออกแบบมาเพื่อสนับสนุน Workflow ที่ Claude Code สามารถทำงานได้อัตโนมัติมากขึ้น ขณะเดียวกันยังจำกัดการกระทำที่อาจก่อให้เกิดความเสี่ยงด้านความปลอดภัยอย่างมีนัยสำคัญ

แชร์บทความนี้
โดยKOMCHAD
ติดตาม
KOMCHAD นำเสนอข่าวไอที AI สมาร์ตโฟน Gadget คอมพิวเตอร์ ความปลอดภัยไซเบอร์ และนวัตกรรมล่าสุดในภาษาไทย
ฝากความคิดเห็น