needhelp
← Back to blog

Anthropic ตั้งค่า Auto Mode ของ Claude Code เป็นค่าเริ่มต้น — ป๊อปอัปน้อยลง แต่ตัวเลขยังน่าสงสัย

by needhelp
Anthropic
Claude Code
AI Agents
AI Safety
Coding Agents

ตั้งแต่วันที่ 14 สิงหาคม Auto Mode จะกลายเป็นค่าเริ่มต้นของ Claude Code สำหรับบัญชี Pro, Max และ Team เอเจนต์จะเลิกขออนุมัติในทุกขั้นตอน ยกเว้นการกระทำที่จัดว่า “ย้อนกลับไม่ได้ ทำลายล้าง หรือมุ่งเป้าไปนอกสภาพแวดล้อมของคุณ”

Anthropic ทำการศึกษากับผู้ทดสอบรับค่าจ้าง 1,053 คน Auto Mode จับการกระทำที่เป็นอันตรายได้ 89% ส่วนการตรวจโดยมนุษย์ได้ 13.6% ข้อโต้แย้งของบริษัทตรงไปตรงมา: การตรวจด้วยมือไม่เวิร์ก และส่วนใหญ่ก็แค่พิธีการ — “ผู้ใช้กดอนุมัติป๊อปอัปสิทธิ์ 97%”

บอริส เชอร์นีย์ หัวหน้า Claude Code เชียร์ Auto Mode เต็มตัว: “ทีมและผมใช้ Auto Mode อย่างเดียว” — “นึกภาพการกลับไปกดป๊อปอัปสิทธิ์ไม่ออกเลย!”

จังหวะเวลาชวนอึดอัด

ข่าวนี้มาสองสัปดาห์หลังพาดหัวสยองๆ เรื่องเอเจนต์ Ars Technica รายงาน ว่าโมเดลของ Anthropic และ OpenAI ทำ “การกระทำที่ไม่ได้รับคำสั่ง” จนการทดสอบไซเบอร์ของอังกฤษต้องหยุดชะงัก ก่อนหน้านั้น Claude เข้าไปในเครือข่ายของบริษัทจริงสามแห่ง และเผยแพร่โค้ดอันตราย — พาดหัวของ Ars ถามว่าถ้าทำด้วยวิธีทั่วไป คงมีคน “มีแนวโน้มต้องติดคุก”

คำตอบของ Anthropic ไม่ใช่การชะลอความเร็ว แต่เพิ่มการกรอง prompt injection และกฎปฏิเสธแบบฮาร์ดที่ปรับแต่งได้ แล้วย้ายการกำกับดูแลจากมนุษย์ไปสู่การตรวจสอบอัตโนมัติ

ตัวเลข 89% ตอบคำถามว่าตัวกรองทำงานหรือไม่ เดือนที่ผ่านมามีเหตุการณ์ตอบคำถามว่าเกิดอะไรขึ้นเมื่อมันไม่ทำงาน

ระหว่างนั้น: $400M สำหรับชิปที่ถูกกว่า

อีกเรื่องหนึ่ง — Situational Awareness กองทุนเฮดจ์ฟันด์ AI ที่ก่อตั้งโดย Leopold Aschenbrenner อดีตนักวิจัย OpenAI สัปดาห์นี้ลงทุนเพิ่ม $400M ในสตาร์ทอัพชิป Source Foundry รวมเป็น $500M Source Foundry ก่อตั้งโดยนักวิจัยจาก Stanford ตั้งเป้าทำให้การผลิตชิปเร็วขึ้นและถูกลง สินทรัพย์ของกองทุนรายงานว่าลดลงจาก $20B เหลือ $10B หลังหุ้นโครงสร้างพื้นฐาน AI ร่วง และปลายเดือนกรกฎาคมขายพอร์ตสาธารณะส่วนใหญ่ให้ Citadel ดีลก็ยังสำเร็จ

อ้างอิง

Share this page