needhelp
← Back to blog

เมื่อสูตรปี 1967 แก้ปัญหาที่ใหญ่ที่สุดของ AI สมัยใหม่

by needhelp
AI Research
Reinforcement Learning
Mathematics
Scientific Discovery

การแก้ไขอันสง่างามของ Sutton

Reinforcement learning มีความลับสกปรก: การฝึกโมเดลใน streaming environments พังโดยพื้นฐาน Richard Sutton เพิ่งแก้มัน วิธีแก้ของเขาเกือบจะ embarrassingly elegant: สูตรจาก 1967

ผลลัพธ์? Computation ลดลงเหลือ 1/140 ของ algorithms กระแสหลัก

สถิติคณิตศาสตร์ที่ทำให้ Google ตกใจ

Wang Yiping ใช้ AI tools ที่สร้างเอง ทำสิ่งที่ทีมวิจัยของ Google ทำไม่ได้: ทำลาย Ramsey number lower bound ที่ต้านทานการปรับปรุงมา 30 ปี

อ้างอิง

  • Richard Sutton, “Intent Update Algorithm”

Share this page