เมื่อสูตรปี 1967 แก้ปัญหาที่ใหญ่ที่สุดของ AI สมัยใหม่
by needhelp
AI Research
Reinforcement Learning
Mathematics
Scientific Discovery
การแก้ไขอันสง่างามของ Sutton
Reinforcement learning มีความลับสกปรก: การฝึกโมเดลใน streaming environments พังโดยพื้นฐาน Richard Sutton เพิ่งแก้มัน วิธีแก้ของเขาเกือบจะ embarrassingly elegant: สูตรจาก 1967
ผลลัพธ์? Computation ลดลงเหลือ 1/140 ของ algorithms กระแสหลัก
สถิติคณิตศาสตร์ที่ทำให้ Google ตกใจ
Wang Yiping ใช้ AI tools ที่สร้างเอง ทำสิ่งที่ทีมวิจัยของ Google ทำไม่ได้: ทำลาย Ramsey number lower bound ที่ต้านทานการปรับปรุงมา 30 ปี
อ้างอิง
- Richard Sutton, “Intent Update Algorithm”