وقتی یک فرمول ۱۹۶۷ بزرگترین مشکل هوش مصنوعی مدرن را حل میکند
by needhelp
AI Research
Reinforcement Learning
Mathematics
Scientific Discovery
راهحل زیبای ساتن
یادگیری تقویتی یک راز کثیف دارد: آموزش مدلها در محیطهای streaming اساساً شکسته است. الگوریتمهایی که در محیطهای آزمایشگاهی تمیز به زیبایی کار میکنند وقتی در دنیای واقعی که داده پیوسته میرسد و توزیعها تغییر میکنند مستقر میشوند فرومیریزند.
ریچارد ساتن، پدرخوانده یادگیری تقویتی، همین الان آن را رفع کرد. و راهحل او تقریباً شرمآور زیباست: یک فرمول از ۱۹۶۷.
نتیجه؟ محاسبات به ۱۴۰/۱ الگوریتمهای جریان اصلی کاهش مییابد.
رکورد ریاضی که گوگل را شوکه کرد
در حالی که ساتن RL را رفع میکرد، Wang Yiping—یک فارغالتحصیل دانشگاه ژجیانگ—از ابزارهای هوش مصنوعی خودساخته برای انجام کاری که تیم تحقیقاتی گوگل نمیتوانست استفاده کرد: شکستن کران پایین عدد رمزی، مسئلهای که ۳۰ سال در برابر بهبود مقاومت کرده بود.