needhelp
← Back to blog

وقتی یک فرمول ۱۹۶۷ بزرگترین مشکل هوش مصنوعی مدرن را حل می‌کند

by needhelp
AI Research
Reinforcement Learning
Mathematics
Scientific Discovery

راه‌حل زیبای ساتن

یادگیری تقویتی یک راز کثیف دارد: آموزش مدل‌ها در محیط‌های streaming اساساً شکسته است. الگوریتم‌هایی که در محیط‌های آزمایشگاهی تمیز به زیبایی کار می‌کنند وقتی در دنیای واقعی که داده پیوسته می‌رسد و توزیع‌ها تغییر می‌کنند مستقر می‌شوند فرومی‌ریزند.

ریچارد ساتن، پدرخوانده یادگیری تقویتی، همین الان آن را رفع کرد. و راه‌حل او تقریباً شرم‌آور زیباست: یک فرمول از ۱۹۶۷.

نتیجه؟ محاسبات به ۱۴۰/۱ الگوریتم‌های جریان اصلی کاهش می‌یابد.

رکورد ریاضی که گوگل را شوکه کرد

در حالی که ساتن RL را رفع می‌کرد، Wang Yiping—یک فارغ‌التحصیل دانشگاه ژجیانگ—از ابزارهای هوش مصنوعی خودساخته برای انجام کاری که تیم تحقیقاتی گوگل نمی‌توانست استفاده کرد: شکستن کران پایین عدد رمزی، مسئله‌ای که ۳۰ سال در برابر بهبود مقاومت کرده بود.

Share this page