مجموعی The RL Hub یک کتاب و آزمایشگاه متنباز فارسی برای یادگیری تقویتی است. هدف ما ساختن مسیری است که از شهود و احتمال شروع شود، به MDP و روشهای tabular برسد و در ادامه مباحث پیشرفتهتر را با متن، فرمول، مثال و notebook قابلاجرا پوشش دهد.
مطالعهی کتاب · گفتوگو در Telegram
- ریپازیتوی The-RL-Hub.github.io: متن اصلی و وبسایت آموزشی
- ریپازیتوری RLH-Material: notebookها، پیادهسازیهای مرجع و تمرینهای اجرایی
- ریپازیتوری RL-Roadmap: نقشهی curriculum، پیشنیازها و منابع معتبر
- ریپازیتوری Tutorial-website-template: قالب مستقل برای انتشار آموزش Markdown
- ریپازیتوری .github: راهنمای مشارکت و استانداردهای مشترک سازمان
مقدمهی RL، سپس bandit، سپس contextual bandit، سپس احتمال، سپس MDP، سپس dynamic programming، سپس Monte Carlo temporal-difference learning
اصلاح علمی، بهبود ترجمه و نگارش، مثال تازه، notebook، آزمون و بهبود دسترسپذیری همگی مشارکت ارزشمندند. پیش از شروع، راهنمای مشارکت و راهنمای نگارش را بخوانید.