کتاب یادگیری تقویتی کاربردی: مفاهیم، الگوریتم‌ها و پیاده‌سازی

انتخاب پلن

انتخاب پلن برای ادامه خرید الزامی است.

پرداخت اقساطی
در صورت خرید اقساطی هر قسط: 62,488 تومان
۴ قسط ماهانه. بدون سود، چک و ضامن.
پرداخت اقساطی با دیجی‌پی پرداخت اقساطی با ترب‌پی

📚 محتوای این محصول آموزشی (پکیج کامل)

💡 این محصول یک نسخهٔ کامل و جامع است

تمامی محتوای آموزشی این کتاب در قالب یک بسته‌ی کامل و یکپارچه ارائه می‌شود و شامل تمام نسخه‌ها و فایل‌های موردنیاز برای یادگیری است.

🎁 محتویات کامل بسته دانلودی

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل کتاب‌ها، تمرین‌ها و خودآزمایی .


ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود و نسخهٔ چاپی ندارد.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های کتاب همانجا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

🎓 دوره آموزشی جامع

📚 اطلاعات دوره

عنوان دوره: دوره یادگیری تقویتی کاربردی: مفاهیم، الگوریتم‌ها و پیاده‌سازی

موضوع کلی: یادگیری تقویتی چندعامله (MARL)

موضوع میانی: مبانی یادگیری تقویتی (RL)

📋 سرفصل‌های دوره

  • 1. مقدمه‌ای بر یادگیری تقویتی
  • 2. مفاهیم اصلی یادگیری تقویتی: عامل، محیط، حالت، عمل، پاداش
  • 3. مدل‌های مسئله یادگیری تقویتی: فرایندهای تصمیم‌گیری مارکوف (MDP)
  • 4. عناصر فرایندهای تصمیم‌گیری مارکوف
  • 5. تابع سیاست (Policy)
  • 6. تابع ارزش (Value Function)
  • 7. تابع ارزش اقدام (Action-Value Function)
  • 8. روش‌های اکتشاف و بهره‌برداری (Exploration vs. Exploitation)
  • 9. الگوریتم‌های مبتنی بر ارزش (Value-Based Methods)
  • 10. یادگیری تفاضل زمانی (Temporal Difference Learning)
  • 11. الگوریتم Q-Learning
  • 12. الگوریتم SARSA
  • 13. الگوریتم Deep Q-Network (DQN)
  • 14. بهینه‌سازی DQN: Double DQN
  • 15. بهینه‌سازی DQN: Dueling DQN
  • 16. بهینه‌سازی DQN: Prioritized Experience Replay
  • 17. الگوریتم‌های مبتنی بر سیاست (Policy-Based Methods)
  • 18. گرادیان سیاست (Policy Gradient)
  • 19. الگوریتم REINFORCE
  • 20. الگوریتم Actor-Critic
  • 21. الگوریتم A2C (Advantage Actor-Critic)
  • 22. الگوریتم A3C (Asynchronous Advantage Actor-Critic)
  • 23. الگوریتم DDPG (Deep Deterministic Policy Gradient)
  • 24. الگوریتم PPO (Proximal Policy Optimization)
  • 25. الگوریتم TRPO (Trust Region Policy Optimization)
  • 26. یادگیری تقویتی عمیق (Deep Reinforcement Learning)
  • 27. شبکه‌های عصبی کانولوشنی در یادگیری تقویتی
  • 28. شبکه‌های عصبی بازگشتی در یادگیری تقویتی
  • 29. یادگیری تقویتی در بازی‌ها: آتاری
  • 30. یادگیری تقویتی در بازی‌ها: شطرنج و گو
  • 31. یادگیری تقویتی در رباتیک
  • 32. یادگیری تقویتی در سیستم‌های توصیه‌گر
  • 33. یادگیری تقویتی در مدیریت منابع
  • 34. یادگیری تقویتی در پردازش زبان طبیعی
  • 35. یادگیری تقویتی در بازارهای مالی (با رویکرد اسلامی)
  • 36. یادگیری تقویتی در بهینه‌سازی زنجیره تامین
  • 37. یادگیری تقویتی در سیستم‌های کنترل صنعتی
  • 38. یادگیری تقویتی در سلامت (با ملاحظات شرعی)
  • 39. ملاحظات اخلاقی در یادگیری تقویتی
  • 40. پیاده‌سازی یادگیری تقویتی با کتابخانه‌های پایتون
  • 41. کتابخانه OpenAI Gym
  • 42. کتابخانه Stable Baselines3
  • 43. کتابخانه Ray RLlib
  • 44. مثال‌های کاربردی با OpenAI Gym
  • 45. پیاده‌سازی Q-Learning برای مسائل ساده
  • 46. پیاده‌سازی SARSA برای مسائل ساده
  • 47. پیاده‌سازی DQN برای بازی‌های آتاری
  • 48. پیاده‌سازی Actor-Critic برای مسائل ساده
  • 49. پیاده‌سازی PPO برای مسائل پیچیده‌تر
  • 50. یادگیری تقویتی چندعاملی (Multi-Agent Reinforcement Learning)
  • 51. معرفی یادگیری تقویتی چندعاملی
  • 52. چالش‌های یادگیری تقویتی چندعاملی
  • 53. الگوریتم‌های یادگیری تقویتی چندعاملی
  • 54. کاربرد یادگیری تقویتی چندعاملی در ترافیک
  • 55. کاربرد یادگیری تقویتی چندعاملی در اقتصاد
  • 56. یادگیری تقویتی با پاداش‌های پراکنده
  • 57. یادگیری تقویتی با پاداش‌های منفی
  • 58. یادگیری تقویتی در محیط‌های با ابعاد بالا
  • 59. یادگیری تقویتی با یادگیری انتقالی (Transfer Learning)
  • 60. یادگیری تقویتی با یادگیری خودنظارتی (Self-Supervised Learning)
  • 61. یادگیری تقویتی با مدل‌سازی محیط (Model-Based RL)
  • 62. مقایسه روش‌های مبتنی بر ارزش و مبتنی بر سیاست
  • 63. نقش یادگیری عمیق در پیشرفت یادگیری تقویتی
  • 64. چالش‌های پایداری در یادگیری تقویتی عمیق
  • 65. روش‌های بهبود پایداری در یادگیری تقویتی
  • 66. یادگیری تقویتی برای بهینه‌سازی سبد سهام (با رویکرد اسلامی)
  • 67. یادگیری تقویتی در مدیریت انرژی
  • 68. یادگیری تقویتی در بهینه‌سازی سیستم‌های توزیع‌شده
  • 69. یادگیری تقویتی در ربات‌های خودمختار
  • 70. یادگیری تقویتی در کشف دارو
  • 71. یادگیری تقویتی در تحلیل داده‌های پزشکی
  • 72. یادگیری تقویتی در شبکه‌های ارتباطی
  • 73. یادگیری تقویتی در بهینه‌سازی مصرف سوخت
  • 74. یادگیری تقویتی در پیش‌بینی رفتار مصرف‌کننده
  • 75. یادگیری تقویتی در بهینه‌سازی فرآیندهای تولید
  • 76. یادگیری تقویتی در سیستم‌های توزیع شده مقیاس‌پذیر
  • 77. یادگیری تقویتی در تحلیل ریسک (با ملاحظات شرعی)
  • 78. یادگیری تقویتی در بهینه‌سازی تخصیص منابع
  • 79. یادگیری تقویتی در مدیریت موجودی
  • 80. یادگیری تقویتی در بهینه‌سازی زمان‌بندی
  • 81. یادگیری تقویتی در کنترل کیفیت
  • 82. یادگیری تقویتی در سیستم‌های تشخیص نفوذ
  • 83. یادگیری تقویتی در بهینه‌سازی مسیریابی
  • 84. یادگیری تقویتی در اتوماسیون فرآیندهای کسب‌وکار
  • 85. یادگیری تقویتی در بهینه‌سازی تبلیغات آنلاین
  • 86. یادگیری تقویتی در پیش‌بینی تغییرات آب و هوا
  • 87. یادگیری تقویتی در مدیریت بحران
  • 88. یادگیری تقویتی در بهینه‌سازی مصرف آب
  • 89. یادگیری تقویتی در سیستم‌های هوشمند شهری
  • 90. یادگیری تقویتی در بهینه‌سازی خدمات پس از فروش
  • 91. یادگیری تقویتی در تحلیل احساسات (Sentiment Analysis)
  • 92. یادگیری تقویتی در تشخیص چهره
  • 93. یادگیری تقویتی در ترجمه ماشینی
  • 94. یادگیری تقویتی در خلاصه‌سازی متن
  • 95. یادگیری تقویتی در تولید متن خلاقانه
  • 96. یادگیری تقویتی در پیش‌بینی تقاضا
  • 97. یادگیری تقویتی در بهینه‌سازی چرخه عمر محصول
  • 98. یادگیری تقویتی در مدیریت ارتباط با مشتری (CRM)
  • 99. یادگیری تقویتی در بهینه‌سازی لجستیک
  • 100. یادگیری تقویتی در بهینه‌سازی قیمت‌گذاری

📚 محتوای این محصول آموزشی (پکیج کامل)

💡 این محصول یک نسخهٔ کامل و جامع است

تمامی محتوای آموزشی این کتاب در قالب یک بسته‌ی کامل و یکپارچه ارائه می‌شود و شامل تمام نسخه‌ها و فایل‌های موردنیاز برای یادگیری است.

🎁 محتویات کامل بسته دانلودی

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل کتاب‌ها، تمرین‌ها و خودآزمایی .


ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود و نسخهٔ چاپی ندارد.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های کتاب همانجا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

نظرات

هنوز نظری ثبت نشده است.

وارد شوید تا نظر ثبت کنید.