کتاب مدل‌های یادگیری تقویتی مبتنی بر ارزش در یادگیری تقویتی چندعامله

انتخاب پلن

انتخاب پلن برای ادامه خرید الزامی است.

پرداخت اقساطی
در صورت خرید اقساطی هر قسط: 62,488 تومان
۴ قسط ماهانه. بدون سود، چک و ضامن.
پرداخت اقساطی با دیجی‌پی پرداخت اقساطی با ترب‌پی

📚 محتوای این محصول آموزشی (پکیج کامل)

💡 این محصول یک نسخهٔ کامل و جامع است

تمامی محتوای آموزشی این کتاب در قالب یک بسته‌ی کامل و یکپارچه ارائه می‌شود و شامل تمام نسخه‌ها و فایل‌های موردنیاز برای یادگیری است.

🎁 محتویات کامل بسته دانلودی

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل کتاب‌ها، تمرین‌ها و خودآزمایی .


ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود و نسخهٔ چاپی ندارد.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های کتاب همانجا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

🎓 دوره آموزشی جامع

📚 اطلاعات دوره

عنوان دوره: دوره مدل‌های یادگیری تقویتی مبتنی بر ارزش در یادگیری تقویتی چندعامله

موضوع کلی: یادگیری تقویتی چندعامله (MARL)

موضوع میانی: مدل‌های یادگیری تقویتی

📋 سرفصل‌های دوره

  • 1. مقدمه‌ای بر یادگیری تقویتی
  • 2. مفاهیم اساسی یادگیری تقویتی
  • 3. عوامل و محیط در یادگیری تقویتی
  • 4. تابع پاداش و تابع ارزش
  • 5. سیاست‌ها و تابع ارزش
  • 6. مدل‌های مبتنی بر ارزش
  • 7. یادگیری ارزش-مبنایی
  • 8. یادگیری Q-learning
  • 9. یادگیری SARSA
  • 10. تفاوت Q-learning و SARSA
  • 11. یادگیری مبتنی بر مدل
  • 12. یادگیری بدون مدل
  • 13. روش‌های مونت کارلو در یادگیری تقویتی
  • 14. یادگیری تفاضل زمانی (TD)
  • 15. یادگیری TD(0)
  • 16. یادگیری TD(λ)
  • 17. شبکه‌های عصبی در یادگیری تقویتی
  • 18. یادگیری عمیق تقویتی (Deep RL)
  • 19. شبکه‌های عصبی کانولوشنال (CNN) در RL
  • 20. شبکه‌های عصبی بازگشتی (RNN) در RL
  • 21. یادگیری تقویتی چند عامله (MARL)
  • 22. مقدمه‌ای بر MARL
  • 23. چالش‌های MARL
  • 24. همکاری در MARL
  • 25. رقابت در MARL
  • 26. محیط‌های مشترک و مجزا
  • 27. مدل‌های مبتنی بر ارزش در MARL
  • 28. یادگیری ارزش در محیط‌های مشترک
  • 29. یادگیری ارزش در محیط‌های مجزا
  • 30. توسعه مدل‌های ارزش برای MARL
  • 31. ارتباط بین عامل‌ها در MARL
  • 32. یادگیری ارزش متمرکز
  • 33. یادگیری ارزش غیرمتمرکز
  • 34. یادگیری ارزش نیمه‌متمرکز
  • 35. مدل‌های ارزش مشترک
  • 36. مدل‌های ارزش مجزا
  • 37. مدل‌های ارزش مبتنی بر ارتباط
  • 38. یادگیری ارزش مبتنی بر مشاهده
  • 39. یادگیری ارزش مبتنی بر وضعیت
  • 40. یادگیری ارزش مبتنی بر عمل
  • 41. استراتژی‌های یادگیری ارزش در MARL
  • 42. یادگیری سیاست مشترک
  • 43. یادگیری سیاست مجزا
  • 44. یادگیری سیاست نیمه‌متمرکز
  • 45. یادگیری سیاست مبتنی بر مشاهده
  • 46. یادگیری سیاست مبتنی بر وضعیت
  • 47. یادگیری سیاست مبتنی بر عمل
  • 48. یادگیری سیاست مبتنی بر ارتباط
  • 49. مدل‌های مبتنی بر بازی در MARL
  • 50. مفاهیم بازی‌های متعارف
  • 51. تعادل نش در بازی‌های متعارف
  • 52. بازی‌های تکراری
  • 53. بازی‌های با مجموع غیر صفر
  • 54. یادگیری مبتنی بر بازی در MARL
  • 55. یادگیری ارزش در بازی‌های متعارف
  • 56. یادگیری سیاست در بازی‌های متعارف
  • 57. مدل‌های بازی مشترک
  • 58. مدل‌های بازی مجزا
  • 59. مدل‌های بازی مبتنی بر ارتباط
  • 60. یادگیری ارزش در بازی‌های تکراری
  • 61. یادگیری سیاست در بازی‌های تکراری
  • 62. مدل‌های ارزش در بازی‌های تکراری
  • 63. مدل‌های سیاست در بازی‌های تکراری
  • 64. یادگیری تقویتی توزیع‌شده
  • 65. یادگیری تقویتی موازی
  • 66. یادگیری تقویتی توزیع‌شده با هماهنگ‌کننده مرکزی
  • 67. یادگیری تقویتی توزیع‌شده بدون هماهنگ‌کننده مرکزی
  • 68. کاربردها در رباتیک
  • 69. کاربردها در سیستم‌های توصیه‌گر
  • 70. کاربردها در بازی‌ها
  • 71. کاربردها در سیستم‌های کنترل
  • 72. کاربردها در مدیریت ترافیک
  • 73. کاربردها در بازارهای مالی
  • 74. کاربردها در شبکه‌های ارتباطی
  • 75. کاربردها در بهینه‌سازی منابع
  • 76. کاربردها در سیستم‌های هوشمند
  • 77. کاربردها در شبیه‌سازی‌های پیچیده
  • 78. مدل‌های ارزش برای عامل‌های محدود
  • 79. مدل‌های ارزش برای عامل‌های با حافظه
  • 80. مدل‌های ارزش برای عامل‌های با محدودیت ارتباطی
  • 81. مدل‌های ارزش برای عامل‌های با عدم قطعیت
  • 82. مدل‌های ارزش برای عامل‌های با پاداش پراکنده
  • 83. مدل‌های ارزش برای عامل‌های با پاداش تاخیری
  • 84. مدل‌های ارزش برای عامل‌های با پاداش متغیر
  • 85. مدل‌های ارزش برای عامل‌های با اهداف چندگانه
  • 86. مدل‌های ارزش برای عامل‌های با اهداف متعارض
  • 87. مدل‌های ارزش برای عامل‌های در محیط‌های پویا
  • 88. مدل‌های ارزش برای عامل‌های در محیط‌های غیر ایستا
  • 89. مدل‌های ارزش برای عامل‌های در محیط‌های با تغییرات ناگهانی
  • 90. مدل‌های ارزش برای عامل‌های در محیط‌های با تغییرات تدریجی
  • 91. بهینه‌سازی مدل‌های ارزش در MARL
  • 92. ارزیابی عملکرد مدل‌های ارزش در MARL
  • 93. چالش‌های آینده در MARL

📚 محتوای این محصول آموزشی (پکیج کامل)

💡 این محصول یک نسخهٔ کامل و جامع است

تمامی محتوای آموزشی این کتاب در قالب یک بسته‌ی کامل و یکپارچه ارائه می‌شود و شامل تمام نسخه‌ها و فایل‌های موردنیاز برای یادگیری است.

🎁 محتویات کامل بسته دانلودی

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل کتاب‌ها، تمرین‌ها و خودآزمایی .


ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود و نسخهٔ چاپی ندارد.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های کتاب همانجا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

نظرات

هنوز نظری ثبت نشده است.

وارد شوید تا نظر ثبت کنید.