کتاب بازی‌های مداوم و دینامیک در یادگیری تقویتی چندعامله

انتخاب پلن

انتخاب پلن برای ادامه خرید الزامی است.

پرداخت اقساطی
در صورت خرید اقساطی هر قسط: 62,488 تومان
۴ قسط ماهانه. بدون سود، چک و ضامن.
پرداخت اقساطی با دیجی‌پی پرداخت اقساطی با ترب‌پی

📚 محتوای این محصول آموزشی (پکیج کامل)

💡 این محصول یک نسخهٔ کامل و جامع است

تمامی محتوای آموزشی این کتاب در قالب یک بسته‌ی کامل و یکپارچه ارائه می‌شود و شامل تمام نسخه‌ها و فایل‌های موردنیاز برای یادگیری است.

🎁 محتویات کامل بسته دانلودی

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل کتاب‌ها، تمرین‌ها و خودآزمایی .


ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود و نسخهٔ چاپی ندارد.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های کتاب همانجا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

🎓 دوره آموزشی جامع

📚 اطلاعات دوره

عنوان دوره: دوره بازی‌های مداوم و دینامیک در یادگیری تقویتی چندعامله

موضوع کلی: یادگیری تقویتی چندعامله (MARL)

موضوع میانی: بازی‌ها (Games)

📋 سرفصل‌های دوره

  • 1. مقدمه‌ای بر یادگیری تقویتی چندعامله
  • 2. مفاهیم اساسی در بازی‌های مداوم
  • 3. مدل‌های مارکوف تصمیم‌گیری (MDP) برای بازی‌های مداوم
  • 4. فضاهای حالت و عمل پیوسته
  • 5. توابع پاداش و هزینه‌ در بازی‌های مداوم
  • 6. یادگیری تقویتی تک‌عامله در فضاهای پیوسته
  • 7. تخمین تابع ارزش (Value Function Estimation)
  • 8. تخمین تابع سیاست (Policy Function Estimation)
  • 9. الگوریتم‌های مبتنی بر گرادیان سیاست (Policy Gradient)
  • 10. الگوریتم‌های Actor-Critic
  • 11. الگوریتم‌های مبتنی بر مدل (Model-Based RL)
  • 12. مدل‌های دینامیکی برای بازی‌های مداوم
  • 13. یادگیری مدل از داده‌ها
  • 14. تولید مسیر (Trajectory Generation)
  • 15. بهینه‌سازی مسیر
  • 16. یادگیری تقویتی چندعامله (MARL): مفاهیم اولیه
  • 17. تعامل عامل‌ها در محیط‌های پویا
  • 18. فضاهای حالت-عمل مشترک
  • 19. تعریف بازی‌های چندعامله
  • 20. تعادل نش (Nash Equilibrium) در بازی‌های چندعامله
  • 21. بازی‌های مجموع صفر (Zero-Sum Games)
  • 22. بازی‌های مجموع غیرصفر (Non-Zero-Sum Games)
  • 23. بازی‌های همکاری‌کننده (Cooperative Games)
  • 24. بازی‌های غیرهمکاری‌کننده (Non-Cooperative Games)
  • 25. یادگیری تقویتی تیمی (Team RL)
  • 26. یادگیری تقویتی رقابتی (Competitive RL)
  • 27. یادگیری تقویتی مختلط (Mixed Cooperative-Competitive RL)
  • 28. چالش‌های MARL: غیرایستایی محیط (Non-Stationarity)
  • 29. چالش‌های MARL: پیچیدگی حالت-عمل
  • 30. چالش‌های MARL: ارتباطات بین عامل‌ها
  • 31. چالش‌های MARL: هماهنگی و استقلال
  • 32. الگوریتم‌های پایه در MARL
  • 33. الگوریتم‌های مبتنی بر ارزش مشترک (Joint Value-Based)
  • 34. الگوریتم‌های مبتنی بر سیاست مشترک (Joint Policy-Based)
  • 35. الگوریتم‌های مبتنی بر تفکیک عامل‌ها (Decentralized Agents)
  • 36. الگوریتم‌های مبتنی بر یادگیری متمرکز-اجرای توزیع‌شده (CTDE)
  • 37. معماری‌های CTDE
  • 38. شبکه‌های عصبی عمیق در MARL
  • 39. یادگیری عمیق تقویتی چندعامله (Deep MARL)
  • 40. شبکه‌های عصبی کانولوشنال (CNN) در MARL
  • 41. شبکه‌های عصبی بازگشتی (RNN) در MARL
  • 42. شبکه‌های عصبی ترنسفورمر (Transformer) در MARL
  • 43. یادگیری ارتباطات بین عامل‌ها
  • 44. مکانیزم‌های توجه (Attention Mechanisms)
  • 45. کدگذاری و دیکدگذاری ارتباطات
  • 46. یادگیری زبان‌های ارتباطی
  • 47. مسائل هماهنگی در MARL
  • 48. مدل‌سازی هماهنگی
  • 49. یادگیری استراتژی‌های هماهنگ
  • 50. کاربردها در رباتیک چندرباته
  • 51. کاربردها در سیستم‌های حمل‌ونقل هوشمند
  • 52. کاربردها در مدیریت منابع انرژی
  • 53. کاربردها در بازی‌های شبیه‌سازی‌شده
  • 54. کاربردها در سیستم‌های توصیه‌گر چندعامله
  • 55. کاربردها در بازارهای الکترونیکی
  • 56. کاربردها در امنیت سایبری
  • 57. کاربردها در بازی‌های استراتژیک
  • 58. کاربردها در هوش مصنوعی جمعی
  • 59. کاربردها در شبکه‌های حسگر بی‌سیم
  • 60. کاربردها در سیستم‌های توزیع‌شده
  • 61. کاربردها در اقتصاد محاسباتی
  • 62. کاربردها در مدیریت زنجیره تأمین
  • 63. کاربردها در بهینه‌سازی ترافیک شهری
  • 64. کاربردها در کنترل ناوگان وسایل نقلیه
  • 65. کاربردها در مدیریت منابع طبیعی
  • 66. کاربردها در سیستم‌های مالی
  • 67. کاربردها در هوش مصنوعی پزشکی
  • 68. کاربردها در آموزش و یادگیری
  • 69. کاربردها در تحقیقات علمی
  • 70. کاربردها در توسعهٔ نرم‌افزار
  • 71. کاربردها در رباتیک صنعتی
  • 72. کاربردها در شبکه‌های ارتباطی
  • 73. کاربردها در سیستم‌های توزیع بار
  • 74. کاربردها در بهینه‌سازی منابع محاسباتی
  • 75. کاربردها در مدیریت پایگاه داده
  • 76. کاربردها در پردازش زبان طبیعی
  • 77. کاربردها در بینایی ماشین
  • 78. کاربردها در تحلیل داده‌های بزرگ
  • 79. کاربردها در سیستم‌های خودمختار
  • 80. کاربردها در طراحی سیستم‌های هوشمند
  • 81. کاربردها در شبیه‌سازی اجتماعی
  • 82. کاربردها در پیش‌بینی رفتار
  • 83. کاربردها در تحلیل ریسک
  • 84. کاربردها در بهینه‌سازی فرآیندها
  • 85. کاربردها در سیستم‌های توزیع‌شدهٔ کارآمد
  • 86. کاربردها در مدیریت پروژه
  • 87. کاربردها در یادگیری تدافعی
  • 88. کاربردها در یادگیری تهاجمی
  • 89. کاربردها در یادگیری ترکیبی
  • 90. کاربردها در معماری‌های جدید MARL
  • 91. کاربردها در بهینه‌سازی پارامترهای MARL
  • 92. کاربردها در ارزیابی عملکرد MARL
  • 93. کاربردها در مسائل اخلاقی در MARL
  • 94. کاربردها در آیندهٔ MARL

📚 محتوای این محصول آموزشی (پکیج کامل)

💡 این محصول یک نسخهٔ کامل و جامع است

تمامی محتوای آموزشی این کتاب در قالب یک بسته‌ی کامل و یکپارچه ارائه می‌شود و شامل تمام نسخه‌ها و فایل‌های موردنیاز برای یادگیری است.

🎁 محتویات کامل بسته دانلودی

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل کتاب‌ها، تمرین‌ها و خودآزمایی .


ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود و نسخهٔ چاپی ندارد.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های کتاب همانجا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

نظرات

هنوز نظری ثبت نشده است.

وارد شوید تا نظر ثبت کنید.