کتاب رویکردهای مدرن در یادگیری تقویتی چندعامله ناظر و بدون ناظر

انتخاب پلن

انتخاب پلن برای ادامه خرید الزامی است.

پرداخت اقساطی
در صورت خرید اقساطی هر قسط: 62,488 تومان
۴ قسط ماهانه. بدون سود، چک و ضامن.
پرداخت اقساطی با دیجی‌پی پرداخت اقساطی با ترب‌پی

📚 محتوای این محصول آموزشی (پکیج کامل)

💡 این محصول یک نسخهٔ کامل و جامع است

تمامی محتوای آموزشی این کتاب در قالب یک بسته‌ی کامل و یکپارچه ارائه می‌شود و شامل تمام نسخه‌ها و فایل‌های موردنیاز برای یادگیری است.

🎁 محتویات کامل بسته دانلودی

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل کتاب‌ها، تمرین‌ها و خودآزمایی .


ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود و نسخهٔ چاپی ندارد.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های کتاب همانجا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

🎓 دوره آموزشی جامع

📚 اطلاعات دوره

عنوان دوره: دوره رویکردهای مدرن در یادگیری تقویتی چندعامله ناظر و بدون ناظر

موضوع کلی: یادگیری تقویتی چندعامله (MARL)

موضوع میانی: مباحث پژوهشی روز در MARL

📋 سرفصل‌های دوره

  • 1. مقدمه‌ای بر یادگیری تقویتی چندعامله
  • 2. اصول یادگیری تقویتی
  • 3. عوامل در محیط‌های یادگیری تقویتی
  • 4. محیط‌های یادگیری تقویتی
  • 5. فضای حالت و فضای عمل
  • 6. تابع پاداش
  • 7. سیاست عامل
  • 8. ارزش تابع
  • 9. کشف و اکتشاف در یادگیری تقویتی
  • 10. یادگیری تقویتی مارکوف (MDP)
  • 11. فرآیندهای تصمیم‌گیری مارکوف
  • 12. معادلات بل‌من
  • 13. روش‌های مقدار-تابع (Value-Function Methods)
  • 14. روش‌های سیاست-تابع (Policy-Function Methods)
  • 15. روش‌های مدل-مبتنی (Model-Based Methods)
  • 16. روش‌های مدل-مستقل (Model-Free Methods)
  • 17. یادگیری تقویتی ناظر
  • 18. یادگیری تقویتی بدون ناظر
  • 19. یادگیری تقویتی نیمه‌ناظر
  • 20. یادگیری تقویتی چندعامله (MARL)
  • 21. مفاهیم کلیدی در MARL
  • 22. تعامل بین عامل‌ها
  • 23. همکاری عامل‌ها
  • 24. رقابت عامل‌ها
  • 25. حالت‌های ترکیبی همکاری و رقابت
  • 26. یادگیری تقویتی ناظر در MARL
  • 27. یادگیری تقویتی بدون ناظر در MARL
  • 28. یادگیری تقویتی نیمه‌ناظر در MARL
  • 29. مدل‌های عامل مرکزی (Centralized Agent Models)
  • 30. مدل‌های عامل توزیع‌شده (Decentralized Agent Models)
  • 31. مدل‌های عامل نیمه‌متمرکز (Semi-Centralized Agent Models)
  • 32. یادگیری تقویتی با نظارت مرکزی (Centralized Training with Decentralized Execution - CTDE)
  • 33. حسابداری پاداش در MARL
  • 34. تخصیص پاداش در سناریوهای همکاری
  • 35. تخصیص پاداش در سناریوهای رقابتی
  • 36. مسئله پاداش اسپارس (Sparse Reward Problem)
  • 37. یادگیری تقویتی با پاداش مهندسی‌شده (Reward Shaping)
  • 38. شبکه‌های عصبی در یادگیری تقویتی
  • 39. یادگیری عمیق تقویتی (Deep Reinforcement Learning)
  • 40. شبکه‌های عصبی کانولوشنی (CNN) در RL
  • 41. شبکه‌های عصبی بازگشتی (RNN) در RL
  • 42. شبکه‌های عصبی ترنسفورمر (Transformer) در RL
  • 43. الگوریتم‌های یادگیری تقویتی عمیق
  • 44. DQN (Deep Q-Network)
  • 45. DDQN (Double Deep Q-Network)
  • 46. Dueling DQN
  • 47. Prioritized Experience Replay
  • 48. A2C (Advantage Actor-Critic)
  • 49. A3C (Asynchronous Advantage Actor-Critic)
  • 50. PPO (Proximal Policy Optimization)
  • 51. TRPO (Trust Region Policy Optimization)
  • 52. SAC (Soft Actor-Critic)
  • 53. DDPG (Deep Deterministic Policy Gradient)
  • 54. TD3 (Twin Delayed Deep Deterministic Policy Gradient)
  • 55. MARL با استفاده از DQN
  • 56. MARL با استفاده از Actor-Critic
  • 57. یادگیری تقویتی در رباتیک
  • 58. کنترل ربات‌های خودمختار
  • 59. ناوبری ربات‌ها
  • 60. یادگیری تقویتی در بازی‌ها
  • 61. یادگیری تقویتی در سیستم‌های توصیه‌گر
  • 62. یادگیری تقویتی در مدیریت منابع
  • 63. یادگیری تقویتی در شبکه‌های ارتباطی
  • 64. یادگیری تقویتی در مالیه الگوریتمی
  • 65. یادگیری تقویتی در بهینه‌سازی سیستم‌ها
  • 66. یادگیری تقویتی در سیستم‌های توزیع‌شده
  • 67. یادگیری تقویتی برای هماهنگی عامل‌ها
  • 68. یادگیری تقویتی برای حل مسائل بهینه‌سازی چندهدفه
  • 69. مدل‌های یادگیری اجتماعی در MARL
  • 70. یادگیری تقویتی از مشاهده
  • 71. یادگیری تقویتی از طریق تقلید (Imitation Learning)
  • 72. یادگیری تقویتی با یادگیری مبتنی بر مدل (Model-Based RL)
  • 73. یادگیری تقویتی با یادگیری بدون مدل (Model-Free RL)
  • 74. یادگیری تقویتی با فضای حالت پیوسته
  • 75. یادگیری تقویتی با فضای عمل پیوسته
  • 76. یادگیری تقویتی با پاداش‌های تاخیردار
  • 77. یادگیری تقویتی با پاداش‌های متغیر
  • 78. چالش‌های مقیاس‌پذیری در MARL
  • 79. چالش‌های پایداری در MARL
  • 80. چالش‌های تعمیم‌پذیری در MARL
  • 81. ارزیابی عملکرد در MARL
  • 82. معیارهای ارزیابی در MARL
  • 83. شبیه‌سازی محیط‌های MARL
  • 84. پیاده‌سازی الگوریتم‌های MARL
  • 85. کتابخانه‌های نرم‌افزاری برای MARL
  • 86. کاربرد یادگیری تقویتی در هوش مصنوعی
  • 87. آینده یادگیری تقویتی چندعامله
  • 88. تحقیقات پیشرو در MARL
  • 89. کاربردهای عملی MARL
  • 90. تکنیک‌های پیشرفته در MARL
  • 91. یادگیری تقویتی برای سیستم‌های پیچیده
  • 92. یادگیری تقویتی در زمان واقعی
  • 93. یادگیری تقویتی با داده‌های محدود
  • 94. یادگیری تقویتی برای سناریوهای پویا
  • 95. یادگیری تقویتی در محیط‌های نامشخص
  • 96. یادگیری تقویتی برای تصمیم‌گیری جمعی
  • 97. یادگیری تقویتی برای بهینه‌سازی توزیع‌شده
  • 98. یادگیری تقویتی برای شبکه‌های هوشمند
  • 99. یادگیری تقویتی برای ربات‌های گروهی
  • 100. یادگیری تقویتی برای سیستم‌های حمل‌ونقل هوشمند

📚 محتوای این محصول آموزشی (پکیج کامل)

💡 این محصول یک نسخهٔ کامل و جامع است

تمامی محتوای آموزشی این کتاب در قالب یک بسته‌ی کامل و یکپارچه ارائه می‌شود و شامل تمام نسخه‌ها و فایل‌های موردنیاز برای یادگیری است.

🎁 محتویات کامل بسته دانلودی

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل کتاب‌ها، تمرین‌ها و خودآزمایی .


ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود و نسخهٔ چاپی ندارد.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های کتاب همانجا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

نظرات

هنوز نظری ثبت نشده است.

وارد شوید تا نظر ثبت کنید.