کتاب مهارت‌های لازم برای توسعه سیستم‌های یادگیری تقویتی چندعامله تعاونی

انتخاب پلن

انتخاب پلن برای ادامه خرید الزامی است.

پرداخت اقساطی
در صورت خرید اقساطی هر قسط: 62,488 تومان
۴ قسط ماهانه. بدون سود، چک و ضامن.
پرداخت اقساطی با دیجی‌پی پرداخت اقساطی با ترب‌پی

📚 محتوای این محصول آموزشی (پکیج کامل)

💡 این محصول یک نسخهٔ کامل و جامع است

تمامی محتوای آموزشی این کتاب در قالب یک بسته‌ی کامل و یکپارچه ارائه می‌شود و شامل تمام نسخه‌ها و فایل‌های موردنیاز برای یادگیری است.

🎁 محتویات کامل بسته دانلودی

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل کتاب‌ها، تمرین‌ها و خودآزمایی .


ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود و نسخهٔ چاپی ندارد.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های کتاب همانجا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

📚 کتاب آموزشی جامع

📚 اطلاعات کتاب

عنوان کتاب: کتاب مهارت‌های لازم برای توسعه سیستم‌های یادگیری تقویتی چندعامله تعاونی

موضوع کلی: یادگیری تقویتی چندعامله (MARL)

موضوع میانی: همکاری (Cooperative MARL)

📋 سرفصل‌های کتاب (100 موضوع)

  • 1. مبانی یادگیری تقویتی
  • 2. مبانی یادگیری ماشین
  • 3. مبانی یادگیری عمیق
  • 4. مبانی آمار و احتمالات
  • 5. مبانی جبر خطی
  • 6. مبانی بهینه‌سازی
  • 7. مبانی نظریه بازی‌ها
  • 8. مبانی سیستم‌های چندعامله
  • 9. مقدمه‌ای بر یادگیری تقویتی چندعامله (MARL)
  • 10. مفهوم عامل
  • 11. مفهوم محیط
  • 12. مفهوم حالت
  • 13. مفهوم عمل
  • 14. مفهوم پاداش
  • 15. مفهوم سیاست
  • 16. مفهوم تابع ارزش
  • 17. مفهوم تابع Q
  • 18. مفهوم دینامیک محیط
  • 19. مفهوم مشاهده‌پذیری
  • 20. مفهوم حالت کامل مشاهده‌پذیر (Fully Observable State)
  • 21. مفهوم حالت جزئی مشاهده‌پذیر (Partially Observable State)
  • 22. مفهوم یادگیری بدون نظارت
  • 23. مفهوم یادگیری با نظارت
  • 24. مفهول یادگیری تقویتی
  • 25. انواع یادگیری تقویتی (مدل‌محور، بدون مدل)
  • 26. الگوریتم‌های مبتنی بر مدل (مانند برنامه‌ریزی پویا)
  • 27. الگوریتم‌های بدون مدل (مانند Monte Carlo، TD learning)
  • 28. یادگیری تفاوت زمانی (Temporal Difference Learning)
  • 29. Q-Learning
  • 30. SARSA
  • 31. Deep Q-Networks (DQN)
  • 32. Double DQN
  • 33. Dueling DQN
  • 34. Prioritized Experience Replay
  • 35. یادگیری مبتنی بر گرادیان سیاست (Policy Gradient Methods)
  • 36. REINFORCE
  • 37. Actor-Critic Methods
  • 38. A2C (Advantage Actor-Critic)
  • 39. A3C (Asynchronous Advantage Actor-Critic)
  • 40. PPO (Proximal Policy Optimization)
  • 41. TRPO (Trust Region Policy Optimization)
  • 42. مقدمه‌ای بر سیستم‌های چندعامله (MAS)
  • 43. مفهوم تعامل عامل‌ها
  • 44. مفهوم هماهنگی عامل‌ها
  • 45. مفهوم رقابت عامل‌ها
  • 46. مفهوم همکاری عامل‌ها
  • 47. مفهوم تعادل نش (Nash Equilibrium)
  • 48. مفهوم تعادل کورنو (Cournot Equilibrium)
  • 49. مفهوم تعادل استاکلبرگ (Stackelberg Equilibrium)
  • 50. مفهوم بازی‌های مجموع صفر (Zero-Sum Games)
  • 51. مفهوم بازی‌های مجموع غیرصفر (Non-Zero-Sum Games)
  • 52. مفهوم هماهنگی در سیستم‌های چندعامله
  • 53. چالش‌های هماهنگی در MARL
  • 54. مفهوم سیاست مشترک (Joint Policy)
  • 55. مفهوم سیاست توزیع‌شده (Decentralized Policy)
  • 56. مفهوم سیاست متمرکز (Centralized Policy)
  • 57. مفهوم سیاست متمرکز-توزیع‌شده (Centralized-Decentralized Policy)
  • 58. مدل‌های عامل منفرد در محیط چندعامله
  • 59. یادگیری سیاست‌های مشترک
  • 60. یادگیری سیاست‌های توزیع‌شده
  • 61. روش‌های مبتنی بر ارزش در MARL
  • 62. Value Decomposition Networks (VDN)
  • 63. QMIX
  • 64. Mean Field Q-Learning
  • 65. روش‌های مبتنی بر گرادیان سیاست در MARL
  • 66. MADDPG (Multi-Agent Deep Deterministic Policy Gradient)
  • 67. COMA (Counterfactual Multi-Agent Policy Gradients)
  • 68. MAPPO (Multi-Agent Proximal Policy Optimization)
  • 69. روش‌های مبتنی بر بازی در MARL
  • 70. یادگیری تعادل در بازی‌های چندعامله
  • 71. تکامل سیاست‌ها
  • 72. روش‌های مبتنی بر شبیه‌سازی در MARL
  • 73. شبیه‌سازهای استاندارد MARL (مانند OpenAI Gym، PettingZoo)
  • 74. طراحی محیط‌های سفارشی برای MARL
  • 75. مدل‌سازی و پیش‌بینی رفتار عامل‌ها
  • 76. یادگیری مدل محیط مشترک
  • 77. یادگیری مدل‌های رفتار عامل‌ها
  • 78. روش‌های مبتنی بر ارتباطات بین عامل‌ها
  • 79. یادگیری پروتکل‌های ارتباطی
  • 80. ارتباطات صریح و ضمنی
  • 81. مفهوم توجه (Attention) در MARL
  • 82. پیاده‌سازی شبکه‌های عصبی برای MARL
  • 83. شبکه‌های کانولوشنال (CNN) در MARL
  • 84. شبکه‌های بازگشتی (RNN) در MARL
  • 85. شبکه‌های ترنسفورمر (Transformer) در MARL
  • 86. تکنیک‌های یادگیری انتقالی (Transfer Learning) در MARL
  • 87. یادگیری چندوظیفه‌ای (Multi-Task Learning) در MARL
  • 88. یادگیری تقویتی با تقلب (Curriculum Learning) در MARL
  • 89. ارزیابی و سنجش عملکرد سیستم‌های MARL
  • 90. معیارهای ارزیابی در MARL
  • 91. تحلیل پایداری و همگرایی الگوریتم‌های MARL
  • 92. کاربردها و مطالعات موردی MARL (مانند رباتیک، بازی‌ها، مدیریت ترافیک)
  • 93. اخلاق در توسعه سیستم‌های MARL
  • 94. چالش‌های مقیاس‌پذیری در MARL
  • 95. بهینه‌سازی منابع محاسباتی برای MARL
  • 96. ابزارها و کتابخانه‌های محبوب برای MARL (مانند Ray RLlib، PyMARL)
  • 97. مباحث پیشرفته در MARL
  • 98. یادگیری تقویتی با عدم قطعیت
  • 99. یادگیری تقویتی توزیع‌شده
  • 100. یادگیری تقویتی امن (Safe MARL)

📚 محتوای این محصول آموزشی (پکیج کامل)

💡 این محصول یک نسخهٔ کامل و جامع است

تمامی محتوای آموزشی این کتاب در قالب یک بسته‌ی کامل و یکپارچه ارائه می‌شود و شامل تمام نسخه‌ها و فایل‌های موردنیاز برای یادگیری است.

🎁 محتویات کامل بسته دانلودی

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل کتاب‌ها، تمرین‌ها و خودآزمایی .


ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود و نسخهٔ چاپی ندارد.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های کتاب همانجا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

نظرات

هنوز نظری ثبت نشده است.

وارد شوید تا نظر ثبت کنید.