کتاب یادگیری تقویتی چندعامله مبتنی بر عامل برای کنترل سیستم‌های خودکار

انتخاب پلن

انتخاب پلن برای ادامه خرید الزامی است.

پرداخت اقساطی
در صورت خرید اقساطی هر قسط: 62,488 تومان
۴ قسط ماهانه. بدون سود، چک و ضامن.
پرداخت اقساطی با دیجی‌پی پرداخت اقساطی با ترب‌پی

📚 محتوای این محصول آموزشی (پکیج کامل)

💡 این محصول یک نسخهٔ کامل و جامع است

تمامی محتوای آموزشی این کتاب در قالب یک بسته‌ی کامل و یکپارچه ارائه می‌شود و شامل تمام نسخه‌ها و فایل‌های موردنیاز برای یادگیری است.

🎁 محتویات کامل بسته دانلودی

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل کتاب‌ها، تمرین‌ها و خودآزمایی .


ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود و نسخهٔ چاپی ندارد.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های کتاب همانجا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

📚 کتاب آموزشی جامع

📚 اطلاعات کتاب

عنوان کتاب: کتاب یادگیری تقویتی چندعامله مبتنی بر عامل برای کنترل سیستم‌های خودکار

موضوع کلی: یادگیری تقویتی چندعامله (MARL)

موضوع میانی: یادگیری تقویتی چندعامله برای سیستم‌های خودکار

📋 سرفصل‌های کتاب (100 موضوع)

  • 1. مبانی یادگیری تقویتی
  • 2. مقدمه ای بر هوش مصنوعی
  • 3. مقدمه ای بر یادگیری ماشین
  • 4. انواع یادگیری ماشین
  • 5. یادگیری تحت نظارت
  • 6. یادگیری بدون نظارت
  • 7. یادگیری تقویتی
  • 8. مفهوم عامل
  • 9. محیط
  • 10. حالت
  • 11. اقدام
  • 12. پاداش
  • 13. سیاست
  • 14. تابع ارزش
  • 15. تابع ارزش اقدام
  • 16. اپیزود
  • 17. فرآیندهای تصمیم گیری مارکوف (MDP)
  • 18. عناصر MDP
  • 19. حالات
  • 20. اقدامات
  • 21. احتمالات انتقال
  • 22. پاداش ها
  • 23. فرمول بندی MDP
  • 24. مثال های ساده MDP
  • 25. مسائل Gridworld
  • 26. مسائل راه یابی
  • 27. مفهوم یادگیری تقویتی
  • 28. یادگیری مبتنی بر مدل
  • 29. یادگیری بدون مدل
  • 30. روش های تخمین تابع ارزش
  • 31. تخمین ارزش حالت
  • 32. تخمین ارزش اقدام
  • 33. روش های تکرار ارزش
  • 34. تکرار سیاست
  • 35. تکرار مقدار
  • 36. روش های مبتنی بر نمونه
  • 37. تکرار مونت کارلو
  • 38. یادگیری تفاوت زمانی (TD)
  • 39. TD(0)
  • 40. TD(lambda)
  • 41. روش های مبتنی بر سیاست
  • 42. تخمین گر سیاست
  • 43. گرادیان سیاست
  • 44. یادگیری تقویتی عمیق (DRL)
  • 45. شبکه های عصبی
  • 46. شبکه های عصبی کانولوشنال (CNN)
  • 47. شبکه های عصبی بازگشتی (RNN)
  • 48. یادگیری تقویتی عمیق با شبکه های عصبی
  • 49. DQN (Deep Q-Network)
  • 50. Double DQN
  • 51. Dueling DQN
  • 52. Prioritized Experience Replay
  • 53. Actor-Critic Methods
  • 54. A2C (Advantage Actor-Critic)
  • 55. A3C (Asynchronous Advantage Actor-Critic)
  • 56. DDPG (Deep Deterministic Policy Gradient)
  • 57. TRPO (Trust Region Policy Optimization)
  • 58. PPO (Proximal Policy Optimization)
  • 59. یادگیری تقویتی چندعامله (MARL)
  • 60. مقدمه ای بر MARL
  • 61. تفاوت های MARL با RL تک عامله
  • 62. چالش های MARL
  • 63. عدم سکون محیط
  • 64. عدم قطعیت ناشی از عوامل دیگر
  • 65. مقیاس پذیری
  • 66. همکاری و رقابت
  • 67. انواع سناریوهای MARL
  • 68. سناریوهای همکاری
  • 69. سناریوهای رقابتی
  • 70. سناریوهای مختلط
  • 71. روش های MARL
  • 72. روش های مبتنی بر عامل مستقل
  • 73. یادگیری عامل مستقل با DQN
  • 74. یادگیری عامل مستقل با Actor-Critic
  • 75. محدودیت های عامل مستقل
  • 76. روش های مبتنی بر عامل مرکزی
  • 77. معماری عامل مرکزی
  • 78. آموزش عامل مرکزی
  • 79. نقش عامل مرکزی
  • 80. روش های مبتنی بر عامل نیمه مرکزی
  • 81. روش های مبتنی بر بازی غیرکوششی
  • 82. مفاهیم نظریه بازی ها
  • 83. تعادل نش
  • 84. بازی های با مجموع صفر
  • 85. بازی های با مجموع غیر صفر
  • 86. روش های مبتنی بر بازی کوششی
  • 87. یادگیری تطبیقی
  • 88. روش های مبتنی بر عامل با شبکه های ارتباطی
  • 89. شبکه های ارتباطی بین عوامل
  • 90. یادگیری ارتباطات
  • 91. کاربرد شبکه های ارتباطی
  • 92. یادگیری تقویتی مبتنی بر عامل برای کنترل سیستم های خودکار
  • 93. مفهوم سیستم های خودکار
  • 94. انواع سیستم های خودکار
  • 95. رباتیک
  • 96. وسیله نقلیه خودران
  • 97. شبکه های هوشمند
  • 98. سیستم های تولید
  • 99. کاربردهای MARL در سیستم های خودکار
  • 100. کنترل ترافیک

📚 محتوای این محصول آموزشی (پکیج کامل)

💡 این محصول یک نسخهٔ کامل و جامع است

تمامی محتوای آموزشی این کتاب در قالب یک بسته‌ی کامل و یکپارچه ارائه می‌شود و شامل تمام نسخه‌ها و فایل‌های موردنیاز برای یادگیری است.

🎁 محتویات کامل بسته دانلودی

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل کتاب‌ها، تمرین‌ها و خودآزمایی .


ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود و نسخهٔ چاپی ندارد.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های کتاب همانجا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

نظرات

هنوز نظری ثبت نشده است.

وارد شوید تا نظر ثبت کنید.