معاينة مختبر آمنة
تدريب Mountain Car على الهروب
هذي معاينة منقّحة للقراءة فقط؛ ما فيه أي شيء يشتغل داخل الصفحة.
تعليمات المختبر
تدريب Mountain Car على الهروب
طبّقوا مفاهيم الدرس في هالمختبر الموجّه.
المهمة
هدفكم إنكم تدرّبون وكيل التعلم المعزز (RL) عشان يتحكم في Mountain Car داخل بيئة OpenAI.
وصف الشكل: سيارة Mountain Car داخل الوادي
البيئة
بيئة Mountain Car فيها سيارة عالقة داخل وادٍ. هدفكم تطلعونها من الوادي وتوصلونها إلى العلم. الإجراءات المتاحة هي التسارع يسار، أو التسارع يمين، أو عدم التسارع. وتقدرون تراقبون موقع السيارة على المحور x وسرعتها.
ابدأوا بالدفتر
ابدؤوا المختبر بفتح MountainCar.ipynb.
الزبدة
اللي نبي نتعلمه من هالمختبر إن تكييف خوارزميات التعلم المعزز مع بيئة جديدة غالبًا مباشر وسهل؛ لأن Gymnasium يقدّم الواجهة نفسها لكل البيئات، ولأن الخوارزميات نفسها ما تعتمد كثير على طبيعة البيئة. وتقدرون حتى تعيدون ترتيب كود Python بحيث تمرّرون أي بيئة إلى خوارزمية التعلم المعزز على إنها معامل.
قراءة فقط
معاينة الدفتر
Mountain Car
import gymnasium as gym
env = gym.make("MountainCar-v0", render_mode="rgb_array")state, _ = env.reset()
while True:
env.render()
action = env.action_space.sample()
state, reward, terminated, truncated, info = env.step(action)
done = terminated or truncated
if done:
break## Lost of code hereenv.close()حذفنا المخرجات وعدّادات التشغيل والودجات والمحتوى النشط وقت الاستيراد. شغّل الدفاتر بس في بيئة خارجية تثق فيها.
سجّل تطبيقك
التسجيل اختياري، يفيدك تتذكر وش طبّقت، ولا يمنع إكمال الدورة.