הידען > למידת חיזוק
למידת חיזוק
- אבי בליזובסקי
- אין תגובות
מערכת APT-RL משלבת מיומנויות תנועה שנלמדו מראש עם למידת חיזוק. הרובוט בוחר בעצמו מתי לרוץ, לטפס או לדלג, באמצעות חיישנים ומחשב הנמצאים על גופו
- אבי בליזובסקי
- תגובה אחת
חוקרי MIT פיתחו אלגוריתם מתקדם ללמידת חיזוק (אימון ראשוני מערכת בינה מלאכותית) המייעל את קבלת ההחלטות של מערכות AI במשימות מורכבות כמו בקרת תנועה עירונית, תוך חיסכון משמעותי בזמן ומשאבים