http://blog.samaltman.com/reinforcement-learning-progress
Sam Altman co-found 的公司 Open AI 在強化學習上有了進展,證明專精於特定領域的強化學習演算法可以有效的解決問題,在這篇文章中 Dota 機器人的勝率已經高達 95%
強化學習被稱作「近似動態規劃」(approximate dynamic programming,ADP)
https://zh.wikipedia.org/zh-tw/%E5%BC%BA%E5%8C%96%E5%AD%A6%E4%B9%A0
沒有留言:
張貼留言