
从躲猫猫的bug,看强化学习到底在干吗

别被神话骗了,它现在真的还很笨
AlphaGo下围棋赢了人类,大家就说强化学习已经超越人类了。这话真的经不住推敲。 AlphaGo下围棋,是在一个规则完全固定、所有变化都在棋盘里的封闭环境,它可以在模拟器里和自己对下几百万局,烧几千万的电费练出来。换到现实世界呢? 你让它学开车,能让它撞几百次人试错吗?不可能。 说实话,现在大部分吹得神乎其神的强化学习成果,都躲在模拟器里。
最值得期待的方向,其实离我们的生活更近

作者|科技
排版|科技
审核|白杨




作者|科技
排版|科技
审核|白杨