谷歌让 AI 学会「做梦」:不改权重,靠回放历史自己进化

9 月 18 日,谷歌和 Google DeepMind 联合马里兰大学与弗吉尼亚大学挂出一篇论文。正文里反复出现同一个词。做梦。

论文给的结论很硬。人工智能的递归自我改进,不一定非得从改权重开始。

它的做法是让智能体把走过的每一步存成一棵树。然后在树里做梦,试出更优的探索策略,再回到现实接着干[……]

继续阅读