经典强化学习2016
AlphaGo:搜索遇见深度学习
Mastering the game of Go with deep neural networks and tree search
AlphaGo 将神经网络直觉与树搜索规划闭环结合,而非单靠其中一方。它在完整围棋上达到超人类水平,并为后续自我对弈与测试时计算路线提供了样板。
David Silver, Aja Huang, Chris J. Maddison et al.·Nature18k 引用1.6k 阅读
按时代、领域或关键词筛选。经典是骨架,新篇每天早上 6 点从 arXiv 自动收入。
Mastering the game of Go with deep neural networks and tree search
AlphaGo 将神经网络直觉与树搜索规划闭环结合,而非单靠其中一方。它在完整围棋上达到超人类水平,并为后续自我对弈与测试时计算路线提供了样板。