最新AI:无需被告知规则就能自己玩转游戏?
2016年,Alphabet的DeepMind与AlphaGo一起问世,该AI一直领先于人类最好的棋手。一年后,工作继续完善,AlphaGo Zero创建。AlphaGo通过观察业余比赛和专业比赛学会了围棋,而AlphaGo Zero能通过简单地与自己对战来掌握游戏。然后,DeepMind创建了AlphaZero,该AlphaZero可以使用单一算法玩围棋、国际象棋和将棋。这些AI的共同特点是,它
原创
2020-12-25 08:00:24
来源:钉科技  

2016年,Alphabet的DeepMind与AlphaGo一起问世,该AI一直领先于人类最好的棋手。一年后,工作继续完善,AlphaGo Zero创建。AlphaGo通过观察业余比赛和专业比赛学会了围棋,而AlphaGo Zero能通过简单地与自己对战来掌握游戏。然后,DeepMind创建了AlphaZero,该AlphaZero可以使用单一算法玩围棋、国际象棋和将棋。

image.png

这些AI的共同特点是,它们必须掌握游戏规则然后再进行培训。DeepMind的最新AI MuZero不需要游戏的规则即可掌握游戏。与DeepMind之前的AI算法一样,MuZero具有相同甚至更好的能力。  

MuZero没有尝试对所有模型进行建模,而只是尝试考虑那些对决策至关重要的因素。正如DeepMind所指出的,这是作为人类所做的事情。当大多数人看着窗外,看到地平线上形成乌云时,他们通常不会陷入乌云是如何形成之类的问题。相反,它们思考的是如果出门应该穿什么以防止被淋湿。MuZero就是做类似这样的事情。

MuZero在做决定时会考虑三件事。首先,它会考虑上一次行动的结果、当前所处的位置以及下一次行动的最佳方案。这种看似简单的方法使MuZero成为迄今为止DeepMind最有效的算法。在测试中DeepMind发现,MuZero与之前的AI算法表现都一样好。而且,给它的时间越多,它提供的解决方案就越好。即使加入了时间限制,比如在行动前限制吃豆人女士的模拟次数,MuZero也取得了不错的效果。

该公司表示,MuZero的学习能力有一天可以帮助解决没有简单规则领域的复杂问题。(钉科技根据《engadget》消息编译)

最新文章
1
投影与电视“接不住”的商用场景,TCL新品商用显示器D系列用“简单可靠”稳住“关键现场”
2
空调10月增速转正至4.5%,迎趋势性拐点
3
AI狂飙,阿里云为企业落地破题
4
传统旺季反常遇冷!IDC:Q3全球PC出货量暴跌20.1%
5
国庆期间消费品以旧换新惠及639.2万人次,带动销售额334.8亿元
6
家电领域一条全新的增量路径渐渐清晰
7
一加联合BOE发布第四代东方屏,一加16全球首发硬件级全局高刷兼顾低功耗
8
行业首创阔直板爆火!华为Pura X View销量已突破40万
9
从“缺芯少屏”到“RISC-V第一股”:奕斯伟计算上市,开放计算架构迎来“芯”标杆
10
极米AI眼镜即将开售,投影老大能否打造“第二增长曲线”?
11
BOE(京东方)携手一加发布第四代东方屏 以动态清晰定义中国屏幕新标杆
12
Agent AI “上线难”?亚马逊云科技带来破题新解法
13
果家生态?苹果LG或联手推出智能家居设备
14
8月消费级运动相机线上市场:量额价同比齐升,新品带动高端跃升
15
200个抽查样本,95张3C认证被撤销,厨电真不能再“跑偏”了!
16
维信诺全球首款量产2K 185Hz面板亮相,第四代pTSF技术加持
17
苹果10月新品大爆发!MacBook Pro史诗级升级:首次搭载OLED触控屏
18
小米17 Ultra/徕卡版涨价:全系涨价1000元!
19
电纸书均价近两年首次跌破千元 销量大涨近60%
20
尊界汽车发布回应,释放了哪些信息?
关于我们

微信扫一扫,加关注

商务合作
  • QQ:61149512