最新AI:无需被告知规则就能自己玩转游戏?
2016年,Alphabet的DeepMind与AlphaGo一起问世,该AI一直领先于人类最好的棋手。一年后,工作继续完善,AlphaGo Zero创建。AlphaGo通过观察业余比赛和专业比赛学会了围棋,而AlphaGo Zero能通过简单地与自己对战来掌握游戏。然后,DeepMind创建了AlphaZero,该AlphaZero可以使用单一算法玩围棋、国际象棋和将棋。这些AI的共同特点是,它
原创
2020-12-25 08:00:24
来源:钉科技  

2016年,Alphabet的DeepMind与AlphaGo一起问世,该AI一直领先于人类最好的棋手。一年后,工作继续完善,AlphaGo Zero创建。AlphaGo通过观察业余比赛和专业比赛学会了围棋,而AlphaGo Zero能通过简单地与自己对战来掌握游戏。然后,DeepMind创建了AlphaZero,该AlphaZero可以使用单一算法玩围棋、国际象棋和将棋。

image.png

这些AI的共同特点是,它们必须掌握游戏规则然后再进行培训。DeepMind的最新AI MuZero不需要游戏的规则即可掌握游戏。与DeepMind之前的AI算法一样,MuZero具有相同甚至更好的能力。  

MuZero没有尝试对所有模型进行建模,而只是尝试考虑那些对决策至关重要的因素。正如DeepMind所指出的,这是作为人类所做的事情。当大多数人看着窗外,看到地平线上形成乌云时,他们通常不会陷入乌云是如何形成之类的问题。相反,它们思考的是如果出门应该穿什么以防止被淋湿。MuZero就是做类似这样的事情。

MuZero在做决定时会考虑三件事。首先,它会考虑上一次行动的结果、当前所处的位置以及下一次行动的最佳方案。这种看似简单的方法使MuZero成为迄今为止DeepMind最有效的算法。在测试中DeepMind发现,MuZero与之前的AI算法表现都一样好。而且,给它的时间越多,它提供的解决方案就越好。即使加入了时间限制,比如在行动前限制吃豆人女士的模拟次数,MuZero也取得了不错的效果。

该公司表示,MuZero的学习能力有一天可以帮助解决没有简单规则领域的复杂问题。(钉科技根据《engadget》消息编译)

最新文章
1
打破版本内卷!iQOO16官宣9月29日发布,标准版对标Pro Max体验
2
iPhone 17降价?苹果官网:涨800
3
电视面板价格9月止跌,面板企业及主机厂共同应对促销期
4
那些大企业看不上的产品却成为了小企业的香馍馍
5
72%成年人喝水量不达标,净水行业下半场拼什么?
6
迈入2nm旗舰时代!天玑9600 Pro正式登场,重构移动端AI与能效新标杆!
7
半导体收入创纪录,单季狂飙31.4%
8
苹果折叠屏也开始抄作业 iPhone Duo这5大功能安卓早就有了
9
小米18 Pro系列搭载全新百变背屏:支持AI生成应用卡 玩法更多
10
问界合作模式变化,塞力斯如何“自强”?
11
8月电动两轮车:TOP3增长分化,九号小牛冲高,小品牌弱化
12
MediaTek发布天玑9600 Pro,卓越AI 重构强悍冷劲旗舰体验
13
从开发到运维:HarmonyOS 应用稳定性问题定位定界实践
14
vivo X500,OPPO Find X10,蓝绿旗舰正面交锋
15
电动两轮车 | 内销同比下降7.8%:头部强势反攻,新势力还能守住优势吗?
16
RGB Mini-LED杀向高端显示器,算力如何保障?惠科海思“打了个样”
17
宇树科技发布人形机器人G1+:六项升级,标准版售价9.5W
18
今年有些家电卖不动了,家电行业营收出现微弱下降
19
成为全球高端屏共同定义者,iQOO 16 联合三星显示致力于打造全球最好屏
20
快升级!苹果iOS 26.7正式版发布:一口气修复80多个安全漏洞
关于我们

微信扫一扫,加关注

商务合作
  • QQ:61149512