当前位置:首页 > 网络安全 > 正文内容

DeepMind为AI打造出一个「元宇宙」,XLand到底有多牛?

访客3年前 (2021-09-25)网络安全435

  

  文丨锌财经,作者丨陈伊婷,编辑丨大风

  DeepMind推出最新泛用型游戏XLand,冷不丁丢出一个重磅炸弹。这意味着,在零样本且不需要事先知道规则的情况下,就可以打造出一个全新的、堪比AlphaGo的人工智能。

  一直以来,AI强化学习苦于泛化能力差,只能针对单个任务来从头开始学习。

  5年前,AlphaGo打败世界围棋冠军李世石,举世惊呼。自AlphaGo之后,Deepmind又推出能通学西洋棋、将棋、围棋的AlphaZero。

  

  AlphaZero非常强大,在三大棋领域中「打遍天下无敌手」。但问题在于,AlphaZero若想能够在不同游戏中「称霸天下」,还得在每个游戏「从零训练」后才能够实现。

  XLand的出现则弥补了这个缺陷。如果说AlphaZero是「下棋的手」,那么XLand则创造出了「一个人」。

  它的强大之处,在于它高度泛化的能力。简单的说就是触类旁通,好比人类学会用筷子夹米饭,就能学会用筷子夹菜。而DeepMind打造XLand的目的,则是为了让自家通过强化学习训练的AI,能够玩遍「全宇宙的游戏」。

  这个世界的任务由游戏、世界、玩家构成。根据三要素的不同关系,来决定任务的复杂度。复杂度则由竞争性,平衡性,可选项,探索难度这4个维度评判。

  从简单到复杂的游戏,AI智能体通过第一人称视角去感知游戏中环境,并且不断尝试、碰撞游戏规则,从中累积庞大数据来训练自己完成游戏目标。

  简单的比如「靠近紫色立方体」,复杂一点的比如「靠近紫色立方体或将黄色球体放在红色地板上」。长此以往,AI智能体从新手小白成长为屠龙勇士,吃鸡、捉迷藏都难不倒它们。

  

  基于此,一个由任务空间组成的、超大规模的「元宇宙」XLand就诞生了,几何地球只是其中的一个小角落。我们或许可以提出这样一个设想,人类是外星人创造的AI,而地球是外星人创造的XLand。

  经过5代训练,AI智能体在XLand的4000个独立世界中玩大约70万个独立游戏,涉及340万个独立任务的结果,最后一代的每个智能体都经历了2000亿次训练步骤。

  目前,AI智能体已经能够顺利参与几乎每个评估任务,除了少数连人类也无法完成的任务。

  从AlphaGo走到现在XLand,DeepMind展示了无监督式机器学习的高度潜力,也向世界证明未来训练AI的成本跟门槛将会越来越低,直至普及全球。

  未来的某一天,当AI也能够在「元宇宙」中自己学习演化,赛博朋克的世界是否会真的到来?

扫描二维码推送至手机访问。

版权声明:本文由黑客接单发布,如需转载请注明出处。

本文链接:http://therlest.com/72145.html

分享给朋友:

“DeepMind为AI打造出一个「元宇宙」,XLand到底有多牛?” 的相关文章

创业板投资风险揭示书,创业板风险揭示书

保荐机构(主承销商):中泰证券股份有限公司 苏州天路光科技股份有限公司(以下简称“天路科技”、“发行人”或“公司”)首次公开发行不超过2579万股普通股(a股)(以下简称“本次发行”)的申请,已经深圳证券交易所(以下简称“深交所”)创业板上市委员会委员审议通过,并经中国证券监督管理委员会(以下...

【紧急+重要】勒索病毒解决方案!附:MS17-010补丁下载

  滚动更新:2017年5月13日16:57:22   游侠安全网(良心网站,站长先贴上注意事项和解决方法!防止你看本文的时候就被加密了!   1、本次共计是自动化攻击,利用了Windows的MS17-010。但苹果的MacOS用户不用得意,因为在昨晚之前,我这里得到的好几起勒索攻击案例都是针对...

干洗对衣物有害吗

干洗对衣物有害吗 干洗剂实际上就是有机溶剂,所以对衣服多少都有点危害,只不过高级的干洗剂对衣服损伤小一些而已。 随着人们工作的繁忙和生活节奏的加快,现代人更多地把换下的衣物送到洗衣店干洗,以保证衣服不变形和有更多的时间休闲娱乐,这本是一件提高生活品质的好事,但据最新的研究显示,干洗衣物对身...

Webshell安全检测篇(1)-根据流量的检测方法

一、概述 笔者一直在重视webshell的安全剖析,最近就这段时刻的心得体会和咱们做个共享。 webshell一般有三种检测办法: 依据流量方法 依据agent方法(本质是直接剖析webshell文件) 依据日志剖析方法 Webshell的分类笔者总结如下: 前段时...

二手路虎极光 「2015路虎极光二手车报价」

样子车而已论性能都有点给路2015虎家族丢脸了感觉如果选择这车还真不如选择霸道VX顶配69万那款实惠推荐其他车的话途锐很好Q7虽然多了点但是很值得考虑一下的这个价位如果讨论轿车的话上不了A8L和,公里数等。火烧。 二手车价格:41点00万,2013极光款2点0T AT圣诞限量版,车子没有。 2015...

宝马528(宝马5系528li报价)

系最终决定选择宝马528.新款BMW,528领先,4400元,另外附525豪华,型57点66万,后驱:525豪华,车型宝马指导售价车型售价报价。 高保真扬声器。小屏、厂家指导价,相差27马力,多功能方向盘电动调节带巡航+换挡拨片、8速变速箱。 jnsdxx2016-2-2323:10:35发表在23...

评论列表

馥妴雨安
2年前 (2022-09-02)

haGo的人工智能。  一直以来,AI强化学习苦于泛化能力差,只能针对单个任务来从头开始学习。  5年前,AlphaGo打败世界围棋冠军李世石,举世惊呼。自AlphaGo之后,Deepmind又推出能

竹祭瑰颈
2年前 (2022-09-02)

靠近紫色立方体或将黄色球体放在红色地板上」。长此以往,AI智能体从新手小白成长为屠龙勇士,吃鸡、捉迷藏都难不倒它们。    基于此,一个由任务空间组成的、超大规模的「元宇宙」XLand就诞生了,几何地球只是其中的

痴妓北渚
2年前 (2022-09-02)

是为了让自家通过强化学习训练的AI,能够玩遍「全宇宙的游戏」。  这个世界的任务由游戏、世界、玩家构成。根据三要素的不同关系,来决定任务的复杂度。复杂度则由竞争性,平衡性,可选项,探索难度这4个维度评判。  从简单到复杂的游戏,AI智能体通过第一人称视角去感知游戏中环境,并且不断尝试、碰撞游戏

语酌柠木
2年前 (2022-09-02)

,从中累积庞大数据来训练自己完成游戏目标。  简单的比如「靠近紫色立方体」,复杂一点的比如「靠近紫色立方体或将黄色球体放在红色地板上」。长此以往,AI智能体从新手小白成长为屠龙勇士,吃鸡、捉迷藏都难不倒它们。    基于此,一个由任务空

发表评论

访客

◎欢迎参与讨论,请在这里发表您的看法和观点。