DeepMind用新AI超越自己:提速200倍 所有雅达利游戏上胜过人类

Android社区 收藏文章

但它有一个致命缺陷是效率低:需要近800亿帧的数据训练才能实现。

现在,MEME的出现完美解决了这一问题。

有网友看完表示:这就是真正的样本高效吧。

话不多说,赶紧来一睹为快吧。

新的智能体:MEME

Agent57,作为首个在所有雅达利游戏中超越人类基准表现的智能体,性能上已足够先进。

但问题是,要想达到这一目标,背后需要780亿帧的庞大的经验训练,这在时间和成本上都是一笔大开支。

因此,以Agent57为起点,DeepMind采用了一系列不同的策略,来实现训练效率上的提升。

他们调查了在减少数据制度时遇到的一系列不稳定因素和瓶颈,并提出了有效的解决方案,最后建立一个更加强大和高效的智能体:MEME。

新的MEME智能体主要针对Agent57的4个方面进行改善,分别是:

A.实现与罕见事件相关的学习信号的快速传播

B.在不同的价值尺度下稳定学习

C.改进神经网络结构

D.在快速变化的政策下使更新更加稳健

为了达到这四个目标,DeepMind采取了以下方法,与上述四点相对应。

A1.用在线网络进行引导;

A2.有公差的目标计算;

B1.损失和优先权归一化;

B2.交叉混合训练;

C1.无归一化的躯干网络;

C2.带有综合损失的共享躯干;

D.通过策略提炼的鲁棒行为。

这些方法旨在提高Agent57的数据效率,但这种效率的提高不能以牺牲终端性能为代价。

因此,为了检验经过上述步骤的智能体MEME的效率和性能,研究团队分别在2亿、10亿、200亿、900亿帧环境进行了训练。

通过下图可以直观的看出,新智能体MEME在3.9亿帧时就超过了人类基准,比Agent57快了两个数量级,并且在将参数量从90B减少到1B的情况下,取得了类似的最终表现。

可以说相比Agent57而言,MEME既提升了效率,又保持了性能。

研究团队

MEME的研究团队来自DeepMind。

其中三位Adrià Puigdomènech Badia、Steven Kapturowski、Charles BlunDELL也是之前Agent57的论文作者。

值得一提的是,Steven Kapturowski在两篇论文中都是一作。

他毕业于美国科罗拉多大学博尔德分校,曾在苹果微软、GlaSSDoor等公司工作过,现在是DeepMind的一名高级研究工程师。

相关标签
 相关文章
王慧文病休53天,旗下OneFlow团队重新创业 1年以前  |  1次阅读
智己CEO现场怒怼!不满LS6和小鹏G6当对手 1年以前  |  1次阅读
董明珠回应落榜世界500强:总比爆雷的世界500强好 1年以前  |  1次阅读
阿里云上线 AI 视频生成工具 Live Portait:可一键让照片开口说话 1年以前  |  78次阅读
妙鸭相机将并入神力视界,阿里大文娱CTO郑勇:不是“搬家”是“回家” 1年以前  |  85次阅读
特斯拉上海超级工厂约40秒下线一台车,零部件本土化率超95% 1年以前  |  69次阅读
宁德时代发布神行超充电池,可实现充电10分钟行驶800里 1年以前  |  71次阅读
中科院博士被骗到缅甸已一年!女友:他负债几万,家里条件一般,以为去当翻译 1年以前  |  85次阅读
小鹏汽车否认收购玛莎拉蒂传闻:系谣言 1年以前  |  63次阅读
联想二季度净利润猛降66%,股价应声跳水 1年以前  |  80次阅读
业内人士:视觉中国对不同侵权主体采用差异化策略,老客由销售沟通新客发律师函 1年以前  |  70次阅读
恒大集团在美国申请破产保护 1年以前  |  56次阅读
劳斯莱斯首款纯电轿跑将在北美亮相 1年以前  |  89次阅读
realme印度前CEO确认加盟荣耀,即将推出手机新品 1年以前  |  88次阅读
OpenAI正在测试内容审核系统,一天可以完成六个月的工作 1年以前  |  80次阅读
谷歌百人“复仇者联盟”出击,将发对标GPT-4的大模型,26位研发主管名单流出 1年以前  |  77次阅读
OpenAI收购数字产品公司Global Illumination,为创立以来首笔公开收购 1年以前  |  80次阅读
海口规定:电动汽车充电服务费不得超过0.65元每度 1年以前  |  80次阅读
波音任命柳青为波音中国总裁 1年以前  |  88次阅读
业内人士谈图片复杂代理链:图片代理商越多摄影师分成越少 1年以前  |  67次阅读

扫一扫

在手机上阅读