天天百事通!强化学习发现矩阵乘法算法,DeepMind再登Nature封面!

2022-10-09 17:02:37   来源:商业新知网

来源:机器之心


(相关资料图)

DeepMin d 的 Alpha 系列 AI 智能体家族又多了一个成员——AlphaTensor,这次是用来发现算法。

数千年来,算法一直在帮助数学家们进行基本运算。早在很久之前,古埃及人就发明了一种不需要乘法表就能将两个数字相乘的算法。希腊数学家欧几里得描述了一种计算最大公约数的算法,这种算法至今仍在使用。在伊斯兰的黄金时代,波斯数学家 Muhammad ibn Musa al-Khwarizmi 设计了一种求解线性方程和二次方程的新算法,这些算法都对后来的研究产生了深远的影响。

事实上,算法一词的出现,有这样一种说法:波斯数学家 Muhammad ibn Musa al-Khwarizmi 名字中的 al-Khwarizmi 一词翻译为拉丁语为 Algoritmi 的意思,从而引出了算法一词。不过,虽然今天我们对算法很熟悉,可以从课堂中学习、在科研领域也经常遇到,似乎整个社会都在使用算法,然而发现新算法的过程是非常困难的。

现在,DeepMind 用 AI 来发现新算法。

在最新一期 Nature 封面论文《Discovering faster matrix multiplication algorithms with reinforcement learning》中,DeepMind 提出了 AlphaTensor,并表示它是第一个可用于为矩阵乘法等基本任务发现新颖、高效且可证明正确的算法的人工智能系统。简单来说,使用 AlphaTensor 能够发现新算法。这项研究揭示了 50 年来在数学领域一个悬而未决的问题,即找到两个矩阵相乘最快方法。

论文地址 :https://www.nature.com/articles/s41586-022-05172-4

GitHub 地址:https://github.com/deepmind/alphatensor

AlphaTensor 建立在 AlphaZero 的基础上,而 AlphaZero 是一种在国际象棋、围棋和将棋等棋盘游戏中可以打败人类的智能体。这项工作展示了 AlphaZero 从用于游戏到首次用于解决未解决的数学问题的一次转变。

矩阵乘法

矩阵乘法是代数中最简单的运算之一,通常在高中数学课上教授。但在课堂之外,这种不起眼的数学运算在当代数字世界中产生了巨大的影响,在现代计算中无处不在。

两个 3x3 矩阵相乘的例子。

你可能没注意到,我们生活中处处隐藏着矩阵相乘,如智能手机中的图像处理、识别语音命令、为电脑游戏生成图形等都有它在背后进行运算。遍布世界各地的公司都愿意花费大量的时间和金钱开发计算硬件以有效地解决矩阵相乘。因此,即使是对矩阵乘法效率的微小改进也会产生广泛的影响。

几个世纪以来,数学家认为标准矩阵乘法算法是效率最高的算法。但在 1969 年,德国数学家 Volken Strassen 通过证明确实存在更好的算法,这一研究震惊了整个数学界。

标准算法与 Strassen 算法对比,后者少进行了一次乘法运算,为 7 次,而前者需要 8 次,整体效率大幅提高。

通过研究非常小的矩阵(大小为 2x2),Strassen 发现了一种巧妙的方法来组合矩阵的项以产生更快的算法。之后数十年,研究者都在研究更大的矩阵,甚至找到 3x3 矩阵相乘的高效方法,都还没有解决。

DeepMind 的最新研究探讨了现代 AI 技术如何推动新矩阵乘法算法的自动发现。基于人类直觉(human intuition)的进步,对于更大的矩阵来说,AlphaTensor 发现的算法比许多 SOTA 方法更有效。该研究表明 AI 设计的算法优于人类设计的算法,这是算法发现领域向前迈出的重要一步。

算法发现自动化的过程和进展

首先将发现矩阵乘法高效算法的问题转换为单人游戏。其中,board 是一个三维度张量(数字数组),用于捕捉当前算法的正确程度。通过一组与算法指令相对应的所允许的移动,玩家尝试修改张量并将其条目归零。

当玩家设法这样做时,将为任何一对矩阵生成可证明是正确的矩阵乘法算法,并且其效率由将张量清零所采取的步骤数来衡量。

这个游戏非常具有挑战性,要考虑的可能算法的数量远远大于宇宙中原子的数量,即使对于矩阵乘法这样小的情况也是如此。与几十年来一直是人工智能挑战的围棋游戏相比,该游戏每一步可能的移动数量要多 30 个数量级(DeepMind 考虑的一种设置是 10^33 以上。)

为了解决这个与传统游戏明显不同的领域所面临的挑战,DeepMind 开发了多个关键组件,包括一个结合特定问题归纳偏置的全新神经网络架构、一个生成有用合成数据的程序以及一种利用问题对称性的方法。

接着,DeepMind 训练了一个利用强化学习的智能体 AlphaTensor 来玩这个游戏,该智能体在开始时没有任何现有矩阵乘法算法的知识。通过学习,AlphaTensor 随时间逐渐地改进,重新发现了历史上的快速矩阵算法(如 Strassen 算法),并且发现算法的速度比以往已知的要快。

AlphaTensor 玩的单人游戏,目标是找到正确的矩阵乘法算法。游戏状态是一个由数字组成的立方数组(灰色表示 0,蓝色表示 1,绿色表示 - 1),它代表了要完成的剩余工作。

举例而言,如果学校里教的传统算法可以使用 100 次乘法完成 4x5 与 5x5 矩阵相乘,通过人类的聪明才智可以将这一数字降至 80 次。与之相比,AlphaTensor 发现的算法只需使用 76 次乘法即可完成相同的运算,如下图所示。

除了上述例子之外,AlphaTensor 发现的算法还首次在一个有限域中改进了 Strassen 的二阶算法。这些用于小矩阵相乘的算法可以当做原语来乘以任意大小的更大矩阵。

AlphaTensor 还发现了具有 SOTA 复杂性的多样化算法集,其中每种大小的矩阵乘法算法多达数千,表明矩阵乘法算法的空间比以前想象的要丰富。

在这个丰富空间中的算法具有不同的数学和实用属性。利用这种多样性,DeepMind 对 AlphaTensor 进行了调整,以专门发现在给定硬件(如 Nvidia V100 GPU、Google TPU v2)上运行速度快的算法。这些算法在相同硬件上进行大矩阵相乘的速度比常用算法快了 10-20%,表明了 AlphaTensor 在优化任意目标方面具备了灵活性。

AlphaTensor 具有一个对应于算法运行时的目标。当发现正确的矩阵乘法算法时,它会在指定硬件上进行基准测试,然后反馈给 AlphaTensor,以便在指定硬件上学习更高效的算法。

对未来研究和应用的影响

从数学的角度来看,对于旨在确定解决计算问题的最快算法的复杂性理论而言,DeepMind 的结果可以指导它的进一步研究。通过较以往方法更高效地探索可能的算法空间,AlphaTensor 有助于加深我们对矩阵乘法算法丰富性的理解。

此外,由于矩阵乘法是计算机图形学、数字通信、神经网络训练和科学计算等很多计算任务的核心组成部分,AlphaTensor 发现的算法可以显著提升这些领域的计算效率。

虽然本文只专注于矩阵乘法这一特定问题,但 DeepMind 希望能够启发更多的人使用 AI 来指导其他基础计算任务的算法发现。并且,DeepMind 的研究还表明,AlphaZero 这种强大的算法远远超出了传统游戏的领域,可以帮助解决数学领域的开放问题。

未来,DeepMind 希望基于他们的研究,更多地将人工智能用来帮助社会解决数学和科学领域的一些最重要的挑战。

关键词: 矩阵相乘

上一篇:
下一篇:
精彩阅读

天天百事通!强化学习发现矩阵乘法算法,DeepMind再登Nature封面!

热点

DeepMind的Alpha系列AI智能体家族又多了一个成员——AlphaTensor,这次是用来发现算法。

【全球速看料】Google翻译退出中国:附访问方法

热点

用户被定向到一个普通的搜索栏,并建议将该App的中国香港版本加入书签。

前沿资讯!飞越数字鸿沟:新一代行业云加速政企羽化蜕变

热点

当你凝望数字鸿沟时,数字鸿沟也在凝望你。

每日热讯!6小时4万种生化武器,食人族AI同类相食,AI让人瑟瑟发抖

热点

科学家一直以来争辩的AI末日论,是过于悲观了吗?

天天热点评!红蓝药丸的选择:大脑在缸中还是颅中?

热点

科技的蓬勃发展让人们越来越关注一些技术与人文交织的科幻作品。

【快播报】创作者如何拥抱Web3?

热点

想要利用Web3的优势实现创作者自身的大发展,转变思想观念是基础。

每日讯息!元宇宙新鲜事2024年元宇宙设备市场存量将达1亿 Meta高管称旗下元宇宙应用存诸多问题

热点

近日,华硕正式进军元宇宙,成立“华硕元宇宙股份有限公司”。

天天时讯:为各行各业赋能?看中奥物联如何做到

热点

中奥物联网科技(南京)有限公司是一家专注智慧酒店、智能家居、智慧养老的现代化双创型人才企业。

全球今热点:5G NR广播成为国际无线移动电视标准

热点

可以说,中国广电是5GNR多波广播技术及全球标准落地的重要推动者。

财富

世界微速讯:倒在转“码”路上的文科生

资讯

倒在转“码”路上的文科生,想“逆天改命”,却一败涂地。

世界简讯:小鹏入局,Kittyhawk关停,飞行汽车是伪命题?

资讯

小鹏入局,Kittyhawk关停,飞行汽车是伪命题?,难道下一个出行风口是它。

信息:我在农村租院子:一年租金3万块、200平

资讯

我在农村租院子:一年租金3万块、200平,北京新中产,开始流行去农村租院子。

当前讯息:凡客,复活在抖音直播间

资讯

凡客,复活在抖音直播间,还有粉丝买账么?

天天快资讯丨零跑上市未脱险

资讯

零跑上市未脱险,挑战才刚刚开始。

环球关注:因为喜欢微信,马斯克启动X计划

资讯

因为喜欢微信,马斯克启动X计划,碰上狂人马斯克,不知道是推特的福,还是推特的祸。

今日热搜:融资丨「光恒科技」完成超5000万元A轮及A+轮融资,永攀创投等机构领投

资讯

融资丨「光恒科技」完成超5000万元A轮及A+轮融资,永攀创投等机构领投,本轮融资主要用于新厂房扩建,新型激光测量设备研发和批量生产。

全球观察:融资丨「云舟生物」完成4.1亿元C轮融资,广州产投等机构领投

资讯

融资丨「云舟生物」完成4 1亿元C轮融资,广州产投等机构领投,云舟生物凭借强大的原研能力,致力于系统性攻克基因递送行业的关键技术瓶颈,加速

每日热闻!新式炒货火了,瓜子自由没了?

资讯

新式炒货火了,瓜子自由没了?,街头炒货店“翻身”记。

【环球快播报】Bessemer和老虎基金下注,印度保险科技公司Zopper完成7500万美元C轮融资丨海外邦

资讯

Bessemer和老虎基金下注,印度保险科技公司Zopper完成7500万美元C轮融资丨海外邦,本轮融资将用于完善SaaS平台,招聘技术人才,增强数据分析能

【全球速看料】Google翻译退出中国:附访问方法

用户被定向到一个普通的搜索栏,并建议将该App的中国香港版本加入书签。

前沿资讯!飞越数字鸿沟:新一代行业云加速政企羽化蜕变

当你凝望数字鸿沟时,数字鸿沟也在凝望你。

每日热讯!6小时4万种生化武器,食人族AI同类相食,AI让人瑟瑟发抖

科学家一直以来争辩的AI末日论,是过于悲观了吗?

天天热点评!红蓝药丸的选择:大脑在缸中还是颅中?

科技的蓬勃发展让人们越来越关注一些技术与人文交织的科幻作品。

【快播报】创作者如何拥抱Web3?

想要利用Web3的优势实现创作者自身的大发展,转变思想观念是基础。

苹果举行主题为超前瞻秋季新品发布会 AirPodsPro2正式登场

北京时间9月8日凌晨,苹果举行主题为超前瞻的秋季新品发布会,在此次发布会上,备受关注的iPhone 14系列新机、新款Apple Watch Ultra以

微软正为Windows12开发新驱动框架 提升新老显卡性能

Windows 12系统可能会在2024年到来,按照正常的节奏,其开发工作应该早已秘密进行。日前,有开发者从Windows 11最新预览版Build 25188中

华盛顿地铁站首次亮相为视障人士扩展旅行路线

5月25日消息,一款旨在帮助视障人士或盲人行人使用公共交通工具的应用程序在华盛顿地铁站首次亮相。该应用程序名为Waymap,旨在为盲人和视

2022年情况又要变了!华硕高管:今年PC恐怕要供过于求

这两年来,由于疫情导致的居家办公及远程教育需求爆发,一直在下跌的PC市场枯木逢春,2021年更是创下了2012年以来的最快增长,然而2022年情

垃圾佬的心头好!西数新款固态盘SN740曝光

对于DIY垃圾佬来说,散片、拆机件、工包……这些名词怕是并不陌生。本周,西数推出了主要供应OEM厂商的新款固态盘SN740。SN740升级到了第五

虚假宣传、误导消费者 倍至冲牙器关联公司被处罚

后来者要想在激烈的市场竞争中立足,如果可以背靠巨头享受大树底下好乘凉的红利,那自然是皆大欢喜,没有这个福气,也大可凭借自己一步一个