天天播报:深度学习红利见顶,AI“敢问路在何方”?潘云鹤、姚期智两院士支招

2022-09-07 16:09:04   来源:商业新知网

图源:东方IC

在刚刚闭幕的2022世界人工智能大会(WAIC)上,很多观众邂逅了一件神奇的“隐身衣”:将一件T恤举在身前走过摄像头,它便对你“视而不见”,用来演示的屏幕上,一起路过的行人中,唯有你没有被绿色方框标注。


(相关资料图)

“这意味着,最后输出的报告中,你所有的信息都不在其中。”现场的瑞莱智慧RealAI工作人员告诉记者,一些特殊场景下,穿这件T恤的人就算在镜头里出现,人脸也不会被特殊标注并抓取,从而躲过比对。

这是一个警醒。10年前,ImageNet挑战赛上,Geoffrey Hinton团队运用神经网络深度学习技术,将图片识别的错误率从30%左右提升至16.42%,从而掀起本轮人工智能浪潮。

然而,高速发展10年后,学界普遍认为,从应用的角度来看,以数据驱动的深度学习,其技术潜力已接近“天花板”。一方面,深度学习的本质是利用没有加工处理过的数据,用概率学习的“黑箱”处理方法寻找规律,这一方法本质上不可解释、不可以迁移使用,而且需要大量标识化的数据。另一方面,风险点也已出现, 除了记者在2022WAIC现场看到的这件“隐身衣”外,伪造人脸“骗”过银行认证系统,在国内已有多起实际案例出现 。

世界人工智能大会举办的第五年,人们开始讨论新的话题:当此轮深度神经网络学习的技术红利逐渐见顶时,如何推动人工智能的普及化以惠及更多产业?人工智能新的发展又该走向何方?

“ 大数据、大模型固然很重要,大知识同样重要。 ”中国工程院院士、浙江大学教授潘云鹤在2022WAIC上指出,数据和知识双轮驱动将是人工智能第四次创新方向。

让数字人“有知识”

从诞生到现在,人工智能已经走过了66年,潘云鹤将其分为三个阶段。第一阶段是1956年达特茅斯会议之后, 规则和逻辑驱动的人工智能 ;第二阶段是20世纪60~70年代, 从逻辑进化到知识和推理驱动的人工智能 ,当时的知识型人工智能,不但使用逻辑,而且使用比逻辑更加广泛的人类经验,思维方式比现在更加“类人”,但当时的知识表达都是字符型,视觉和声音的信号怎么变成知识并没有解决。

2012年,这块空白被神经网络所填补,人工智能发展进入第三阶段,此后发生的一切,大家便熟知了, 深度神经网络在视觉识别、听觉识别、文字识别、多媒体人工智能方面得到了极大突破 ,但同时也产生了很多缺点,比如不可解释的“黑盒”、大量需要标注的数据。

“这些缺点都和只采用数据而不采用知识有很大关系。”潘云鹤表示,现在人们常说AI的逻辑能力很难训练,但其实早期的AI逻辑能力很强,只是现在这一轮的深度神经网络技术没有这个能力,所以要将两者联合起来使用,他称之为“知识和数据共同驱动”的人工智能。

潘云鹤指出, 人工智能第四阶段是将数据和跨媒体智能、跨媒体知识表达相结合 ,对视觉的对象进行识别、分析和模拟,其中,开路先锋很可能就是视觉、文字等其他知识的多重知识表达,也即这两年技术上正在突破的多模态人工智能。

比如,此次大会讨论的中心“元宇 宙”,便是典型的跨媒体人工智能。元宇宙要同时模拟物理世界和人类社会,这需要人工智能不仅有大量的设备识别,还要大量的视觉生成。

潘云鹤以数字人为例解释,它不但要表现人的外观、动作、感知、人的认知能力,还要表现人的个性化数据,“ 数字人本身就是一个人的跨媒体知识表达,是元宇宙的难点 ”。

清华大学在“多模态学习”方面的研究也开展多时。上海期智研究院院长姚期智介绍,清华大学交叉信息研究院赵行研究组正在将多模态学习从理论推向实际应用,目前已经可以让AI根据配音脚本,自动生成与画面节奏同步的高质量配音。据了解,这项研究是利用视频中的嘴部运动控制生成语音的韵律,以达到语音和视频同步。

可喜的是,近年来,人工智能产学研协同的速度越来越快。据《IT时报》记者了解,腾讯已经将多模态融合应用于计算机视觉研究,为交通银行提供多个场景下的视觉AI解决方案,可快速处理用户上传图片不清晰、用户证件照片识别、资料印章模糊干扰、用户证件PS鉴伪等问题,从而提升银行交易流程效率,提升用户办理业务体验。

自动驾驶认不出“雪糕桶”

向新的技术方向前进,是人工智能发展10年后的顺势而为。

如今,数据、算力、算法是公认“AI三件套”,其中,大数据是基础中的基础。究其原因,在于深度学习本质是寻找规律,利用大量没有加工处理过的数据,通过概率的方式不断寻找重复出现的模式。也就是说,一种模式出现次数多了,就会被人工智能认为是正确的,但它为何会得出这个结论,中间的过程是个“黑箱”。

因此,我们常听到这样的说法,如果某个模型还不够准确,那是数据还不够多,需要更多的数据“投喂”。甚至有时候,AI会自动形成“偏见”,比如此前谷歌便被质疑“性别歧视”,搜索“工程师”,出现的图片结果大多是男性,这是因为现实生活中的工程师以男性居多。

但当人工智能具有越来越普遍的应用价值时,以海量数据和超强算力为主的深度学习技术,不仅没办法解决所有问题,甚至出现新的风险。上文中,记者看到的“隐身衣”,便是一种“对抗样本攻击”,通过在输入数据中添加扰动,从而使系统做出错误判断。

瑞莱智慧RealAI合伙人、高级副总裁朱萌告诉《IT时报》记者,测试显示, 在自动驾驶场景中,通过修改锥桶的形状,可以让汽车感知模块失效,径直撞上去;而通过带有特制花纹的眼镜,他们数分钟便刷开了数十部商用手机的人脸密码。

同时,低数据效率也使得强化学习发生很大缺陷,打败李世石的AlphaGo需要的数据量,一位职业棋手要花两万年才能学完,这意味着,在一些小样本的场景中,识别准确率将大打折扣。

Robust.AI 创始人、纽约大学名誉教授 Gary Marcus在今年3月的一篇论文中也以特斯拉未能识别“举着停车标志的人”的案例说明,由于这个场景远远超出了训练数据库,以至于系统不知道该怎么做。

占领制高点议题

“为了人工智能将来的发展,我们必须在基础研究上做大量工作。”姚期智指出,生成原始创新的生态,中国研究学者必须做到“人无我有”。

清华大学交叉信息研究院高阳研究组去年在高效率强化学习上实现了突破。

Atrai游戏是目前强化学习领域最常用的性能测试标准之一。2015年,Deep Mind团队提出的算法DQN,通过200M帧训练数据,在Atari游戏上达到了人类平均水平。但高阳团队提出的EfficientZero仅使用了DQN需求数据量的1/500,2小时便实现了同等效果。

姚期智认为,建设人工智能创新高地,就是要在制高点议题上,取得话语权 。此外,在关键技术上,中国即便现阶段相对不足,也要尽力追赶,争取早日进入世界前列。而在新兴理论与技术方向,大家都在同一起跑线上,应该争取先机,和全球并跑。

姚期智重点指出两个交叉研究方向:量子智能和AI+X,一方面要及早准备,随着量子计算机的逐渐成熟,进行算法突破;另一方面要与其他学科交叉研究,使其成为原创工作的源泉。比如人工智能和材料学便可以一起研究,用新材料创造新的建筑方式。

作者/ IT时报记者 郝俊慧

编辑/ 挨踢妹

排版/ 季嘉颖

图片/ WAIC IT时报 东方IC

来源/《IT时报》

关键词: 人工智能 神经网络

上一篇:
下一篇:
精彩阅读

天天播报:深度学习红利见顶,AI“敢问路在何方”?潘云鹤、姚期智两院士支招

热点

比如人工智能和材料学便可以一起研究,用新材料创造新的建筑方式。

天天速读:互联网大厂停止赛马

热点

今年,互联网大厂如何活下去、搏未来?

环球关注:从用得上到用得起,虚拟数字人能成下一个风口的行业吗?

热点

在本次2022世界人工智能大会上,虚拟数字人是一个很大的亮点。现在,虚拟数字人的“风口”似乎已经快要到来。

天天速看:快十年了,虚拟运营商“夹缝求生”还有存在的必要吗?

热点

说起运营商,我们都知道如今的中国移动、电信、联通、广电四大运营商,但是你注意过虚拟运营商吗?

全球新动态:广电5G或将在10月中旬全面商用 与三大运营商打擂胜算有几何

热点

说起广电5G,现在大概也很少有人不知道了。在前段时间开启了192号段的预约放号后,广电5G也就正式的浮出了水面。

精彩看点:门外的古罗马人:国内知名互联网收购交易回顾

热点

A股市场在2018年发生了一起极为成功的交易,星期六鞋业收购互联网营销公司遥望网络。

环球播报:重磅!武汉市获批创建国家区块链发展先导区!

热点

近日,工信部正式复函湖北省经信厅,支持武汉市创建国家区块链发展先导区。

全球观速讯丨新思科技发布最新软件供应链安全调研报告

热点

随着企业开始采用现代软件开发流程,开发人员可以通过将应用部署到云端而快速开发和发布应用。

天天百事通!2022世界人工智能大会“AI商业落地论坛”圆满落幕

热点

亿欧主办的2022世界人工智能大会“AI商业落地论坛”成功举办。

环球微速讯:祝贺中国邮政集团数据中台一期上线,成为国内首家以数据服务为核心的央企数据中台

热点

数据是信息技术应用创新的基础,没有安全、高质量的数据,数字化转型将无法有序开展。

财富

每日热闻!资本撤退、增长不再,扫地机器人跑不动了

资讯

资本撤退、增长不再,扫地机器人跑不动了,靠烧钱营销,卷不出未来。

全球速看:老年零食,休闲食品内卷的下一个出口?

资讯

老年零食,休闲食品内卷的下一个出口?,越来越多的年轻人,为老年人寻找零食。

环球微资讯!迷上摩托车的年轻人:我太难了

资讯

迷上摩托车的年轻人:我太难了,骑摩托车很酷,但也没那么酷。

今日热闻!香飘飘,连下沉市场也不香了

资讯

香飘飘,连下沉市场也不香了,香飘飘困在原地。

全球快资讯丨“2022金鱼嘴每日路演暨光速中国机构日活动”圆满落幕,4家企业获最具投资潜力奖

资讯

“2022金鱼嘴每日路演暨光速中国机构日活动”圆满落幕,4家企业获最具投资潜力奖,9家该赛道的优质项目参加,共同打造一场创投分享的盛会。

世界通讯!GGV和贝恩下注,实时数据分析平台StarTree完成4700万美元B轮融资丨海外邦

资讯

GGV和贝恩下注,实时数据分析平台StarTree完成4700万美元B轮融资丨海外邦,作为一个实时在线数据存储和分析系统,可方便研究人员进行实时数据分析。

【环球新要闻】张一鸣要抢李彦宏饭碗了?

资讯

张一鸣要抢李彦宏饭碗了?,为什么大厂都想做搜索?

每日快看:狂热的旧衣回收行业:投入1万多,8个月赚30万

资讯

狂热的旧衣回收行业:投入1万多,8个月赚30万,被你扔掉的旧衣,是创业商机,还是“割韭菜”的镰刀?

【独家】交个朋友VS东方甄选,该押谁胜?

资讯

交个朋友VS东方甄选,该押谁胜?,各自光环能持续多久?

全球速讯:口碑两极分化,预制菜品牌最该做好这件事

资讯

口碑两极分化,预制菜品牌最该做好这件事,消费者需要教育吗?

天天速读:互联网大厂停止赛马

今年,互联网大厂如何活下去、搏未来?

环球关注:从用得上到用得起,虚拟数字人能成下一个风口的行业吗?

在本次2022世界人工智能大会上,虚拟数字人是一个很大的亮点。现在,虚拟数字人的“风口”似乎已经快要到来。

天天速看:快十年了,虚拟运营商“夹缝求生”还有存在的必要吗?

说起运营商,我们都知道如今的中国移动、电信、联通、广电四大运营商,但是你注意过虚拟运营商吗?

全球新动态:广电5G或将在10月中旬全面商用 与三大运营商打擂胜算有几何

说起广电5G,现在大概也很少有人不知道了。在前段时间开启了192号段的预约放号后,广电5G也就正式的浮出了水面。

精彩看点:门外的古罗马人:国内知名互联网收购交易回顾

A股市场在2018年发生了一起极为成功的交易,星期六鞋业收购互联网营销公司遥望网络。

微软正为Windows12开发新驱动框架 提升新老显卡性能

Windows 12系统可能会在2024年到来,按照正常的节奏,其开发工作应该早已秘密进行。日前,有开发者从Windows 11最新预览版Build 25188中

华盛顿地铁站首次亮相为视障人士扩展旅行路线

5月25日消息,一款旨在帮助视障人士或盲人行人使用公共交通工具的应用程序在华盛顿地铁站首次亮相。该应用程序名为Waymap,旨在为盲人和视

2022年情况又要变了!华硕高管:今年PC恐怕要供过于求

这两年来,由于疫情导致的居家办公及远程教育需求爆发,一直在下跌的PC市场枯木逢春,2021年更是创下了2012年以来的最快增长,然而2022年情

垃圾佬的心头好!西数新款固态盘SN740曝光

对于DIY垃圾佬来说,散片、拆机件、工包……这些名词怕是并不陌生。本周,西数推出了主要供应OEM厂商的新款固态盘SN740。SN740升级到了第五

虚假宣传、误导消费者 倍至冲牙器关联公司被处罚

后来者要想在激烈的市场竞争中立足,如果可以背靠巨头享受大树底下好乘凉的红利,那自然是皆大欢喜,没有这个福气,也大可凭借自己一步一个

吉利几何EX3功夫牛高居榜首,4月投诉量230起

近日,车质网发布了2022年4月车型投诉排行八卦(前30名),其中有不少产品的出现属实让人没想到。具体来看,吉利几何EX3功夫牛高居榜首,4月