您的位置:首页 > 互联网

高文院士谈AI:规模即所需,三“大”缺一不可

发布时间:2024-05-26 00:15:34  来源:互联网     背景:

通信世界网消息(CWW)“规模是做好生成式人工智能的撒手锏,大数据、大模型和大算力对于生成式人工智能缺一不可。”在近日举行的第七届数字中国峰会之中国移动人工智能生态大会上,中国工程院院士、鹏城实验室主任、北京大学博雅讲习教授高文表示。高文院士回顾了人工智能发展的三次浪潮,并对影响当下生成式人工智能发展的关键因素进行了分析。

历经三次浪潮

1956年夏天,美国达特茅斯学院举行了一场研讨会,在会上麦卡锡首提“人工智能”,标志着人工智能元年的到来。追忆历史,高文表示,从1956年开始人工智能经历了三次浪潮:以推理研究为主的第一次浪潮,持续20年左右时间;以专家系统为主的第二次浪潮,持续30年左右时间;以及从2006年开始的第三次浪潮。其中第三次浪潮又包括两大技术进展:从2009年开始的判别式人工智能,从2018年开始的生成式人工智能。

2009年,华裔科学家李飞飞和李凯教授提出imageNet(图像网络),一石激起千层浪,业界八仙过海各显神通,纷纷基于imageNet提出各自的判别式人工智能算法,直到2012年深度神经元网络出现,以绝对优势令其他算法黯然失色,将百花齐放的格局进行收敛。2015年微软研究院何凯明、孙剑等联合提出ResNet(残差网络),又将判别式人工智能带到了新高度。此后,从深度神经网络DNN到卷积神经网络CNN再到循环神经网络RNN,深度网络快速迭代,不断走向新的技术高度。

“判别式人工智能以模式识别见长,如图像分类、人脸识别、智能监测等,如今广泛应用的人脸识别正是判别式人工智能的应用。判别式人工智能与人的对象认知学习接近,可以根据学习速度、记忆规模、判别准确度判断其结果好坏。”高文分析。

大语言模型破解长语言序列难题

不过,判别式人工智能通过在神经网络中输入大量数据进行快速判别,擅长图像和矩阵识别,对于长语言序列则力不从心。在这样的形势下,大语言模型应运而生,致力于解决长语言序列问题,而生成式人工智能则是大语言模型的最主要突破。

高文表示,自2018年开始生成式人工智能快速迭代,从大语言模型LLM到ChatGPT再到Sora多模态,万变不离其宗的是底层关键技术GPT(生成式预训练模型)。GPT引入注意力机制,使得一个长串中无论相隔多远的两个相关数据都能连接在一起,并训练出关联度。“GPT的核心算法是用大量序列做大模型预训练,关键是注意力机制。由于GPT算法对业界并无差别,因此具体应用效果取决于学习速度、记忆规模、表达准确度等。”高文认为。

虽然如今ChatGPT如火如荼,但是GPT起初并没有激起太多涟漪。这是因为GPT使用起来问题较多:给出的答案要么过于简单,要么过于复杂,要么不合规,存在意识形态、文化习惯、行业差别等方面的问题。

ChatGPT的出现改变了这一现象,使得业界对于人工智能的印象和投入力度大为改观。不过从底层技术看,从GPT到ChatGPT并没有改变,其不同在于:一是ChatGPT增加了InstructionGPT指令,通过微调、对齐和抑制,使得回答更加“人模人样”;二是引入基于人类反馈的增强学习RLHF,解决合规问题和垂应用适配等。

大数据、大模型和大算力缺一不可

在中国移动人工智能生态大会上,中国移动发布了“万千百”智能基座,其中,“万”指“万”卡互联并行加速算力供给,中国移动年内将投产3个近两万卡超大规模单体智算中心和12个区域智算中心,广泛升级1500个边缘节点,为全社会提供澎湃算力。

中国移动在智算中心方面的规模投入并非个例,随着生成式人工智能的发展,全国各地多个智算中心如雨后春笋不断出现,而这背后的原因是人工智能的发展需要算力支撑。

“生成式人工智能做得好不好,规模是决性定因素。”高文一语道出其中关键。

高文表示,GPT和Sora等人工智能生成技术并没有提出理论革新,与20年前的人工智能神经网络理论本质上并无差异。生成式人工智能的突破得益于大数据、大模型和大算力,这三个“大”缺一不可。特别是算力,如今千卡是入门级规模,要想做大模型必须有万卡级。

对于规模,OpenAI等公司也有深刻见解:如果能用规模解决问题,就无需动用新的算法。不仅如此,OpenAI还提出了“假设性三公理”,已被AI领域奉为圭臬。

第一条公理,苦涩的教训。多年来人工智能的研究者们一直试着将人类已知的知识构建到他们的智能体中,但是屡战屡败。成功的极少数案例都是使用规模计算,通过搜索和机器学习完成的。大规模、大算力和大数据是通用人工智能的必要条件。

第二条公理,规模即所需。一旦选择了良好且通用的数据标注、算法,就能够找到一套通用的规律,数据越多,模型越大,效果就越好,而且这个规律在训练之前就可以预知效果。大规模是通用人工智能AGI的充分条件,大就是好。

第三条公理,涌现需规模。随着规模的扩大、数据的增加,大模型一定会涌现出前所未有的能力,这个能力可以被所有人看到。

最后,高文总结表示,判别式人工智能方兴未艾,生成式人工智能如火如荼,关于下一波浪潮业界也有很多预测,如无人驾驶、具身智能、人形机器等,但总体而言仍不得而知。未来充满想象,值得我们期待,也需要业界有所作为。高文特别提到,中国的人工智能需要自己的大模型底座,只有这样才能实现以中文语料和中国历史为基础的文明传承。

三体动画上线


返回网站首页

本文评论
IDC:2022下半年,专属云逐步成为产业上云更优解_idc云计算产业2020
通信世界网消息(CWW)国际数据公司 (IDC)最新发布的《中国专属云服务市场(2022下半年)跟踪》报告显示,2022下半年,专属云服务市场同比增长27.1%,整体市场规模达165.2亿元人民币。其中...
日期:07-24
Meta AI 负责人:当前的 ChatGPT 等人工智能还不如狗聪明
6月16日消息:当前的人工智能系统(如 ChatGPT)并没有人类级别的智能,甚至不如狗聪明。这是 Meta 的 AI 负责人在关于这种快速发展技术危险的论坛中表示的。ChatGPT 是由 OpenAI...
日期:06-16
Windows 11预览版月底全面推送_windows11开始推送
  本周,微软带来了Windows 10 21H2预览版Build 19044.1147以及Windows 11预览版Build 22000.71两大新版本。   其中Build 22000.71是Win11上线以来的第三个版本累积更新...
日期:04-17
00后大学生色彩创业之路 用三色激光还原千年珐琅之美
5 月 18 日,海信旗下年轻潮牌Vidda在北京举办新品发布会,一次性发布了三款智能投影全家桶新品。现场,来自广州美术学院数字媒体艺术专业 00 后学生方志烨,现场展示了原创3D Mapp...
日期:05-24
移动互娱是什么_整个娱乐终端和网络平台的移动化将是业界关注的大方向
  “整个娱乐终端和网络平台的移动化是业界关注的大方向。但3G和4G的发展和WIFI网络的发展未来需要配合起来,这仍需要一定的路程要走。” 腾讯互动娱乐业务系统副总裁程武...
日期:07-27
ChinaJoy 2023即将开展 入手参展品牌最新游戏装备首选京东「chinajoy2021参展商」
暑假正在进行时,除了学习生活外,畅快体验游戏世界也是当下一大趋势。为让每一位消费者的暑期生活都更加精彩,京东在近期上线了“暑假嗨玩 游戏当家”活动会场。会场内不但有性...
日期:07-27
老人自称腰疼 买一张坐票占三个座
近期,关于一位老人在火车上因自称腰疼和腿脚不便而占用三个座位的事件在网络上引起了广泛关注。根据报道,这位老人乘坐的是T211 次列车,在列车上他购买了一张坐票,但实际上却占...
日期:04-17
前沿科技与艺术结合,三星携手金晨共同打造创新家居生活
随着科技发展日新月异,家的内涵不断在拓展,消费者对于家庭生活质量的要求也在不断提升。近年来,三星致力将科技、艺术和家更为紧密地结合在一起,以“科技·艺术·家”为主题,希望...
日期:11-10
马斯克警惕人工智能「马斯克:人工智能比核弹更危险」
快科技11月30日消息,特斯拉首席执行官埃隆马斯克称,我们应该对人工智能实施某种监管。折叠屏手机贵马斯克说道:在我看来,人工智能比核弹更危险。”马斯克一直关注人工智能的发展...
日期:11-30
今晚发布!小米13 Ultra内置5000mAh电池:支持90W有线 50W无线快充_小米1033w快充多久能充满
快科技4月18日消息,今晚小米就要召开重磅的新品发布会,推出今年的超大杯旗舰小米13 Ultra,在发布会之前,该机的一项重要信息被曝光,消息称其机身内置了5000mAh电池,而且支持90W有...
日期:04-18
推动ESG理念深入践行,TCLGreen全球倡议广获国际认可_tcl全球生态合作伙伴大会
  ESG已成为衡量企业可持续发展的重要指标,中国企业积极推动ESG实践,受到国际关注与认可。其中,中国制造代表企业TCL凭借在“科技赋能、环保教育普及、海洋生态保护”等方面...
日期:12-21
ChatGPT官网已经无法登陆 如何注册chatgpt账号?「chat怎么注册账号」
自去年刚刚发布后引起互联网界热议后,ChatGPT这一聊天机器人模型在近期又迎来了第二春,由于其强大的答案搜集和语言整合能力,ChatGPT成为了当前的一个香饽饽,微软宣布将会在自家...
日期:02-11
InstantID模型发布 相比PhotoMaker保留了良好的文本可编辑性_instant类型
1月23日 消息:人脸身份保持项目InstantID正式发布模型。与PhotoMaker和IP-Adapter-FaceID相比,InstantID实现了更好的保真度并保留了良好的文本可编辑性。这个项目的发布受到...
日期:01-23
新灵感,新保鲜!科大讯飞联合果壳,把“有意思”带给你!
  每个人都曾在浴室外的生活中体验过尤里卡的发生。这个夏天,第二届果壳有意思博物馆于8月17-18日在北京·朝阳规划艺术馆开幕!以“平凡生活里的尤里卡时刻”为主题,与大家...
日期:09-27
日媒:iPhone 14研发过程表明,苹果要真正脱离中国将会多么困难「苹果日报为什么」
  [环球时报报道 记者 赵觉珵]北京时间8日凌晨,苹果正式发布了iPhone 14系列新机等产品,“刘海屏”变为加入交互功能的“灵动岛”、支持紧急情况下的卫星通信、在除美国以外...
日期:09-10
东方晶圆微电子「对话东方晶源:打造中国芯片制造的GoldenFlow」
一直以来,芯片厂商都将先进制程作为竞争的目标,将摩尔定律奉为圭臬。然而,在这个过程中,随着集成电路制程节点的不断演进,工艺复杂程度不断增加,良率变得极具挑战,成为阻碍行业发展...
日期:04-03
抖音本地生活启动“心动观赛季”营销活动_抖音活动专区
10月9日 消息:昨日,抖音生活服务宣布,2022世界杯将至,平台将启动心动观赛季活动,联合全国万家优质商家,覆盖餐饮、酒旅、休娱等全品类生活服务领域,以多矩阵新颖的玩法,超优质资源...
日期:10-19
AMD RX 7900首发只有公版?非公拼了!「AMD RX 6900 XT」
AMD RX 7900系列显卡将于12月13日正式上市,有说法称首销只有AMD公版型号,非公版要晚1-2周,且价格可能会贵不少。具体原因不详,据说是不可描述,但无论如何,首发没有非公版是难以接...
日期:11-27
“科创中国”创新创业投资大会(2022)正式启动_2020中国年度创投大会
  5月10日,“科创中国”创新创业投资大会(2022)(以下简称“创投会”)正式启动,面向全球征集参会项目,遴选新兴科技领域的创新创业之星。创投会作为中国科协“科创中国”...
日期:05-14
iphone钛合金「iPhone 15 Pro系列的钛中框和铝底盘不是导致过热问题的原因」
苹果公司表示,iPhone 15 Pro系列的钛中框和铝底盘不是导致过热问题的原因,排除了硬件问题。42寸oled电视下半年上市并不是所有的iPhone 15 Pro和Pro Max用户都经历了过热问题,...
日期:10-02