您的位置:首页 > 互联网

李开复、张亚勤对谈:大模型产业化,To B、To C哪个赛道更有机会?

发布时间:2024-06-15 23:31:05  来源:互联网     背景:

6月15日消息,在第六届“北京智源大会”上,零一万物CEO、创新工场董事长李开复博士,中国工程院院士、清华大学智能产业研究院(AIR)院长张亚勤院士、智源研究院理事长黄铁军教授,三位行业领袖就大模型的成功因素、面临的挑战、产业化场景等多个热点话题展开了深入的讨论。

以下为讨论内容部分摘录:

一、什么原因使得大模型如此成功?

黄铁军:近期关于大模型的讨论特别热门,从刚才的报告大家也感受到了大模型的能量以及其在各领域的应用潜力,可以说大模型是至今为止人工智能发展最成功的一个技术方向。想请问两位,是什么原因使得大模型如此成功?还有哪些欠缺的地方需要进一步发展?

李开复:AI 2.0是有史以来最伟大的科技革命和平台革命,大模型Scaling Law 的重要性在这个时代得以凸显——人类能够用更多计算和数据不断增加大模型的智慧,这条被多方验证的路径还在推进中,还远没有触达天花板,这点也让大家非常振奋。

第二,大模型的智慧来自于接近无损的压缩,这点也非常重要。上世代的人工智能从业者很难想到今天会把压缩和智能连接在一起。因为Scaling Law过程中不能盲目堆更多的GPU,所以需要有一个方法评估我们有没有越做越好或者哪个方法做得更好。零一万物内部有严谨的方法论,用压缩的理念去评估,让以往漫无目的“炼丹”训模过程变得更系统也更有科学和数学根据。

大模型正面临着一些挑战。比方说,如果“仅仅用更多算力就能把它往前推动”是主要方向的话,就会导致只有那些GPU资源丰富的公司和国家能够在这方面胜出。但话说回来,我们已经验证了,很多国内大模型在部分案例里接近或者打平、或者偶尔超过美国的大模型。所以我认为需要专注的是算法和工程创新一体化的推进,以及怎么以这种能力避免进入“盲目堆算力推动模型性能提升”的状态。

当然,目前大模型还直面许多挑战。就像每个技术刚诞生都会有问题,起初大模型也不知道最近一年发生了什么。还有记忆的问题、窗口构成的问题、幻觉问题等等,但我们可以看到的是,当全球如此多聪明的大脑涌入这个领域后,大部分问题不能说被完美地解决,但是都在逐步被攻克的过程中,所以我对大模型的未来相当乐观。

张亚勤:我讲“三个做对了”的和“三个需要改进”的 。

“三个做对了”的点是,首先,规模定律Scaling Law。规模定律的实现,主要得益于对海量数据的利用以及算力的显著提升。再加上现在的Diffusion和Transformer架构能够高效地利用算力和数据,使得“飞轮效应”得以正循环。尽管有人质疑Scaling Law在2到3年后是否仍然有效,但我个人认为至少在未来5年里,它仍将是产业发展的主要方向。

其次是“Token-Based”统一表述方式。在大模型中,“Token”是一个基本元素。无论是文本、语音、图像、视频,还是自动驾驶中的激光雷达信号,甚至是生物领域的蛋白质和细胞,最终都可以抽象为一个Token。Token之间的训练、学习和生成是核心环节,这与我们大脑中的神经元工作原理相似,无论执行何种任务,其基础机制都是相同的。

最后是通用性。这与Token紧密相关。现在的通用性不仅体现在文本处理上,还扩展到了多模态领域,甚至可以生成如蛋白质等复杂结构。此外,它在物理世界(如具身智能)和生物世界(如生物智能)中也有着广泛的应用前景。以上这三个是大模型做对的。

现阶段主要问题呢,第一个是效率较低。特别是大模型的计算效率低下问题,与人类大脑的高效性形成了鲜明的对比。

人类大脑拥有860亿个神经元,每个神经元又有数千个突触连接,却只需要20瓦的能量,重量还不到三斤;而GPT-4这个万亿参数模型则需要巨大的算力和能源,与人脑相比相差1,000倍之多。

此外,人脑能够根据不同的情境灵活调用不同区域的神经元,而大模型却每次输入一个问题都要调用和激活几乎大量参数。

因此,如何借鉴人类大脑的计算方法,在降低计算耗能、提高效率方面进行探索和创新,是一个值得关注的方向。

第二个,大模型目前还未能真正理解物理世界,相关的推理能力、透明性以及开复刚才提到的幻觉等问题都还在深入研究中。

有一个重要的问题是,即使我们的大模型做得再好,它在生成式表述与对真实世界的描绘之间仍存在矛盾。因此,我们需要探索如何将生成式的概率大模型与现有的“第一性原理”或真实模型、知识图谱相结合。

目前,虽然已经有了一些尝试,如采用RAG技术或进行微调,并取得了一定的进展,但我认为这些方法并非根本解决方案。我预测,在未来五年内,将会有一个全新的架构出现,这个架构有望取代目前的Transformer和Diffusion模型。

第三个欠缺的地方是边界问题。现在大模型无法知道“我不知道什么”,这是目前要解决的问题,是它的边界效应。

黄铁军:谢谢亚勤的“三个做对了”和“三个不足”。

刚才开复老师没讲,我想再追加问一下,有些人认为大模型是一个实践、是一个工程,是经验主义做的东西,没有理论基础,说得不好听叫“不靠谱”,不知道你怎么看这个问题?

李开复:我觉得科学和工程缺一不可。如果只做工程,不了解“第一性原理”,没有数学的根据、没法评估不同路径的效果,考虑到高昂的算力成本,这样的摸索肯定是做不出一个好模型的。但是如果只是在实验室里雕花,期待有工程人才把自己的论文做成产品,这也是不行的。

小米redmia32

零一万物的经验是,每个做AI、做模型的Researcher要懂Infrastructure、都要懂推理、都要知道成本的问题。这样当你需要面对科研问题时,就知道在产品里需要的反应速度有多快,要怎么实现,做完实验就能确保模型可以得到令人满意的工程结果。训练模型的过程中绝对不只是写Paper,还要同时考虑怎样系统化、工程化地做数据工程,因为数据的训练、数据的筛选是非常重要的。还有底层的AI Infrastructure,GPU这么昂贵,如果把一张当成两张、三张使用,任何公司都会得到好处,所以科技和工程这两方面缺一不可。

二、大模型产业化To B、To C哪个赛道更有机会?

黄铁军:大家关心AI2.0,大模型产业化最大的场景在哪里?移动互联网这么多年,To B、To C ,这两个大赛道哪个更有机会?为什么?

李开复:简单来说,在中国To C 短期更有机会,国外两者都有机会。To C方面,就像移动互联网、PC时代里,一个新技术、新平台带来新应用,大模型同样如此,这是巨大的机会,但是这些应用的出现一定是按部就班的。

我认为AI 2.0 时代会和PC、移动互联网时代一样,第一个阶段应该是生产力工具,包括信息获取;第二个阶段可能会是娱乐、音乐、游戏,第三个阶段可能会是搜索;再下一个阶段可能会是电商;然后可能会有社交、短视频、O2O的应用出现。

一个理由就是刚开始应用要能够赚钱、能够解决问题,所以第一波潮流会是生产力工具,但越往后,难度越高——高用户量的应用商业模式往往是先堆积用户再找变现模式,所以应用成本一定要很低,试错难度很大、所需要的投资也更多。

我认为递进的模式不会有特别大的改变,To C应用会从生产力工具一步步走向短视频类应用。To C确实会产生大量的用户,但这不是说不能用大模型来做产品,只是在普及顺序上会按照这六个阶段进行。

当然,这个过程中也有挑战,在大模型领域做应用跟PC、互联网时代不一样,因为推理成本还太贵。最近零一万物提出了TC-PMF概念(技术成本✖️产品市场契合度),这个概念是指,当你考虑PMF时,还要把技术的需求、实现难度和成本考虑进去。

做应用一定要考虑到刚才这六个阶段谁先谁后、什么时候做、提早做。第二,做应用的时候还要综合考虑到当时的技术够不够好,成本是否足够低,所以大模型To C应用不像过去移动互联网时代,产品经理一个人就可以做主,它需要做Infrastructure、做推理引擎的人、一起打磨TC-PMF。这件事难度高,但是回报也高,机会也更大。最后我想讲,在To C方面,我不相信技术可以永久领先,事实上技术带来的领先窗口非常短暂,一旦巨头看到你验证了PMF,他们会有很多方法超越你。一旦你验证了TC-PMF,要把握时间窗口把品牌打出来,最终胜出的To C应用不只是需要有技术优势,还需要在时间窗口内打造持续优势,比如品牌优势,比如社交链,比如用户数据,让用户不能离开你这个平台。在微信强大的时代里抖音能被做出来,就是因为它抓住了这个时间窗口。

再讲一下To B的应用。大模型有可能在To B方向上带来更大价值,而且能够比To C更快实现,但是To B这个领域有几个挑战。

第一个挑战是大公司、传统公司不是很敢采取颠覆式技术,大公司会习惯每年增长5%预算,做和去年一样的事情。

第二个挑战在中国比较严重,许多大公司没有认识到软件的价值,为软件付费意的意识有待进一步提高。现在有许多大模型公司在竞标时越竞越低,做到最后做一单赔一单,都没有利润。我们在AI 1.0时代曾见过这个现象,现在它在AI 2.0时代又重现了。这种心态导致部分大公司只愿支付很低的价格,大模型公司也只能给出折中的方案,达到惊艳效果的寥寥无几。

零一万物坚决做To C,不做赔钱的To B,而是做能赚钱的To B。所以零一万物在To B方面精挑细选,找那种公司上下都愿意拥抱新概念的公司,也为它们设计了 RAG 知识检索、专有云、微调等方案,在国内国外都有尝试。无论To C还是To B,API都很重要,最近国内很多模型降价了,零一万物也推出了接入国际SOTA成绩Yi-Large大模型的API,也希望有机会可以跟各位合作。这个API背后的模型能力大概接近GPT-4o,但是价格是GPT-4的四分之一,我相信这可以帮助更多公司或者创业者达到所谓的TC-PMF。

黄铁军:谢谢开复老师对To B、To C的分析,很透彻。亚勤,刚才关于To B的观点,大家还有一个非常关心的问题,大模型产业的最大场景会在哪里?To B、To C在什么地方能够落地发挥作用?

张亚勤:在应用和服务层面,先面向消费者(To C)再面向企业(To B)。To B的周期相对较长,而To C的应用产品则可以迅速推出,这与过去的PC互联网和移动互联网的发展路径基本一致。在基础设施层,目前真正盈利的主要集中在To B领域,特别是在芯片、硬件、服务器等。像英伟达、AMD等芯片制造商,以及服务器、HBM存储、InfiniBand和NVLink等相关技术的提供商,他们目前是盈利最多的。

关于AI路径,我在过去十年中一直强调三个关键领域:首先是信息智能,其次是物理智能(现在流行的术语是具身智能),最后是生物智能。在具身智能阶段,To B的应用可能会比To C更快落地。然而,在生物智能阶段,情况可能相反,To C的应用可能会先于To B出现。尽管每个领域的具体情况可能有所不同,但总体来看,无论是To C还是To B,都将存在开源模型、商业闭源模型、基础大模型,以及针对垂直行业模型和边缘模型。


返回网站首页

本文评论
华为7月服务日开启:手机免费贴膜 换原装电池99元起「华为是不是免费换膜」
快科技7月8日消息,华为开启7月服务日,到店可享六大专属权益。华为手机免费贴膜,99元换原装电池活动回归。华为服务日,指的是每个月的第一个周五周六周日,三天连着。比如6月是2/3/...
日期:07-08
苹果A14成本「苹果真良心!A16生产成本是A15的2.4倍但iPhone 14 Pro仍然原价发」
近日,有拆解机构给出了最新的iPhone 14 Pro Max的生产成本,其制造成硬件成本为501美元,约合人民币3565元,较比上一代的iPhone 13 Pro Max高出了60美元。而这其中主要的溢价源自...
日期:10-08
科大讯飞能成为中国版ChatGPT吗「科大讯飞是中国的吗」
声明:本文来自于微信公众号零态LT(ID:LingTai_LT),作者:张尧,授权转载发布。ChatGPT爆火,中国AI公司坐不住了。据了解,ChatGPT是海外公司OpenAI开发的一种大型预训练语言模型,通过...
日期:02-08
摩托罗拉新旗舰渲染图曝光_摩托罗拉新机曝光
  上个月,有消息称摩托罗拉正在开发代号为“Frontier”的“下一代”旗舰手机。该机将提供顶级硬件配置,包括高通旗舰处理器、超快的充电速度和强大的摄像头。   近日,爆料...
日期:05-11
贾跃亭再次被限消_贾跃亭再被限制高消
12 月 14 日消息,天眼查App显示,近日,贾跃亭新增一则限制消费令,申请人为平安银行股份有限公司深圳分行,关联案件为金融借款合同纠纷。此前,贾跃亭及乐视控股(北京)有限公司、乐视体...
日期:12-14
三星S24Ultra再创巅峰:2亿像素主摄,四摄系统,10倍光学变焦
近年来,手机摄像技术的快速发展使得各大品牌都在不断地提升自家旗舰手机的影像配置,以满足消费者对更高品质拍照体验的需求。作为全球领先的手机制造商,三星一直在这方面保持着...
日期:10-17
韵达货运全国并网发电分布式光伏电站正式实现并网发电
9月28日消息,位于浏阳经开区韵达货运湖南分拨中心屋顶的分布式光伏电站于9月23日正式实现并网发电,年平均发电量约630万千瓦时,是截至目前浏阳市单体装机容量最大的分布式光伏...
日期:09-30
日本人的友情观「日本年轻人开始流行友情婚:主要以友情、利益等为目的」
在日本,一种新型的婚姻形式正逐渐受到人们的青睐,这就是所谓的“友情婚”。与传统的婚姻观念不同,友情婚并不强调爱情的存在,而是基于双方的友情、共同利益以及一致的想法来缔结...
日期:04-23
车主把32位保险推销员拉进群 续保堪比"选妃"!结果被喷_保险公司推销员潦草
车主们都知道,每年距离车险还有一个月到期时,就进入了续保期”,而不同保险公司的车险业务员会以各种方式联系车主续保。有车主不堪其扰,就另辟蹊径,建群让业务员们集体报价,自己再...
日期:10-17
AOL宣布收购个人档案社交网站About.me
  据国外媒体报道,AOL于美国当地时间周一下午宣布,公司已收购个人档案社交网站About.me,并将其并入由AOL高管布莱德·加林豪斯(Brad Garlinghouse)所领导的消费者应用部门。...
日期:07-25
摩托罗拉:越来越多iPhone机主转投使用安卓可折叠手机「摩托罗拉苹果合作手机」
据国外科技媒体CNET报道,摩托罗拉的北美地区运营主管Allison Yi日前接受了采访,表示越来越多的iPhone用户正在转投使用安卓可折叠手机。新能源车出问题上个月随着谷歌推出Pixe...
日期:06-03
配旁白软件「Clipchamp AI旁白生成器 免费为视频添加专业的画外音」
12月5日 消息:Clipchamp AI文字转语音生成器是一款免费在线工具,通过人工智能技术,为视频添加专业的画外音。用户可以选择400多个逼真的声音,涵盖不同年龄、口音、性别和中性音...
日期:12-05
618前夕京东与小米达成全新战略合作 共推3C数码智能硬件产品销售增长
近日,京东与小米达成全新战略合作,双方明确了未来三年小米在京东全渠道销售额2000亿的目标,并达成了在零售、物流、科技等多领域战略合作的共识。同时,双方将共同推动包括3C数码...
日期:05-14
iPhone13现价「新机来临前的狂欢?iPhone13最新售价确定,果粉:幸福来得太突然」
根据手机市场调研机构相关的数据显示,在今年第二季度国内高端市场份额占比之中,iPhone凭借着46%的占比再次获得了第一名的成绩,对于iPhone产品能够获得第一笔者并不感到意外,毕...
日期:09-05
iphone1784「iOS 17支持机型名单公布!iPhone 8/X无缘升级」
快科技6月6日讯,今天凌晨苹果首秀iOS 17系统。其中开发者Beta将于今日抵达,公测版Beta 7月上线,正式版随iPhone 15定档7月。支持机型方面,非常遗憾,iPhone 8/X惨遭移除。根据官方...
日期:06-06
京东宣布:春晚30亿红包人人有份!_京东11.11晚会
快科技1月30日消息,京东已成为2024年总台春晚独家互动合作平台。京东今天发消息称,除夕看春晚,下载并打开京东APP,1亿份实物好礼一分钱带回家,更有30亿红包人人有份!三星半导体和...
日期:01-30
粉笔科技更新招股书:上半年净亏近四亿,公考业务占比超六成_粉笔公考营收
  记者/陈琼烨  近日,非学历职业教育培训服务供应商粉笔科技向香港联交所递交更新后的招股书。  最新财务数据显示,粉笔科技2022年上半年营收为14.51亿元,同比减少23.2%;...
日期:09-10
名创优品在印尼、中东成轻奢 海外开店2100家_名创优品意大利签约
在过去的十年里,名创优品先后登陆美国、香港股市,从一家不知名的街边小店,成长为覆盖全球105个国家和地区的超级品牌,甚至在印尼、中东被视为轻奢。华为watch 3 pro和gt3pro买哪...
日期:03-30
华为Mate X5发售1秒卖光!余承东:这是全能折叠屏
快科技9月8日消息,今天上午华为再次开启了先锋计划,Mate 60 Pro 和Mate X5双双开售。可即便是没有任何宣发突然开售,Mate X5作为理财神器”的继任者,还是展现了强大的热度和市场...
日期:09-09
成都首家屈臣氏网易严选生活美学馆开业 线上线下良性互动创造零售新机遇
  2019年8月9日,屈臣氏与网易携手打造的Watsons+网易严选生活美学馆落户成都。这是屈臣氏的全新子品牌“Watsons+”与网易旗下自营生活家居品牌“网易严选”的二度合作。...
日期:09-09