您的位置:首页 > 媒体评论

斯坦福“草泥马”火了:约687元就能比肩GPT-3.5!手机都能运行的那种

发布时间:2023-03-15 02:02:50  来源:互联网     背景:

斯坦福发布Alpaca(羊驼,网友口中的“草泥马”):

只花100美元,人人都可微调Meta家70亿参数的LLaMA大模型,效果竟可比肩1750亿参数的GPT-3.5(text-davinci-003)。

而且还是单卡就能运行的那种,甚至树莓派、手机都能hold住!

还有一个更绝的“骚操作”。

研究所涉及到的数据集,是斯坦福团队花了不到500美元用OpenAI的API来生成的。

所以整个过程下来,就等同于GPT-3.5自己教出了个旗鼓相当的对手AI。

(薅羊毛高手……)

然后团队还说,用大多数云计算平台去微调训练好的模型,成本也不到100美元:

复制一个GPT-3.5效果的AI,很便宜,很容易,还很小。

而且团队还把数据集(秒省500刀)、代码统统都给开源了,这下子人人都能去微调个效果炸裂的对话AI:

项目在GitHub发布才半天时间,便已经狂揽1800+星,火爆程度可见一斑。

Django联合开发者甚至对斯坦福的新研究用“惊天大事”来形容:

不仅如此,斯坦福团队还搞了个demo,在线可玩的那种。

话不多说,我们现在就来看看这个“草泥马”的效果。

比肩davinci-003的草泥马Aplaca

在斯坦福官方的演示中,他们先小试牛刀地提了一个问题:

什么是羊驼?它和美洲驼的区别是什么?

草泥马Aplaca给出的答案较为干练:

羊驼是一种小型骆驼科动物,原产于秘鲁、玻利维亚、厄瓜多尔和智利;它比美洲驼小,羊毛更细,也没有驼峰。

而后又简单的介绍了二者群居生活的不同。

同样的问题若是交给ChatGPT(GPT3.5-turbo),则答案就不会像草泥马Aplaca那般简洁:

对此,团队给出的解释是:

Alpaca的答案通常比ChatGPT短,反映出text-davinci-003的输出较短。

而后团队演示了让草泥马Alpaca写邮件:

写一封e-mail祝贺被斯坦福大学录取的新生,并提到你很高兴能亲自见到他们。

草泥马Alpaca对于这个任务也是信手拈来,直接给出了一个像模像样的邮件模板:

难度再次进阶,团队这次提出了让草泥马Alpaca写论文摘要的需求:

写一篇经过深思熟虑的机器学习论文摘要,证明42是训练神经网络的最优seed。

草泥马Alpaca给出的答案从内容上来看,非常符合大多数论文的摘要形式:试图回答什么问题、用了什么方法、结果如何,以及未来展望。

当然,也有迫不及待的网友亲自下场试验,发现草泥马Alpaca写代码也是不在话下。

不过即便草泥马Alpaca能够hold住大部分问题,但这并不意味着它没有缺陷。

例如团队便演示了一个例子,在回答“坦桑尼亚的首都是哪里”的问题时,草泥马Alpaca给出的答案是“达累斯萨拉姆”。

但实际上早在1975年便被“多多马”取代了。

除此之外,若是亲自体验过草泥马Alpaca就会发现,它……巨慢:

对此,有网友认为可能是使用的人太多的原因。

笔记本、手机、树莓派都能跑

Meta开源的LLaMA大模型,刚发布几周就被大家安排明白了,单卡就能运行。

所以理论上,基于LLaMA微调的Alpaca同样可以轻松在本地部署。

没有显卡也没关系,苹果笔记本甚至树莓派、手机都可以玩。

在苹果笔记本部署LLaMA的方法来自GitHub项目llama.cpp,使用纯C/C++做推理,还专门对ARM芯片做了优化。

作者实测,M1芯片的MacBook Pro上即可运行,另外也支持Windows和Linux系统。

还是这个C++移植版本,有人成功在4GB内存的树莓派4上成功运行了LLaMA的 70亿参数版本。

虽然速度非常慢,大约10秒生成一个token(也就是一分钟蹦出4.5个单词)。

更离谱的是仅仅2天之后,有人把LLaMA模型量化压缩(权重转换成更低精度的数据格式)后成功在Pixel 6安卓手机上运行(26秒一个token)。

Pixel 6使用谷歌自研处理器Google Tensor,跑分成绩在骁龙865+到888之间,也就是说新一点的手机理论上都能胜任。

微调数据集也开源

斯坦福团队微调LLaMA的方法,来自华盛顿大学Yizhong Wang等去年底提出的Self-Instruct。

以175个问题作为种子任务,让AI自己从中组合出新的问题以及生成配套答案实例,人工过滤掉低质量的,再把新任务添加到任务池里。

所有这些任务,之后可以采用InstructGPT的方法让AI学会如何遵循人类指令。

世界首富贝索斯前妻

套娃几圈下来,相当于让AI自己指导自己。

斯坦福版Alpaca,就是花了不到500美元使用OpenAI API生成了5.2万个这样的示例搞出来的。

这些数据同样开源了出来,并且比原论文的数据多样性更高。

同时还给出了生成这些数据的代码,也就是说如果有人还嫌不够,可以再去自行扩充微调数据,继续提高模型的表现。

微调代码也会在HuggingFace官方支持LLaMA后放出。

不过Alpaca最终的模型权重需要Meta许可才能发布,并且继承了LLaMA的非商用开源协议,禁止任何商业用途。

并且由于微调数据使用了OpenAI的API,根据使用条款也禁止用来开发与OpenAI形成竞争的模型。

One More Thing

还记得AI绘画的发展历程吗?

2022年上半年还只是话题热度高,8月份Stable Diffusion的开源让成本下降到可用,并由此产生爆炸式的工具创新,让AI绘画真正进入各类工作流程。

语言模型的成本,如今也下降到了个人电子设备可用的程度。

最后还是由Django框架创始人Simon Willison喊出:

大语言模型的Stable Diffusion时刻到了。


返回网站首页

本文评论
腾讯游戏的野心 困境和迷局_腾讯游戏的野心 困境和迷局怎么玩
图片来源:视觉中国文|商隐社,作者 | 散人,编辑|甄幸运三个人站在奖台上欢呼,下面一片墓地,立着很多墓碑,每个墓碑都是一个项目。这是腾讯投资的明星公司Supercell开内部年会时,曾经打...
日期:10-09
涨价不断、亏损加大,共享充电宝赚的钱哪去了?「共享充电宝会亏钱吗」
在共享经济泡沫被戳破的那段时期,共享充电宝曾一度为共享经济带来曙光。2018年,街电、小电、来电等几家共享充电宝头部企业都对外宣称实现盈利。近期以来,共享充电宝又开始持续...
日期:09-18
35个月超过瑞幸,这家咖啡有股“韭菜味儿”_瑞幸咖啡大涨
今年的咖啡赛道格外热闹,前有老品牌跨界联名,后有新品牌不断诞生。最近,T97咖啡直播间里的大嘴妹靠着喊麦成为带货界新晋红人。比大嘴妹更出圈的是该品牌的老板李潇,他曾扬言T97...
日期:11-08
华为钱包上线健康码卡片 支持部分NFC机型「华为钱包nfc功能」
  8月27日消息,昨天,华为钱包迎来了9.0.18.362更新,上线钱包健康码卡片,已经支持部分NFC机型,用户可以通过双击电源键快速领取。国美117内购会xbox series x官网缺货  华为钱...
日期:08-28
华为被出卖_16年前被华为卖掉 换了7次主人:它终于真正属于中国!
有这么一家公司,被一些人称为 “ 华为弃子 ” ,五岁的时候被华为抛弃,从此开启了颠沛流离的一生。而最近呢,这家公司终于是找到了自己的归宿,成为了紫光家族的一份子。它就是新华...
日期:01-19
电子科大学霸写了一篇电池论文 已融资3500万_关于电池的科技小论文
一个理工学霸和他的固态电池,火了。起源是一篇发表于科学杂志《Nature》的论文来自哈佛大学的华人教授指导着来自中国的学生研发了一种新型固态电池,震撼之处在于这种电池可重...
日期:10-05
对话凤凰网执行总编辑吴晨光:流量的密码,藏在“源流说”体系中
出品 | 创业最前线作者 | 李小反 王卓然编辑 | 蛋总“任何一条河流——无论是清浅的小溪还是奔腾的大江,皆发于源、长于流。内容传播也是如此。”吴晨光在《源流说:内容生产与...
日期:09-18
“新能源越电越危险”这句话是对汽车工业的侮辱「新能源汽车对传统汽车的冲击」
2022年11月5日,广东潮州一台新能源汽车“失控”并引发了一起严重交通事故。由于这是“自带流量”的特斯拉品牌汽车,这起事故在短时间内就成为了互联网讨论热点,甚至在被称为“...
日期:11-16
马斯克开除员工_马斯克把公开给他纠错的工程师开除了
“He’s”fired.”马斯克的裁员大戏还在继续,而最新的这“一集”,矛头直指一名在推特待了6年的工程师。甚至The Verge都这样描述:虽然马斯克已经开除了数千人,但最新的人事变动...
日期:11-25
谁会用抖音桌面端聊天软件?_抖音里面聊天软件
作者丨樱木 编辑丨月见新年伊始,抖音再次潜入了微信的后院。12月30日,抖音官方网站上线了名为“抖音聊天”的即时通讯软件,提供Windows和Mac桌面客户端,最新版本显示为1.0.0。不...
日期:01-05
Edge集锦新增类Pinterest功能:基于用户收藏显示推荐信息流_pinterest 使用
  Microsoft Edge 即将引入类似于 Pinterest 的功能。集锦窗口即将会基于用户保存的话题显示推荐信息流。集锦可帮助你保存和整理在网络上找到的网页、文本片段和图像。...
日期:07-10
到底发生了什么?“币圈茅台”创始人被批捕!「茅台区块链币」
2022年9月14日,韩国法院向加密货币LUNA的主要开发者发出逮捕令。到底是咋回事呢?加密货币LUNA素有“币圈茅台”之称。但在2022年5月,LUNA币出现暴跌,短短一周,价值跌去99.99%,近乎...
日期:09-18
扎克伯格用300亿美元打水漂?我们该如何理解这件事
让我们来填一个之前的坑,测评META2022年的新款VR眼镜,META QuestPro。首先得说明一下,我们的测评内容,跟别的内容是一以贯之的,都是以看这个产业的未来发展为主,只是说换个视角,通...
日期:01-17
银行倒闭的可能性_为啥要救倒闭的银行?现在的诺奖得主40年前就给出了答案
前两天,本 · 伯南克( Ben S.Bernanke ),道格拉斯 · 戴蒙德( Douglas W.Diamond )和菲利普 · 戴布维格( Philip H.Dybvig )三个人共同夺得今年的诺贝尔经济学奖。根据官方说明,这次...
日期:10-18
手机也要安排上光追?联发科今年的芯片太狠了…_联发科 光追
2022 年,可以说是联发科扬眉吐气的一年。推出的天玑 8100 和天玑 9000 在性价比和能耗控制方面都有不错的表现,性能释放也和当时高通的旗舰打的有来有回。这种情况一直持续到...
日期:11-17
事实上,在iA5之前,广汽丰田推出过另一款纯电动车_电动化浪潮下,为什么丰田不肯All in电动车?
撰文 | 郝庆谦惠普envy2015款责编 | 齐卿减少碳排放,电动化是唯一选择?丰田掌门人丰田章男对电动车革命表示不满,认为电动车会释放更多二氧化碳,被小鹏汽车创始人何小鹏暗指为“...
日期:09-17
这款来自小厂的迷你主机,把小米新品按在地上摩擦_小米玩具后续
前阵子小米不是发布了一台迷你主机么?它搭载英特尔酷睿 i5-1240P 处理器,16GB DDR4 内存以及 512GB PCIe 4.0 SSD,首发价 3699 元:同时,小米还推出了这款机型的准系统版本,也就是...
日期:01-29
这一次 “韭菜”打败了趣店罗敏
斑马消费 范建一般情况下,“韭菜”都只有被收割的命。但当这些绿油油的小家伙们牢牢抱团时,却表现出了钢铁一般的强悍。靠校园贷起家的趣店和罗敏,曾收割了数以万计的大学生。...
日期:09-09
多点冲刺IPO,张文中能等来“救命钱”吗?
张文中黄光裕的难题,张文中也逃不掉撰文 | 赵晋杰编辑 | 王靖谷歌应用商店里的软件来源 | 盒饭财经(ID:daxiongfan)当黄光裕只能靠着减持国美股票的方法,套现部分资金为员工补发...
日期:12-20
高盛在华尔街吗_华尔街裁员大潮 高盛也顶不住了
原标题:高盛也顶不住了文丨陶辉东来源丨投中网高盛也加入华尔街的裁员大潮了。根据多家媒体的报道,高盛正在着手进行大约500人规模的大裁员,约占高盛员工总数的1%。其实高盛在7...
日期:09-18