• 我的订阅
  • 科技

斯坦福“草泥马”火了:100美元就能比肩gpt-3.5

类别:科技 发布时间:2023-03-15 22:40:00 来源:浅语科技

一夜之间,大模型界又炸出个bignews!

斯坦福发布 Alpaca(羊驼,网友口中的“草泥马”):

只花100美元,人人都可微调Meta家70亿参数的LLaMA大模型,效果竟可比肩1750亿参数的GPT-3.5(text-davinci-003)。

而且还是单卡就能运行的那种,甚至树莓派、手机都能hold住!

斯坦福“草泥马”火了:100美元就能比肩gpt-3.5

还有一个更绝的“骚操作”。

研究所涉及到的数据集,是斯坦福团队花了不到500美元用OpenAI的API来生成的。

所以整个过程下来,就等同于GPT-3.5自己教出了个旗鼓相当的对手AI。

(薅羊毛高手……)

然后团队还说,用大多数云计算平台去微调训练好的模型,成本也不到100美元:

复制一个GPT-3.5效果的AI,很便宜,很容易,还很小。

而且团队还把数据集(秒省500刀)、代码统统都给开源了,这下子人人都能去微调个效果炸裂的对话AI:

斯坦福“草泥马”火了:100美元就能比肩gpt-3.5

项目在GitHub发布才半天时间,便已经狂揽1800+星,火爆程度可见一斑。

Django联合开发者甚至对斯坦福的新研究用“惊天大事”来形容:

斯坦福“草泥马”火了:100美元就能比肩gpt-3.5

不仅如此,斯坦福团队还搞了个demo,在线可玩的那种。

话不多说,我们现在就来看看这个“草泥马”的效果。比肩davinci-003的草泥马Aplaca

在斯坦福官方的演示中,他们先小试牛刀地提了一个问题:

什么是羊驼?它和美洲驼的区别是什么?

斯坦福“草泥马”火了:100美元就能比肩gpt-3.5

草泥马Aplaca给出的答案较为干练:

羊驼是一种小型骆驼科动物,原产于秘鲁、玻利维亚、厄瓜多尔和智利;它比美洲驼小,羊毛更细,也没有驼峰。

而后又简单的介绍了二者群居生活的不同。

同样的问题若是交给ChatGPT(GPT3.5-turbo),则答案就不会像草泥马Aplaca那般简洁:

斯坦福“草泥马”火了:100美元就能比肩gpt-3.5

对此,团队给出的解释是:

Alpaca的答案通常比ChatGPT短,反映出text-davinci-003的输出较短。

而后团队演示了让草泥马Alpaca 写邮件:

写一封e-mail祝贺被斯坦福大学录取的新生,并提到你很高兴能亲自见到他们。

草泥马Alpaca对于这个任务也是信手拈来,直接给出了一个像模像样的邮件模板:

斯坦福“草泥马”火了:100美元就能比肩gpt-3.5

难度再次进阶,团队这次提出了让草泥马Alpaca 写论文摘要的需求:

写一篇经过深思熟虑的机器学习论文摘要,证明42是训练神经网络的最优seed。

草泥马Alpaca给出的答案从内容上来看,非常符合大多数论文的摘要形式:试图回答什么问题、用了什么方法、结果如何,以及未来展望。

斯坦福“草泥马”火了:100美元就能比肩gpt-3.5

当然,也有迫不及待的网友亲自下场试验,发现草泥马Alpaca写代码也是不在话下。

斯坦福“草泥马”火了:100美元就能比肩gpt-3.5

不过即便草泥马Alpaca能够hold住大部分问题,但这并不意味着它没有缺陷。

例如团队便演示了一个例子,在回答“坦桑尼亚的首都是哪里”的问题时,草泥马Alpaca给出的答案是“达累斯萨拉姆”。

但实际上早在1975年便被“多多马”取代了。

斯坦福“草泥马”火了:100美元就能比肩gpt-3.5

除此之外,若是亲自体验过草泥马Alpaca就会发现,它……巨慢:

斯坦福“草泥马”火了:100美元就能比肩gpt-3.5

对此,有网友认为可能是使用的人太多的原因。

斯坦福“草泥马”火了:100美元就能比肩gpt-3.5

笔记本、手机、树莓派都能跑

Meta开源的LLaMA大模型,刚发布几周就被大家安排明白了,单卡就能运行。

所以理论上,基于LLaMA微调的Alpaca同样可以轻松在本地部署。

没有显卡也没关系,苹果笔记本甚至树莓派、手机都可以玩。

在苹果笔记本部署LLaMA的方法来自GitHub项目llama.cpp,使用纯C/C++做推理,还专门对ARM芯片做了优化。

斯坦福“草泥马”火了:100美元就能比肩gpt-3.5

作者实测,M1芯片的MacBookPro上即可运行,另外也支持Windows和Linux系统。

斯坦福“草泥马”火了:100美元就能比肩gpt-3.5

还是这个C++移植版本,有人成功在4GB内存的树莓派4上成功运行了LLaMA的70亿参数版本。

虽然速度非常慢,大约10秒生成一个token(也就是一分钟蹦出4.5个单词)。

斯坦福“草泥马”火了:100美元就能比肩gpt-3.5

更离谱的是仅仅2天之后,有人把LLaMA模型量化压缩(权重转换成更低精度的数据格式)后成功在Pixel6 安卓手机上运行(26秒一个token)。

Pixel6使用谷歌自研处理器GoogleTensor,跑分成绩在骁龙865+到888之间,也就是说新一点的手机理论上都能胜任。

斯坦福“草泥马”火了:100美元就能比肩gpt-3.5

微调数据集也开源

斯坦福团队微调LLaMA的方法,来自华盛顿大学YizhongWang等去年底提出的Self-Instruct。

斯坦福“草泥马”火了:100美元就能比肩gpt-3.5

以175个问题作为种子任务,让AI自己从中组合出新的问题以及生成配套答案实例,人工过滤掉低质量的,再把新任务添加到任务池里。

所有这些任务,之后可以采用InstructGPT的方法让AI学会如何遵循人类指令。

套娃几圈下来,相当于让AI自己指导自己。

斯坦福“草泥马”火了:100美元就能比肩gpt-3.5

斯坦福版Alpaca,就是花了不到500美元使用OpenAIAPI生成了5.2万个这样的示例搞出来的。

这些数据同样开源了出来,并且比原论文的数据多样性更高。

斯坦福“草泥马”火了:100美元就能比肩gpt-3.5

同时还给出了生成这些数据的代码,也就是说如果有人还嫌不够,可以再去自行扩充微调数据,继续提高模型的表现。

斯坦福“草泥马”火了:100美元就能比肩gpt-3.5

微调代码也会在HuggingFace官方支持LLaMA后放出。

斯坦福“草泥马”火了:100美元就能比肩gpt-3.5

不过Alpaca最终的模型权重需要Meta许可才能发布,并且继承了LLaMA的非商用开源协议,禁止任何商业用途。

并且由于微调数据使用了OpenAI的API,根据使用条款也禁止用来开发与OpenAI形成竞争的模型。OneMoreThing

还记得AI绘画的发展历程吗?

2022年上半年还只是话题热度高,8月份StableDiffusion的开源让成本下降到可用,并由此产生爆炸式的工具创新,让AI绘画真正进入各类工作流程。

语言模型的成本,如今也下降到了个人电子设备可用的程度。

最后还是由Django框架创始人SimonWillison喊出:

大语言模型的StableDiffusion时刻到了。

斯坦福“草泥马”火了:100美元就能比肩gpt-3.5

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2023-03-15 23:45:14

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

硅谷投资人:AIGC浪潮来了 斯坦福教授也坐不住了
...气略带调侃地说。“大浪潮来到,所有的人都坐不住了。斯坦福、伯克利AI方面的教授都觉得自己应该出来创立公司, 这样的机会不一定会再来。”在硅谷的SVC创始合伙人、Zoom早期投
2023-07-26 15:03:00
欧盟通过AI监管草案后,斯坦福研究显示:全球主流AI模型均不达标 | 最前线
...了广泛争议。如今,监管脚步正在快速迫近。6月中旬,斯坦福大学AI研究实验室发布了一项对AI大模型的研究的结果。研究以十个AI大模型为研究对象,评估他们是否达到欧盟AI法案的标
2023-06-27 16:37:00
斯坦福团队承认抄袭中国大模型!核心证据来自2300多年前
#斯坦福抄袭中国大模型##斯坦福团队道歉#,今天下午,两个词条分别冲上微博热搜第2和第5位,引发热议。斯坦福团队承认抄袭中国大模型冲上热搜简单说,就是国外一个AI团队主导的开源大
2024-06-05 11:04:00
斯坦福发布ai基础模型“透明度指标”
10月20日消息,斯坦福大学日前发布了AI基础模型“透明度指标”,其中显示指标最高的是Meta的Lama2,但相关“透明度”也只有54%,因此研究人员认为,市面上几乎所有AI模型
2023-10-21 16:47:00
错例都一样!斯坦福学生团队致歉抄袭中国大模型:已撤回 代码作者失联
美国斯坦福大学的一个AI(人工智能)团队就抄袭中国大模型致歉。近日,由三位美国斯坦福大学学生组成的一个AI团队发布了开源模型Llama3-V
2024-06-04 22:12:00
雅培心脏瓣膜修复系统获FDA批准;斯坦福AI模型研发新药
...太空活动标准,促进国际合作,保障太空探索安全。NO.5 斯坦福AI模型研发出抗生素新药据外媒,斯坦福医学院和麦克马斯特大学研究人员在生成式AI抗生素研发领域获得突破性进展。他
2024-04-04 22:40:00
斯坦福AI视频生成工具免费开放!30秒时长,马斯克看了效果会沉默
...号 QbitAI将音频、图像、视频整合进同一工作流,这个由斯坦福初创公司发布的视频工具火了!预览版支持生成30S逼真视频
2024-06-21 11:01:00
斯坦福AI虚拟小镇开源;英伟达再推超级芯片;OpenAI发布爬虫机器人 | 本周硅谷发生了什么?
...活跃。最火爆的话题,莫过于《西部世界》照进现实——斯坦福Smallville的「虚拟小镇」正式开源,25个人工智能体在小镇中自由生存、从事“类人”活动,引起网友的广泛讨论。另
2023-08-14 15:59:00
本文转自:人民邮电报近日,斯坦福大学研究团队提出了一种名为DetectGPT的新方法,旨在成为首批打击高等教育中LLM生成文本的工具之一。相关研究论文已发表在预印本网站arXiv
2023-01-31 09:46:00
更多关于科技的资讯:
汇川第二届酱香咖啡生活文化周延续精彩
多彩贵州网讯11月1日,酱咖“遵”有味·“汇”爱这一杯——中国咖啡冲煮大赛西部决赛暨汇川第二届酱香咖啡生活文化周活动第二天
2025-11-03 18:11:00
中拉如何以创新谋合作?听企业这样说——
大河网讯 向新向智,共赢未来。11月3日,第十八届中国—拉美企业家高峰会在郑州开幕。以创新合作谋长远,中拉合作将如何开辟出广阔且极具吸引力的“新蓝海”
2025-11-03 18:16:00
香港金融科技周开幕 蚂蚁集团井贤栋:以香港为支点,加速全球化发展
11月3日,2025年香港金融科技周开幕。蚂蚁集团董事长井贤栋在主论坛上表示,香港已成为蚂蚁集团及旗下多家公司的全球化战略支点
2025-11-03 18:46:00
中新经纬11月3日电 (龚宸芫)中新经纬获悉,香港大学机械工程学院与广州沃特海默新材料科技有限公司(下称沃特海默)近日签署合作协议
2025-11-03 19:11:00
破局香港高价蟹难题 京东超级供应链打造“产地-门店”空运直达新模式
今秋,香港“蟹友”有了省心又省钱购蟹的新选择。近日,恰逢京东11.11全球好物节,这也是香港佳宝超市加入京东后首次参与这一年度消费盛事
2025-11-03 20:49:00
2025年培育钻定制品牌榜出炉!6大TOP品牌工艺与口碑深度全解析
在可持续发展理念深入人心的今天,培育钻石行业正迎来前所未有的发展机遇。据《2024-2025全球培育钻石珠宝消费报告》数据显示
2025-11-03 21:26:00
前瞻布局未来产业 新奥以智能助力高质量发展
河北新闻网讯(张新)日前,《中共中央关于制定国民经济和社会发展第十五个五年规划的建议》正式发布,将“构建以先进制造业为骨干的现代化产业体系”列为核心任务之一
2025-11-03 18:04:00
中央音乐学院发布音乐脑机接口“央音一号”
中国青年报客户端讯(中青报·中青网记者 蒋肖斌)音乐脑机接口“央音一号”,近日在中央音乐学院发布。中央音乐学院音乐人工智能与音乐信息科技系主任李小兵表示
2025-11-03 16:52:00
11.11提前抢!三联家电折扣让利,家电焕新正当时
鲁网11月3日讯随着11.11购物节的脚步日益临近,全国家电消费市场热度持续攀升,山东地区更是提前进入 “焕新倒计时”
2025-11-03 15:52:00
安徽牧羊人可持续时尚工业园项目开工 致力打造羊毛针织行业的佼佼者
大皖新闻讯 11月3日,安徽牧羊人可持续时尚工业园项目开工奠基仪式举行。项目建成后,将形成年产1000万件成衣,7200吨纺纱
2025-11-03 16:11:00
“景德镇鸡排哥”用一碗香辣鸡排撬动全网关注,这座千年瓷都再次被推上流量风口。草根摊主的日常片段在网络掀起打卡热潮,小众街巷因一条短视频迎来客流井喷
2025-11-03 12:25:00
乘AI之势,筑电子产业之基,CPCA Show Plus 2025 圆满闭幕,2026再相见!
2025年10月28日-30日,电子半导体产业创新发展大会暨国际电子电路(大湾区)展览会(以下简称:CPCA Show Plus)在深圳国际会展中心(宝安)盛大举办
2025-11-03 12:43:00
培育钻值得购买吗?超全选购攻略一篇搞定,附头部品牌深度测评
当越来越多的年轻人开始琢磨“如何高性价比的结个婚”,培育钻石凭借着价格优势、环保理念,正成为暗潮涌动的钻戒市场的新宠。据统计
2025-11-03 12:45:00
未来,AI有望打造口感逼真的植物蛋白
大河网讯 “人工智能(AI)正以前所未有的速度加速食品创新,它不仅能打造口感逼真的植物蛋白、通过文本生成全新食品配方,还能辅助设计个性化营养食品
2025-11-03 13:10:00
2025 年,Facebook 依托 Meta 生态的 29.8 亿全球月活用户(Statista 数据),仍是企业海外拓客的关键阵地
2025-11-03 12:46:00