• 我的订阅
  • 科技

王小川:大模型创业挺快乐,最好的大模型未必来自大厂

类别:科技 发布时间:2023-08-17 17:45:00 来源:第一财经

清华大学东门外不远的搜狐网络大厦,曾是搜狗的办公室,在今年大模型创业热潮中,王慧文成立的光年之外就在这里办公;而原搜狗CEO王小川,则将百川智能的创业地选在了与其一路之隔的赛尔大厦。站在这里,甚至可以看清对楼窗边的办公环境。

不到一年时间,大模型创业已经几近红海。隔着马路的另一面,光年之外创始人王慧文因健康问题离岗退出,将创立不到半年的公司卖给美团,引起了外界对于创业者心理健康的关注。

8月8日下午,在赛尔大厦17层的一间会议室里,当王小川被问及此事以及“大模型创业压力大不大”时,他对第一财经等媒体说:“我听说慧文是特别负责任的。他是国内几个主流做大模型里唯一一个没有强势的技术背景的,对他的挑战比其他家要大。工作中要做大量的技术决策、招什么人、走什么技术路线图、需要多少计算资源……一定会面临非常多的决策压力。”

王小川说,“不是做大模型压力大,是没有技术背景做决策压力会大很多,但是技术足够的话,其实挺愉悦的,我们的进度是在一个快乐的状态。”

王小川:大模型创业挺快乐,最好的大模型未必来自大厂

搜索虽晚,但赶上AI好时候

从今年4月下场杀入大模型到现在,王小川说,比当年搜索引擎时候的成就感更大。

过去,搜狗想从搜索转问答,搜索输入法想做续写,尽管当时搜狗已经做了百亿的参数模型,把全身武艺都用上了,但始终不能有效地把搜索变成问答,实现不了今天大模型才能达到的效果。他说,今天有了大模型的加持,在搜索增强方面将大有可为。

而对于加入如火如荼的“百模大战”,他回应:确实每个有技术理想的企业都想下场去试一下。

ChatGPT火了,有朋友对王小川说,“你特别适合做大模型”,因为这正好需要用到过去搜索、输入法等相关的AI能力。他说当时回想了一下,自己干了20年搜索,从来没人说:“小川,你适合做搜索。”

当年王小川创立搜狗做搜索,比百度晚了四年,因此在行业里一直处于跟随的位置,做创新突破特别难,现在赶上了信息时代走向智能时代,大家站在同一个起跑线上,新的机会来了。

王小川说,其实自己也有压力,尤其在一开始,要抵制动作走形的地方。比如有投资人说,搜索公司不适合做大模型,因为谷歌也没干成,做搜索的人可能已经“脑子锈了”、思维固化了,再去做大模型可能是个减分项。还有人认为在新公司里有“老搜狗人”的加入,不够开放,建议他要多招90、95后海归回来的“小鲜肉”。这些压力其实不是来自内生,而是市场审美理念的不同。

他说,搜索这个模式存在太久了,以至于大家慢慢忘了搜索本身也是AI,且搜索和输入法本身就是把语言AI用到极致。百川智能技术联合创始人陈炜鹏对记者举例,做大模型的第一个环节是数据从哪来,中文互联网网页中的数据高达万亿、百亿量级,搜狗此前的数据积累,能让他们知道哪里有好的数据,并且将这些数据进行收集、处理、识别,在这一领域,百川智能目前的团队有较强的技术积累和方法论。此外从人才来看,搜狗原有团队有着较强的战斗力,搜狗原COO茹立云、原CMO洪涛相继加入进来,以及有更多年轻人才的加入,形成了目前百川智能的人才梯队。

从4月宣布下场做大模型后,百川智能动作迅速。6月发布70亿参数开源大模型Baichuan-7B,7月发布130亿参数开源大模型Baichuan-13B。

这两款大模型引擎,并没有立刻商业化,王小川说首先是填补空白,展现自家的技术实力,相信伴随着开源后不断的技术迭代,商业模式水到渠成。他透露,目前有150余家企业申请使用百川智能大模型。

“谁是最好的大模型”还没结论

在发布两款开源大模型后,今日王小川发布了百川智能新模型Baichuan-53B,不同的是,这一次是参数规模更大(530亿)的闭源大模型。

在王小川的电脑页面上,向百川大模型提问的对话一幕幕闪过,比如“以古龙的风格写个朋友圈”、“罗刹海市的歌词是什么”、“300P算力相当于多少张A100”、“讲讲卡夫卡的名作《城堡》”等等。他说,这次大模型的文科能力更好,比如在理解古诗、生成有个性化风格的文章等方面。

王小川:大模型创业挺快乐,最好的大模型未必来自大厂

目前的大模型有以OpenAI GPT-4为代表的闭源大模型和以Meta Llma2为代表的开源大模型两股力量。后者正在快速地拉拢“朋友圈”,对前者形成有力冲击。

谈到最近热议的开源与闭源之争时,王小川说,开源确实容易“建立人品”,“朋友多多的”,让大家迅速了解和评测;同时开源也是为商业化做准备,如果大家用起来觉得不错,当需要更好的服务和更大的参数时,可以探索进一步的商业化路径。

但是他认为,开源和闭源并不像手机中iOS或者安卓操作系统只能二选一,从tob角度,开源闭源其实都需要。他预计未来80%的企业会用到开源的大模型,因为闭源没有办法对产品做更好的适配,或者成本特别高,闭源可以给剩下的 20%提供服务。二者不是竞争关系,而是在不同产品中互补的关系。

王小川还提到,在6月发布第二款大模型后第二天就飞去硅谷。第一个收获是对齐认知,交流技术思路,到底走开源还是闭源……第二个收获是美国做技术很牛,但是应用能力可能有短板。

他说,在硅谷和 OpenAI 交流时,他们讲理想时满眼放光,走得非常远,比如他们现在做 GPT-4 需要 2 万多张卡做计算,国内都没见过这么大的规模。对方还很自豪地说正在设计把 1000 万颗 GPU 连在一块做计算模型。“要知道英伟达一年才生产100万颗。”而在怎么去做应用、做产品上,这可能是OpenAI的短板。

这让王小川意识到,光跟着OpenAI走是不够的,理想上确实拼不过,但是在落地上,更有底气了。他说在去硅谷之前自己认为,是“在理想上比OpenAI慢半步,在落地上比OpenAI快半步”。从硅谷回来之后改成了:“在理想上比OpenAI一半步,在落地上快三步。”

而在对比中美大模型时,王小川还提到,美国闭源大模型的头部格局几乎已经定,比如OpenAI、Anthropic的Claude,Google也拿到门票,已经没有太多悬念,投资人也不会再投。

但中国的情况不一样,面对轰轰烈烈的“百模大战”,王小川认为,钱是重要的是,最终决定的力量还是人和团队、组织能力。大厂钱多、人多、算力多,但组织效率通常不一定够好,创业公司的组织效率可能好、也可能不好。“中国谁做了最好的大模型,还没有结论,大家都在争取机会,而且不一定落在大厂里。”

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2023-08-17 21:45:05

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

GPT革命:王小川向左,Sam Altman向右|钛媒体焦点
...创业风潮。4月10日下午,身着橙色帽衫的搜狗公司创始人王小川,走进搜狐网络大厦二层一间近30平米的会议室,在这里他宣布了自己即将投入创业的大模型新项目,名叫“百川智能”,旨在
2023-04-14 14:00:00
对话王小川:国内在技术理想上拼不过OpenAI,但应用落地会跑得更快
... | 搜狐科技作者 | 梁昌均6月15日、7月11日、8月8日。这是王小川自4月10日官宣创办百川智能入局AI大模型创业以来
2023-08-09 15:00:00
ChatGPT一周年,机会在大厂还是小公司?
...、生活方式会有天翻地覆的变化。”百川智能创始人、CEO王小川在12月1日的2023腾讯ConTech大会中谈到。大会上
2023-12-07 09:42:00
超30个国产大模型混战:华为百度阿里腾讯,谁能成为“中国的OpenAI”?
...一周。同时,创业市场依然不断有大佬进入,搜狗创始人王小川,美团联合创始人王慧文和元老级高管陈亮纷纷投身AI大模型。王小川和百度李彦宏阵营围绕技术差距等问题打起口水战,为AI大
2023-04-18 13:00:00
AI大模型诸神之战:总有人要成功,为什么不能是我们?
...技圈大佬争相加入大模型竞赛的境况,王慧文、李开复、王小川......一串串如雷贯耳的名字纷纷入局,经历了三年疫情之后,科技圈又迎来了久违的创业热潮。这些连续创业者们成名已久,
2023-04-13 10:35:00
AI大模型混战“真相”:投资人看得多投得少,20家公司仅获60亿元融资
...滚烫的赛道,百模大战已然开启。在创投市场,王慧文、王小川、李开复等大佬先后入场,喊出要做中国的OpenAI、做中国最好的大模型等宣言,成为这波AI大模型浪潮中重要的一股势力。
2023-07-11 13:00:00
王小川公布最新530亿百川大模型,阿里腾讯等超150家企业已使用
百川智能创始人兼CEO 王小川成立120天,王小川的大模型公司百川智能又有了新动作。钛媒体App获悉,8月8日下午,百川智能在北京发布530亿参数通用大模型Baichuan-53B
2023-08-09 15:00:00
张一鸣熬夜看论文 AI博士年薪500万 大模型搅动创业圈
...往旧金山的,有一批人并不是为了度假休闲——李开复、王小川、傅盛、王慧文……中国科技圈的创业者与投资人,近期不是在位于旧金山的硅谷,就是在飞往硅谷的航班上。他们中的许多人之前已
2023-05-09 10:37:00
王小川归来 跑步入局大模型创业
...了AI大模型的创业风潮。4月10日,淡出公众视线近两年的王小川,带着他的新公司“百川智能”亮相,正式宣布进入AI模型创业赛道。王小川被人熟知的,是他理科学霸和搜狗创始人的身份
2023-04-14 10:47:00
更多关于科技的资讯:
蔡高民:颠覆认知!打破西方理论垄断!中国老年学自主知识体系诞生
《全生命周期养能力发展与医养结合:理论和实践》的核心突破,在于建构“养”的元概念、定义与内涵外延,并以此为基础构建了逻辑自洽的三大理论体系
2026-01-04 20:15:00
编者按:周期更迭,变量叠加。站在“十五五”开局之年的关键节点上,各行业如何调整节奏、校准路径、寻找增量?中新经纬广邀多领域学者
2026-01-04 20:21:00
春节临近,年味渐浓。在贵阳,一场不同于传统年货市集的新春活动正在酝酿——它以“创意游乐场”为定位,融合在地风物、潮流文化与青年创造力
2026-01-04 21:50:00
不经意晃动手机,软件立即跳转购物页面。最近,记者实测发现,备受诟病的“摇一摇跳转”广告乱象依然时有发生,困扰着不少用户
2026-01-04 17:59:00
2025年度帆书APP经典热搜榜,精准解锁经典中的成长指南
当“信息过载”成为常态,“选择困难”深入骨髓,我们比任何时候都更需要一个清晰的信号:什么才是值得投入时间的真知?近日,帆书APP根据全年用户收听数据发布的“经典热搜榜”
2026-01-04 14:25:00
黄鹤权据光明网报道,英国《剑桥词典》将2025年年度词汇定为“准社交”,形容个体单方面与名人、虚拟角色或聊天机器人产生的密切连接感
2026-01-04 14:25:00
飞晟科技入选海南省儋州市中小企业数字化转型城市试点服务商
近日,海南省儋州市科学技术和工业信息化局对外公示《儋州市中小企业数字化转型城市试点服务商拟纳入名单(第一批)》。公示名单显示
2026-01-04 15:28:00
抖音生活服务联合南京德基广场落地“心动街区”,电视台直播+明星见面会+打卡活动助力商圈消费
12月30日,抖音生活服务“心动街区”活动联合江苏电视台城市频道零距离栏目发起“心动德基24h·南京跨年在德基”美食专场直播
2026-01-04 15:30:00
浪潮卓数大数据旗下公司入围多项2025年山东省大数据产业“三优两重”项目
近日,山东省工业和信息化厅正式公布2025年山东省大数据产业“三优两重”项目名单。浪潮卓数大数据旗下天元征信公司、浪潮(山东)大数据科技有限公司
2026-01-04 15:31:00
华麟数科推出联盟生态链“麒麟链”,加速数字经济深度融合与转型
【中国,2026年1月】 —— 在数字经济浪潮席卷全球、深入渗透各行各业的关键阶段,华麟数科(广东)有限公司(以下简称“华麟数科”)正式宣布
2026-01-04 15:31:00
以具身智能赋能教育未来----开普勒机器人助力高校产学研融合创新
在新一轮科技革命与产业变革加速演进的背景下,人工智能正从"算法与算力"的竞争,走向"智能体与真实世界深度融合"的新阶段
2026-01-04 15:33:00
中国首个!新奈发布“智能呼吸工程体系”,破解家用呼吸设备长期安全难题
在睡眠与呼吸健康领域,真正的改变往往不是某一功能的增加,而是背后那套长期支撑它持续进化的技术体系。2025年12月,新奈 Synaire 对外发布年度科研成果
2026-01-04 15:33:00
中国科技定义未来运动 HURA超现实远程赛车亮相世界未来运动会
2025年12月18日至23日,全球体育科技前沿的目光齐聚阿联酋首都阿布扎比国家展览中心。在这里举办的2025世界未来运动会(Games of the Future 2025)上
2026-01-04 15:33:00
京东健康深化政企协同 助力吉林人参产业发展提质增效
元旦假期期间,人参等滋补品在节庆送礼与家庭健康消费中的需求集中释放。京东健康的消费数据显示,近一个月以来,人参等滋补品类销售同比增长55%
2026-01-04 15:59:00
稳送万物,乘势而上:顺丰同城交出2025年度答卷
2025年,即时零售的“东风”依旧猛烈,市场规模逼近万亿大关,“餐饮+非餐”品类单量均刷新了历史纪录,验证即时零售的天花板远未见顶
2026-01-04 13:55:00