• 我的订阅
  • 头条热搜
推理成本直降99%!百川智能「1+3」矩阵揭秘,两张4090玩转旗舰新模型
【新智元导读】大模型热,企业落地难?就在刚刚,百川智能推出「1+3」产品矩阵,一站式解决大模型商业化难题。「系列优质通用数据+领域增强训练工具链」,仅需10分钟就能让企业自主成为模型定制增强专家,实现行业最...……更多
百川智能、阿里云等进入开源大模型领域,开启商业化前奏
...8、9月份推出的开源大模型则包括阿里云Qwen-7B、Qwen-14B,百川智能Baichuan2-7B、Baichuan2-13B等。近日,香港中文大学贾佳亚团队还联合MIT发布长文本开源大语言模型LongAIpaca,号称全球首个70B参数长文本开源大语言模型,显示开源之...……更多
百川智能发布baichuan3稳定语言模型
1月29日,百川智能发布超千亿参数的大语言模型Baichuan3。在多个权威通用能力评测如CMMLU、GAOKAO和AGI-Eval中,Baichuan3都展现了出色的能力,尤其在中文任务上更是超越了GPT-4。而在数学和代码专项评测如MATH、HumanEval和MBPP中同样表...……更多
李开复辟谣「掉队」传闻,零一万物推「白菜价」顶级模型
...国内的大模型创业公司「六小虎」(月之暗面、Minimax、百川智能、智谱 AI、零一万物、阶跃星辰)开始在不同的道路上做出选择。Minimax 被传年营收预计 7000 万美金,同一时间流出的信息,还包括海螺 AI 由于视频大模型的推出...……更多
商汤升级“日日新5.0”大模型,对标GPT-4Turbo
...理时上下文窗口达200K左右。云、端、边全栈大模型产品矩阵中,用于终端设备的“商汤端侧大模型”可满足各类终端用户对大模型技术的应用需求。“日日新5.0”和GPT-4回答趣味推理问题。4月23日,在2024商汤技术交流日上,商...……更多
本周硅谷发生了什么?|苹果Vision Pro正式开售;Neuralink完成人类脑机接口植入;字节Coze国内版上线;
...同时开放了GPT商店。另外,商汤、面壁智能、科大讯飞、百川智能等厂商本周也更新了大模型。另外脑机接口也有了重要历史进展,马斯克的脑机接口公司Neuralink完成了公司首例人脑植入手术。据马斯克透露,患者目前恢复情况...……更多
阿里云通义千问主力模型价格直降97%,大模型商业化拐点已至
...供更丰富的模型和工具链。阿里云百炼平台上汇聚通义、百川、ChatGLM、Llama系列等上百款国内外优质模型,内置大模型定制与应用开发工具链,开发者可以便捷地测试比较不同模型,开发专属大模型,并轻松搭建RAG等应用。从选...……更多
“技术故障”背刺巴菲特,金融大模型到底靠不靠谱?
...要实时数据处理和决策支持,大模型的推理涉及到大量的矩阵乘法计算,对硬件的矩阵乘法计算能力提出较高要求,计算复杂性可能导致响应时间延迟,不利于实时应用。加之大模型训练和推理过程需要大量的计算资源和能量消...……更多
chatgpt低成本复现流程开源
...键。低成本微调的LoRA在微调部分,Colossal-AI支持使用低秩矩阵微调(LoRA)方法。LoRA方法认为大语言模型是过参数化的,其在微调中的参数改变量是一个低秩的矩阵,可以将其分解为两个更小的的矩阵的乘积,即在微调时,固定...……更多
CPU,正在被AI时代抛弃?
...中两个重要阶段的需求,即在预填充阶段,需要高算力的矩阵乘法运算部件;在解码阶段,尤其是小批量请求时,需要更高的内存访问带宽。这些需求CPU都可以很好地满足。 以英特尔举例,从2017年第一代至强®可扩展处理器开...……更多
商汤科技sensetime推出“云端边”全栈大模型体系
...流日活动,发布行业首个“云、端、边”全栈大模型产品矩阵,以满足不同规模场景的应用需求,并且全新升级“日日新SenseNova5.0”大模型体系,其综合能力全面对标GPT-4Turbo,技术领跑加速生成式AI向产业落地的全面跃迁,实现...……更多
大模型价格战“卷”向何方?|深度
...国内AI圈两个“顶流”李开复与王小川的表态耐人寻味。百川智能创始人王小川认为,如果(大模型)是面向B端企业客户,那往后就是直接卖云服务的方式,中间的应用层反倒会繁荣起来,有不少新机会。不过,在王小川也看来...……更多
大模型降价背后,国产大模型的竞争逻辑变了
...众多与AI相关的创业公司也在持续涌现,业内更是出现了百川智能、月之暗面、MiniMax、智谱AI等AI四小龙。随着大厂下调API价格,包括新AI四小龙在内的创投公司,都将面临全新的考验。一方面,以BAT为首的云服务商,成为了“降...……更多
chatgpt低成本复现流程来了
...键。低成本微调的LoRA在微调部分,Colossal-AI支持使用低秩矩阵微调(LoRA)方法。LoRA方法认为大语言模型是过参数化的,其在微调中的参数改变量是一个低秩的矩阵,可以将其分解为两个更小的的矩阵的乘积,即在微调时,固定...……更多
国产大模型第一梯队玩家,为什么pick了CPU?
...化,各方面都考虑到位了。硬件方面,英特尔®AMX(高级矩阵扩展)技术,正是为大模型推理重深度学习中大量的矩阵乘法运算专门优化的,可以理解成”CPU里的TensorCore”。有了英特尔®AMX,处理器每个时钟周期可完成高达2048个...……更多
...自:北京日报本报讯(记者 孙奇茹)北京人工智能企业百川智能近日发布角色大模型Baichuan-NPC,基于此推出的“角色创建平台+搜索增强知识库”,可以让游戏厂商、初创团队无需编写任何代码,仅通过简单的文字描述就能快速...……更多
百川智能完成3亿美元A1轮融资,阿里、腾讯、小米等巨头参投
...叶峰《每日经济新闻》记者获悉,10月17日,王小川旗下百川智能官宣已完成A1轮战略融资,融资金额3亿美元,阿里、腾讯、小米、深创投等科技巨头及多家顶级投资机构参投。对于百川智能的这一轮融资,有知情人士告诉每经...……更多
腾讯大模型混元Turbo:御气升昺云,梓桐金鼎开
...算力效能优秀;打造了底座+模型+工具+应用的大模型产品矩阵,为客户提供了一系列AI数字化解决方案。5T基础平台软件产品兼容国内主流芯片。一、混元Turbo之评测混元Turbo的核心技术混元Turbo的发布凝聚了腾讯团队长期以来对...……更多
GPU训Llama 3.1疯狂崩溃,竟有大厂用CPU服务器跑千亿参数大模型?
...强大计算单元中处理。对此,它需要支持向量化指令集、矩阵计算指令集,来实现大量的矩阵乘法和张量运算。 其次,是解码阶段,即在问题全部输入之后,模型开始输出结果的阶段。在这个阶段,对大模型唯一要求便是,输...……更多
ai生命周期:ai训练和ai推理的完美结合
...。比如灵活高效的AVX-512扩展指令集,可高效执行大量的矩阵和向量计算,显著提高卷积和矩阵乘法的速度,尤其是BF16数据类型可提高吞吐量,避免INT8数据的量化风险,而且还是双周期的256位流水线设计,效率和能效都更高。比...……更多
影响英伟达根本逻辑的大争论:OpenAI改变策略意味着什么?谁在撒谎?
...展不顺。据科技媒体The Information报道,OpenAI开发的下一个旗舰模型“Orion”,目前已经完成20%的训练。尽管表现已接近现有的GPT-4,但进步幅度却远不如前两代旗舰模型之间的飞跃。Orion在语言任务上表现更好,但在编码等任务上...……更多
谈大模型免费和被美双重制裁,周鸿祎“诉苦\\\
...”产品,这里的15家大模型厂商包括智谱AI、商汤科技、百川智能、火山引擎、百度智能云、腾讯、科大讯飞、华为云、MiniMAX、零一万物、面壁智能。合作后,在360安全卫士、安全浏览器、搜索、智能硬件四个重点场景下,用户...……更多
阿里云的AI路线图
...型系列就是基于阿里云人工智能平台PAI训练而成。此外,百川智能、智谱AI、零一万物、昆仑万维、vivo、复旦大学等企业及机构均在阿里云上训练大模型。人工智能馆围绕MaaS(模型即服务)理念,从人工智能开发者、模型工具...……更多
骁龙8至尊版混合架构、成本揭秘:更贵是不可避免的!
...高通也有充分的考虑,尤其是内存占用方面。比如Llama和百川的70亿参数大模型版,即使压缩到16位整数精度进行处理,也会占用13GB左右的内存,而通过高通的软件和相应的解决方案,将内存需求大幅降至约3.5GB。高通预计,未来...……更多
清华开源混合精度推理系统MixQ:大模型近无损量化并提升推理吞吐
...化为低比特可能会出现较大的精度损失。其原因在于激活矩阵中存在离群值(图4)。一个有效的方法是SmoothQuant,主要思想是通过平滑激活矩阵来降低量化激活的误差。 △图4 激活矩阵中存在离群值混合精度量化则是一类全新...……更多
围绕算力+数据,矩阵起源建设开源 AI 原生软件平台
...摸索中。 MatrixOS正式发布 为应对AI大模型时代的挑战,矩阵起源发布MatrixOS产品。MatrixOS是一个开源开放的AI-Native操作系统,链接算力、数据、知识、模型与企业应用,提供一整套端到端的AIStack服务框架。 MatrixOS秉承开放理念...……更多
天时、地利、人和,AIPC的新时代,AMD准备好了
...场,AMD邀请到了来自联想、华硕这类OEM厂商以及始智AI、百川智能、有道、游戏加加、生数等ISV参会,分享了他们对于AIPC的展望,从硬件到软件全面为AI产业赋能。联想分享了他们与AMD这20年来的合作,作为全球领先电脑品牌,...……更多
ChatGPT一周年,机会在大厂还是小公司?
...内,我们的工作方式、生活方式会有天翻地覆的变化。”百川智能创始人、CEO王小川在12月1日的2023腾讯ConTech大会中谈到。大会上,他与长江商学院教授、数字化转型中心主任孙天澍,以及复旦大学计算机学院教授、Moss系统负责...……更多
李彦宏:大模型场景下开源是最贵的,多模态是通往AGI的必经之路
...司 Mistral发布的模型)都有相当的影响力,国内的智源、百川、阿里的通义也都是开源模型,市场上不缺百度这一家开源的模型。百度要开源还得自己去维护一套开源的版本,这不划算。李彦宏的判断是,闭源才有真正的商业模...……更多
2023年AI的钱被谁赚走了?
...和互联网大厂对于AI的投入可谓大手笔:MiniMax、智谱AI、百川智能、月之暗面、零一万物等大模型初创企业已完成数轮融资,其中MiniMax估值达到25亿美元,月之暗面新一轮估值已达到30亿美元。科大讯飞(002230.SZ)、商汤(00020.HK...……更多
更多关于科技的资讯:
让幸福发生,容声606WILL养鲜冰箱重磅登场
12月28日,“让幸福发生——容声606WILL养鲜冰箱新品发布会”在上海盛大举行,这款冰箱搭载了升级迭代的WILL养鲜系统
2024-12-29 13:56:00
小米SU7发布2025年1月限时购车权益:下订即享免费增强智驾等功能
快科技12月29日消息,小米汽车近日宣布了2025年1月份的小米SU7限时购车权益。从1月1日至1月31日,所有下定购买小米SU7全系车型的用户将享受价值8000元的Nappa真皮座椅
2024-12-29 14:09:00
网红辛巴发声力挺良品铺子:不要为蹭流量恶意搞垮国民企业
快科技12月29日消息,日前,国内头部电商主播辛巴在带货良品铺子时,喊话打假人不要为蹭流量搞垮国民企业。辛巴表示,在这个社会上有太多人为了流量不择手段
2024-12-29 14:39:00
微软Win11 24H2隐藏改动:Alt+Tab经典任务视图回归无望!
快科技12月29日消息,在微软Windows 11的最新更新24H2版本中,用户将无法再体验到经典的Alt+Tab任务视图界面
2024-12-29 14:39:00
6.6千米!广西最长跨海大桥龙门大桥正式通车
快科技12月29日消息,据报道,中交公路规划设计院有限公司牵头设计的广西首座单跨超千米的跨海大桥,也是广西最长的跨海大桥——龙门大桥于12月29日上午正式通车
2024-12-29 14:39:00
科技创新,如何点燃新质生产力“引擎”?
本文转自:人民网“以科技创新引领新质生产力发展”圆桌论坛现场。人民网记者 翁奇羽摄人民网北京12月29日电 (记者赵竹青)在12月28日举办的“2024年人民财经论坛暨数字经济大会”上
2024-12-29 14:47:00
运营时速400公里全球高铁最快!CR450动车组座舱布局公布
快科技12月29日消息,CR450动车组样车今日在北京正式发布,此次发布的CR450动车组样车包括CR450AF和CR450BF两列样车
2024-12-29 15:09:00
雷军元旦跨年直播来了:大约4个半小时
快科技12月29日消息,今日,雷军发微博预告称,打算在12月31日晚8点做一场直播,陪大家一起跨年。“2024马上就要过去了
2024-12-29 15:09:00
现场画面!韩国客机起火爆炸烧得只剩机尾:179人遇难 2名生还者均为乘务员
12月29日消息,当地时间29日上午9时07分左右(北京时间29日8时07分左右),一架正在着陆的客机在韩国全罗南道的务安国际机场偏离跑道
2024-12-29 15:09:00
AI手机全球大调查!日本认知度最低
快科技12月29日消息,生成式人工智能(Gen AI)技术智能手机行业中的应用成为热门话题。Counterpoint Research针对美国
2024-12-29 15:09:00
红米k80的性能到底怎么样?一起来看看吧
自从红米K80系列发布之后,友商就开启了对该系列手机的疯狂狙击。真我,iQOO,一加,荣耀等友商是轮番轰炸,尤其是对于红米K80标准版更是极其针对
2024-12-29 15:31:00
荣耀200大降价,销量迎来一波大涨
只要舍得降价,原本性价比不高的机型,也能变成高性价比手机,这种情况在手机行业中经常发生,荣耀200就是一个典型的例子,早期这款手机在线上渠道并不受欢迎
2024-12-29 15:31:00
小米发布“年终总结”:苹果用户占比57.34%
继宣布今年交付量超过30万台后,小米汽车官微今日发布了“年终总结”:目前销售门店已开业200家,覆盖全国58城市;研发投入超过130亿
2024-12-29 15:32:00
虽然英伟达(NVIDIA)新的B200系列处理器推出的过程中出现了良率、发热等方面的问题,但据外媒SemiAnalysis报导
2024-12-29 15:33:00
华为鸿蒙生态创新中心揭牌启用,覆盖18个垂直领域
华为鸿蒙生态(武汉)创新中心正式揭牌启用,这是继深圳、成都之后,国内设立的第三个鸿蒙生态创新中心,也是全国规模最大、设施最先进
2024-12-29 15:34:00