• 我的订阅
  • 头条热搜
微软论文一张截图,曝出GPT-3.5仅有200亿参数?AI圈巨震,网友大呼太离谱!
新智元报道编辑:编辑部【新智元导读】微软最近一篇论文爆料,GPT-3.5的参数量只有20B,远远小于之前GPT-3公布175B。网友表示,ChatGPT能力似乎「配得上」这个体量?GPT-3.5只有200亿参数?今天,大模型圈都被微软论文中的一纸...……更多
微软开源爆火1bit大模型推理框架!千亿参数模型量化后单CPU可跑
微软开源1bit大模型推理框架!现在1000亿参数大模型量化后单CPU可跑,速度可达每秒5-7个token。就是今年爆火论文The Era of 1-bit LLMs的官方代码实现,开源不到一周GitHub已揽获7.9k Star。传统大模型参数以16位浮点数(如FP16或BF16)形...……更多
马斯克xAI发布首款大模型;苹果发布M3芯片;ChatGPT被曝仅200亿参数|本周硅谷发生了什么?
...3nm工艺加持的“M3芯片”,顺带展示了搭载M3的MacBook Pro。微软的一篇论文则意外曝光ChatGPT实际参数仅有200亿,引起一片哗然。大模型这边,马斯克旗下众星云集的xAI发布了首款大模型“Gork”,与其他模型不同,Grok不仅能通过X...……更多
OpenAI举办“AI春晚”;李开复大模型破纪录 | 图灵周报
...A股、美股的“超导概念股”都曾受影响,大幅波动。 03微软以安全问题为由限制员工访问ChatGPT图源:Pixabay在当地时间周四的一段时间内,微软员工被禁止使用OpenAI产品ChatGPT。微软在内部网站上的最新消息中表示,“出于安全...……更多
大模型新趋势之MoE:现状、挑战及研究方向
...发各种新型MoE架构,以提升模型性能或实用性。如清华和微软联合提出MH-MoE5,通过多头机制弥补MoE原始缺陷,实现专家激活率由8.33%提升至90.71%,提升模型高效扩展能力;华为提出全新LocMoE架构,并将其嵌入盘古大模型,提升模...……更多
微软发布旗下最小语言模型phi-2
11月17日消息,微软Ignite2023大会已拉开帷幕,微软在本次活动中发布了旗下最小的语言模型Phi-2,共有27亿参数,相比较此前版本有明显提升。注:微软于今年6月发布Phi-1,只有13亿代码,适用于QA问答、聊天格式和代码等等场景...……更多
挑战Scaling Law,Meta发布移动端350M小模型MobileLLM,性能比肩7B LLaMA-v2
...是唯一的路径,模型「以小搏大」的故事不断上演。先有微软更新;后有谷歌用。硬件方面,我们看到了AI功能逐渐与电子产品进行深度集成。比如微软臭名昭著的Recall功能,正是他们的重要组成部分;苹果也在Apple Intelligence的...……更多
专家模型不要专家并行!微软开源MoE新路径
【新智元导读】近日,来自微软的研究人员开源了使用全新方法训练的MoE大模型,不走寻常路,且编码和数学表现出色。继Phi家族之后,微软又开源了新的混合专家大模型——GRIN MoE。与Phi-3.5同样的个头(16 * 3.8B),却采用了...……更多
科学家提出情景学习新范式,让学霸大模型向学弱大模型输送能力
...、低算力需求的模型,并取得了一定成果。2023 年 6 月,微软发布 13 亿参数的语言模型 Phi,同年 9 月 Phi-2 的参数扩大到 27 亿。据报道,微软的“小模型”已经在金融客户和银行客户中测试。此后,国内厂商也逐步跟进小模型的...……更多
马斯克打脸OpenAI!全球最大模型Grok-1开源
...利性开源组织创建的,目的是抗衡谷歌。但此后它变成了微软控制下的一家闭源、以利润为导向的公司。“OpenAI已经成为一家利润最大化的公司……这根本不是他的初衷。”马斯克还谴责OpenAI遭到微软的控制。他表示,世界需要...……更多
本周硅谷发生了什么?|苹果Vision Pro正式开售;Neuralink完成人类脑机接口植入;字节Coze国内版上线;
...人助手苹果发布2024年Q1财报,库克称AI是“巨大的机会”微软、Alphabet等AI相关企业总市值一天蒸发1.3万亿元360 AI搜索移动App已上线Sam Altman弟弟的风投公司募资1.5亿美元,将重点关注AI初创人形机器人初创公司Figure AI与微软、OpenAI...……更多
o1突发内幕曝光?谷歌更早揭示原理 大模型光有软件不存在护城河
...现在英伟达直接掌控谁能拥有更多算力。那么如果谷歌/微软开发出了效果更好的定制芯片,情况又会如何呢?o1突发内幕曝光?谷歌更早揭示原理,大模型光有软件不存在护城河值得一提的是,前段时间OpenAI首颗芯片曝光,将采...……更多
语音克隆达到人类水平,微软全新VALL-E 2模型让DeepFake堪比配音员
【新智元导读】继去年初的第一代VALL-E模型之后,微软最近又上新了VALL-E 2模型,标志着第一个在合成语音稳健性、相似度、自然程度等方面达到人类水平的文本到语音模型。最近,微软发布了零样本的文本到语音(TTS)模型VAL...……更多
苹果300亿参数大模型首亮相,还买了家AI公司|焦点分析
...下来,苹果的重心都在加速大模型进程上,来追赶谷歌、微软、亚马逊。目前,整体大模型进展,苹果对外的信息较少,看上去已经落后其竞争对手一大截。在年初的苹果季度财报电话会议上,蒂姆·库克表示,苹果正在投入大...……更多
全球市值第一背后的AI算力焦虑
...。本月内,人工智能芯片公司英伟达市值先后超过苹果、微软,登顶全球市值第一的公司。而在这个“第一”背后,是众多大模型厂商的“算力焦虑”。英伟达股价截图当算力成为人工智能的关键当地时间6月18日美股收盘,英伟...……更多
微软Win11中发现国产开源大模型!RWKV官方:没给钱啊?现在赶趟
微软正尝试在Office中集成国产开源大模型RWKV!RWKV官方甚至直接发了个推文表示:RWKV.cpp,现已在全球五亿系统中部署。之所以这么说,是因为他们发现最新版Windows 11系统的Office文件夹中有以rwkv命名的DLL文件,包含GPU、CPU版本...……更多
OpenAI掀小模型血战!苹果DCLM强势登场,碾压Mistral 7B全开源
...越好。其实一直以来,AI社区中,并不缺少小模型,比如微软Phi系列模型多次迭代,以及6月末谷歌刚刚更新的Gemma 2 7B。这周,OpenAI突然发布GPT-4o mini,Mistral AI联手英伟达发布Mistral NeMo,HuggingFace的SmoLLM等小模型的发布,为小模……更多
Meta大模型LLaMA 3即将登场,参数量或达1400亿
...把子”,Meta在AI基础设施上的投入亦不可小觑,目前只有微软拥有与之相当的计算能力储备。Meta发布的一篇技术博客称,到2024年底,该公司将再购350000个英伟达H100GPU,算上其他GPU,其算力相当于近600000个H100。LLaMA3即将登场参...……更多
掰开安卓手机 满屏都是三个字:大模型
...,从大模型厂商巨头的技术储备栈变化可以窥见一斑。以微软为例,这家科技巨头和云厂商,近期开始注重起AI软硬件结合的技术,如大模型训练等。在微软前不久的一篇训练研究中,就系统阐述了大模型在FP8精度下训练的效果...……更多
谷歌DeepMind推Imagen2;ChatGPT Plus恢复订阅;OpenAI提出用小模型监督大模型 | 本周硅谷发生了什么?
...展通用世界模型研发Mistral AI发布专家混合模型Mixtral 8x7B微软发布27亿参数基座模型Phi-2因拿到更多GPU,ChatGPT Plus重新开放订阅OpenAI首席科学家llya和ChatGPT入选Nature年度十大科学人物OpenAI推Converge 2加速器计划,参……更多
mistralai公司推出mixtral8x22b开源模型
...“6人团队,7页PPT,8亿融资”不断缔造传奇,而且在得到微软的投资之后更是进入发展快车道。该公司今天发布的Mixtral8x22B开源模型是个开源模型,官方目前放出了Torrent种子链接,文件大小为281GB。用户可以通过磁性链接直接下...……更多
谷歌版贾维斯即将问世,最强Gemini 2.0加持!AI自主操控电脑时代来临
...称谷歌同类Project Jarvis预计年底亮相。AI操控电脑已成为微软、苹果等巨头,下一个发力的战场。AI接管人类电脑,就是下一个未来!几天前,Anthropic向所有人展示了,Claude 3.5自主看屏幕操作光标完成复杂任务,足以惊掉下巴。...……更多
微软被曝正自研AI大模型:5000亿个参数,与谷歌和OpenAI竞争
科技巨头微软或正在研发参数达5000亿的全新AI(人工智能)大模型,将正面叫板谷歌和OpenAI。当地时间5月6日,据外媒报道,微软正在研发一款名为MAI-1的最新AI大模型,其规模远超出微软此前推出的一些开源模型,在性能上或...……更多
微软连发3款Phi-3.5模型:128K上下文,首用MoE架构,部分性能超GPT-4o mini
智东西8月21日消息,今天,微软一口气甩出3款超强轻量级模型!微软本次发布的轻量级模型系列名为Phi-3.5,适合在内存和算力受限的环境中运行,均支持128k上下文长度。Phi-3.5-mini-instruct主要面向基础快速推理任务,Phi-3.5-MoE-in...……更多
LLM数学性能暴涨168%,微软14人团队力作!合成数据2.0秘诀曝光,智能体生成教学
【新智元导读】合成数据2.0秘诀曝光了!来自微软的研究人员们提出了智能体框架AgentInstruct,能够自动创建大量、多样化的合成数据。经过合成数据微调后的模型Orca-3,在多项基准上刷新了SOTA。全世界高质量数据几乎枯竭。AI...……更多
本周硅谷发生了什么?| 高通第三代骁龙8;谷歌20亿美元追投Anthropic;联想拿出能跑大模型个人PC
...子轮融资。本轮融资由 Gradient Ventures、TR Ventures、Nvidia和微软Azure AI副总裁Misha Bilenko参投。资金将用于加强CentML 的产品开发和研究工作,同时扩大初创公司的工程团队和分布在美国和加拿大的30人员工队伍。CentML是一家开发工具……更多
Llama 4训练已开启!Meta科学家最新采访,揭秘Llama 3.1是如何炼成的
...目。 以下是采访内容的节选。Llama 3.1研发思路如何决定参数规模其实LLM的参数规模的选择需要考虑多种因素,包括scaling law、训练时间、GPU和硬件的约束等等。而且,不能只考虑Meta所用的硬件,还有整个AI社区,并不是每个人...……更多
微软为msn天气引入ai预测模型
5月5日消息,微软为MSN 天气引入一项最新的天气预测模型,该模型基于微软旗下Start团队近日在 arXiv 发表的论文,结合了5种不同的人工智能模型和3种深度学习架构,据称能够准确预测 30 天内天气预报,IT之家查询论文信息,整...……更多
谷歌立秋新品发布会:Pixel 9系列整齐亮相 还有一些AI新花样
...截图内容,并与日历等app进行联动操作。这个功能与之前微软给Windows做的Recall功能非常像,但区别在于微软的功能因为“时时刻刻在截图”,被视为侵犯隐私而“回炉重造”,谷歌的功能只分析用户手动进行的截图。谷歌还发...……更多
微软宣布可以提前30天预测天气
...发团队\"世界上最准确的全球天气预报提供商\"的称号。微软开始团队似乎并不满足于此。本周,微软宣布该团队提出了一种更准确的方法,可以提前30天预测天气。在必应博客上的一篇文章中,微软称其\"Start\"团队在康奈尔大学...……更多
更多关于科技的资讯:
这种螨虫的雄性出生就死亡 而雌性却每次都进行有性生殖
寄生虫的世界非常有趣,为了配合自己寄生的生活方式,许多寄生虫在我们看来都显得非常独特!△ 蓟马在中东地区有一种叫蓟马小昆虫
2025-02-13 23:51:00
看着都疼!女子10根手指戴了10枚戒指 全部套牢卡死
快科技2月13日消息,近日,据中山消防消息,在广东省中山市第三人民医院发生了一起紧急救援事件。一名女病人因戒指卡手而急需救助
2025-02-13 23:51:00
无论百度还是阿里 这波最急的可能是苹果。。。
众所周知,每次当马云马老师这边传出来什么消息,中国互联网上都要掀起一阵波澜。这不, 11 号马云穿着马甲现身西溪园区的照片刚一刷屏
2025-02-14 00:21:00
牵手阿里后 苹果仍在继续与百度合作:为国行iPhone落地AI
快科技2月14日消息,阿里官方已经确认目前正在与苹果合作,针对中国市场进行本地化AI接入。对于能够与苹果合作,蔡崇信表示阿里非常幸运
2025-02-14 00:21:00
iPhone SE 4真要来了!库克官宣:苹果2月19日发布新品
快科技2月14日消息,库克今天突然官宣,苹果将会在2月19日发布新产品。虽然目前尚未公布具体产品,但是结合近期多方爆料来看
2025-02-14 00:21:00
科大讯飞:纯国产算力的星火X1新版本要来了 能力超OpenAI o1
快科技2月13日消息,近日,在一次机构调研中,科大讯飞透露了其最新的研发进展:公司正在全力训练的纯国产算力平台“星火X1”新版本
2025-02-14 00:21:00
比尔盖茨自述曾是熊孩子:16岁徒步数百英里 边走脑中边写BASIC代码
步入70岁之际,比尔·盖茨终于出版了自己人生中的首部自传《源代码》。不同于以往的商业发展视角,无关对微软成就的宏大叙事
2025-02-14 00:51:00
12306回应特价车票:没有查询特价车票的网页
快科技2月13日消息,近期,特价火车票引起网友热议,有媒体报道称,从大城市出发到中西部地区的部分线路及小城市之间却出现不少打折车票
2025-02-14 00:51:00
靠AI 90分钟做出来的WikiTok 维基百科+抖音会让我知识成瘾吗
如何克服狂刷短视频带来的时间黑洞?屏幕健康、数字极简都太好用。如今,出现了一个新应用,想用魔法打败魔法:不是爱刷下一条吗
2025-02-14 01:21:00
聚焦现代旅游业体系建设 | 案例 · “AI游贵州”推动智能旅游服务再升级
上海游客张妍计划今年夏天携家人来贵州避暑,提前半年规划行程。当了解到“AI游贵州”这个智能小程序后,她立马咨询AI规划了9天8晚的自驾线路
2025-02-14 01:25:00
波音737客机起飞途中与皮卡车相撞:皮卡秒变敞篷车
快科技2月14日消息,据报道,当地时间2月11日,巴西GOL航空一架737 MAX 8(PS-GPP)在巴西里约热内卢加利昂机场滑跑起飞时
2025-02-14 01:51:00
国产重载AGV加速出海
本文转自:人民日报海外版本报记者 孙 懿广东嘉腾机器人自动化有限公司生产的八十吨重载自动导引车。受访企业供图天津朗誉机器人有限公司生产的80吨智慧矿山AGV
2025-02-14 04:48:00
“你有多久没吃过徐福记”,昔日零食钉子户成时代眼泪了?
原标题 | 广东糖果大王,过了个豪横春节你有多久没吃过徐福记了?今年春节,各个超市都迎来了意料之内的排队火爆,胖东来、山姆等年后几天人山人海
2025-02-14 05:26:00
本文转自:人民日报海外版上海徐汇区大模型产业加速发展人工智能引燃“模都”“语料创新技术与应用探索沙龙活动”“多模态大模型应用研讨会”“AI赋能下的开发流程蜕变”……走进位于徐汇西岸的模速空间创新生态社区
2025-02-14 04:50:00
“年轻态”,老品牌找准新方向(经济新方位·品牌的故事(下))
本文转自:人民日报糕点联名“悟空”、童车“马卡龙”风、直播手表穿搭——“年轻态”,老品牌找准新方向(经济新方位·品牌的故事(下))本报记者  王伟健  姜泓冰  李家鼎天津电商节上
2025-02-14 06:08:00