• 我的订阅
  • 头条热搜
谷歌发布gemma2大语言模型,共有两种大小
...布新闻稿,面向全球研究人员和开发人员发布Gemma2大语言模型,共有90亿参数(9B)和270亿参数(27B)两种大小。Gemma2大语言模型相比较第一代,推理性能更高、效率更高,并在安全性方面取得了重大进步。谷歌在新闻稿中表示...……更多
微软、英伟达纷纷押注小模型,大模型不香了?
...发展的道路上,科技巨头们曾经竞相开发规模庞大的语言模型,但如今出现了一种新趋势:小型语言模型(SLM)正逐渐崭露头角,挑战着过去“越大越好”的观念。视觉中国当地时间8月21日,微软和英伟达相继发布了最新的小型...……更多
PyTorch官宣:告别CUDA,GPU推理迎来Triton加速新时代
...0%的Triton内核Pytorch最近发表了一篇技术博客,他们以两个模型——Llama3-8B和IBM的Granite-8B Code为例,100%使用Triton内核实现了FP16推理。Granite-8B Code是由IBM开发的一种仅限解码器的代码模型,专为代码生成任务设计。仓库地址:……更多
英伟达地表最强,黄教主被称作AI界“霉霉”
...多款重磅明星产品,目前市面上能叫得上名字得人工智能模型几乎都是在该架构上进行训练,行业内“一芯难求”的局面迟迟得不到缓解。而今年,按照英伟达每两年更新一次GPU架构的节奏,大家都对英伟达新一代计算平台翘首...……更多
晶圆级AI芯片WSE-3性能公布:80亿参数模型上每秒生成1800个Token
...上一代WSE-2的两倍,可用于训练业内一些最大的人工智能模型。在近日的Hot Chips 2024大会上,Cerebras Systems详细介绍了这款芯片在AI推理方面的性能。根据官方资料显示,WSE-3依然是采用了一整张12英寸晶圆来制作,基于台积电5nm制...……更多
碾压所有对手?谷歌发布轻量化开源大模型,笔记本电脑就可跑
开源大模型赛道迎来重磅新品。当地时间2月21日,谷歌宣布正式推出全新的开源大语言模型(LLM)“Gemma”, 旨在帮助开发人员和研究人员负责任地构建人工智能。据介绍,Gemma大模型与谷歌规模最大、能力最强的人工智能模型...……更多
多模态竞技场对标90B Llama 3.2!Pixtral 12B技术报告全公开
...杀入江湖的Mistral AI,在9月份甩出了自家的首款多模态大模型Pixtral 12B,如今,报告之期已至,技术细节全公开。作为欧洲的OpenAI,Mistral最近压力不小。端侧小模型端不出来,对比评测的结果又遭到质疑。上个月震撼登场的自家...……更多
前谷歌工程师创业造AI芯片!产品明年问世,已拿到1.8亿融资
...MatX正在挑战英伟达在AI芯片领域的霸主地位,其为大语言模型训练而设计的AI芯片将于明年问世。这家公司的官网显示,使用MatX芯片,训练70B大模型的延迟将小于10ms/token。该公司还预言,使用其芯片训练,能够让世界上最好的...……更多
苹果开源7B模型,训练过程数据集一口气全给了,网友:很不像苹果
苹果最新杀入开源大模型战场,而且比其他公司更开放。推出7B模型,不仅效果与Llama 3 8B相当,而且一次性开源了全部训练过程和资源。要知道,不久前Nature杂志编辑Elizabeth Gibney还撰文批评:许多声称开源的AI模型,实际上在...……更多
英伟达发布mistral-nemoai大语言模型
...国初创公司MistralAI,今天发布了全新的Mistral-NeMoAI大语言模型,拥有120亿个参数,上下文窗口(AI模型一次能够处理的最大Token数量)为12.8万个token。VentureBeat与Midjourney合作制作Mistral-NeMoAI大模型主要面向企业环境,让企……更多
英伟达开源NVLM 1.0屠榜多模态!纯文本性能不降反升
【新智元导读】NVLM 1.0系列多模态大型语言模型在视觉语言任务上达到了与GPT-4o和其他开源模型相媲美的水平,其在纯文本性能甚至超过了LLM骨干模型,特别是在文本数学和编码基准测试中,平均准确率提高了4.3个百分点。文本...……更多
加速AI落地企业!微软解读Copilot技术栈,云端混合大小模型是关键
...试用推广、团队扩张。 一、Copilot平台推出Agent能力,小模型满足端侧需求在Scaling Laws下,AI技术的能力大约每六个月就会翻倍增长。陶然谈道,如何让技术成果对齐行业、企业的实际业务需求,加速技术能力的落地转化,成为...……更多
4090笔记本0.37秒直出大片!英伟达联手MIT清华祭出Sana架构,性能秒杀FLUX
...合成高分辨率、高质量,且具有强文本-图像对其能力的模型。而且,它还能高效生成高达4096×4096像素的图像。项目主页:https://nvlabs.github.io/Sana/论文地址:https://arxiv.org/abs/2410.10629Sana的核心设计包含了以下几个要素:深……更多
英伟达llama-3.1-minitron4bai模型发布
...,英伟达公司联合Meta公司发布了最新的Llama-3.1-Minitron4BAI模型,主要通过结构化权重剪枝、知识提炼等尖端技术,成功蒸馏(Distill)出40亿参数的“小而强”模型。图源:英伟达Llama-3.1-Minitron4B模型在Llama-3.1-Minitron8B基础上……更多
英伟达发布80亿参数的ai模型
...伟达(NVIDIA)宣布,其已成功研发并发布了一款全新的AI模型,该模型拥有高达80亿的参数规模,具备精度高、计算效率高等优点,可在GPU加速的数据中心、云和工作站上运行。据介绍,这款新发布的AI模型是基于英伟达在深度学...……更多
老黄祭出史上最强 AI 芯片B200!30倍性能提升,AI 迎来新摩尔定律时代|钛媒体AGI
...)Blackwell,是英伟达A100/H100系列AI GPU的继任者。在大语言模型推理工作负载方面,Blackwell的性能相比H100 GPU提升了30倍,能耗却降低了25倍。亚马逊、谷歌、微软和甲骨文将是首批合作伙伴。此外,黄仁勋还在GTC大会推出了新一款...……更多
支持1024帧、准确率近100%,英伟达「LongVILA」开始发力长视频
现在,长上下文视觉语言模型(VLM)有了新的全栈解决方案 ——LongVILA,它集系统、模型训练与数据集开发于一体。现阶段,将模型的多模态理解与长上下文能力相结合是非常重要的,支持更多模态的基础模型可以接受更灵活...……更多
AI“卖铲人”英伟达,为何业绩再爆发?
...智能在2023迎来爆发,生成式AI以ChatGPT为代表掀起全球大模型浪潮,全球各行业的算力需求激增。英伟达GPU作为主流AI训练解决方案使其成为最大受益者,实现量价双收。英伟达财报也揭示了未来发展战略的三大方向:一是以数据...……更多
英伟达深夜炸场,世界最强AI芯片H200震撼发布,性能飙升90%
...两款芯片还是互相兼容的。这意味着,使用H100训练/推理模型的企业,可以无缝更换成最新的H200。全世界的AI公司都陷入算力荒,英伟达的GPU已经千金难求。英伟达此前也表示,两年一发布的架构节奏将转变为一年一发布。 就...……更多
英伟达尖端图像处理半导体h200开始供货
...英伟达方面公布的性能评测结果,以Meta公司旗下大语言模型Llama2处理速度为例,H2000相比于H100,生成式AI导出答案的处理速度最高提高了45%。市场调研机构Omdia曾表示,2022年英伟达在AI半导体市场约占8成的份额,与此同时AMD等...……更多
微软难以摆脱英伟达 |焦点分析
...市场至少90%的份额。AI芯片是AI时代石油一般的存在。大模型公司想更快推出模型和AI应用,就必须大量购入英伟达的芯片。而英伟达的产能有限,按照上一年计划制定的供给,远不能满足蓬勃的市场需求,抢不到芯片的云厂商、...……更多
英特尔推出新款AI芯片:推理性能比英伟达H100快50%
...大飞跃。英特尔Gaudi 3预计可大幅缩短70亿和130亿参数Llama2模型,以及1750亿参数GPT-3模型的训练时间。英特尔表示,Gaudi 3能够比英伟达上一代H100处理器训练特定大型语言模型的速度快40%,在推理端比英伟达H100快50%。基辛格在现场...……更多
英伟达发布Llama-3.1-Nemotron-51B AI 模型
...伟达 9 月 23 日发布博文,宣布推出 Llama-3.1-Nemotron-51B AI 模型,源自 Meta 公司的 Llama-3.1-70B,不过创新使用神经架构搜索(NAS)方法,建立了一个高度准确和高效的模型。Llama-3.1-Nemotron-51B 简介Llama-3.1-……更多
开源大模型杀疯了!Mistral新模型三分之一参数卷爆Llama 3.1
Llama 3.1 405B“最强模型”宝座还没捂热乎,就被砸场子了——Mistral AI发布最新模型Mistral Large 2,参数123B,用不到三分之一的参数量性能比肩Llama 3.1 405B,也不逊于GPT-4o、Claude 3 Opus等闭源模型。主打的就是一个高性价比。用官……更多
程序员福音 英伟达推出AI编程新模型:代码生成、补全、调试样样精通!
程序员福音 英伟达推出AI编程新模型:代码生成、补全、调试样样精通!快科技2月29日消息,近日英伟达和Hugging Face、ServiceNow一起发布了StarCoder2模型,代码生成、补全、调试样样精通。据介绍,系列模型包括一个ServiceNow训练...……更多
疯狂一夜!美国AMD、谷歌纷纷亮出大杀器,人类迎来巨变前夜?|钛媒体焦点
...迄今为止功能最强大、最通用的多模态人工智能(AI)大模型:Gemini(中文称“双子座”)。具体来看,谷歌最新发布的Gemini 1.0系列,主要是英语模型,共包括三个不同尺寸版本:Ultra(超大杯)、Pro(大杯)和Nano(中杯),将...……更多
AI芯片下半场:英伟达不再一家独大
...开发者大会上,推出两款定制芯片,以应对不断增加的大模型训练成本挑战,并试图降低提供AI服务的成本。微软表示,新发布的芯片不会出售,仅供支持自己的产品,并作为微软云Azure云计算服务的一部分。微软最新推出的两...……更多
英伟达推出史上最强AI芯片H200:推理性能提升90%,无缘中国市场
...最先进的H100的带宽和容量分别为3.35TB和80GB。这将提升大模型在推理方面的表现,并有助于提升高性能计算应用的计算能力。英伟达预计,H200将在明年二季度开始发货,谷歌、微软、甲骨文等科技巨头将会率先实现首批部署。但...……更多
影响英伟达根本逻辑的大争论:OpenAI改变策略意味着什么?谁在撒谎?
大模型预训练“缩放定律”定律失效?模型推理成“解药”,英伟达一家独大格局要变天?“缩放定律”指导下,AI大模型预训练目前遭遇瓶颈。据路透12日报道,硅谷主要AI实验室的新模型训练计划目前普遍进展不顺,新模型...……更多
AI春晚:黄仁勋称需要更强大的GPU,马斯克吹捧英伟达最适合AI
...介绍最新AI芯片GB200等产品外,黄仁勋还谈到了对于AI、大模型和机器人未来的一些展望。“算力需求”在演讲中,黄仁勋重申了自己在此前财报中提出的观点:“加速计算已经达到引爆点——通用计算已经到达瓶颈。”不到一个...……更多
更多关于科技的资讯:
余承东用华为平板画了一个福字:巧妙融入“2025”
快科技1月24日消息,今晚,华为余承东在微博晒出了一张别具一格的“福”字,引发了广泛关注。这张福字之所以特殊,不仅因为它出自余承东之手
2025-01-24 23:04:00
上汽集团:2024年少卖100万辆车 净利润减少近90%
快科技1月24日消息,上汽集团今晚发布发布了2024年度业绩预告。经财务部门初步测算,预计2024年度实现归属于母公司所有者的净利润为15亿元到19亿元
2025-01-24 23:04:00
《封神第二部:战火西岐》新剧照 西岐战火将至
近日《封神第二部:战火西岐》电影官方发布新剧照,殷商大军盘弓错马,准备一举攻下西岐城。面对敌人的迅猛攻击,百余年未经战火的西岐百姓要如何应对
2025-01-24 23:34:00
起亚发布2024年业绩报告:销售额首破100万亿韩元
快科技1月24日消息,日前,起亚汽车发布2024年业绩报告,报告显示核实2024年营业利润为12.6671万亿韩元(约合人民币641
2025-01-24 23:34:00
这是有史以来最大的淡水龟:龟壳长达3米 是人类两倍
地纹骇龟,这是发现的最大的淡水龟物种,它们已灭绝,生活在距今约1300万至500万年前。目前发现的最大龟壳化石差不多有3米长
2025-01-24 23:34:00
江苏:邮政小包裹拉动“指尖”大市场
本文转自:人民网-江苏频道“这些颜色和款式都是专门为过年定制的,拍下当天即可发货……”1月23日,江苏省东海县的一家穿戴甲公司内
2025-01-24 23:51:00
超1/4打工人0点后才睡觉 熬夜最大原因找到了
快科技1月24日消息,2024年打工人,加最长的班,熬最深的夜。智联招聘最新数据显示,高达26%的职场人不得不在深夜12点之后才能入睡
2025-01-25 00:04:00
试驾新款Model Y 它凭啥10天能订10万台
全球最畅销的电车,也是特斯拉今年最为重要的一款车—— Model Y ,卖了 5 年终于改款了。要说这车也真是不缺热度
2025-01-25 00:34:00
小米YU7 Max高清实车曝光 质感不输50万豪车
快科技1月25日消息,小米YU7无疑是今年最受瞩目的一款车,它不仅是小米首款SUV,也将是纯电SUV神车——特斯拉Model Y的最大对手
2025-01-25 00:34:00
本文转自:人民日报《人民日报》(2025年01月25日第 06 版)据新华社电 美国华盛顿大学、丹麦技术大学等参与的研究团队日前在英国《自然》杂志上报告说
2025-01-25 05:45:00
“隐形”的暗物质  如何被“看见”(瞰前沿)
本文转自:人民日报李  然《人民日报》(2025年01月25日第 06 版)图①:“悟空”卫星在轨示意图。“悟空”卫星为暗物质直接和间接探测提供了大量线索
2025-01-25 05:48:00
海外文案将春节写成Lunar New Year!网红奶茶霸王茶姬深夜紧急道歉
快科技1月25日消息,日前,许多网友在社交平台发帖,称霸王茶姬在海外社交平台的宣传文案中,将春节翻译为“Lunar New Year”
2025-01-25 07:04:00
看了一眼手机:车子直接报废
快科技1月25日消息,开车上路,需心无旁骛,否则很容易酿成事故,严重情况下甚至车毁人亡。据“公安部交通管理局”最新披露的案例显示
2025-01-25 07:34:00
最高补贴2000元!一图看懂2025红魔国补领取指南
1月20日起,全国各地开始陆续实施手机等数码产品购新补贴。手机、平板、智能手表/手环类,单件价格低于6000元的,给予15%补贴
2025-01-25 07:34:00
美动保团体申请为5头大象提供人身保护 法院驳回:它们不是人
1月24日消息,此前美国动物保护团体为一家动物园的5头大象申请“人身保护令”,要求动物园将其“释放”,近日法院就此事做出裁定
2025-01-24 17:34:00