• 我的订阅
  • 头条热搜
谷歌发布gemma2大语言模型,共有两种大小
...布新闻稿,面向全球研究人员和开发人员发布Gemma2大语言模型,共有90亿参数(9B)和270亿参数(27B)两种大小。Gemma2大语言模型相比较第一代,推理性能更高、效率更高,并在安全性方面取得了重大进步。谷歌在新闻稿中表示...……更多
微软、英伟达纷纷押注小模型,大模型不香了?
...发展的道路上,科技巨头们曾经竞相开发规模庞大的语言模型,但如今出现了一种新趋势:小型语言模型(SLM)正逐渐崭露头角,挑战着过去“越大越好”的观念。视觉中国当地时间8月21日,微软和英伟达相继发布了最新的小型...……更多
PyTorch官宣:告别CUDA,GPU推理迎来Triton加速新时代
...0%的Triton内核Pytorch最近发表了一篇技术博客,他们以两个模型——Llama3-8B和IBM的Granite-8B Code为例,100%使用Triton内核实现了FP16推理。Granite-8B Code是由IBM开发的一种仅限解码器的代码模型,专为代码生成任务设计。仓库地址:……更多
英伟达地表最强,黄教主被称作AI界“霉霉”
...多款重磅明星产品,目前市面上能叫得上名字得人工智能模型几乎都是在该架构上进行训练,行业内“一芯难求”的局面迟迟得不到缓解。而今年,按照英伟达每两年更新一次GPU架构的节奏,大家都对英伟达新一代计算平台翘首...……更多
晶圆级AI芯片WSE-3性能公布:80亿参数模型上每秒生成1800个Token
...上一代WSE-2的两倍,可用于训练业内一些最大的人工智能模型。在近日的Hot Chips 2024大会上,Cerebras Systems详细介绍了这款芯片在AI推理方面的性能。根据官方资料显示,WSE-3依然是采用了一整张12英寸晶圆来制作,基于台积电5nm制...……更多
碾压所有对手?谷歌发布轻量化开源大模型,笔记本电脑就可跑
开源大模型赛道迎来重磅新品。当地时间2月21日,谷歌宣布正式推出全新的开源大语言模型(LLM)“Gemma”, 旨在帮助开发人员和研究人员负责任地构建人工智能。据介绍,Gemma大模型与谷歌规模最大、能力最强的人工智能模型...……更多
前谷歌工程师创业造AI芯片!产品明年问世,已拿到1.8亿融资
...MatX正在挑战英伟达在AI芯片领域的霸主地位,其为大语言模型训练而设计的AI芯片将于明年问世。这家公司的官网显示,使用MatX芯片,训练70B大模型的延迟将小于10ms/token。该公司还预言,使用其芯片训练,能够让世界上最好的...……更多
苹果开源7B模型,训练过程数据集一口气全给了,网友:很不像苹果
苹果最新杀入开源大模型战场,而且比其他公司更开放。推出7B模型,不仅效果与Llama 3 8B相当,而且一次性开源了全部训练过程和资源。要知道,不久前Nature杂志编辑Elizabeth Gibney还撰文批评:许多声称开源的AI模型,实际上在...……更多
英伟达发布mistral-nemoai大语言模型
...国初创公司MistralAI,今天发布了全新的Mistral-NeMoAI大语言模型,拥有120亿个参数,上下文窗口(AI模型一次能够处理的最大Token数量)为12.8万个token。VentureBeat与Midjourney合作制作Mistral-NeMoAI大模型主要面向企业环境,让企……更多
英伟达开源NVLM 1.0屠榜多模态!纯文本性能不降反升
【新智元导读】NVLM 1.0系列多模态大型语言模型在视觉语言任务上达到了与GPT-4o和其他开源模型相媲美的水平,其在纯文本性能甚至超过了LLM骨干模型,特别是在文本数学和编码基准测试中,平均准确率提高了4.3个百分点。文本...……更多
加速AI落地企业!微软解读Copilot技术栈,云端混合大小模型是关键
...试用推广、团队扩张。 一、Copilot平台推出Agent能力,小模型满足端侧需求在Scaling Laws下,AI技术的能力大约每六个月就会翻倍增长。陶然谈道,如何让技术成果对齐行业、企业的实际业务需求,加速技术能力的落地转化,成为...……更多
英伟达llama-3.1-minitron4bai模型发布
...,英伟达公司联合Meta公司发布了最新的Llama-3.1-Minitron4BAI模型,主要通过结构化权重剪枝、知识提炼等尖端技术,成功蒸馏(Distill)出40亿参数的“小而强”模型。图源:英伟达Llama-3.1-Minitron4B模型在Llama-3.1-Minitron8B基础上……更多
英伟达发布80亿参数的ai模型
...伟达(NVIDIA)宣布,其已成功研发并发布了一款全新的AI模型,该模型拥有高达80亿的参数规模,具备精度高、计算效率高等优点,可在GPU加速的数据中心、云和工作站上运行。据介绍,这款新发布的AI模型是基于英伟达在深度学...……更多
老黄祭出史上最强 AI 芯片B200!30倍性能提升,AI 迎来新摩尔定律时代|钛媒体AGI
...)Blackwell,是英伟达A100/H100系列AI GPU的继任者。在大语言模型推理工作负载方面,Blackwell的性能相比H100 GPU提升了30倍,能耗却降低了25倍。亚马逊、谷歌、微软和甲骨文将是首批合作伙伴。此外,黄仁勋还在GTC大会推出了新一款...……更多
支持1024帧、准确率近100%,英伟达「LongVILA」开始发力长视频
现在,长上下文视觉语言模型(VLM)有了新的全栈解决方案 ——LongVILA,它集系统、模型训练与数据集开发于一体。现阶段,将模型的多模态理解与长上下文能力相结合是非常重要的,支持更多模态的基础模型可以接受更灵活...……更多
AI“卖铲人”英伟达,为何业绩再爆发?
...智能在2023迎来爆发,生成式AI以ChatGPT为代表掀起全球大模型浪潮,全球各行业的算力需求激增。英伟达GPU作为主流AI训练解决方案使其成为最大受益者,实现量价双收。英伟达财报也揭示了未来发展战略的三大方向:一是以数据...……更多
英伟达深夜炸场,世界最强AI芯片H200震撼发布,性能飙升90%
...两款芯片还是互相兼容的。这意味着,使用H100训练/推理模型的企业,可以无缝更换成最新的H200。全世界的AI公司都陷入算力荒,英伟达的GPU已经千金难求。英伟达此前也表示,两年一发布的架构节奏将转变为一年一发布。 就...……更多
英伟达尖端图像处理半导体h200开始供货
...英伟达方面公布的性能评测结果,以Meta公司旗下大语言模型Llama2处理速度为例,H2000相比于H100,生成式AI导出答案的处理速度最高提高了45%。市场调研机构Omdia曾表示,2022年英伟达在AI半导体市场约占8成的份额,与此同时AMD等...……更多
微软难以摆脱英伟达 |焦点分析
...市场至少90%的份额。AI芯片是AI时代石油一般的存在。大模型公司想更快推出模型和AI应用,就必须大量购入英伟达的芯片。而英伟达的产能有限,按照上一年计划制定的供给,远不能满足蓬勃的市场需求,抢不到芯片的云厂商、...……更多
英特尔推出新款AI芯片:推理性能比英伟达H100快50%
...大飞跃。英特尔Gaudi 3预计可大幅缩短70亿和130亿参数Llama2模型,以及1750亿参数GPT-3模型的训练时间。英特尔表示,Gaudi 3能够比英伟达上一代H100处理器训练特定大型语言模型的速度快40%,在推理端比英伟达H100快50%。基辛格在现场...……更多
英伟达发布Llama-3.1-Nemotron-51B AI 模型
...伟达 9 月 23 日发布博文,宣布推出 Llama-3.1-Nemotron-51B AI 模型,源自 Meta 公司的 Llama-3.1-70B,不过创新使用神经架构搜索(NAS)方法,建立了一个高度准确和高效的模型。Llama-3.1-Nemotron-51B 简介Llama-3.1-……更多
开源大模型杀疯了!Mistral新模型三分之一参数卷爆Llama 3.1
Llama 3.1 405B“最强模型”宝座还没捂热乎,就被砸场子了——Mistral AI发布最新模型Mistral Large 2,参数123B,用不到三分之一的参数量性能比肩Llama 3.1 405B,也不逊于GPT-4o、Claude 3 Opus等闭源模型。主打的就是一个高性价比。用官……更多
程序员福音 英伟达推出AI编程新模型:代码生成、补全、调试样样精通!
程序员福音 英伟达推出AI编程新模型:代码生成、补全、调试样样精通!快科技2月29日消息,近日英伟达和Hugging Face、ServiceNow一起发布了StarCoder2模型,代码生成、补全、调试样样精通。据介绍,系列模型包括一个ServiceNow训练...……更多
疯狂一夜!美国AMD、谷歌纷纷亮出大杀器,人类迎来巨变前夜?|钛媒体焦点
...迄今为止功能最强大、最通用的多模态人工智能(AI)大模型:Gemini(中文称“双子座”)。具体来看,谷歌最新发布的Gemini 1.0系列,主要是英语模型,共包括三个不同尺寸版本:Ultra(超大杯)、Pro(大杯)和Nano(中杯),将...……更多
AI芯片下半场:英伟达不再一家独大
...开发者大会上,推出两款定制芯片,以应对不断增加的大模型训练成本挑战,并试图降低提供AI服务的成本。微软表示,新发布的芯片不会出售,仅供支持自己的产品,并作为微软云Azure云计算服务的一部分。微软最新推出的两...……更多
英伟达推出史上最强AI芯片H200:推理性能提升90%,无缘中国市场
...最先进的H100的带宽和容量分别为3.35TB和80GB。这将提升大模型在推理方面的表现,并有助于提升高性能计算应用的计算能力。英伟达预计,H200将在明年二季度开始发货,谷歌、微软、甲骨文等科技巨头将会率先实现首批部署。但...……更多
AI春晚:黄仁勋称需要更强大的GPU,马斯克吹捧英伟达最适合AI
...介绍最新AI芯片GB200等产品外,黄仁勋还谈到了对于AI、大模型和机器人未来的一些展望。“算力需求”在演讲中,黄仁勋重申了自己在此前财报中提出的观点:“加速计算已经达到引爆点——通用计算已经到达瓶颈。”不到一个...……更多
英伟达发布GB200计算卡:2080亿个晶体管,AI性能提升5倍
...算卡的算力还远远不够,尤其是像Sora这样的文生视频的模型出来,更是对计算卡的算力提出了更高的要求,于是英伟达也适时地推出了下一代GPU,在AI性能上有着突飞猛进的进步,可以说拉了竞争对手整整一代。英伟达在今天凌...……更多
英伟达blackwell计算引擎制造商推出的ai模型
...最新这代Blackwell计算引擎的出炉,面向生成式AI的大语言模型则进一步推动架构的发展,强调不断压缩更大规模AI训练与推理工作负载的处理成本。英伟达公司超大规模与HPC副总裁IanBuck在大会前的简报中解释道,“在过去的2023年...……更多
微调大模型,AMD MI300X就够了!跟着这篇博客微调Llama 3.1 405B
随着 AI 模型的参数量越来越大,对算力的需求也水涨船高。比如最近,Llama-3.1 登上了最强开源大模型的宝座,但超大杯 405B 版本的内存就高达 900 多 GB,这对算力构成了更加苛刻的挑战。如何降低算力的使用成本和使用门槛,...……更多
更多关于科技的资讯:
全球首款!努比亚Z70 Ultra实现全尺寸内嵌DeepSeek-R1
快科技2月13日消息,中兴努比亚今日官宣,率先实现全尺寸内嵌DeepSeek。其中,努比亚Z70 Ultra成为全球首款全尺寸内嵌DeepSeek-R1的机型
2025-02-13 21:21:00
“今年外贸开门红是AI带来的”,义乌商家接到千万美元大单
“2000万美元的订单拿下了,2025年开门红!”今年春节,欧佩克机械设备有限公司总经理徐镜钱在沙特首都利雅得,收到了开年的巨大惊喜
2025-02-13 22:14:00
男子图便宜给路虎换万元组装发动机 结果才开两千公里就坏了
快科技2月12日消息,据博主“检车家”透露,近期,他们接到一位路虎车主的委托,要求对车辆发动机损坏原因进行鉴定。据介绍
2025-02-13 22:21:00
小米SU7被困千米雪峰 汽车售后徒步+缆车前往救援
快科技2月13日消息,今年春节前,雷军曾向广大车主承诺,在春节期间如遇汽车故障,小米汽车将提供免费道路救援服务,并赠送500元打车券
2025-02-13 22:21:00
大疆两款新品官宣:一红一绿很神秘
快科技2月13日消息,大疆今晚正式宣布,本月将举办“双重奏”发布会,引发科技界与摄影爱好者的广泛关注。据悉,这场备受期待的发布会定于2月18日与20日两晚
2025-02-13 22:21:00
江南时报讯 自“千企万户大走访 服务实体展担当”2025年一季度劳动竞赛活动开展以来,灌云农商银行以实际行动诠释地方金融机构的责任与担当
2025-02-13 22:40:00
江南时报讯 为破解小微企业融资难、融资贵、融资慢的难题,紫金农商银行多措并举,通过创新金融产品,开展精准走访,落实减费让利
2025-02-13 22:42:00
网传威睿电机小作坊式生产 工人手工绕线!极氪法务部回应
快科技2月12日消息,今日晚间,极氪法务部发布《关于对恶意散布威睿电机相关不实信息行为的追责声明》。声明中称,近日,网络流传的威睿公司生产的电机采用所谓“手工定子绕线”及谣传的现场图片
2025-02-13 22:51:00
开孔机盖+纯碳尾翼!小米SU7 Ultra“银色子弹”曝光
快科技2月13日消息,继官方公布的标志性黄色版本后,今日有博主曝光了银色版的实车视频。从视频来看,银色版采用淡雅的银色涂装
2025-02-13 17:50:00
腾讯元宝重大更新!接入Deepseek-R1满血版:免费用
快科技2月13日消息,今天腾讯官方宣布,其AI助手“腾讯元宝”迎来重大更新,正式接入满血版Deepseek-R1模型,用户打开腾讯元宝并进入对话界面
2025-02-13 17:50:00
自然成熟蜜 上海老字号森蜂园蜂蜜便宜了 2斤仅14.9元
森蜂园蜂蜜1kg平时要卖300.9元,今日下单可领246元限时优惠券,叠加满减优惠,到手仅14.9元。产品规格:自然成熟蜜
2025-02-13 17:50:00
威联通推出4盘位超扁NAS:可装4个HDD+3个SSD
快科技2月13日消息,威联通科技近日推出新款1U短机箱机架式4盘位NAS——TS-h765eU。其机身深度较短,可放置于小型媒体柜或壁挂式网络柜
2025-02-13 17:50:00
iPhone 17 Pro Max将首发金属超构透镜:灵动岛会变小
快科技2月13日消息,博主数码闲聊站爆料,iPhone 17 Pro Max会落地金属超构透镜,主要是集成Face ID Rx和Tx
2025-02-13 17:50:00
中国攻克世界级难题:高寒高海拔水电站大坝 没有一丝裂缝
快科技2月13日消息,在金沙江上,叶巴滩水电站正在如火如荼地建设中,这是一座举世瞩目的特高拱坝工程,叶巴滩水电站大坝至今未出现任何裂缝
2025-02-13 17:50:00
蔡崇信回忆初见马云:听他讲了大概一个小时 也不完全理解
快科技2月13日消息,据媒体报道,今日下午,在阿联酋迪拜举办的World Governments Summit 2025峰会上
2025-02-13 17:50:00