• 我的订阅
  • 头条热搜
谷歌发布gemma2大语言模型,共有两种大小
...布新闻稿,面向全球研究人员和开发人员发布Gemma2大语言模型,共有90亿参数(9B)和270亿参数(27B)两种大小。Gemma2大语言模型相比较第一代,推理性能更高、效率更高,并在安全性方面取得了重大进步。谷歌在新闻稿中表示...……更多
微软、英伟达纷纷押注小模型,大模型不香了?
...发展的道路上,科技巨头们曾经竞相开发规模庞大的语言模型,但如今出现了一种新趋势:小型语言模型(SLM)正逐渐崭露头角,挑战着过去“越大越好”的观念。视觉中国当地时间8月21日,微软和英伟达相继发布了最新的小型...……更多
PyTorch官宣:告别CUDA,GPU推理迎来Triton加速新时代
...0%的Triton内核Pytorch最近发表了一篇技术博客,他们以两个模型——Llama3-8B和IBM的Granite-8B Code为例,100%使用Triton内核实现了FP16推理。Granite-8B Code是由IBM开发的一种仅限解码器的代码模型,专为代码生成任务设计。仓库地址:……更多
英伟达地表最强,黄教主被称作AI界“霉霉”
...多款重磅明星产品,目前市面上能叫得上名字得人工智能模型几乎都是在该架构上进行训练,行业内“一芯难求”的局面迟迟得不到缓解。而今年,按照英伟达每两年更新一次GPU架构的节奏,大家都对英伟达新一代计算平台翘首...……更多
晶圆级AI芯片WSE-3性能公布:80亿参数模型上每秒生成1800个Token
...上一代WSE-2的两倍,可用于训练业内一些最大的人工智能模型。在近日的Hot Chips 2024大会上,Cerebras Systems详细介绍了这款芯片在AI推理方面的性能。根据官方资料显示,WSE-3依然是采用了一整张12英寸晶圆来制作,基于台积电5nm制...……更多
碾压所有对手?谷歌发布轻量化开源大模型,笔记本电脑就可跑
开源大模型赛道迎来重磅新品。当地时间2月21日,谷歌宣布正式推出全新的开源大语言模型(LLM)“Gemma”, 旨在帮助开发人员和研究人员负责任地构建人工智能。据介绍,Gemma大模型与谷歌规模最大、能力最强的人工智能模型...……更多
多模态竞技场对标90B Llama 3.2!Pixtral 12B技术报告全公开
...杀入江湖的Mistral AI,在9月份甩出了自家的首款多模态大模型Pixtral 12B,如今,报告之期已至,技术细节全公开。作为欧洲的OpenAI,Mistral最近压力不小。端侧小模型端不出来,对比评测的结果又遭到质疑。上个月震撼登场的自家...……更多
前谷歌工程师创业造AI芯片!产品明年问世,已拿到1.8亿融资
...MatX正在挑战英伟达在AI芯片领域的霸主地位,其为大语言模型训练而设计的AI芯片将于明年问世。这家公司的官网显示,使用MatX芯片,训练70B大模型的延迟将小于10ms/token。该公司还预言,使用其芯片训练,能够让世界上最好的...……更多
苹果开源7B模型,训练过程数据集一口气全给了,网友:很不像苹果
苹果最新杀入开源大模型战场,而且比其他公司更开放。推出7B模型,不仅效果与Llama 3 8B相当,而且一次性开源了全部训练过程和资源。要知道,不久前Nature杂志编辑Elizabeth Gibney还撰文批评:许多声称开源的AI模型,实际上在...……更多
英伟达发布mistral-nemoai大语言模型
...国初创公司MistralAI,今天发布了全新的Mistral-NeMoAI大语言模型,拥有120亿个参数,上下文窗口(AI模型一次能够处理的最大Token数量)为12.8万个token。VentureBeat与Midjourney合作制作Mistral-NeMoAI大模型主要面向企业环境,让企……更多
英伟达开源NVLM 1.0屠榜多模态!纯文本性能不降反升
【新智元导读】NVLM 1.0系列多模态大型语言模型在视觉语言任务上达到了与GPT-4o和其他开源模型相媲美的水平,其在纯文本性能甚至超过了LLM骨干模型,特别是在文本数学和编码基准测试中,平均准确率提高了4.3个百分点。文本...……更多
加速AI落地企业!微软解读Copilot技术栈,云端混合大小模型是关键
...试用推广、团队扩张。 一、Copilot平台推出Agent能力,小模型满足端侧需求在Scaling Laws下,AI技术的能力大约每六个月就会翻倍增长。陶然谈道,如何让技术成果对齐行业、企业的实际业务需求,加速技术能力的落地转化,成为...……更多
4090笔记本0.37秒直出大片!英伟达联手MIT清华祭出Sana架构,性能秒杀FLUX
...合成高分辨率、高质量,且具有强文本-图像对其能力的模型。而且,它还能高效生成高达4096×4096像素的图像。项目主页:https://nvlabs.github.io/Sana/论文地址:https://arxiv.org/abs/2410.10629Sana的核心设计包含了以下几个要素:深……更多
英伟达llama-3.1-minitron4bai模型发布
...,英伟达公司联合Meta公司发布了最新的Llama-3.1-Minitron4BAI模型,主要通过结构化权重剪枝、知识提炼等尖端技术,成功蒸馏(Distill)出40亿参数的“小而强”模型。图源:英伟达Llama-3.1-Minitron4B模型在Llama-3.1-Minitron8B基础上……更多
英伟达发布80亿参数的ai模型
...伟达(NVIDIA)宣布,其已成功研发并发布了一款全新的AI模型,该模型拥有高达80亿的参数规模,具备精度高、计算效率高等优点,可在GPU加速的数据中心、云和工作站上运行。据介绍,这款新发布的AI模型是基于英伟达在深度学...……更多
老黄祭出史上最强 AI 芯片B200!30倍性能提升,AI 迎来新摩尔定律时代|钛媒体AGI
...)Blackwell,是英伟达A100/H100系列AI GPU的继任者。在大语言模型推理工作负载方面,Blackwell的性能相比H100 GPU提升了30倍,能耗却降低了25倍。亚马逊、谷歌、微软和甲骨文将是首批合作伙伴。此外,黄仁勋还在GTC大会推出了新一款...……更多
支持1024帧、准确率近100%,英伟达「LongVILA」开始发力长视频
现在,长上下文视觉语言模型(VLM)有了新的全栈解决方案 ——LongVILA,它集系统、模型训练与数据集开发于一体。现阶段,将模型的多模态理解与长上下文能力相结合是非常重要的,支持更多模态的基础模型可以接受更灵活...……更多
英伟达深夜炸场,世界最强AI芯片H200震撼发布,性能飙升90%
...两款芯片还是互相兼容的。这意味着,使用H100训练/推理模型的企业,可以无缝更换成最新的H200。全世界的AI公司都陷入算力荒,英伟达的GPU已经千金难求。英伟达此前也表示,两年一发布的架构节奏将转变为一年一发布。 就...……更多
AI“卖铲人”英伟达,为何业绩再爆发?
...智能在2023迎来爆发,生成式AI以ChatGPT为代表掀起全球大模型浪潮,全球各行业的算力需求激增。英伟达GPU作为主流AI训练解决方案使其成为最大受益者,实现量价双收。英伟达财报也揭示了未来发展战略的三大方向:一是以数据...……更多
英伟达尖端图像处理半导体h200开始供货
...英伟达方面公布的性能评测结果,以Meta公司旗下大语言模型Llama2处理速度为例,H2000相比于H100,生成式AI导出答案的处理速度最高提高了45%。市场调研机构Omdia曾表示,2022年英伟达在AI半导体市场约占8成的份额,与此同时AMD等...……更多
微软难以摆脱英伟达 |焦点分析
...市场至少90%的份额。AI芯片是AI时代石油一般的存在。大模型公司想更快推出模型和AI应用,就必须大量购入英伟达的芯片。而英伟达的产能有限,按照上一年计划制定的供给,远不能满足蓬勃的市场需求,抢不到芯片的云厂商、...……更多
英特尔推出新款AI芯片:推理性能比英伟达H100快50%
...大飞跃。英特尔Gaudi 3预计可大幅缩短70亿和130亿参数Llama2模型,以及1750亿参数GPT-3模型的训练时间。英特尔表示,Gaudi 3能够比英伟达上一代H100处理器训练特定大型语言模型的速度快40%,在推理端比英伟达H100快50%。基辛格在现场...……更多
英伟达发布Llama-3.1-Nemotron-51B AI 模型
...伟达 9 月 23 日发布博文,宣布推出 Llama-3.1-Nemotron-51B AI 模型,源自 Meta 公司的 Llama-3.1-70B,不过创新使用神经架构搜索(NAS)方法,建立了一个高度准确和高效的模型。Llama-3.1-Nemotron-51B 简介Llama-3.1-……更多
开源大模型杀疯了!Mistral新模型三分之一参数卷爆Llama 3.1
Llama 3.1 405B“最强模型”宝座还没捂热乎,就被砸场子了——Mistral AI发布最新模型Mistral Large 2,参数123B,用不到三分之一的参数量性能比肩Llama 3.1 405B,也不逊于GPT-4o、Claude 3 Opus等闭源模型。主打的就是一个高性价比。用官……更多
程序员福音 英伟达推出AI编程新模型:代码生成、补全、调试样样精通!
程序员福音 英伟达推出AI编程新模型:代码生成、补全、调试样样精通!快科技2月29日消息,近日英伟达和Hugging Face、ServiceNow一起发布了StarCoder2模型,代码生成、补全、调试样样精通。据介绍,系列模型包括一个ServiceNow训练...……更多
疯狂一夜!美国AMD、谷歌纷纷亮出大杀器,人类迎来巨变前夜?|钛媒体焦点
...迄今为止功能最强大、最通用的多模态人工智能(AI)大模型:Gemini(中文称“双子座”)。具体来看,谷歌最新发布的Gemini 1.0系列,主要是英语模型,共包括三个不同尺寸版本:Ultra(超大杯)、Pro(大杯)和Nano(中杯),将...……更多
AI芯片下半场:英伟达不再一家独大
...开发者大会上,推出两款定制芯片,以应对不断增加的大模型训练成本挑战,并试图降低提供AI服务的成本。微软表示,新发布的芯片不会出售,仅供支持自己的产品,并作为微软云Azure云计算服务的一部分。微软最新推出的两...……更多
英伟达推出史上最强AI芯片H200:推理性能提升90%,无缘中国市场
...最先进的H100的带宽和容量分别为3.35TB和80GB。这将提升大模型在推理方面的表现,并有助于提升高性能计算应用的计算能力。英伟达预计,H200将在明年二季度开始发货,谷歌、微软、甲骨文等科技巨头将会率先实现首批部署。但...……更多
影响英伟达根本逻辑的大争论:OpenAI改变策略意味着什么?谁在撒谎?
大模型预训练“缩放定律”定律失效?模型推理成“解药”,英伟达一家独大格局要变天?“缩放定律”指导下,AI大模型预训练目前遭遇瓶颈。据路透12日报道,硅谷主要AI实验室的新模型训练计划目前普遍进展不顺,新模型...……更多
AI春晚:黄仁勋称需要更强大的GPU,马斯克吹捧英伟达最适合AI
...介绍最新AI芯片GB200等产品外,黄仁勋还谈到了对于AI、大模型和机器人未来的一些展望。“算力需求”在演讲中,黄仁勋重申了自己在此前财报中提出的观点:“加速计算已经达到引爆点——通用计算已经到达瓶颈。”不到一个...……更多
更多关于科技的资讯:
《哪吒2》票房破146亿!冲击全球第6 距《复联3》一步之遥
快科技3月6日消息,今日,据网络平台数据显示,动画电影《哪吒之魔童闹海》(以下简称《哪吒2》)总票房(包含港澳台及海外票房)突破146亿元
2025-03-06 19:43:00
智界R7车主称开智驾出严重事故:事发原因公布看呆网友
快科技3月6日消息,近日有小红书用户,同时也是智界R7车主发帖称,自己新提的车才1个月,结果在高速路上出事故导致车辆被撞报废
2025-03-06 19:43:00
顺鑫农业牛栏山持续引领行业品牌创新,让中国白酒融入烟火气
2024年度,中国白酒行业风云变幻、竞争激烈,而顺鑫农业旗下的牛栏山酒厂在这一年中的表现则可圈可点。牛栏山酒厂在其2024年度厂务公开暨总结表彰大会上
2025-03-06 20:13:00
雷军:小米汽车已交付超18万辆 还有15万台在排队
快科技3月6日消息,据报道,全国人大代表、小米集团董事长雷军在大会上表示:去年我在全国人代会上表态,一定会把小米汽车干好
2025-03-06 20:13:00
12万的“青春版奥迪” 奇瑞艾瑞泽8 PRO值得买吗
在12万级家用轿车市场,消费者常常面临“选国产还是合资”“要配置还是品牌”的纠结。如今,随着奇瑞艾瑞泽8 PRO的预售开启(起售价11
2025-03-06 20:13:00
五菱汽车发布正面盈利预告:净利润1.04亿同比增长约50%
快科技3月6日消息,五菱汽车在港交所发布正面盈利预告,预计截至2024年12月31日止年度将录得净利润约1.04亿元人民币
2025-03-06 20:13:00
刷新岛城春天的N种打开方式!上抖音,焕新青岛春日生活
摘要:相约青岛“过春天”,上抖音,焕新春日生活!春回大地,万象更新。褪去厚重的衣物,换上轻盈的春装,和三五好友围坐小马扎
2025-03-06 20:25:00
东科克诺尔:做好节能降耗 “加减法” 打造绿色工厂
十堰广电讯(全媒体记者 吕行 李昀翔)企业践行绿色发展,节能降耗是关键。东科克诺尔商用车制动有限公司通过调整生产工艺、科技化手段利用等方式
2025-03-06 20:28:00
护眼台灯哪个牌子好?掌握这三个挑选诀窍,远离智商税!
每当孩子写作业、看书的时候,我们总会担忧不良光线伤害孩子的眼睛。可想要挑个合适的护眼台灯,简直比解数学难题还让人头疼!市面上五花八门的牌子
2025-03-06 20:30:00
3月6日阳曲县消息,健康阳曲平台通过接入DeepSeek大语言模型,全面升级县域慢病AI辅诊能力,阳曲县在智慧医疗领域迈入全新阶段
2025-03-06 20:32:00
Manus创始人是中国90后:毕业于华中科技大学
快科技3月6日消息,继DeepSeek之后,科技圈又迎来一款全新的通用型AI Agent产品Manus,它由中国团队打造
2025-03-06 20:43:00
“英伟达小弟”上市风波不断:创始人巨额套现遭质疑 大客户被传撤单
随着本周被称为“英伟达小弟”的美国云计算平台CoreWeave递交上市招股书,这份充满“金融交易智慧”的文件令吃瓜群众大开眼界
2025-03-06 21:13:00
聚焦9大领域打造60+应用新场景 重庆发布人工智能赋能超大城市现代化治理三年行动计划
3月6日,上游新闻记者从重庆市城市治理委员会办公室获悉,为深入推进国家“人工智能+”战略部署,创新探索人工智能赋能超大城市现代化治理新路径
2025-03-06 21:14:00
车位到车位全程自主通行!广汽NDA4.0高阶智驾官宣:首搭昊铂HL
快科技3月6日消息,广汽昊铂宣布其NDA 4.0城市领航高阶智驾系统将率先应用于中大型SUV昊铂HL,该车型将于3月18日启动预售
2025-03-06 21:43:00
人民日报下场降温:DeepSeek最大的价值是被超越!
快科技3月6日消息,DeepSeek自春节前成为国内“顶流”之后,犹如一声惊雷劈开垄断,跻身世界最强大模型行列,开启中国人工智能崭新的春天
2025-03-06 17:13:00