• 我的订阅
  • 头条热搜
谷歌发布gemma2大语言模型,共有两种大小
...布新闻稿,面向全球研究人员和开发人员发布Gemma2大语言模型,共有90亿参数(9B)和270亿参数(27B)两种大小。Gemma2大语言模型相比较第一代,推理性能更高、效率更高,并在安全性方面取得了重大进步。谷歌在新闻稿中表示...……更多
微软、英伟达纷纷押注小模型,大模型不香了?
...发展的道路上,科技巨头们曾经竞相开发规模庞大的语言模型,但如今出现了一种新趋势:小型语言模型(SLM)正逐渐崭露头角,挑战着过去“越大越好”的观念。视觉中国当地时间8月21日,微软和英伟达相继发布了最新的小型...……更多
PyTorch官宣:告别CUDA,GPU推理迎来Triton加速新时代
...0%的Triton内核Pytorch最近发表了一篇技术博客,他们以两个模型——Llama3-8B和IBM的Granite-8B Code为例,100%使用Triton内核实现了FP16推理。Granite-8B Code是由IBM开发的一种仅限解码器的代码模型,专为代码生成任务设计。仓库地址:……更多
英伟达地表最强,黄教主被称作AI界“霉霉”
...多款重磅明星产品,目前市面上能叫得上名字得人工智能模型几乎都是在该架构上进行训练,行业内“一芯难求”的局面迟迟得不到缓解。而今年,按照英伟达每两年更新一次GPU架构的节奏,大家都对英伟达新一代计算平台翘首...……更多
晶圆级AI芯片WSE-3性能公布:80亿参数模型上每秒生成1800个Token
...上一代WSE-2的两倍,可用于训练业内一些最大的人工智能模型。在近日的Hot Chips 2024大会上,Cerebras Systems详细介绍了这款芯片在AI推理方面的性能。根据官方资料显示,WSE-3依然是采用了一整张12英寸晶圆来制作,基于台积电5nm制...……更多
碾压所有对手?谷歌发布轻量化开源大模型,笔记本电脑就可跑
开源大模型赛道迎来重磅新品。当地时间2月21日,谷歌宣布正式推出全新的开源大语言模型(LLM)“Gemma”, 旨在帮助开发人员和研究人员负责任地构建人工智能。据介绍,Gemma大模型与谷歌规模最大、能力最强的人工智能模型...……更多
英伟达新版旗舰AI芯片售价炒到4万美金 “算力垄断”难被打破
GPT等大型语言模型带动的芯片需求飙升趋势依然没有平息的迹象。英伟达的最新版旗舰AI芯片H100近日在网上的售价已经被炒到4万多美金,反映了科技行业对训练和部署人工智能软件的需求仍未被满足。受AI芯片需求的提振,英...……更多
前谷歌工程师创业造AI芯片!产品明年问世,已拿到1.8亿融资
...MatX正在挑战英伟达在AI芯片领域的霸主地位,其为大语言模型训练而设计的AI芯片将于明年问世。这家公司的官网显示,使用MatX芯片,训练70B大模型的延迟将小于10ms/token。该公司还预言,使用其芯片训练,能够让世界上最好的...……更多
苹果开源7B模型,训练过程数据集一口气全给了,网友:很不像苹果
苹果最新杀入开源大模型战场,而且比其他公司更开放。推出7B模型,不仅效果与Llama 3 8B相当,而且一次性开源了全部训练过程和资源。要知道,不久前Nature杂志编辑Elizabeth Gibney还撰文批评:许多声称开源的AI模型,实际上在...……更多
英伟达发布mistral-nemoai大语言模型
...国初创公司MistralAI,今天发布了全新的Mistral-NeMoAI大语言模型,拥有120亿个参数,上下文窗口(AI模型一次能够处理的最大Token数量)为12.8万个token。VentureBeat与Midjourney合作制作Mistral-NeMoAI大模型主要面向企业环境,让企……更多
加速AI落地企业!微软解读Copilot技术栈,云端混合大小模型是关键
...试用推广、团队扩张。 一、Copilot平台推出Agent能力,小模型满足端侧需求在Scaling Laws下,AI技术的能力大约每六个月就会翻倍增长。陶然谈道,如何让技术成果对齐行业、企业的实际业务需求,加速技术能力的落地转化,成为...……更多
烧数亿美元、耗上万颗英伟达 GPU,微软揭秘构建 ChatGPT 背后超级计算机往事 !
整理 | 苏宓出品 | CSDN(ID:CSDNnews)都说 ChatGPT 这种大模型研发是大公司之间的博弈,不仅仅是因为其要消耗的算力巨大,也是因为需要有强大的资金支撑。那么,加入这场战局,究竟要花费多少钱?此前,据 Techcrunch 报道,有...……更多
英伟达llama-3.1-minitron4bai模型发布
...,英伟达公司联合Meta公司发布了最新的Llama-3.1-Minitron4BAI模型,主要通过结构化权重剪枝、知识提炼等尖端技术,成功蒸馏(Distill)出40亿参数的“小而强”模型。图源:英伟达Llama-3.1-Minitron4B模型在Llama-3.1-Minitron8B基础上……更多
英伟达发布80亿参数的ai模型
...伟达(NVIDIA)宣布,其已成功研发并发布了一款全新的AI模型,该模型拥有高达80亿的参数规模,具备精度高、计算效率高等优点,可在GPU加速的数据中心、云和工作站上运行。据介绍,这款新发布的AI模型是基于英伟达在深度学...……更多
老黄祭出史上最强 AI 芯片B200!30倍性能提升,AI 迎来新摩尔定律时代|钛媒体AGI
...)Blackwell,是英伟达A100/H100系列AI GPU的继任者。在大语言模型推理工作负载方面,Blackwell的性能相比H100 GPU提升了30倍,能耗却降低了25倍。亚马逊、谷歌、微软和甲骨文将是首批合作伙伴。此外,黄仁勋还在GTC大会推出了新一款...……更多
GPU受限,国内AI大模型能否交出自己的答卷?
这个4月,成为国产大模型混战期。继百度之后,阿里、华为、京东、360等大模型也陆续浮出水面,大模型军备竞赛正式开启。4月7日,阿里云宣布自研大模型“通义千问”开始邀请企业用户测试体验。4月8日,华为云人工智能领...……更多
支持1024帧、准确率近100%,英伟达「LongVILA」开始发力长视频
现在,长上下文视觉语言模型(VLM)有了新的全栈解决方案 ——LongVILA,它集系统、模型训练与数据集开发于一体。现阶段,将模型的多模态理解与长上下文能力相结合是非常重要的,支持更多模态的基础模型可以接受更灵活...……更多
微软拟推出人工智能芯片,训练大模型语言
...出人工智能芯片,为负责理解和生成类人语言的大型语言模型(LLM)提供动力。报道称,了解相关项目的人士透露,微软自2019年开始开发内部代号为“雅典娜”(Athena)的芯片。并已向一小部分微软与OpenAI员工提供这款芯片,...……更多
AI“卖铲人”英伟达,为何业绩再爆发?
...智能在2023迎来爆发,生成式AI以ChatGPT为代表掀起全球大模型浪潮,全球各行业的算力需求激增。英伟达GPU作为主流AI训练解决方案使其成为最大受益者,实现量价双收。英伟达财报也揭示了未来发展战略的三大方向:一是以数据...……更多
英伟达深夜炸场,世界最强AI芯片H200震撼发布,性能飙升90%
...两款芯片还是互相兼容的。这意味着,使用H100训练/推理模型的企业,可以无缝更换成最新的H200。全世界的AI公司都陷入算力荒,英伟达的GPU已经千金难求。英伟达此前也表示,两年一发布的架构节奏将转变为一年一发布。 就...……更多
英伟达尖端图像处理半导体h200开始供货
...英伟达方面公布的性能评测结果,以Meta公司旗下大语言模型Llama2处理速度为例,H2000相比于H100,生成式AI导出答案的处理速度最高提高了45%。市场调研机构Omdia曾表示,2022年英伟达在AI半导体市场约占8成的份额,与此同时AMD等...……更多
微软难以摆脱英伟达 |焦点分析
...市场至少90%的份额。AI芯片是AI时代石油一般的存在。大模型公司想更快推出模型和AI应用,就必须大量购入英伟达的芯片。而英伟达的产能有限,按照上一年计划制定的供给,远不能满足蓬勃的市场需求,抢不到芯片的云厂商、...……更多
英特尔推出新款AI芯片:推理性能比英伟达H100快50%
...大飞跃。英特尔Gaudi 3预计可大幅缩短70亿和130亿参数Llama2模型,以及1750亿参数GPT-3模型的训练时间。英特尔表示,Gaudi 3能够比英伟达上一代H100处理器训练特定大型语言模型的速度快40%,在推理端比英伟达H100快50%。基辛格在现场...……更多
Meta首次公布AI芯片细节 功耗低于英伟达
...)计划的一部分,主要用于提升广告投放和其他内容推荐模型的效率。据Meta介绍,首个MTIA芯片将专注于AI推理。Meta软件工程师Joel Coburn表示,Meta最初考虑将GPU用于推理任务,但后来发现GPU并不不太适合推理工作。“GPU在真实模...……更多
程序员福音 英伟达推出AI编程新模型:代码生成、补全、调试样样精通!
程序员福音 英伟达推出AI编程新模型:代码生成、补全、调试样样精通!快科技2月29日消息,近日英伟达和Hugging Face、ServiceNow一起发布了StarCoder2模型,代码生成、补全、调试样样精通。据介绍,系列模型包括一个ServiceNow训练...……更多
开源大模型杀疯了!Mistral新模型三分之一参数卷爆Llama 3.1
Llama 3.1 405B“最强模型”宝座还没捂热乎,就被砸场子了——Mistral AI发布最新模型Mistral Large 2,参数123B,用不到三分之一的参数量性能比肩Llama 3.1 405B,也不逊于GPT-4o、Claude 3 Opus等闭源模型。主打的就是一个高性价比。用官……更多
疯狂一夜!美国AMD、谷歌纷纷亮出大杀器,人类迎来巨变前夜?|钛媒体焦点
...迄今为止功能最强大、最通用的多模态人工智能(AI)大模型:Gemini(中文称“双子座”)。具体来看,谷歌最新发布的Gemini 1.0系列,主要是英语模型,共包括三个不同尺寸版本:Ultra(超大杯)、Pro(大杯)和Nano(中杯),将...……更多
AI芯片下半场:英伟达不再一家独大
...开发者大会上,推出两款定制芯片,以应对不断增加的大模型训练成本挑战,并试图降低提供AI服务的成本。微软表示,新发布的芯片不会出售,仅供支持自己的产品,并作为微软云Azure云计算服务的一部分。微软最新推出的两...……更多
英伟达推出史上最强AI芯片H200:推理性能提升90%,无缘中国市场
...最先进的H100的带宽和容量分别为3.35TB和80GB。这将提升大模型在推理方面的表现,并有助于提升高性能计算应用的计算能力。英伟达预计,H200将在明年二季度开始发货,谷歌、微软、甲骨文等科技巨头将会率先实现首批部署。但...……更多
AI春晚:黄仁勋称需要更强大的GPU,马斯克吹捧英伟达最适合AI
...介绍最新AI芯片GB200等产品外,黄仁勋还谈到了对于AI、大模型和机器人未来的一些展望。“算力需求”在演讲中,黄仁勋重申了自己在此前财报中提出的观点:“加速计算已经达到引爆点——通用计算已经到达瓶颈。”不到一个...……更多
更多关于科技的资讯:
科学认识皮肤光损伤问题,业内首份白皮书来了!
众所周知,晒黑、晒伤、光老化、光加剧性皮肤病、光致癌,是目前皮肤光损伤的主要表现。从需求端来看,消费者不仅要光防护,还要重视光损修护
2024-09-23 19:40:00
《黑神话:悟空》官方首度公开回应DLC、电影计划!一个确定、一个神秘
快科技9月23日消息,《黑神话:悟空》现已发售一个多月,众多玩家已经完成了游戏,满怀期待游戏科学能够放出《黑神话:悟空》DLC或其他方面的消息
2024-09-23 19:57:00
首发89元 荣耀亲选JOWAY 22.5W移动电源预售:USB-C双向快充
快科技9月23日消息,荣耀亲选JOWAY 22.5W移动电源今日正式开启预售,首发89元。据悉,新款移动电源兼容SCP
2024-09-23 19:57:00
“邪门”的彼岸花!竟专挑台风期开放:很多人见过却不知道
最近,接二连三的台风经过魔都,雨哗哗下个不停,给很多人的出行带来了极大的不便……正在漏水的窗户 而初秋上海,你虽被风+雨淋个透湿
2024-09-23 19:57:00
999元 ROG魔导士ACE HFX磁轴键盘上市:68键布局、双USB-C接口
快科技9月23日消息,ROG魔导士ACE HFX磁轴键盘目前已经上市开售,首发999元。据悉,新款键盘采用紧凑的68键布局
2024-09-23 19:57:00
微软开始筹划庆祝其Xbox品牌的一个重要里程碑
9月22日消息,微软已经开始筹划庆祝其Xbox品牌的一个重要里程碑——Xbox25周年。在接受《LicenseGlobal》杂志采访时
2024-09-23 20:02:00
洁碧(Waterpik)冲牙器,开启口腔护理新辉煌
在当今快节奏的生活中,人们对健康的追求愈发强烈,而口腔健康作为整体健康的关键一环,更是备受瞩目。洁碧,这个冲牙器领域的传奇品牌
2024-09-23 20:18:00
“互联网+智慧城市甄选平台”为本地生活带来新变革
在互联网的浪潮中,有这样一位领航者,他以深厚的行业积淀和敏锐的洞察力,为本地生活领域带来了一场前所未有的变革——赵崇鹏先生
2024-09-23 20:22:00
9月23日下午,稳健医疗用品股份有限公司(以下简称“稳健医疗”)发布公告称,以现金形式收购Global Resources International
2024-09-23 20:23:00
直播电商时代 亿级主播蛋蛋再次引领消费升级 带货总销售额14.42亿元
近日,快手主播杨润心(蛋蛋)宣布粉丝破亿,成为全网唯一一位粉丝破亿的直播带货女主播。9月21日,蛋蛋以一场史无前例的“破亿之战”刷新了大众对行业的期待
2024-09-23 20:24:00
安卓性能小钢炮!联想拯救者Y700搭载乾坤散热架构:VC面积比手机屏幕还大
快科技9月23日消息,全新的联想拯救者Y700已经预热许久,今天官方公布了散热规格。新一代搭载乾坤散热架构,拥有10004mm²超大VC
2024-09-23 20:27:00
热湃气凝胶纤维斩获“省长杯”铜奖,加速发展新质生产力
9月20日,山东省第五届“省长杯”工业设计大赛颁奖仪式在2024世界工业设计大会开幕式活动现场隆重举行。山东稀有科技发展有限公司(稀有高科)创新研发的“热湃®气凝胶蓄热抑菌纤维/纱线”经过历时4个月初赛
2024-09-23 20:29:00
第一届智能制造技术与产业创新发展大会在京举办
本文转自:人民网人民网北京9月23日电 (记者夏晓伦)9月22日,北京机械工业自动化研究所有限公司(以下简称“北自所”)召开第一届智能制造技术与产业创新发展大会
2024-09-23 20:34:00
五菱新能源概念车南宁发布,量产版本有望在海外市场销售
9月23日消息,上汽通用五菱即将于9月24日在广西南宁发布其首款全球概念车。 同时,发布会还将展示上汽通用五菱的东盟战略
2024-09-23 20:51:00
redminote14pro系列手机将于9月26日发布
9月23日消息,今日,红米官方正式宣布了RedmiNote14系列手机将于9月26日19:00发布。其中RedmiNote14Pro系列支持IP66+IP68+IP69
2024-09-23 20:54:00