• 我的订阅
  • 头条热搜
GPU训Llama 3.1疯狂崩溃,竟有大厂用CPU服务器跑千亿参数大模型?
【新智元导读】是时候用CPU通用服务器跑千亿参数大模型了!马斯克19天建成由10万块H100串联的世界最大超算,已全力投入Grok 3的训练中。与此同时,外媒爆料称,OpenAI和微软联手打造的下一个超算集群,将由10万块GB200组成。...……更多
AI大厂硬刚价格战,中小模型夹缝求生存
...资源和成本也越相应增加。而承载超大参数量的背后则是服务器数量。据安信证券测算,目前ChatGPT每天所需的算力约50EFLOPs,所需服务器约1万台,若ChatGPT的用户量继续保持上涨,假设到24年底用户数量为5亿,则需要23万台服务...……更多
微软紧随英伟达发布芯片,老黄还不慌吗?
...大在于,建立了完整的自研芯片产业链,形成网络芯片、服务器芯片、AI芯片三条产品线。在AI芯片领域,亚马逊的自研产品就通用计算芯片、机器学习训练芯片、学习推理芯片等。满打满算,从2013年推出首款自研芯片Nitro1以来...……更多
大模型应用疯狂加速,洗牌却在静悄悄进行了
...让腾讯具备了更强的“全局优化”能力。从自研的星星海服务器,到新一代HCC高性能计算集群,再到自研的星脉高速网络,腾讯已经为自己打造了一整套面向AIGC的高性能智算网络。据腾讯内部负责人介绍,目前腾讯云已经可支...……更多
国产GPU万卡集群终于来了!摩尔线程CEO张建中:做难而正确的事
...首先有自研全功能GPU,基于GPU做出计算加速卡,再组建成服务器,放进超融合一体机,然后将这样的4台机器整合到一个机柜里,形成一个小集群,小集群连成大集群,大集群的线性加速比高于91%。有了这样一个灵活组合的集群...……更多
ChatGPT走红背后:苦熬五年,三次AI路线迭代|行业观察
...要几百甚至几千张GPU卡的算力。这意味着在算力之外,当服务器节点众多,跨服务器通信需求大,网络带宽性能亦成为GPU集群瓶颈,高性能计算网络也随之成为一个话题。具体的数字更具说服力。有报道指出,Stability AI此前仅计...……更多
ChatGPT中国变形记|深氪
...“清爽”。他以云服务做类比,在美国,可以直接按租用服务器收费,其他都不用管,正如ChatGPT可以直接按调用次数收费。但在中国,面对大企业和政府,技术公司得做全套服务、甚至是定制开发。这项技术与大用户产品结合...……更多
没有这些,别妄谈做 ChatGPT 了
...络经常需要几百 G 以上的 RDMA 带宽连接,而不是常见的云服务器几 G 到几十 G 的带宽。对于高可用并没有很强的要求,因为本身很多离线计算的任务,不涉及到容灾等问题。没有过度复杂的调度和机器级别的容灾。因为机器本身...……更多
大模型厂商急寻PlanB:英伟达改良版芯片已调试 华为等国产算力供应不足
...,英伟达面向中国市场的改良版——HGX H20已与国内头部服务器厂商在进行适配测试,由于具体的性能差异和优化程度挂钩,目前还很难对其与高配版H800做性能对比,但是,预估HGX H20的8卡服务器仍高达百万级。英特尔则对Gaudi 2...……更多
存储市场“供销两旺”原厂业绩好转,AI对存储应用市场提出要求
...近日在线上对记者分析说。进入2023年,除传统手机、PC和服务器市场外,ChatGPT开启的AI大模型浪潮、汽车智能化浪潮带来更多商业机会,这些应用场景对数据存储的容量、效率、流动性和安全性等方面提出了更高的需求。面对新...……更多
英特尔预计2024年正式上市Gaudi3,用于生成式AI模型
...伴和7家云服务商基于第五代至强处理器准备好了全新的服务器和云服务。”英特尔数据中心与人工智能集团副总裁兼中国区总经理陈葆立称。自去年年底ChatGPT发布以来,大语言模型技术支持下的AIGC应用获得了极大的发展。而这...……更多
MOSS核心成员:我们低估了ChatGPT影响力
...公布的对话式大型语言模型,热情的用户涌入一度导致其服务器被挤崩。21日晚,第一财经连麦学界、法律界大V,共同探讨了ChatGPT的应用、误读以及其牵涉的法律风险和商业伦理问题。复旦大学计算机科学技术学院教授张奇参...……更多
AI服务器缺货真相调查:两天涨价30万,连“味精大王”都入场了
几乎是一夜之间,AI服务器价格在国内市场中飙升。智东西从一位服务器渠道销售人员处得知,搭载英伟达A800 GPU的热门AI服务器型号的价格已达140~150万元/台,比今年6月上涨超40%;搭载8颗英伟达H800 GPU的AI服务器价格上涨则更离...……更多
前商汤通用模型负责人打造3D大模型「Tripo」,3D生成迈入「秒级」时代 | 早期项目
...战,实现通用且可扩展的解决方案。这对算法、数据量、服务器等有很高的要求一一不过这恰恰也是VAST团队的核心优势。VAST这一思路提高了生成模型的成功率和效率。目前,已经实现8秒钟生成带纹理3D网格模型,可以进入传统...……更多
阿里云挥出“三板斧”:免费也要挣到钱
...下来的模型“放置”在任何一个云厂商平台上,通过虚拟服务器跑起来。上述人士介绍,在第二种形式中,阿里云构建了百炼平台、灵积(DashScope)平台等,为用户提供模型训练、推理等所需的算力服务。这些平台不仅支持阿里...……更多
英伟达特供芯片卖不动了?黄仁勋穿上东北花袄“示好”,中国大厂难掩AI野心
...囤货,大批量购买A800、H800等英伟达芯片,目前已部署的服务器总量尚能支撑市场需求,故而对“减量不减价”的H20兴致缺缺。而前人工智能NLP企业首席科学家、千芯科技董事长陈巍进一步向时代财经记者透露,国内交易市场中...……更多
GPT-4撞上文心一言,百度压力骤增:多模态和中文能力受关注,或多种方式落地
...言顺利上线,百度阳泉智算中心专门为其搭建了GPU集成的服务器中心,该地运维人员也在紧急进行压力测试。据了解,百度阳泉智算中心采用的也是英伟达芯片,而百度也在推动芯片研发,其量产的7纳米昆仑芯2代在FP16精度下达...……更多
有了它,断网也能“纵享丝滑”
...网络,如果网络不稳定,信号覆盖不到或者信号质量差,服务器处理能力不行的情况下,它的识别会非常不稳定。其次就是云端无法保证用户的隐私安全,存在泄漏风险。再就是云端的运行成本非常高,因为它要搭建,涉及到搭...……更多
00后华裔小哥哈佛辍学组团挑战英伟达,史上最快AI芯片Sohu推理性能超H100二十倍!
... ASIC。通过专门化,Sohu获得了前所未有的性能。一台8xSohu服务器每秒可以处理超过50万个Llama 70B token,等效于160块H100 GPU。Sohu仅支持Transformer推理,并支持当今所有的模型(Google、Meta、Microsoft、OpenAI、Anth……更多
AI手机没有独家大模型供应商
...是一项长期消耗成本、且暂时还无法停下的趋势,无论是服务器消耗的电力、相关研发等都需要持续的投入。算法交易公司Deep Trading就曾指出,ChatGPT4以1.8亿用户基数和每人100Ktoken/天计算,每日成本就高达88.2万美元。此前vivo副...……更多
够21万人喝一辈子的水 还不够谷歌服务器用7个月
...水?今天就来跟大家聊聊,那些互联网巨头们都是怎么给服务器散热的。有什么办法,能把杭州西湖的水给用完?这是杭州西湖,三面环山,面积约6.39平方千米,南北长约3.2千米,东西宽约2.8千米,水体容量约为1429万立方米。...……更多
大模型价格战“卷”向何方?|深度
...掀起了“降价潮”,阿里、百度、腾讯等纷纷加入战团。大厂“钱多、卡多、算力足”无惧价格战,以惯有的免费模式先聚集用户与开发者。中小大模型创业公司普遍还在勒紧腰带苦苦打造爆款应用,也不得不匆忙接招。大模型...……更多
大厂抢做ChatGPT,百度能否狂飙?
...这方面有许多优势。比如在算力方面,做搜索的公司都有服务器集群。在数据积累和自然语言处理方面,搜索引擎本身需要每天在全网爬取所有的网页,而人类真正积累的知识库就存在在这些网页里;同时搜索本身就需要做大量...……更多
AI时代不甘落后:英特尔全新软硬件平台助力企业加速创新
...外机架密度也是上代的2.7倍。英特尔称72个机架的新一代服务器就能完成过去200个机架服务器的工作量,差不多节省了1兆瓦的功率,能够满足1300个家庭的能源需求。 在边缘计算上,英特尔AI硬件也同样给力,预计到2030年,边缘...……更多
割韭菜!第一批炒作ChatGPT的人已套现离场,海天瑞声、汉王被高位减持
...公布的对话式大型语言模型,热情的用户涌入一度导致其服务器被挤崩。随后,MOSS官方致歉就曾表示,模型还不成熟,距离ChatGPT还有很长的路需要走。“我们一个学术研究的实验室无法做出和ChatGPT能力相近的模型,MOSS只是想...……更多
百川智能、阿里云等进入开源大模型领域,开启商业化前奏
...消息称三星担心传输至生成式AI平台的数据被存储在外部服务器上,已禁止员工使用ChatGPT、谷歌Bard等生成式AI工具。开源之后对大模型企业而言,开源与闭源并不矛盾,企业在开源与闭源、收费与免费之间选择,阿里云是在闭源...……更多
疯狂一夜!美国AMD、谷歌纷纷亮出大杀器,人类迎来巨变前夜?|钛媒体焦点
...更多是针对生成式 AI 所研发的训练芯片。每个TPU v5p pod(服务器组)都由8960个芯片组成,它通过TPU带宽最高的芯片间互连(ICI)以每秒4800Gbp速度在3D拓扑结构中连接。与TPU v4相比,TPU v5p的Flops性能提高了2倍以上,高带宽内存(H...……更多
模型即服务,卓世科技MaaS平台 2.0 正式上线
...型部署:将训练好的模型部署到生产环境中,可能包括云服务器、边缘设备或特定硬件上。 2、API集成:提供API接口,使得模型可以被其他应用程序调用,实现模型服务的快速集成。 3、应用开发框架:提供一套框架和工具,帮...……更多
【科技早报】联想、英特尔、爱奇艺签署谅解备忘录;国内低轨卫星通信测试成功
...“云工开物”计划,给中国所有在校大学生每人送一台云服务器在10月31日举办的2023云栖大会上,阿里云首席技术官周靖人发布阿里云高校计划“云工开物”,计划将为中国所有在校大学生免费提供一台云服务器,所有高校学生...……更多
昆仑万维宣布开源2千亿稀疏大模型Skywork-MoE
...用并落地的开源千亿MoE大模型,也是首个支持用单台4090服务器推理的开源千亿MoE大模型。开源地址Skywork-MoE的模型权重、技术报告完全开源,免费商用,无需申请。模型架构本次开源的Skywork-MoE模型隶属于天工3.0的研发模型系列...……更多
更多关于科技的资讯:
iQOO手机激活量份额连续15周超过5% 同比实现大涨
【CNMO科技消息】根据数码博主公布的中国手机市场手机激活量份额数据,iQOO手机激活量份额已连续15周超过5%,同比去年更是实现了大涨
2024-09-09 20:18:00
曝小米15系列澎湃OS将进行全面优化 真对标苹果?
【CNMO科技消息】9月9日,9月9日早,小米集团合伙人、总裁,国际部总裁,小米品牌总经理卢伟冰发微博宣布,小米15系列首发的高通骁龙8Gen4移动平台将带来巨大提升
2024-09-09 20:18:00
小米高管疑似暗示小米15>iPhone 16
【CNMO科技消息】9月9日,小米集团合伙人、总裁,国际部总裁,小米品牌总经理卢伟冰发文暗示小米将全球首发高通骁龙8Gen4移动平台
2024-09-09 20:18:00
曝小米首发骁龙8 Gen 4 但没有独占期 友商紧随其后
【CNMO科技消息】近日,CNMO注意到,有消息人士透露,包括高通骁龙8Gen4移动平台和联发科天玑9400处理器在内的新一代手机SoC没有所谓的独占期
2024-09-09 20:18:00
卢伟冰:小米15系列首发新平台将带来“三超特性”
【CNMO科技消息】9月9日早,小米集团合伙人、总裁,国际部总裁,小米品牌总经理卢伟冰发微博称,2024年是芯片行业的拐点
2024-09-09 20:18:00
容量翻倍,性能依旧出色:三星1TB TF卡评测
去年,我们对全新升级的三星PROPlusmicroSD卡进行了全面评测。作为三星存储卡产品线的旗舰机型,该卡在存储性能和容量方面均已达到业界领先水平
2024-09-09 20:18:00
一加13确认10月发布 骁龙8 Gen4+冰川大电池
据一加中国区总裁李杰消息称,下个月即将发布的一加旗舰新品将搭载的最新一代旗舰芯片,是由曾经设计出划时代PC芯片的明星团队操刀
2024-09-09 20:19:00
vivo Y300 Pro问世背后,千元手机市场的风向变了?
提起千元机,可能很多人第一时间都会想到廉价、低端、难看等关键词。由于成本有限,千元机只能在有限的配置内取舍,自然难以给消费者带来全面出众的使用体验
2024-09-09 20:19:00
6000大电池是底线 9月超级续航手机入手推荐
在进入到2024年中时分后,手机市场迎来了一波电池容量大升级,多款新机均在电池容量上取得突破。一时之间,6000mAh级别的大电池机型
2024-09-09 20:19:00
聚焦全球化发展道路,极米科技携多款产品亮相IFA2024
日前,在德国柏林开幕的2024年度IFA(柏林国际电子消费品展览会)上,中国投影品牌极米科技震撼亮相。这不仅是极米第四次参加IFA展会
2024-09-09 20:19:00
卢伟冰:小米15系列首发骁龙8 Gen4 双超大核
小米卢伟冰通过其个人微博表示:“2024年是芯片行业的拐点,在未来的一个月多时间里,大家就会看到拐点的出现!”卢伟冰的发言几乎是在打明牌
2024-09-09 20:19:00
外媒称iPhone 16 Pro价格不会上涨:主打系统级AI
苹果将于北京时间2024年9月10日凌晨1时举办特别活动,主题为“高光时刻”,届时将发布全新的iPhone16系列手机
2024-09-09 20:19:00
微星MPG X870E CARBON WIFI暗黑主板开箱
在追求极致性能的PC硬件圈里,AMD推出的ZEN5处理器与X870E/X870芯片组主板将会是性能追求者的新宠。尤其是近期发布AMDZEN5架构锐龙9000系列处理器的发布
2024-09-09 20:20:00
高通骁龙8Gen 4+2K纯直屏,iQOO 13通过认证
说这个月是属于苹果的,应该没人会否认。国产手机大爆发需要等到10月中下旬,到时候联发科天玑9400平台的、高通骁龙8Gen4平台的会出现一个井喷的现象
2024-09-09 20:20:00
起步价1499元,realme 13 Pro发布
当大家都在讨论华为与苹果发布会撞车,华为三折叠屏手机命名时。9月3日realme悄然发布一款新机,新机命名为真我13Pro
2024-09-09 20:20:00