• 我的订阅
  • 头条热搜
Hugging Face发布SmolVLM开源 AI 模型:20 亿参数,用于端侧推理
...VLM 仅使用 1200 个 tokens,而 Qwen2-VL 则使用 1.6 万个 tokens。吞吐量SmolVLM 在 MMMU、MathVista、MMStar、DocVQA 和 TextVQA 等多个基准测试中表现出色,且处理速度相比较 Qwen2-VL……更多
专家模型不要专家并行!微软开源MoE新路径
...密集模型进行了比较,使用相同的硬件测量了它们的训练吞吐量。 尽管MoE总的参数量是密集模型的六倍多,但在实验中达到了超过80%的相对吞吐量,证实了使用GRIN MoE方法的模型具有显著的计算扩展潜力。(PS:密集模型的吞吐...……更多
CPU,正在被AI时代抛弃?
...系统能够高效处理大量的数据,而CPU的强大计算能力和高吞吐量特性可以很好地满足要求,能够确保推理任务的快速完成。英特尔的测试数据也验证了千帆大模型平台团队的发现,其通过测试证明,单台双路CPU服务器完全可以轻...……更多
Intel三条线优化阿里云通义千问2模型:720亿参数轻松拿捏
...i 2,对70亿参数、720亿参数的通义千问2模型的推理和微调吞吐量进行了基准测试,以下为详细性能指标和测试结果:70亿参数通义千问2在单颗Gaudi 2加速器上的推理720亿参数通义千问2在八颗Gaudi 2加速器上的推理通义千问2 FP8在Gaud...……更多
北大林宙辰团队全新混合序列建模架构MixCon:性能远超Mamba
...,MixCon 仍能保持较小的 KV 缓存优势(如表 1 所示)。在吞吐量方面,处理长序列时,Conba 层计算效率更高,增加其比例可提高整体吞吐量。基本配置单位是 MixCon 块,由 Conba 或注意力层组合而成,每个层包含注意力模块或 Conba ...……更多
摆脱Transformer依赖?这家AI初创公司推出国内首个非Attention机制大模型
...果——记忆能力提升3倍、速度提升7倍的同时,实现推理吞吐量的5倍提升。 至于为何另辟蹊径,寻求非Transformer的大模型路径,岩芯数智CEO刘凡平指出,以大规模著称的Transformer,在实际应用中的高算力和高成本,让不少中小型...……更多
4090笔记本0.37秒直出大片!英伟达联手MIT清华祭出Sana架构,性能秒杀FLUX
...领先扩散模型Flux-12B,Sana-0.6B不仅参数小12倍,重要的是吞吐量飙升100倍。以后,低成本的内容创作,Sana才堪称这一领域的王者。下面来看个更复杂的:一艘海盗船被困在宇宙漩涡星云中,通过模拟宇宙海滩旋涡的特效引擎渲染...……更多
面壁智能发布2B模型:适配主流手机,推理成本仅为GPT-4的1/360 | 最前线
...1/100,GPT-4的1/360。据介绍,目前MiniCPM-2B在CPU(比GPU计算吞吐量低)上就能跑起来,相较于用GPU才能运行的大模型,能够降低推理成本。与此同时,即便将大小压缩75%,MiniCPM的性能也能做到基本无损耗。在性能上,MiniCPM-2B的中文...……更多
00后华裔小哥哈佛辍学组团挑战英伟达,史上最快AI芯片Sohu推理性能超H100二十倍!
...达3400万刀。当时Sohu号称LLM推理性能达到H100的10倍,单价吞吐量更是高达140倍。而就在刚刚,Etced又宣布了炸裂的新消息:已筹到1.2亿美元。 就在上周,英伟达的市值达到3.3万亿美元,超过微软成为全球第一。而Etched相信,自己...……更多
英伟达展示blackwell平台,否认推迟上市
...多GPU推理方法是在多个GPU上进行计算,以获得低延迟和高吞吐量,但采用多GPU路线也有其复杂性。多GPU环境中的每个GPU都必须将计算结果发送给每一层的其他GPU,这就需要高带宽的GPU对GPU通信。多GPU推理方法是在多个GPU上进行计...……更多
月之暗面 Kimi 联合清华大学等开源大模型推理架构 Mooncake
...以 KVCache 为中心的 PD 分离和以存换算架构,提升了推理吞吐量。近日,为了进一步加速该技术框架的应用与推广,月之暗面 Kimi 和清华大学 MADSys 实验室联合 9#AISoft、阿里云、华为存储、面壁智能、趋境科技等共同发布开源项目...……更多
鄂维南院士领衔新作:大模型不止有RAG、参数存储,还有第3种记忆
...究者通过每秒生成的 token 数来评估 Memory3 的解码速度或吞吐量。了解更多内容,请参考原论文。 ……更多
大模型步入推理Scaling时代,SambaNova如何挑战英伟达的霸主地位
...能力。GPU 有很好的批处理能力(比如从 BS1 到 BS16),可将吞吐量提高 12 到 15 倍。比如在上图中,当 decoder0 在进行批处理运算时,可以同时从 HBM 读取 decoder1 的参数。 SambaNova 的研究者观察到,SN40L 在 Llama 3.1 70B ……更多
英特尔第五代至强可扩展处理器发布:AI推理性能提升42%!
...开启。客户应用实例方面,IBM watsonx.data平台的网络查询吞吐量提高了2.7倍,Palo Alto Networks的基于深度学习模型的威胁检测性能提升了2倍,Gallium Studios游戏工作室Numenta AI平台的推理性能比GPU云实例提高了多达6.5倍。 拥有28款……更多
马斯克官宣Grok-2测试版!xAI将继续拥抱开源路线吗?
...问的内容,模型只会激活不同的专家子模块进行推理,在吞吐量一定的情况下,可以更快地完成推理、给出回答。这让Grok-1拥有了更快的生成速度和更低的推理成本,简而言之就是更好的使用体验和性价比。根据xAI公布的数据,...……更多
晶圆级AI芯片WSE-3性能公布:80亿参数模型上每秒生成1800个Token
...键值缓存留下大约 28GB 的空间。Feldman 声称,除了极高的吞吐量外,WSE-3 还可以扩展到更高的批量大小。尽管它究竟可以扩展到多大程度并保持每个用户Token的生成率,这家初创公司不愿透露。“我们目前的批次大小经常变化。...……更多
支持1024帧、准确率近100%,英伟达「LongVILA」开始发力长视频
...遵循任务上的表现。训练与推理系统该研究对训练系统的吞吐量、推理系统的延迟以及支持的最大序列长度进行了定量评估。表 2 显示了吞吐量结果。与 ZIGZAG-RINGATTN 相比,本文系统实现了 2.1 倍至 5.7 倍的加速,性能与 DeepSpeed-U...……更多
非Transformer架构站起来了!首个纯无注意力大模型,超越Llama 3.1
...处理大小为 1 ,硬件采用 H100 GPU 的设置中测量模型生成吞吐量。结果如下图所示,Falcon Mamba 以恒定的吞吐量生成所有 token,并且 CUDA 峰值内存没有任何增加。对于 Transformer 模型,峰值内存会增加,生成速度会随着生成的 token ...……更多
面壁智能的端侧大模型面壁MiniCPM正式亮相
...对此面壁智能也在发布会上进行了展示,不同终端设备的吞吐量各有不同,也正是壁MiniCPM的出现,让用户那怕是一部手机,一个消费级显卡也能在端侧流畅跑通大模型。为了更真实的展示面壁MiniCPM在端侧的处理能力,发布现场...……更多
Mamba再次挑战霸主Transformer!首个通用Mamba开源大模型一鸣惊人
...k库,对Falcon Mamba和流行的Transformer模型在内存使用和生成吞吐量方面进行了比较。为了公平比较,将所有Transformer模型的词汇大小调整为与Falcon Mamba一致,因为这对模型的内存需求有很大影响。在查看结果之前,先讨论序列中提...……更多
PyTorch官宣:告别CUDA,GPU推理迎来Triton加速新时代
...据传输速度更快。与F32相比,英伟达GPU提供的FP16将算术吞吐量提高了8倍,大幅加快了数学受限层的训练速度。此外,PyTorch团队还着重强调,计算全部是依赖OpenAI的Triton语言执行的。Triton是一种用于编写高效自定义深度学习基元...……更多
自定义Llama 3.1模型的利器来了!NVIDIA打造生成式AI代工厂,还有加速部署的微服务
...些模型。NIM微服务有助于将Llama 3.1模型部署到生产中,其吞吐量最多可比不使用NIM运行推理时高出2.5倍。从ai.nvidia.com即可了解适用于Llama 3.1模型的NVIDIA NIM推理微服务,以加快将Llama 3.1模型部署到生产级AI的速度。 将Llama 3.1 ……更多
史上最快AI芯片「Sohu」,速度10倍于B200,哈佛辍学生打造
...更多的计算能力且利用率非常高, 因此可以运行巨大的吞吐量,而不会出现内存带宽瓶颈。软件如何工作在 GPU 和 TPU 上,软件是一场噩梦。处理任意 CUDA 和 PyTorch 代码需要极其复杂的编译器。第三方 AI 芯片(如 AMD、Intel、AWS ...……更多
昆仑万维宣布开源2千亿稀疏大模型Skywork-MoE
...万维宣布开源2千亿稀疏大模型Skywork-MoE,性能强劲,同时推理成本更低。Skywork-MoE基于之前昆仑万维开源的Skywork-13B模型中间checkpoint扩展而来,是首个完整将MoE Upcycling技术应用并落地的开源千亿MoE大模型,也是首个支持用单台409...……更多
苹果大模型,不藏了
...法,来了:先减少闪存传输的数据量,再提高每次传输的吞吐量。先看框架:以手机为例,平时购机时的【12+256G】、【16+512G】,12/16为运行内存,256/512为储存空间。以此类推绝大部分移动设备存储结构,运存空间小,但读取速...……更多
大模型“免费”送,厂商们图什么?
...悉,DeepSeek可节省42.5%训练成本,减少93.3%的KV缓存,最大吞吐量提高5.76倍。整体而言,DeepSeek-V2消耗的显存(KVCache)只有同级别Dense模型的1/5-1/100。不过,这并不意味着当下大模型行业的价格战十分正常。2024年5月,谈及大模型...……更多
英伟达地表最强,黄教主被称作AI界“霉霉”
...万亿参数AI模型的性能,为每个GPU提供了高达1.8TB/s的双向吞吐量,确保当今最复杂的大语言模型能在多达576个GPU之间实现无缝高速通信。RAS引擎:Blackwell驱动的GPU集成了专用引擎和基于人工智能的预防性维护功能,可确保可靠性...……更多
英特尔酷睿Ultra笔记本NPU能力体验
...计算,且NPU在存储方面拥有高带宽、高容量的特性,数据吞吐量大、响应延迟低的特点,对AI应用效率提升起到积极作用。NPU就像一个效率超高的AI计算专家,让你的本本续航更持久的同时,也能流畅运行虚拟背景、实时美颜等...……更多
oppo首个端侧应用70亿参数大模型findx7系列
...CC和高隔离度技术,OPPO可以进一步提升超级低频四天线的吞吐量并降低网络延迟。面向握持对信号强度的影响,OPPO对低频天线进行了特殊设计,构建了OPPO自研手持状态下的信号模型,改善手持状态下的手机信号状况,实现了最...……更多
李开复发布零一万物首款340亿参数大模型Yi
...车通行5509.5万辆,环比下降2.86%;监测港口累计完成货物吞吐量24726.9万吨,环比下降3.88%,完成集装箱吞吐量552.8万标箱,环比下降3.02%;民航累计保障航班10.3万班(其中货运航班4251班,包括国际货运航班2467班,国内货运航班178...……更多
更多关于科技的资讯:
鲁网9月28日讯金融是经济的血脉,更是百姓生活的依托。在中国经济迈向高质量发展的今天,中国建设银行青岛市分行以国有大行的责任与担当
2025-09-28 10:37:00
五年连获七家世界知名轴承制造企业认证一根轴承钢转动全球——“铁疙瘩”怎样变成“金娃娃”(九)前不久,河钢集团石钢公司收到日本某国际知名轴承企业高碳铬轴承钢的认证邮件
2025-09-28 08:04:00
锚定新赛道 壮大新动能超31亿元新一代工业软件基地项目开工南报网讯(记者刘安琪)项目兴则产业兴,项目强则经济强。9月26日上午
2025-09-28 07:43:00
山东移动成功入选2025年度山东省中小企业服务支撑机构
近日,山东省轻工联社发布《关于公布2025年度山东省中小企业服务支撑机构名单的通知》,山东移动成功入选。作为推动中小企业数字化转型的主力军
2025-09-27 08:11:00
南报网讯(记者卫凌云通讯员建萱)9月26日,2025南京河西中央科创区生态建设推进会举行,“大厂+大学+大所”创新平台揭牌
2025-09-27 09:53:00
山东移动淄博公司织就高速信息网络,筑牢“数字淄博”智慧生命线
在数字化浪潮席卷而来的今天,信息传输网络如同城市的“神经网络”,是智慧城市运转的核心支撑。作为这一无形“生命线”的守护者
2025-09-27 12:34:00
迭代焕新“吾悦经营五步法”,新城控股再启商业新篇
9月24日-25日,新城控股“2025第八届商业年会暨吾悦商管第一届悦链计划合伙人大会”在上海西岸美高梅酒店举行,新城控股集团董事长王晓松及公司高管
2025-09-27 12:37:00
25日上午,以“上山下山·食在晋安”为主题的晋安区“一县一桌菜”云上发布会举行,12道“云端”盛宴引爆味蕾。
2025-09-27 13:53:00
产业链协同驱动 新奥加速冲刺氢硼聚变
河北新闻网讯(张新)2025年,是我国“十四五”规划收官之年,也是“双碳”目标提出五周年。在此背景下,央视《东方时空》栏目近日推出“可控核聚变专题”
2025-09-27 14:45:00
9月25日,国网山西省电力公司发布消息,该公司成功完成配电网无人机电力北斗定位服务的全面应用,标志着该公司依托电力北斗高精度定位服务
2025-09-27 19:56:00
谢志强:从金融菁英到人才“伯乐”,以产学研融合破局就业困境
谢志强,现任中科汇理信息技术研究院党支部书记、秘书长、中科产学研合作一体化人才培育开发平台项目主任。历任中国银行总行风险管理部业务经理
2025-09-27 20:20:00
聚焦数贸会 | 工匠行:机器狗能听会说还会自主巡逻
在第四届全球数字博览会上,贵州工匠行科技有限公司展出的SomaSeek具身智能平台,让机器人彻底告别了遥控器,也能听会说
2025-09-27 22:17:00
企业新市场何处寻?潍坊这场产业国际精准对接会送来“及时雨”
齐鲁晚报·齐鲁壹点 胡晓雪 李国栋9月26日,2025潍坊纺织服装产业国际精准对接活动在奎文区成功举办,本次活动以“我帮企业组主场·我为企业找订单”为主题
2025-09-27 22:22:00
生产周期缩短1/3,宇捷轴承凭核心技术领跑细分市场
齐鲁晚报·齐鲁壹点 陶春燕 山东省宇捷轴承制造有限公司是国家级专精特新重点“小巨人”企业、国内最大的调心滚子轴承生产企业
2025-09-27 20:05:00
电动车照亮小区应急通道?淄博供电验证居民V2G桩集群放电场景
当小区突发故障停电,地下车库里业主们的电动汽车,瞬间变身为一个巨大“充电宝”,为消防、通风和应急照明系统供电,守护社区安全
2025-09-27 12:35:00