• 我的订阅
  • 科技

清华团队开源大模型推理引擎“赤兔Chitu”:硬件成本削减50%

类别:科技 发布时间:2025-03-14 17:22:00 来源:浅语科技

快科技3月14日消息,据报道,清华大学高性能计算研究所翟季冬教授团队与清华系科创企业清程极智联合宣布,开源大模型推理引擎“赤兔Chitu”。这一突破性技术为国产AI芯片的广泛应用和生态建设带来了新的机遇。

“赤兔Chitu”首次实现在非英伟达Hopper架构GPU及各类国产芯片上原生运行FP8精度模型,解决了FP8精度模型对英伟达Hopper架构(如H100/H200)的硬件依赖。

在A800集群的测试中,赤兔引擎在GPU使用量减少50%的情况下,推理速度提升了3.15倍,显著降低了企业的硬件成本,同时提高了性能输出。

赤兔引擎的智能优化技术能够快速适配不同芯片架构,使国产厂商无需重复开发软件,专注于硬件升级。目前,清程极智已与沐曦、燧原等厂商合作,推出“开箱即用”的推理一体机,广泛应用于金融、医疗等行业。

清程极智CEO汤雄超表示,当前国内在推理引擎这一核心环节仍缺乏生产级开源产品。开源“赤兔”引擎是推动国内AI生态建设的重要一步,将为行业提供更高效、更灵活的技术支持。

清华团队开源大模型推理引擎“赤兔Chitu”:硬件成本削减50%

【本文结束】如需转载请务必注明出处:快科技

责任编辑:鹿角

文章内容举报

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2025-03-14 20:45:07

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

...了来自奇绩创坛的种子轮融资。清昴智能创始团队来自于清华计算机系,在边缘计算和模型自动压缩方向有十余年积累;创始人关超宇曾获清华大学研究生特奖,在研究生期间主导开源了首个自动图
2023-06-25 08:51:00
...愈加清晰。在人才组织层面,清昴智能核心成员主要来自清华大学、华为、阿里等高校和公司。创始人兼CEO关超宇毕业于清华大学计算机系,2021年西尔贝学者奖学金获得者(全球不到百人
2024-06-03 15:23:00
无问芯穹夏立雪:破解算力焦虑,我做了大模型算力领域的“淘宝”丨36氪专访
...业至今的第一感受依旧是——算力不够用。近期,有一家清华系创业公司瞄准了这一痛点。这家公司叫「无问芯穹」,项目发起人则是清华大学电子工程系主任汪玉,创始人是他的学生夏立雪。因此
2024-04-03 18:19:00
技术奇迹!清华突破大模型算力难题 RTX 4090单枪匹马就能跑满血版DeepSeek
快科技2月15日消息,清华团队突破大模型算力难题,这让英伟达情何以堪。据国内媒体报道称,清华大学KVCache.AI团队联合趋境科技发布的KTransformers开源项目迎来重大更新
2025-02-15 10:52:00
4090笔记本0.37秒直出大片!英伟达联手MIT清华祭出Sana架构,性能秒杀FLUX
...导读】一台4090笔记本,秒生1K质量高清图。英伟达联合MIT清华团队提出的Sana架构,得益于核心架构创新,具备了惊人的图像生成速度
2024-10-18 09:49:00
大模型新趋势之MoE:现状、挑战及研究方向
...加快研发各种新型MoE架构,以提升模型性能或实用性。如清华和微软联合提出MH-MoE5,通过多头机制弥补MoE原始缺陷
2024-11-04 16:00:00
...eek点燃的火种,成为推动智能革命的熊熊烈火。(作者系清华大学计算机系长聘副教授、面壁智能首席科学家)
2025-02-27 21:52:00
智能体不够聪明怎么办?清华&蚂蚁团队:让它像学徒一样持续学习
...解决,而是需要更系统化的方法。在 NeurIPS 2024 上,来自清华大学和蚂蚁集团的研究者针对人工智能体构建方法的通用性和适应性提出了一个新方案
2024-12-11 09:53:00
...称项目训练成本不到30美元。“二次创造”增强AI普惠性清华大学计算机系长聘副教授刘知远接受记者采访时说,部分海外研究团队使用DeepSeek-R1、o1等高性能推理大模型来构
2025-02-27 05:08:00
更多关于科技的资讯:
年入558亿,中国便利店之王,竟然是它
提起便利店大家脑海中出现的第一个名字是什么?罗森、7-11还是全家,可能每个人的答案都不一样。但如果是广东的朋友,那么答案一定是#美宜佳
2025-08-03 05:41:00
运动品牌营销细分,潮流基因强化圈层认同|世研消费指数品牌榜Vol.56
本次监测周期内,安踏、耐克和斐乐以1.86、1.70、1.68的综合热度位列榜单综合热度前三。图源:世研大消费指数国货运动品牌场景痛点精准拆解
2025-08-03 05:41:00
最没存在感的河北特产,悄悄统治江浙沪?
提到河北衡水,估计不少人脑子里先冒出来的,是让全国学生闻风丧胆的衡水中学,以及一瓶名叫老白干的白酒。但在这两张耀眼名片外
2025-08-03 06:43:00
华立工业园:制造企业落脚海外的“工业唐人街”
过去一百多年来,唐人街是中国移民在海外聚居形成的经济和文化社区,往往也是新移民踏上陌生土地后落脚的第一站。对于许多刚刚“走出去”的中国制造企业
2025-08-03 06:43:00
对话蚂蚁集团张俊杰:AI 如何重塑医疗健康产业?
当大模型从技术奇点跃迁为产业基座,当智能体从实验室走进产线诊室,人工智能的第三次浪潮正以前所未有的锐度重构全球经济肌理
2025-08-03 06:45:00
让机器人拥有智能触觉,「悟通感控」获数千万元融资 | 36氪独家
36氪获悉,柔性触觉感知科技公司「悟通感控」近日完成数千万元系列融资:Pre-A轮由尚势资本领投、水木创投跟投;Pre-A+轮由广发基金瑞元资本领投
2025-08-03 06:45:00
打工人的终极难题:快乐和健康,我都想要
年轻人的「肠胃焦虑」新解法。撰文|J封面图源|《她的城》剧照在这个讲求效率与速度的时代,年轻人似乎比任何时候都更懂健康的重要
2025-08-03 06:45:00
这一次,普通人是主角
一只白鸽突然停在头上,会有什么样的故事发生?静静地等它飞走,留下羽毛扫过的温度。或者,赶快举起手机,记录下这珍贵的一刻
2025-08-03 06:45:00
破晓之光:2025 ChinaJoy AIGC大会圆满召开 | ChinaJoy2025
2025年8月1日,ChinaJoy AIGC大会在上海浦东嘉里大酒店三层上海宴会厅2召开。大会以“破晓之光”为主题,围统“AI基建与大模型重构的黎明之光”
2025-08-03 07:45:00
7月,在太仓大数据产业园,世纪智联科技发展(苏州)有限公司算力中心项目宛如一条腾跃的巨龙,在江苏银行21亿元绿色授信支持下
2025-08-03 05:14:00
2日,浙江大学脑机智能全国重点实验室发布最新成果,新一代神经拟态类脑计算机——“悟空”问世。这是国际首台神经元规模超20亿的基于专用神经拟态芯片的类脑计算机
2025-08-03 07:46:00
全国产智能体MasterAgent:一句话造专属AI团队,专业协同交付
MasterAgent坚持核心技术自主研发,确保从底层架构到上层应用的安全可靠如果说大语言模型让全世界看到了AI的潜力
2025-08-03 07:46:00
当一场国际音乐节落地,百威中国如何把握潮流密码?
情绪主导的消费时代里,啤酒行业正努力让每一代年轻人“上头”。情绪消费时代,一场音乐节仍然是年轻人的刚需11月,全球最大规模的电音音乐节Tomorrowland即将首次登陆中国
2025-08-03 07:47:00
用AI破局情境化学习,瓦拉英语发力在线英语教育
大模型时代来临之后,不少教育公司都在尝试使用AI生成课程内容,或利用AI生产高互动性、个性化内容,来提升教育的质量和效率
2025-08-03 07:47:00
在消费越来越多元化的今天,首发经济正成为城市经济发展的重要引擎和消费增长的活力源泉。从新商业综合体的落成,到品牌开设首店
2025-08-03 06:44:00