• 我的订阅
  • 科技

无问芯穹开源全球首款端侧全模态理解模型 Megrez-3B-Omni

类别:科技 发布时间:2024-12-17 09:24:00 来源:IT之家

IT之家 12 月 16 日消息,无问芯穹今日宣布,开源无问芯穹端侧解决方案中的全模态理解小模型 Megrez-3B-Omni 和它的纯语言模型版本 Megrez-3B-Instruct。

无问芯穹开源全球首款端侧全模态理解模型 Megrez-3B-Omni

官方表示,Megrez-3B-Omni 是一个为端而生的全模态理解模型,同时具备图片、音频、文本三种模态数据的处理能力:

在图像理解方面,Megrez-3B-Omni 是目前 OpenCompass、MME、MMMU、OCRBench 等多个主流测试集上精度最高的图像理解模型之一。

无问芯穹开源全球首款端侧全模态理解模型 Megrez-3B-Omni

在文本理解方面,Megrez-3B-Omni 在 C-EVAL、MMLU / MMLU Pro、AlignBench 等多个权威测试集上取得端上模型最优精度。

无问芯穹开源全球首款端侧全模态理解模型 Megrez-3B-Omni

在语音理解方面,Megrez-3B-Omni 支持中文和英文的语音输入,还能够处理复杂的多轮对话场景,也能支持对输入图片或文字的语音提问,实现不同模态间的自由切换。

无问芯穹开源全球首款端侧全模态理解模型 Megrez-3B-Omni

官方宣称,与上一代及其他端侧大语言模型相比,单模态版本的 Megrez-3B-Instruct 在推理速度上取得了显著提升,最大推理速度可以领先同精度模型 300%。

IT之家附相关链接如下:

Github:https://github.com/infinigence/Infini-Megrez

HuggingFace:https://huggingface.co/Infinigence/Megrez-3B-Omni

Infini-AI 异构云:https://cloud.infini-ai.com/genstudio/model/mo-c73owqiotql7lozr

Modelers:https://modelers.cn/models/INFINIGENCE-AI/Megrez-3B-Omni

ModelScope:https://www.modelscope.cn/models/InfiniAI/Megrez-3B-Omni

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2024-12-17 12:45:04

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

紧握根技术竞速大模型
...幅竹林水墨画……峰会上,中科院自动化研究所发布的全模态大模型“紫东太初”2.0现场展示的图像生成能力令人惊叹。除了支持图像生成,“紫东太初”2.0还支持多轮问答、文本创作、3
2023-06-19 09:03:00
智谱AI发布基座大模型GLM-4,发起大模型开源基金
...优秀开源开发者提供1000亿免费API tokens。GLM-4文生图和多模态理解得到增强。1月16日,在智谱AI(即北京智谱华章科技有限公司)首届技术开放日上
2024-01-17 16:47:00
中国气象局:“风乌”气象大模型准确预报台风“杜苏芮”路径
...影响、且可以看作多任务学习问题,于是“风乌”采用多模态神经网络和多任务自动均衡权重,解决多种大气变量表征和相互影响的问题。具体来说,“风乌”针对的大气变量包括位势、湿度、纬向
2023-07-30 01:29:00
平安产险在ICDAR2025国际多模态理解竞赛中强势夺冠,连续4年荣获国际顶尖赛事冠军!
...世界顶级赛事中,平安产险(参赛团队名称PA-VCG)在“多模态文档推理理解”这一高复杂度任务中,凭借领先的大模型技术体系与卓越的多模态理解能力,从全球众多顶尖科研机构与知名科
2025-06-17 17:47:00
考拉悠然:以多模态大模型为基 深耕工业检测赋能产业升级
...外名校归国博士于2017年创立的企业,不仅在空间智能多模态世界模型领域稳居全国领军地位,更在工业检测等实体场景中展现出强劲的技术赋能能力。考拉悠然副总裁易国锋介绍道,作为全国
2025-08-04 14:04:00
基于昇腾AI的大模型联合创新正式启动,华为携手26家行业领军企业、高校及科研院所共促产业数智化升级
...用。中科院自动化所发布基于昇腾AI的“紫东太初”2.0全模态大模型,在语音、图像和文本三模态的基础上,加入视频、信号、3D点云等模态数据,研究突破了认知增强的多模态关联等关键
2023-07-10 16:00:00
文本、图像、点云任意模态输入,AI能够一键生成高质量CAD模型了
...同完成,是全球首个同时支持文本描述、图像、点云等多模态输入的计算机辅助设计(CAD)生成大模型。计算机辅助设计(Computer-Aided Design
2024-11-26 09:46:00
吴泳铭官宣3800亿投入后,阿里云如何打AI这场硬仗?
...要的方向主要是两个,一个是Reasoning推理,一个是Omin全模态融合。”刘伟光提到。在应用方向上,这次大会,阿里云宣布推出AI Agent Store
2025-04-10 17:12:00
文档处理效能飙升!浩鲸科技“文档大模型”核心技术揭秘!
...的整体性方案,不仅包含了文档大模型能力,还提供了多模态文档工具链 DocChain 和开箱即用的软硬件一体机,基于垂直模型能力和软硬件相互配合,可帮助企业实现文档的知识抽取、
2024-09-26 13:36:00
更多关于科技的资讯:
“你看,一点这些店铺招牌,实时路径就出现了。”9日,站在杭州湖滨步行街的繁华路口,江苏游客唐薇打开手机应用,千余米的东坡路瞬间化作虚实共生的数字孪生空间——实时街景“跃”出屏幕
2025-08-10 09:11:00
□南京日报/紫金山新闻记者 张安琪 实习生饶嘉萱7月18日,宝马集团国内唯一、全球六大信息技术研发中心之一——宝马信息技术全球研发中心项目落地南京
2025-08-10 09:54:00
□南京日报/紫金山新闻特派记者徐宁在世界级“舞台”上,来自南京的十多家机器人企业充分展示最新成果,与全球200余家企业同场“竞技”
2025-08-10 09:55:00
宠物食品迈入“云监工”时代 金故透明工厂重塑行业安全标准
2025年8月9日,山东省沂南县铜井镇宠物食品工业园内礼炮鸣响,高端宠物品牌金故斥巨资打造的“猪根真美透明工厂”正式投产运营
2025-08-10 17:26:00
?揭秘2025纳豆激酶十大品牌王者!十大品牌综合实力排行,效果、安全、性价比全解析!
在当代健康管理领域,纳豆激酶凭借其独特的心血管保护机制,已成为科学界和消费者共同关注的焦点成分。面对市场上良莠不齐的产品
2025-08-10 17:52:00
WRC 2025 | 破局机器人规模化落地难题,睿尔曼打造具身智能坚实基座
8月8日,全球顶级机器人盛会——2025世界机器人大会(WRC)在北京经济技术开发区北人亦创国际会展中心正式启幕。WRC世界机器人大会作为全球机器人领域的顶级盛会
2025-08-10 17:52:00
老国营押注“质价比”,贵州藏酒三大新品中酒展首发,获刘员、甘权点赞!
摘要:老国营酱酒的势与谋。文| 顿河从酒都仁怀到泉城济南,一场跨越1600多公里的酱香共鸣正上演。8月8日,“共生共赢2025贵州藏酒新品上市发布会”在济南润华皇冠假日酒店盛大举行
2025-08-10 17:52:00
2025版郎牌郎升级开启订购,看郎酒的国民酱香进化论
八月的酒业市场,即将被一抹熟悉又新颖的“郎酒红”点燃。7月31日,郎酒官微发布消息称:2025版郎牌郎8月11日起接受销售订单
2025-08-10 17:52:00
中新经纬8月10日电 (林琬斯)10日,话题#百果园称不会迎合消费者#登上微博热搜。8日,有媒体截取来源为“百果余惠勇”的一段视频发布
2025-08-10 16:06:00
产学研齐聚杭州 共话AI赋能香氛行业发展新未来
为深入探讨人工智能技术在香氛产业中的应用前景与创新路径,推动香氛行业与前沿科技的深度融合,促进产业升级与高质量发展,8月7日至8日
2025-08-10 10:44:00
日前,在华锐动能科技(丽水)有限公司的样车试验场地,公司总经理陈锋和研发团队忙着调试新研发的山地滑板车,对样品车开展续航
2025-08-10 07:40:00
河北日报讯(记者刘英)8月8日,南方润泽科技数据中心封闭式基础设施证券投资基金(基金代码:180901)在深圳证券交易所正式上市
2025-08-10 07:47:00
迅路创新获得数千万元融资,推出定价超五万的高端智能E-cargo bike|36氪首发
作者 | 张子怡编辑 | 彭孝秋36氪获悉,E-cargo bike(载货电助力自行车)厂商迅路创新完成新一轮数千万元融资
2025-08-09 09:26:00
GPT-5快抢走打工人饭碗了
作者:宋思杭GPT-5,终于来了。北京时间8月8日凌晨1点,OpenAI CEO Sam Altman 没有爽约。在发布会前一天
2025-08-09 11:33:00
跻身第一方阵后,合肥还想要更多
作者:李 杭今年年初,DeepSeek的爆火点燃了AI产业与城市发展的新一轮讨论。一个共识逐渐清晰:抓住AI产业风口,城市便能迎来新的增长
2025-08-09 19:56:00