• 我的订阅
  • 科技

阿里国际发布最新开源多模态模型Ovis,多模态能力再升级

类别:科技 发布时间:2024-09-20 13:35:00 来源:雷峰网

看一眼菜品图就知道怎么做、能给植物看病、能把手写英文准确翻译成中文、还能精准分析财报数据……多模态能力再次升级!今天,阿里国际AI团队发布了一款多模态大模型Ovis,在图像理解任务上不断突破极限,多种具体的子类任务中均达到了SOTA(最新技术)水平。

多模态大模型能够处理和理解多种不同类型的数据输入,例如文本、图像。与大型语言模型(LLMs)相比,大语言模型在处理和生成文本数据方面有专长,而多模态大模型能够处理非文本数据,如图像等等。

根据多模态权威综合评测平台OpenCompass的数据,Ovis1.6-Gemma2-9B在30B参数以下的模型中取得了综合排名第一,赶超MiniCPM-V-2.6等行业优秀大模型。

阿里国际发布最新开源多模态模型Ovis,多模态能力再升级

图:Ovis在OpenCompass上的测评数据情况

据介绍,Ovis能够在数学推理问答、物体识别、文本提取和复杂任务决策等方面展现出色表现。例如,Ovis可以准确回答数学问题,识别花的品种,支持多种语言的文本提取,甚至可以识别手写字体和复杂的数学公式。

阿里国际发布最新开源多模态模型Ovis,多模态能力再升级

案例1:Ovis对手写文案的识别及翻译能力

阿里国际发布最新开源多模态模型Ovis,多模态能力再升级

案例2:Ovis对复杂数学公式的处理能力

阿里国际发布最新开源多模态模型Ovis,多模态能力再升级

案例3:Ovis通过对图片的识别处理能够给出菜谱

具体来说,Ovis模型有五大优点:

1、创新架构设计:可学习的视觉嵌入词表:首次引入,将连续的视觉特征转换为概率化的视觉token,再经由视觉嵌入词表加权生成结构化的视觉嵌入,克服了大部分MLLM中MLP连接器架构的局限性,大幅提升多模态任务表现。

2、高分图像处理:动态子图方案:支持处理极端长宽比的图像,兼容高分辨率图像,展现出色的图像理解能力。

3、全面数据优化:多方向数据集覆盖:全面覆盖Caption、VQA、OCR、Table、Chart等各个多模态数据方向,显著提升多模态问答、指令跟随等任务表现。

4、卓越模型性能:Ovis展现出了优异的榜单表现。在多模态权威综合评测Opencompass上,Ovis1.6-Gemma2-9B在30B参数以下的模型中取得了综合排名第一,超过了Qwen2-VL-7B、MiniCPM-V-2.6等模型。尤其在数学问答等方向表现媲美70B参数模型;在幻觉等任务中,Ovis-1.6的幻觉现象和错误率显著低于同级别的模型,展现了更高的生成文本质量和准确性。

5、全部开源可商用:Ovis系列模型License采用 Apache 2.0。Ovis 1.0、1.5的数据、模型、训练和推理代码都已全部开源,可复现。Ovis1.6系列中的Ovis1.6-Gemma2-9B也已开源权重。

在AI领域,多模态大模型的应用场景非常广泛,包括但不限于自动驾驶、医疗诊断、视频内容理解、图像描述生成、视觉问答等。例如,在自动驾驶领域,多模态大模型可以整合来自摄像头、雷达和激光雷达的数据,以实现更精准的环境感知和决策。由于多模态大模型能够学习如何联合理解和生成跨多种模式的信息,也被视为朝向通用人工智能的下一个步骤。

根据此前媒体报道,阿里国际在去年成立了一支AI团队,目前已经在40多个电商场景里测试了AI能力,覆盖跨境电商全链路,包括商品图文、营销、搜索、广告投放、SEO、客服、退款、店铺装修等,其中多个应用场景均基于Ovis模型进行开发,已帮助50万中小商家、对1亿款商品进行了信息优化。据介绍,商家的AI需求不断增长,近半年的数据显示,平均每两个月,商家对于AI的调用量就翻1倍。

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2024-09-20 14:45:10

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

阿里云重磅升级全栈AI体系,一文看懂云栖大会技术发布
...模型智能水平、Agent工具调用和Coding能力、深度推理、多模态等方面实现多项突破。2025云栖大会,阿里云CTO周靖人发布多项重磅技术更新在大语言模型中
2025-09-24 13:30:00
中国科学院地化所发布国际首个月球专业大模型,基于通义大模型及阿里云百炼专属版打造
...地球化学研究所与阿里云联合发布国际首个“月球科学多模态专业大模型”(简称“月球专业大模型”)。该大模型以视觉、多模态及自然语言等通义系列模型为基模,结合RAG检索增强等技术,
2024-08-29 15:42:00
...间,阿里AI模型实现七连发,在模型性能、深度推理、多模态、Agent及Coding能力等方面均实现新突破,其中旗舰模型Qwen3-Max性能超过GPT5
2025-11-25 20:38:00
Gemini引领多模态AI热潮,产业发展有望加速
12月11日,多模态AI概念股继续活跃,苏州科达(603660.SH)三连板。截至当日中午收盘,因赛集团(300781
2023-12-11 15:01:00
吴泳铭官宣3800亿投入后,阿里云如何打AI这场硬仗?
...要的方向主要是两个,一个是Reasoning推理,一个是Omin全模态融合。”刘伟光提到。在应用方向上,这次大会,阿里云宣布推出AI Agent Store
2025-04-10 17:12:00
阿里云CTO周靖人:全面投入升级AI大基建
...模型Qwen2.5系列,同时上架语言、音频、视觉等100多款全模态模型,通义开源模型累计下载量已经突破4000万,通义原生模型和衍生模型总数超过5万
2024-09-19 15:53:00
阿里云通义大模型家族迎来新成员,通义万相已开启定向邀测
...云智能集团CTO周靖人表示,这是阿里云大模型全面掌握多模态能力的关键一步,该能力将逐步向行业客户开放。阿里云宣布AI绘画创作大模型通义万相开启定向邀测据介绍,通义万相在语义理
2023-07-07 16:55:00
清华大学携手阿里巴巴共筑AI安全防线 启动大模型与智能体安全研究
...日,阿里巴巴集团与清华大学签订协议,启动智能体与多模态安全产学研深度融合专项合作。双方此次合作为期5年,聚焦中国AI用户在真实应用场景中面临的核心安全挑战,首批启动6个课题。
2026-01-09 14:23:00
阿里Q3财报:核心业务收获稳健增长,“AI驱动”潜力初现
...疗等领域,持续放大技术普惠。通用大模型“全尺寸、全模态”开源,“通义舞王”爆火本季度,阿里云发布开源大模型通义千问Qwen-72B,该模型10个权威基准测评创下开源模型最优成
2024-02-07 22:43:00
更多关于科技的资讯:
中亦科技荣膺徽商银行“核心系统3.0”项目“最佳合作伙伴奖”
近日,在徽商银行“核心系统3.0”建设项目总结表彰中,中亦科技凭借在金融核心场域的深度贡献,荣获“最佳合作伙伴奖”。唯一殊荣
2026-02-14 12:50:00
东阿生力源阿胶股份有限公司:千年阿胶文化的传承者与创新者
东阿生力源阿胶股份有限公司,成立于2002年,坐落于“千年阿胶福寿乡”——山东东阿黄河之滨,历经二十多年的深耕细作,现已发展为一家集阿胶等生物养生滋补品研发创新
2026-02-14 12:52:00
作为浙江省第一家海洋生物医药类上市公司,浙江诚意药业股份有限公司(下称“诚意药业”,股票代码:603811)深耕海洋生物医药领域多年
2026-02-14 11:53:00
厦门网讯(厦门日报记者 应洁 通讯员 帅浩)车间内机械臂精准运转,刚下线的无人驾驶清扫机器人正完成最后的调试——近日,集美灌口智能制造产业园区内
2026-02-14 08:24:00
智造引擎解锁产业新赛道 厦门航天思尔特研发制造基地建成投产
在厦门航天思尔特总装总调厂房车间,工业机器人让制造更智能。(厦门日报记者 许秋珩 摄)厦门网讯(厦门日报记者 应洁) 厦门航天思尔特研发制造基地的车间里
2026-02-14 08:24:00
春节临近,礼品市场进入一年中最活跃的周期。走访多家商超渠道及翻阅十余份健康消费品年度报告后发现,2026年的春节滋补礼品市场正经历一次显著的消费逻辑转向——“送贵的不如送对的”成为主流决策标尺
2026-02-14 08:45:00
对于女生来说,卫生巾不仅是日常刚需,更是私处健康的第一道防线,高洁丝1994年与中国女性初见面,在近30年的发展中,品牌知名度和渗透率持续提升
2026-02-14 08:46:00
经期护理的核心是安全与舒适,高洁丝作为深耕中国市场近30年的品牌,2021—2025年三、四线城市知名度从77.9稳步提升至86
2026-02-14 08:47:00
中国口碑好的 MBA MPA MEM EMBA 培训机构:林晨陪你考研实力获认可
近年来,在职考研人数持续攀升,其中MBA、MPA、MEM、EMBA MPAcc等管理类专硕考专业由于备考难度相对较低 招生名额多受到了学生的广泛关注
2026-02-14 08:48:00
当下女生越来越注重经期的私处健康,大家对产品的安全健康要求越来越高。高洁丝作为率先开启行业大健康元年的品牌,2025年全面从卫生护理品牌转型为健康护理品牌
2026-02-14 08:48:00
泰开大容量出口型新能源箱变顺利通过型式试验
鲁网2月13日讯2026年全球光伏新增装机预计500-667GW,其中海外市场占比超75%。光伏箱变作为核心并网设备,市场前景广阔
2026-02-14 08:49:00
“春启市南 策马迎新” 青岛市市南区零售、餐饮消费券活动重磅来袭!
鲁网2月14日讯青岛市市南区于2026年2月14日正式启动 “春启市南 策马迎新”零售、餐饮消费券发放活动,总额500万元
2026-02-14 09:21:00
2026年或被称为AI应用的元年,技术突破、产业融合、政策支持,共同推动了AI从技术验证向商业化兑现。虽然规模化依然是个问题
2026-02-14 09:53:00
2月7日,字节跳动旗下视频生成模型Seedance2.0正式亮相,并在A股市场引发热议,同时也带火了AI应用概念。Seedance2
2026-02-14 09:53:00