• 我的订阅
  • 科技

Kimi视觉思考模型k1发布:数理化超越OpenAI o1、GPT-4o

类别:科技 发布时间:2024-12-16 11:18:00 来源:浅语科技

快科技12月16日消息,今日,月之暗面国产大模型Kimi发布视觉思考模型k1,k1基于强化学习技术打造,原生支持端到端图像理解和思维链技术,并将能力扩展到数学之外的更多基础科学领域。

k1已陆续上线最新版Kimi智能助手的Android和iPhone APP以及网页版kimi.com。

在最新版手机APP或网页版Kimi+页面找到Kimi视觉思考版,即可拍照或传图体验。

Kimi视觉思考模型k1发布:数理化超越OpenAI o1、GPT-4o

据了解,在数学、物理、化学等基础科学学科的基准能力测试中,初代k1模型的表现超过了全球标杆模型OpenAI o1、GPT-4o以及Claude 3.5 Sonnet。

Kimi视觉思考模型k1发布:数理化超越OpenAI o1、GPT-4o

官方表示,K1模型真正意义上实现了端到端的图像理解和思考能力,模型可以直接处理用户输入的图像信息并进行思考得出答案,不需要借助外部的OCR或额外视觉模型进行信息处理。

从模型训练的角度看,k1的训练分为两个阶段,先通过预训练得到基础模型,再在基础模型上进行强化学习后训练。

Kimi视觉思考模型k1发布:数理化超越OpenAI o1、GPT-4o

k1的基础模型重点优化了字符识别能力,在OCRBench上得到903分的当前最好(state-of-the-art)结果,在MathVista-testmini、MMMU-val 和DocVQA基准测试集上分数分别为69.1、66.7和96.9,处于全球第一梯队水平。

Kimi视觉思考模型k1发布:数理化超越OpenAI o1、GPT-4o

据介绍,k1的强化学习后训练在数据质量和学习效率方面做了进一步优化,在强化学习的规模化(scaling)上取得了新的突破,这是k1视觉推理模型在基准测试中取得行业领先成绩的最关键原因。

Kimi视觉思考模型k1发布:数理化超越OpenAI o1、GPT-4o

月之暗面坦言,在内部测试中也发现了一些k1视觉思考模型存在的局限性,例如在分布外(out-of-distribution)的泛化、在更复杂问题上的成功率、在更多噪声场景的准确率、多轮问答效果等方面,有很大提升空间。

在一些场景和泛化能力上,k1模型与OpenAI的o1系列模型相比仍有差距。

【本文结束】如需转载请务必注明出处:快科技

责任编辑:拾柒

文章内容举报

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2024-12-16 14:45:11

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

能看风水 夸我有情趣 Kimi现在都这么野了吗
...视觉能力,意思就是可以直接拍照上传解题,还号称能在数理化上打平甚至超越 Open AI 的 o1 。那要是这么比的话
2024-12-19 00:21:00
扩散模型训练方法一直错了!谢赛宁:Representation matters
...」?他表示:「我们可能一直都在用错误的方法训练扩散模型。」即使对生成模型而言,表征也依然有用。基于此,他们提出了 REPA
2024-10-15 09:57:00
迎战GPT-4V!谷歌PaLI-3视觉语言模型问世,更小、更快、更强
...况,这一举动引起了业界的广泛关注。然而,在视觉语言模型的角逐中,谷歌也不甘示弱。 近日,Google Research
2023-10-17 16:31:00
训练数据超20亿 云从科技视觉大模型刷新四项世界纪录
近日,云从科技在视觉大模型上取得重要进展,行人基础大模型在PA-100K、RAP V2、PETA、HICO-DET四个数据集上从阿里巴巴
2023-07-22 01:00:00
LeCun 的世界模型初步实现!基于预训练视觉特征,零样本规划
...Yann LeCun 批评 LLM 的推文之一相反,他更注重所谓的世界模型(World Model),也就是根据世界数据拟合的一个动态模型
2024-11-19 09:48:00
类人神经网络再进一步!DeepMind最新50页论文提出AligNet框架:用层次化视觉概念「对齐」人类
...提出了一种新框架AligNet,通过模拟人类判断来训练教师模型,并将类人结构迁移到预训练的视觉基础模型中,从而提高模型在多种任务上的表现,增强了模型的泛化性和鲁棒性,为实现更
2024-09-23 10:00:00
英伟达开源NVLM 1.0屠榜多模态!纯文本性能不降反升
【新智元导读】NVLM 1.0系列多模态大型语言模型在视觉语言任务上达到了与GPT-4o和其他开源模型相媲美的水平,其在纯文本性能甚至超过了LLM骨干模型,特别是在文本数学和编码
2024-09-24 13:36:00
商汤发布开源社区最大最强多模态多任务通用大模型“书生2.5”
商汤发布开源社区最大最强多模态多任务通用大模型“书生2.5” 3月14日,商汤科技发布多模态多任务通用大模型“书生(INTERN)2.5”,在多模态多任务处理能力方面实现多项全新
2023-03-15 13:30:00
华人团队爆火instructblip抢跑看图聊天
碾压GPT-4识图能力的多模态生成模型来了。华人团队最新提出的InstructBLIP在多项任务上实现SOTA。GPT-4看图聊天还没上线
2023-05-15 20:17:00
更多关于科技的资讯:
传统城市形象传播中,政府是主导者。而具创新性的广州“城市合伙人”计划则打破传统赞助模式的边界,向全球征集“奋斗共同体”
2026-01-06 11:04:00
河北日报讯(记者刘英)近日,《廊坊市人工智能产业聚集区建设方案》(以下简称《方案》)正式发布,系统谋划布局人工智能产业发展新蓝图
2026-01-06 08:14:00
京津研发河北转化进行时(五):创新种子何以在这里开花结果
近三年间,12项京津研发成果在晨光生物完成转化创新种子何以在这里开花结果近日,位于曲周县的晨光生物科技集团股份有限公司中试中心内
2026-01-06 08:18:00
四中全会精神在基层|“产业大脑”高效协同 线缆企业多重受益
2025年12月6日,宁晋县河北易缆网络科技有限公司展厅,易缆网平台负责人王洪喜介绍平台功能。 河北日报记者 闫德见摄2025年12月6日10点30分
2026-01-06 08:25:00
福建省“最美科技工作者”、厦门金鹭研发工程师高兰兰:微米之间磨刃 宝刀谁与争锋
高兰兰介绍立铣刀切削的弧度和精度。用UP300系列通用高性能立铣刀切削而成的“青鸾”金属雕塑。厦门网讯 (文/厦门日报记者 李晓平 图/厦门日报记者 黄晓珍)在金属切削的微观世界里
2026-01-06 08:38:00
厦门网讯 (厦门日报记者 林露虹)2025年12月以来,厦门企业融资捷报频传,主要涉及人工智能、新材料领域,彰显厦门在培育新质生产力方面的蓬勃活力
2026-01-06 08:38:00
临沂圣陶高级中学举行高三英语教学传承分享会
鲁网1月5日讯近日,临沂圣陶高级中学“杏坛薪火·师道赓续”专家教师教学传承分享会如期举行,为高三英语一轮复习注入新动能
2026-01-06 09:37:00
20个福建品牌入选中国消费名品其中5个来自厦门,分别为银鹭、暴龙、鹭岛卫浴、瑞尔特和燕之屋东南网1月6日讯(海峡导报记者 黄奕琳)昨日
2026-01-06 10:33:00
厦门网讯(厦门日报记者 沈彦彦)新年伊始,政策红利与节庆消费碰撞出红火“好市”。据厦门市商务局发布的数据显示,2026年元旦假期
2026-01-06 08:38:00
国补山东落地 山东消费者来京东换新单人至高可省11000元
1月4日,2026年国家以旧换新补贴落地山东,京东线上线下全面承接国家补贴落地。山东消费者到京东APP搜索“山东以旧换新”即可进入国补页面
2026-01-06 10:12:00
内存硬盘身价翻倍 存储产品成“年度理财产品” 业内预测:今年手机、电脑将迎来涨价
移动固态硬盘价格比一年前明显上涨“年初买的内存条年底价格已经翻倍!”“不看购买记录不知道,一看吓一跳,连固态硬盘的‘身价’都在一直上涨
2026-01-06 08:09:00
前不久,“魔搭社区”(杭州)开发者中心在杭州云谷中心正式启用。“魔搭社区”是在2022年云栖大会上由中国计算机学会(CCF)开源发展技术委员会与阿里巴巴共同发起的AI模型开源平台
2026-01-06 08:09:00
从春晚舞台上16台机器人甩手绢扭秧歌的惊艳亮相,到机器人半程马拉松的耐力角逐,再到拳击擂台上的对攻,2025年的机器人产业以肉眼可见的速度“狂飙突进”
2026-01-06 07:34:00
君同未来推出“AI+大模型全生命周期智能治理应用”,为AI装上“方向盘”和“安全带”;炽橙科技自主研发的“炽橙AIDT工业多智能体开发平台”
2026-01-06 07:38:00
2026年1月1日,国际顶尖学术期刊《Science》在线发表了中国科学院院士、中国科学院杭州医学研究所所长、浙江省肿瘤医院院长谭蔚泓与吴芩研究员团队合作取得的重要突破
2026-01-06 07:08:00