• 我的订阅
  • 头条热搜
空间智能产业化加速 一线企业集体锚定百度智能云
...实现了图像、语音等多模态数据的毫秒级响应,通过语音指令、视觉反馈等,满足百科问答、地图导航、实时翻译、图像识别、会议纪要等场景需求,实现前所未有的穿戴体验。今年5月,国内AI+AR领域创新企业李未可科技在新品...……更多
文档处理效能飙升!浩鲸科技“文档大模型”核心技术揭秘!
在当今大模型技术日新月异的背景下,数据已跃升为构建企业大模型知识库、优化训练与微调,乃至驱动模型创新不可或缺的核心要素。对于企业来说,积累的宝贵知识广泛散布于形式多样的电子文档之中,这些文档不仅格式...……更多
阿里万相视频生成大模型重磅开源!消费级显卡也能运行
...ggingFace、魔搭社区下载体验。据介绍,14B版本万相模型在指令遵循、复杂运动生成、物理建模、文字视频生成等方面表现突出,在权威评测集Vbench中,万相2.1以总分86.22%大幅超越Sora、Luma、Pika等国内外模型,稳居榜首位置。1.3B...……更多
vivo蓝心大模型升级为“自研ai多模态大模型”
...销月的销量是上一代的432%。同时黄韬宣布,vivo的蓝心大模型升级为“自研AI多模态大模型”,这项技术通过视觉、声音、空间等多维度感知和理解世界,使大模型变得更加全面、智能和强大。蓝心大模型的使命是确保科技革命...……更多
无问芯穹开源全球首款端侧全模态理解模型 Megrez-3B-Omni
...今日宣布,开源无问芯穹端侧解决方案中的全模态理解小模型 Megrez-3B-Omni 和它的纯语言模型版本 Megrez-3B-Instruct。官方表示,Megrez-3B-Omni 是一个为端而生的全模态理解模型,同时具备图片、音频、文本三种模态数据的处理能力:...……更多
浙大校友自研跨模态模型,打造具身智能的“通用语法”
...全同时提高通行效率。 此外,LPLM 还增强了对自然语言指令的理解和执行能力。谈及这项能力重要的原因,陈俊波举例说道:“为什么目前的各类 Robo-taxi 虽然可用,但依然无法取代司机?原因之一在于,当我们提供一些比较模...……更多
阿里Qwen3登顶全球最强开源模型,用8款模型夺回中国AI话语权
...Pro等顶级模型相当,代码运行没有问题,但没有严格遵循指令,生成的可视化内容因太小而难以阅读。此外,多位用户还提到,Qwen3存在过度思考的问题,导致思考过程太长,而且默认的思维模式对更复杂的任务来说非常不可用...……更多
打开大模型的无限可能,云栖通道看AI产业应用
...待。 ” 开源大模型灵活运用,给AI机器人注入灵魂一个指令,人形机器人就能完成唱跳RAP、搬运货物、巡线避障、花式足球等高难度动作。在云栖大会计算馆的通义灵码展位,“素人”都能掌控的小型机器人,吸引了众多观众...……更多
神仙打架!谷歌新款大模型Gemini 和GPT-4谁能笑到最后?丨科技观察
...”的Gemini,究竟有什么杀手锏?拿出一张世界地图,发出指令,“根据你现在所见,想一个游戏,还要用emoji表情呈现。”Gemini即刻给出回答,“我们可以玩一个叫做‘猜国家’的游戏”,然后为你提供几个线索“考拉”、“袋...……更多
国产“Sora”亮相中关村,文生视频相关个股有哪些
就在昨日,我国人工智能大模型领域又迎来重大突破,AGI的真正连锁反应或将从视频开始。4月27日上午,“2024中关村论坛-未来人工智能先锋论坛”在北京正式举办,本次平行论坛由科学技术部、北京市人民政府主办,旨在进一...……更多
中国科技创新“乘”数直上
...2023第二届全球数字贸易博览会上了解华为研发的盘古大模型的应用。 龙 巍摄(人民图片)当今时代,数据已成为重要的创新要素。人工智能大模型、新材料创制、生物育种、基础科学研究等都离不开数据的支撑。国家数据局...……更多
新扩散模型OmniGen一统图像生成,架构还高度简化、易用
...化。此外,与现有模型相比,它更加用户友好,可以通过指令完成复杂的任务,而不需要冗长的处理步骤和额外的模块 (如 ControlNet 或 IP-Adapter),从而大大简化了工作流程。 知识迁移:受益于统一格式的学习,OmniGen 有效地跨不...……更多
昆仑万维SkyReels团队正式发布并开源SkyReels-V2
...ch包含1020个文本提示词,系统性地评估了四个关键维度:指令遵循、运动质量、一致性和视觉质量。该基准旨在评估文本到视频(T2V)和图像到视频(I2V)生成模型,提供跨不同生成范式的全面评估。在SkyReels-Bench评估中,SkyReels-V2在...……更多
科学家开发多模态音乐理解和生成大模型,兼具理解和创作音乐能力
...如音乐中包含哪些乐器等。后者指的是不仅可以根据用户指令生成音乐,比如生成一段吉他弹奏的音乐,还能根据用户输入的图像或视频生成音乐。图丨通过 M2Ugen 大模型进行多模态音乐理解和生成(来源:arXiv) 近日,相关论...……更多
顶流大模型应用!天工AI不炫技,实测真正的生产力工具
...API流量,其中就包括中国。这意味着国内大量“套壳”大模型将无法使用,而自研大模型凸显价值。这无疑给国内的自研大模型创造了机会,同时也将迎来更为拥挤的竞争,5月大厂大模型们价格大战后让中国大模型的商业模式...……更多
千行百业加速拥抱大模型(AI前沿观察)
...术创新快 应用渗透强 国际竞争激烈千行百业加速拥抱大模型(AI前沿观察)潘旭涛 陈斯达《 人民日报海外版 》( 2023年12月22日 第 08 版)在湖南省长沙市举办的2023世界计算大会专题展上,参观者在了解AI大模型。新华社记者 ...……更多
国际首个,我国团队开发糖尿病诊疗多模态大模型 DeepDR-LLM
...作研究,构建了全球首个面向糖尿病诊疗的视觉-大语言模型的多模态集成智能系统 DeepDR-LLM,成果于 2024 年 7 月 19 日在 Nature Medicine 发表(题为 Integrated image-based deep learning and language models for primary diabetes care)……更多
...GLM-4 All Tools实现自主根据用户意图,自动理解、规划复杂指令,自由调用网页浏览器、Code Interpreter代码解释器和多模态文生图大模型以完成复杂任务。 Tims天好咖啡与申通地铁达成合作36氪获悉,连锁咖啡品牌Tim Hortons中国业务...……更多
2024WAIC热议大模型助力产业新趋势,可信应用成焦点
作者:赖文昕编辑:陈彩娴2024 年已经过半,大模型技术的角逐也逐渐从上半场的「百模大战」转向下半场聚焦落地「千行百业」的产业应用。过去短短 2 个月以来,全球 AI 界接连开展了数十场发布会,从海外的英伟达、OpenAI...……更多
vivo自研大模型全家桶炸场,亮出PhoneGPT智能体,蓝心小V一键搞定衣食住行
...新的AI战略“蓝心智能”,同时发布了升级的自研蓝心大模型矩阵、原系统5(OriginOS 5)、蓝河操作系统2(BlueOS 2)等多项新产品和技术升级。vivo高级副总裁、首席技术官施玉坚首先登台,他提到,在过去三年和今年前三季度,v...……更多
支付宝发布多模态医疗大模型:支持千亿级视觉识别
...消息,在2024世界人工智能大会上,支付宝多模态医疗大模型正式亮相,成为国内首批多模态医疗大模型之一。据悉,该医疗大模型的基石,源自蚂蚁集团自主研发的蚂蚁百灵大模型,这一先进平台不仅拥有“视听言画”全方位...……更多
豆包“王炸”:字节跳动一天发布两款视频生成大模型
...体互动和一致性难题此前视频生成模型大多只能完成简单指令,豆包视频生成模型则能实现自然连贯的多拍动作与多主体复杂交互。有创作者在抢鲜体验豆包视频生成模型时发现,其生成的视频不仅能够遵循复杂指令,让不同人...……更多
本文转自:中国新闻网只需要一段文字指令就能生成一段60秒精致细腻的视频——今年2月起,文生视频大模型Sora曾在全球人工智能业内外引发震动。近日,在2024中关村论坛年会未来人工智能先锋论坛上,生数科技联合清华大学...……更多
荣耀Magic V5发布,一文看懂YOYO到底有多强大
...只需在浏览财经APP时,对YOYO下发“分析黄金投资前景”指令,便可以在左边屏幕继续刷实时行情,YOYO会在右边屏幕同步调取国际金价走势、国际利率变化等海量数据,通过AI算法拆解“影响金价的三大核心因素”,甚至算出不...……更多
智谱AI“中国版Sora”实测:6秒视频排队2分钟,猫猫很可爱,人手很翻车
...番,有以下几点发现:1、简短的提示词效果更好,复杂指令下会丢失细节。2、人手仍是重灾区,容易出现画面闪烁的现象。3、生成很快,但加上排队等待时间仍达到1-2分钟。4、相比图生视频,文生视频的稳定性更高。当然,...……更多
首个VR端3D角色扮演AI发布!南洋理工公开SOLAMI技术报告,端到端VLA模型驱动,唱跳都能陪你玩
...训练过程模型的训练主要分为两个阶段:多任务预训练和指令微调训练。多任务预训练阶段主要使用动作-文本、语音-文本相关的数据集进行训练,训练任务包括 text-to-speech, automatic speech recognition,speech-to-speech,motion under……更多
多模态竞技场对标90B Llama 3.2!Pixtral 12B技术报告全公开
...ench)的新基准测试,风格与纯文本的MT-Bench类似,以评估指令调整的多模态模型的性能。 MM-MT-Bench总共包含92个对话(单回合对话69个,2回合对话18个,3回合对话4个,4回合对话1个),涵盖了广泛的实际使用案例,包括五类图像...……更多
智谱落地模力社区,助力浦东构建大模型产业生态圈
...)正式签署战略合作,双方联合发布“模力社区-智谱大模型MaaS平台”。未来“模力社区”的企业可以更低成本、更便捷地使用大模型服务。浦东新区副区长李慧表示,浦东新区始终站在技术创新的潮头,积极拥抱新兴赛道和未...……更多
2023开年热词「大模型」「出海」,现在怎么样了?
...如提供大量的写作模板和AI工具包,不需要学习 Prompt 和指令拆解,就可以傻瓜式填空轻松上手,对于已有的文件也可以导入后进行二次AI创作处理,这一本土化改进也为AI写作市场下沉提供了良好的亲民形象。讯飞写作 产品页面...……更多
给机器人装上大模型大脑,「若愚科技」获超5000万天使轮融资|36氪首发
...言和意图、以及多模态环境的能力,当机器人接收到任务指令时,模型能够感知多模态环境,对任务进行多粒度拆解,将上一步的输出作为下一步的输入,形成一个循环的时间序列规划执行。这样,即使遇到意料之外的情况,机...……更多
更多关于科技的资讯:
人工智能不仅是一种技术,也是一个产业,更是一个时代。最近,AI杭州的目光纷纷投向钱江世纪城。先是长三角首个“芯-模-用”全链条AI产业社区芯模社区启航
2025-12-08 07:52:00
为期三天的消费狂欢落下帷幕!12月7 日,第六届杭州市中小商贸流通企业服务节暨2025惠民汽车消费季在拱墅区运河广场圆满收官
2025-12-08 07:52:00
刘沛雨摘要:本文主要从转型升级时期中小企业的管理创新方面展开分析,在市场发展变化迅速的局面下,通过应用一些管理创新手段和方法
2025-12-08 05:10:00
正值中国首个跨境电商综试区——杭州综试区设立十周年,也恰逢亚马逊全球开店(以下简称“亚马逊”)业务在中国开展运营十周年的重要里程碑
2025-12-08 07:21:00
杭州商业航天产业迎来重磅落子。近日,箭元科技与钱塘(新)区签署协议,其“元行者一号”液体运载火箭回收复用基地正式落地钱塘(新)区前进智造园
2025-12-07 08:23:00
近日,一项重要国家标准——《电磁兼容 电磁兼容标准起草导则》工作会议在云栖小镇召开。这份由上海机器人产业技术研究院牵头起草的文件
2025-12-07 08:53:00
湖北农发旗下米来生物荣获2025欧洲食品配料展食品与饮料技术创新大奖
12月2日,法国巴黎,在欧洲食品科技领域最具影响力的盛会——欧洲食品配料展(Food Ingredients Europe
2025-12-07 16:44:00
当城市核心区的物理空间增长几近饱和,未来的竞争力新高地何在?12月5日,一场发布会以别开生面的“数字气味”体验开场,为上城区加快建设中央创新区(CID)的战略发布
2025-12-07 07:21:00
日前,山西转型综改示范区入区企业山西恒真真空玻璃科技有限公司自主研发的新产品——“真空发热玻璃”上市。这一产品将高效真空玻璃技术与新型半导体制热技术深度融合
2025-12-07 07:32:00
生产设备共享给清河羊绒带来什么——河北特色产业集群共享智造故事(四)纱线在电脑横机上来回穿梭、电商平台的提示音此起彼伏……随着冬季来临
2025-12-06 08:04:00
厦门移动智慧康养产品亮相首届海峡两岸(厦门)银发博览会
市民现场体验移动随心屏(闺蜜机)的AI舌象问诊功能。厦门网讯 (文/厦门日报记者 许晓婷 王玉婷 通讯员 陈奕珣 图/厦门移动 提供)伸出舌头拍一拍
2025-12-06 08:26:00
厦门网讯 (厦门日报记者 林露虹)刷到一部微短剧,不知不觉被剧情吸引,回过神来看介绍,发现竟是AI参与制作的。类似经历
2025-12-06 08:26:00
从“手搓”到“智造” 厦门跑步机“跑”向全球
厦门网讯 (厦门日报记者 詹文 林健华)在位于同安工业集中区的生产车间里,一节一节钢板正传送上激光切割台,自动切割、打孔
2025-12-06 08:26:00
共建共享破局资源瓶颈:临沂联通与电信合作以5G RedCap创新实现业务与服务双突破
鲁网12月5日讯近日,临沂联通与临沂电信深度践行国家共建共享战略,成功完成全省首个基于电信800M频段的5G RedCap技术承载联通物联网专网业务的商用落地
2025-12-06 13:44:00
中国青年报客户端讯(中青报·中青网记者张均斌)近日,“中央引导地方”专项科技赋能文化方向立项课题——“面向文博场景的智能伴游导览系统研发及示范应用”启动会
2025-12-06 15:25:00