• 我的订阅
  • 头条热搜
OpenAI机器人亮相,大模型有了“肉身”,英伟达微软都有投资
...麦克风捕捉的语音,转录为文本输入到由OpenAI预训练的多模态大模型中,模型能够理解图像和文本。模型会处理整个对话的历史记录,包括以往的图像,以生成语言响应,再通过文本到语音的方式向人类回话。△Figure 01训练方法...……更多
“不要卷模型,要卷应用!”李彦宏谈AI:大模型公司热衷于写高考作文,价值不大
...,拥有高度仿生的躯干构型和拟人化的运动控制,支持多模态机动、多模态感知、多模态交互和多模态操控,全身多达43个主动自由度,最大关节峰值扭矩400N.m,算力支持400TOPs。 图片来源:上海证券报运动能力上,“青龙”人...……更多
AI智能体引擎加持:天玑9400让「完全体」AI手机提前问世了
...抓不住经典瞬间了。相比之下更加「基础」的能力,如多模态大模型的推理,也可以在手机端侧进行:无论是拍数学题让 AI 解题,还是看一张外文菜单让 AI 帮忙点菜,都是几秒钟就能办到的事。这一系列技术的驱动力,都来自...……更多
李彦宏:大模型场景下开源是最贵的,多模态是通往AGI的必经之路
...和案例大部分都是基于大语言模型。面向未来,他认为多模态大模型,抑或是文字、图片、语音、视频等多模态的融合,是基础模型非常重要的长期发展方向,是通往AGI(通用人工智能)的必经之路。而百度在这些领域有着长期...……更多
回顾GPT大模型2023这一年,5大顶级公司预测2024年AI产品
...到新高度 ;Andrej:从 Tesla 回归的创始成员和 CV 大牛,多模态的加速器 ;Mira:新晋 CTO,AI 人机交互领域最重要的 PM 之一;Lilian Weng:前沿技术和应用研究的桥梁;Jakub Pachocki:GPT-4预训练的核心 Lead;等等几乎是硅谷甚至是全球.……更多
...制,结合行业专业知识,经过不断训练和优化构建出的多模态自研行业大模型,具备在船舶设计、性能预测、航运气象服务等特定领域任务处理能力,可以助力船舶与海洋工程行业提高工作效率。船舶与海洋工程行业作为典型的...……更多
四川省人工智能产业链产品发布会在成都高新区举行
...布会现场,成都高新区企业带来的诸葛大模型、行者AI多模态大模型、银海闻语大模型、中科创达医疗大模型集中亮相。其中,诸葛大模型是成都高新区与智谱联合打造的首个省级基座大模型,基于全自研GLM技术架构,深度融合...……更多
云计算一哥终于搞多模态了:一口气6个大模型,还有个3nm芯片!
...—亚马逊CEO Andy Jassy亲自站台re:Invent24,发布自家新款AI多模态系列大模型,名曰Amazon Nova。而且是一口气涵盖文本对话、图片生成、视频生成,甚至直接吐露一个小目标:将来我们不仅要Speech to Speech,更要Any-to-Any!整体而言,Am...……更多
百万鲁棒数据训练,3D场景大语言模型新SOTA!IIT等发布Robin3D
...高模型在3D场景理解中的鲁棒性和泛化能力,在多个3D多模态学习基准测试中取得了优异的性能,超越了以往的方法,且无需针对特定任务的微调。多模态大语言模型(Multi-modal Large Language Models, MLLMs)以文本模态为基础,将其它...……更多
掌握创新“主动权” 中国电信掘金未来产业
...人工智能+”行动。自主研发覆盖语义、语音、视觉、多模态的星辰大模型产品矩阵,综合能力进入国内一线阵营。积极推动人工智能应用创新,全面开放场景,联合产业伙伴推动大模型深度应用,面向新型工业化、应急、教育...……更多
携手全球龙头企业,商汤科技与罗氏诊断达成合作
...决方案——“易问e答”。该系统以商汤自研的日日新多模态大模型为技术底座,融合罗氏诊断数十年积累的专业知识,为体外诊断行业量身打造出一位“真正懂行”的AI助手,全面提升客户服务体验与工作效率。聚焦专业,精准...……更多
vivo自研大模型全家桶炸场,亮出PhoneGPT智能体,蓝心小V一键搞定衣食住行
...幕的力度、圈搜文字或图片、还是拖拽一段地址信息,多模态大模型都可以深度解读你的意图,进而给你需要的反馈和服务。依托文本大模型,结合自监督学习语音编解码、多语音任务学习和模态对齐等技术,蓝心小V在文本能...……更多
商汤启动智慧医院建设示范样板工程
...第一医院、北京清华长庚医院,在行业内率先启动医疗多模态大模型赋能的智慧医院创新示范共创,打造由大模型“智慧中枢”驱动的智慧医院建设示范样板。2024世界人工智能大会(WAIC)期间,多方正式签约。作为医疗多模态...……更多
WOT全球技术创新大会2024北京站:探索AI 的无限可能
...里巴巴、Fabarta、商汤科技的三位老师带来精彩分享。多模态AIGC前沿探索专题竞技世界在直播亮点和舆情感知两个真实场景中,如何使用多模态AIGC在实际应用中获取价值?万物云如何通过结合文本和图像输入,利用AI算法自动生...……更多
...公告,中国第一汽车股份有限公司申请一项名为“副车架模态计算有限元建模方法、装置、终端及存储介质“,公开号CN117216865A,申请日期为2023年7月。专利摘要显示,本发明属于汽车技术领域,具体的说是一种副车架模态计算...……更多
具身智能竞速时刻,百度百舸提供全栈加速方案
...供显著性能提升:VLM 模型:针对 VLM 模型训练,AIAK 在多模态数据处理(如数据 Packing、图文视频混训、多轮对话支持)、长序列显存管理(序列并行、高效显存策略)以及模型并行策略(混合切分,保障负载均衡)等方面进行...……更多
...为,从Pika、Gemini1.0到Sora和Gemini1.5,支持AI视频生成的AI多模态模型不断突破,特别是Sora能够理解和模拟现实世界的模型基础,有望成为实现AGI(通用人工智能)的重要突破节点。AI视频生成等多模态模型有望在影视、动画、游戏...……更多
...好用”。5月14日,OpenAI在官网正式发布新旗舰模型GPT-4o多模态大模型,相较于4月发布的GPT-4Turbo速度更快、价格更便宜;5月15日,谷歌在I/O 开发者大会上发布了通用AI新模型Project Astra,可实现跨文本、音频、视频多模态实时推理...……更多
...互动,没法解决更多的问题,但其实更多的场景是需要多模态组合,结合不同其他的模块,做你自己的产品。一个小公司,把GPT和相关的能够结合的模块熟悉掌握了,就已经能够涉及很多的行业领域了,也能够实解决很多的痛点...……更多
开源证券:多模态模型再迎新突破,继续布局AI应用及算力
...议关注券商、银行。(三)券商行业掘金 开源证券:多模态模型再迎新突破,继续布局AI应用及算力1、OpenAI发布首个文生视频模型Sora,可输出长达60秒的视频2月16日凌晨,OpenAI发布了首个文生视频模型Sora。Sora可以直接输出长...……更多
GPT-4劲敌,谷歌进入高能+高产模式
...与微软争相拼臂力秀肌肉。Gemini 1.5 Pro的横空出世,将多模态大模型的标准提到了一个新高度。一、极致性能背后的模型架构当地时间2月15日,Alphabet与Google公司首席执行官Sundar Pichai携首席科学家Jeff Dean等众高管在X平台发布了多...……更多
...征点的三维模型快速匹配系统高逼真数字人快速构建与多模态交互系统虚拟空间创作平台3D沉浸式实时通信系统3D实景地图平台基于文本描述的3D场景生成系统元宇宙数字身份标识技术解决方案人形机器人揭榜挂帅任务榜单:全身...……更多
...、对外经贸大学发起的《面向科技保险的内生统一架构多模态大模型技术研究及应用》课题,入选北京市科学技术委员会2024年度“中央引导地方”专项金融科技方向立项课题。这是较早涉足保险多模态大模型技术研究的课题,...……更多
除却AI不是云 智算为云服务增量送助攻
...发布了千亿参数规模的星辰语义大模型、视觉大模型和多模态大模型。教育、医疗、政务等行业已规模商用20多个行业场景大模型…… 天翼云之所以能够取得如此显著的成绩,离不开中国电信多年的战略布局和技术创新。中国电...……更多
“Sora”王炸,20篇研报带你走进人工智能(下载)
...手段;三是专属、自建模型将在中大型企业涌现;四是多模态大模型拓展服务边界,带来更丰富的用户体验;五是AI Agent(人工智能代理)是大模型落地业务场景的主流形式;六是AIGC加速超级入口的形成;七是业务流程转向“无...……更多
清华教授唐杰:Scaling Laws虽被质疑,但至今仍是提高大模型性能的重要方法
...事实性以及推理能力的缺陷,实现更精细的语义理解、多模态(文本、图像、语音、视频等)输入和输出,具备更强的个性化能力。”“人工智能的发展会更多瞄向通用人工智能,实现AI的自我解释、自我评测和自我监督,构建...……更多
硅谷顶级VC的最新洞察:AI公司应该专注用户需求,而非模型构建
...司,直到ChatGPT的飞速增长引起了广泛关注。我认为不同模态的模型或模型应用领域存在机会,比如视频领域、生物技术、临床医学等。我认为我的基金将大部分投资于应用方向,但目前还投资了一些基础模型公司。Elad Gil:我非...……更多
OpenAI推出GPT5模型引爆AI竞赛,微软/谷歌/微美全息加码千亿市场竞逐AGI
...应。目前,GPT-5有四个版本,针对逻辑、多步骤任务和多模态企业应用程序进行了优化。开发人员可以通过AzureAIFoundry利用GPT-5,利用其模型路由器来确保AI驱动的应用程序中特定于任务的精度。另一边,近日,谷歌(GOOG.US)Deepmind...……更多
讯飞输入法发布行业首个输入法认知大模型:生成式AI全赋能
...一代输入法认知大模型,涵盖文本生成、多语言语音、多模态生成的生成式AI能力矩阵,做更靠近业务的解决方案。丁克玉特别提到,当前一代的输入法基于编解码模式预测输出,对用户意图理解能力有限。然而下一代的输入法...……更多
上海码极客人工智能科技有限公司盛大开业 开启人工智能新篇章
...绿洲隆重举行。活动发布了公司最新产品——悠然视界全模态AI交互智能体。上海市副市长、闵行区委书记陈宇剑,闵行区委副书记、区长陈华文,同济大学党委常务副书记冯身洪,上海市文史研究馆馆长汪胜洋,上海市委组织...……更多
更多关于科技的资讯:
基于“祖冲之2号” 中国科大首次实现量子体系高阶非平衡拓扑相
大皖新闻讯 11月28日,大皖新闻记者从中国科学技术大学获悉,该校潘建伟、朱晓波、彭承志、龚明等学者牵头合作,基于可编程超导量子处理器“祖冲之2号”
2025-11-28 12:52:00
摘要:品牌战略对于企业品牌形成和竞争力的提升有着不可替代的作用,随着市场竞争越来越激烈,品牌战略成为企业争夺市场的一个有力武器
2025-11-28 06:49:00
坚定信心 勇挑大梁·产业新亮点丨河北特色产业集群共享智造故事(二):技术创新共享给安平丝网带来了什么
技术创新共享给安平丝网带来了什么——河北特色产业集群共享智造故事(二)11月21日,安平县高新区绿色产业园区,河北丝筘金属制品有限公司车间里
2025-11-27 08:12:00
海底捞、阿嬷手作等品牌接入,顺丰同城“独享专送”餐饮品类单量同比激增3倍
随着即时零售市场的持续扩张和竞争深化,消费者对即时配送的需求正从“送达”向“送好”升级,推动即时配送加速服务分层,以准时
2025-11-27 08:16:00
风格各异的手作店、静谧雅致的咖啡馆、独具韵味的民宿……如今,在河北很多城市的街头巷尾,小店经济快速发展,在促进消费、扩大就业
2025-11-27 09:02:00
济南海尔第九届感恩月重磅启幕 以真心回馈亿万用户信赖
鲁网11月27日讯11月26日,济南海尔感恩月启动会拉开帷幕。以更加诚挚的福利、更具力度的优惠,回馈用户多年来的信赖与支持
2025-11-27 11:05:00
伽利略智能仿生四足防爆机器人EX-1重磅亮相2025中国国际应急管理展览会 开创高危环境智能作业新纪元
2025年11月18日至20日,以"新质赋能 智慧应急"为主题的2025中国国际应急管理展览会在北京国家会议中心隆重举办
2025-11-27 11:47:00
2026中国特许加盟展全年档期正式发布:两展三会贯通全年,全球特许盛宴即将启幕
由全国性行业组织中国连锁经营协会主办的中国特许加盟展公布2026全年展会规划,将继续采取全国巡展模式,以"两展三会"的形式贯通全年
2025-11-27 11:47:00
中新经纬11月27日电 题:机器人去景点“上班”,游客的快乐从哪里来?作者 周慎 中国科学技术大学科技传播系副研究员、徽州人工智能研究院院长近日
2025-11-27 12:15:00
执“碳”为尺 绘就绿色物流新图景
鲁网11月26日讯冬日清晨的泰山脚下,山东省泰安市烟草专卖局(公司)送货员刘婷正用扫码枪轻触循环周转箱上的智能芯片,“您瞧
2025-11-27 12:15:00
中新经纬11月27日电 国务院新闻办公室27日举行国务院政策例行吹风会,介绍增强消费品供需适配性进一步促进消费政策措施有关情况
2025-11-27 12:20:00
海外科技媒体Tech Times:AI助手“灵光”让难题处理“如清风拂面般轻松”
蚂蚁集团11月18日推出的全模态通用AI助手“灵光”在国内迅速出圈后,引发海外科技媒体和社交平台的关注。美国知名科技媒体《科技时代》(Tech Times)报道称
2025-11-27 14:32:00
华为新品发布会藏惊喜!来华为浏览器解锁资讯获取新方式
2025年11月25日,华为Mate 80系列|Mate X7及全场景新品发布会如期而至,这场科技盛宴备受瞩目。在首发搭载的HarmonyOS 6操作系统与Mate 80新机的双重赋能下
2025-11-27 14:41:00
胜者智选:全人成长新范式 锚定教育变革核心
从体质强健到能力培养,从AI融合到成本理性化,教育行业正迈向健康底色、核心能力、创新素养的全人培养新阶段。在此背景下,胜者教育旗下核心品牌“胜者智选”以生态化布局回应时代需求
2025-11-27 14:43:00
网易云音乐“AI写歌”功能上线测试 普通人也能“玩”音乐
近日,网易云音乐旗下网易天音“AI写歌”趣味功能上线测试,旨在用AI降低音乐创作门槛,帮助音乐人更好捕捉灵感创意的同时
2025-11-27 14:44:00