• 我的订阅
  • 头条热搜
“黄埔星”大模型发布!第三届粤港澳大湾区(黄埔)国际算法算例大赛启动
...创新,聚集力量推进“黄埔星”大模型成为国内领先的多模态基础大模型,在全国范围内征集选拔优秀单点技术,实现大模型在领域赋能上快速突破。广州市黄埔区政府一级调研员杨家伟表示,大赛在聚集人才、攻关科研及产业...……更多
北大推出全新机器人多模态大模型!面向通用和机器人场景的高效推理和操作
...息处理全国重点实验室两大平台,长期从事机器学习、多模态学习和具身智能方向的研究。本工作第一作者为刘家铭博士,研究方向为面向开放世界的多模态具身大模型与持续性学习技术。本工作第二作者为刘梦真,研究方向为...……更多
全面叫板OpenAI!谷歌发布多模态大模型全家桶:从AI助手到文生视频模型
...先一天后,科技巨头谷歌不甘示弱,推出了自己的最新多模态AI(人工智能)产品。当地时间5月14日,在谷歌I/O开发者大会上的主题演讲中,谷歌展示了由升级后Gemini模型驱动的AI助手项目Project Astra、对标Sora的文生视频模型Veo,...……更多
...“爱尔名医陪伴数字人”,可支持视频、文本和语音等多模态交互,也即将投入应用。“爱科(Eyecho)”的名字既体现爱尔“创新驱动,科技爱尔”的发展战略,也起英文Echo“回音”之意,蕴含爱尔运用最新的人工智能技术,...……更多
2024年投资展望丨AI、MR、短剧等概念爆发,传媒板块去年逆市涨近17%
...的发展,带来结构化的成长趋势。一、AI应用拓展 1、多模态加速应用端落地 目前,多家厂商快速布局卡位多模态大模型,AI文生图、文生视频等多模态能力持续提升带动AI应用持续迭代升级。海内外爆款AI应用频现,如Pika 1.0、R...……更多
全球首篇!调研近400篇文献,鹏城实验室&中大深度解析具身智能
...数字空间和物理世界的交互来完成复杂任务。近年来,多模态大模型和机器人技术得到了长足发展,具身智能成为全球科技和产业竞争的新焦点。然而,目前缺少一篇能够全面解析具身智能发展现状的综述。因此,鹏城实验室多...……更多
多模态AI概念股震荡走高 因赛集团涨超10% 【多模态AI概念股震荡走高 因赛集团涨超10%】财联社12月19日电,因赛集团涨超10%,天娱数科涨停,思特奇、软通动力涨超5%,润和软件、宣亚国际、开普云、万兴科技等跟涨。中信证券...……更多
Meta首款多模态Llama 3.2开源!1B羊驼宝宝,跑在手机上了
【新智元导读】Meta首个理解图文的多模态Llama 3.2来了!这次,除了11B和90B两个基础版本,Meta还推出了仅有1B和3B轻量级版本,适配了Arm处理器,手机、AR眼镜边缘设备皆可用。Llama 3.1超大杯405B刚过去两个月,全新升级后的Llama 3....……更多
中国科学院地化所发布国际首个月球专业大模型,基于通义大模型及阿里云百炼专属版打造
...地球化学研究所与阿里云联合发布国际首个“月球科学多模态专业大模型”(简称“月球专业大模型”)。该大模型以视觉、多模态及自然语言等通义系列模型为基模,结合RAG检索增强等技术,于阿里云百炼专属版进行微调及训...……更多
依图科技“天问”大模型赋能安防,智慧应急跨越式发展
...防行业正经历着前所未有的变革。作为应用人工智能和多模态大模型的先锋领域,安防行业不仅展示了其强大的产业基础,更在发展新质生产力方面彰显出卓越的能力和潜力。依图科技,作为AI领域的先行者和创新者,多年来一...……更多
Gemini 开启大模型路线之争,新战场将“数流成河”
...一种可能性:具有原生数据优势的互联网巨头,可能在多模态大模型竞争中占据优势。这意味着,谷歌、马斯克、Meta以及中国的腾讯、抖音、阿里、百度等公司都有可能在Gemini 开创的路线上加速迭代大模型。大模型战局,进入...……更多
语音能力再突破!讯飞星火语音大模型即将发布
...代码纠错、代码解释、单元测试生成5个维度升级,其多模态能力的升级具体体现在图像描述、图像问答、识图创作等多个维度。去年10月24日,在第六届世界声博会暨2023科大讯飞全球1024开发者节的主论坛上,星火认知大模型V3.0...……更多
王一刚:深耕技术产品,助力媒体融合
...中科闻歌雅意大模型在媒体领域的应用研究主要集中在多模态内容理解、关键信息提取、事件脉络分析、多模态内容生成和内容审校等方面,展现了在媒体领域的广阔应用前景。从业务视角来看,大模型可以在选题决策、辅助创...……更多
支持1024帧、准确率近100%,英伟达「LongVILA」开始发力长视频
...统、模型训练与数据集开发于一体。现阶段,将模型的多模态理解与长上下文能力相结合是非常重要的,支持更多模态的基础模型可以接受更灵活的输入信号,以便人们可以以更多样化的方式与模型交互。而更长的上下文使模型...……更多
感官协同配合的精细操纵,人大胡迪团队探索机器人模态时变性挑战
...冯若轩为中国人民大学二年级硕士生,主要研究方向为多模态具身智能,师从胡迪教授。引言:在机器人操纵物体的过程中,不同传感器数据携带的噪声会对预测控制造成怎样的影响?中国人民大学高瓴人工智能学院 GeWu 实验室...……更多
智能化应用将出现爆发式增长(AI前沿观察)
...的热点目标,企业也需要持续建设自己的人才队伍。■多模态大模型塑造“多边形战士”应用——多模态大模型是当前大模型训练和开发的重要方向,能够提升智能化应用中的信息丰富度和全面性。多模态大模型在行业实践中显...……更多
奥林匹克竞赛里选最聪明的AI:Claude-3.5-Sonnet vs. GPT-4o?
...数据泄露,从而反映模型的真实性能。研究团队测试了多模态大模型(LMMs)和纯文本大模型(LLMs)。对于LLMs的测试,输入时不提供任何与图像相关的信息给模型,仅提供文本。所有评估均采用零样本(zero-shot)思维链(Chain of ...……更多
多模态模型免微调接入互联网,即插即用新框架,效果超闭源方案
...合提出即插即用的SearchLVLMs框架,可以无缝整合任意的多模态大模型。该框架在推理阶段对大模型进行互联网检索增强,使得大模型无需微调即可对实时信息进行准确的反馈。研究团队提出首个辅助多模态大模型对实时信息进行...……更多
金域医学域见医言大模型正式发布,提速智慧医检4.0时代
...“六边形战士”,能够做到多模型整合、多场景赋能、多模态与多组学数据处理、多元知识充分融合、基于全病程信息多轮互动,不仅仅具备知识问答、智能化检测结果整合的功能,还具备医学领域的专业分析、推理能力。 金...……更多
· 开展“人工智能+”行动 这些领域有望率先“动起来”
...+算力基础建立全国一体化算力大市场从ChatGPT到Sora,从单模态到多模态,从单一智能到通用智能,人工智能大模型技术正在引领新一轮全球人工智能创新热潮,同时,大模型计算也带来了智能算力需求激增,随着“东数西算”工...……更多
背水一战狙击GPT-4,谷歌最强大模型Gemini终发布,听说读写全能选手 | 焦点分析
...布,“大杀器”Gemini 1.0,正式上线。Gemini是一个原生多模态大模型,谷歌在今年5月的I/O大会宣布开始研发后,Gemini的传说不断:将谷歌大脑和DeepMind部门合并,数百人攻坚,几乎耗尽谷歌内部计算资源……如此种种,只为和OpenA...……更多
...,同参数级性能达到业界领先水平。在此基础上演进出多模态模型,支持声图文3种模态,具备面向多种行业场景的快速定制能力。在大模型底座方面,中国联通借鉴人类职业技能形成规律,打造选模型—改模型—用模型工具链...……更多
美国东北大学提出视频数据增强方法,能让视频模型学到更好的表征
...张一天等人重新审视了色调变换这一操作在视频数据这一模态下的作用,并观察到了完全相反的现象,即这种操作能让视频理解模型的性能和泛化性得到提升。通过进一步地分析其在不同模态数据下(图像/视频)表现差异的原...……更多
阿里Q3财报:核心业务收获稳健增长,“AI驱动”潜力初现
...疗等领域,持续放大技术普惠。通用大模型“全尺寸、全模态”开源,“通义舞王”爆火本季度,阿里云发布开源大模型通义千问Qwen-72B,该模型10个权威基准测评创下开源模型最优成绩,成为业界最强开源大模型,也标志着阿...……更多
...的前沿技术研究,打造和提升高质量、国际领先水平的多模态交通大模型技术能力,高标准打造人工智能应用场景,全面开展人工智能产品应用创新生态建设,致力于将人工智能前沿技术成果广泛应用于智慧交通、车路协同、自...……更多
BAT等互联网大厂,如何入局人形机器人?
...智能公司,其研制的文心产业级知识增强大模型,具备跨模态、跨语言的深度语义理解与生成能力,百度认为,大模型等人工智能工具,核心在于提高效率,因此在上一次机器人发展浪潮中,百度就尝试通过飞桨深度学习平台和...……更多
猎豹CEO傅盛2024年预言:千亿大模型过半凋零,人形机器人必定不能量产【附AIGC市场现状分析】
...景划分,AI大模型主要包括语言大模型、视觉大模型和多模态大模型等。业界典型的自然语言大模型有GPT-3、源、悟道和文心等。视觉大模型也已广泛应用于自动驾驶、智能安防、医学影像等领域。基于多模态大模型的以文生图...……更多
西云算力举办AIGC沙龙,CTO梁峰分享“全系列全场景智算基础设施”
...从技术视角、落地实践、未来展望三个方面,就“领域多模态大模型的实践与创新”的话题展开分享。他介绍了“原生”多模态大模型(LLM)的典型架构和典型多模态Agent的具体案例。同时以营销场景为例分享了白海科技多模态...……更多
实体“贾维斯” vivo发布PhoneGPT:可自动打电话定餐厅
...能力,并带来vivo自研的语音大模型、图像大模型以及多模态大模型。蓝心图像大模型强化了中国特色与东方美学的融合生成能力,是国内最懂中文语境的图像模型之一,甚至还支持国风水墨,支持在图片生成过程中,增加汉字...……更多
实现意念操控鼠标,脑机接口新突破!马斯克的宏伟抱负不远了
...实现了自主脑控喝水。国泰君安指出,脑机接口助推AI多模态领域发展,有望驱动新一轮行情。当前,脑电大模型的开发往往面临脑电数据收集和处理的困难。随着脑机接口的发展,脑机接口成为人机交互的一种新方式后,脑电...……更多
更多关于科技的资讯:
法务部出击!Switch 2泄露厂商被任天堂找麻烦了
前段时间,配件厂商Genki在2025年CES展会上展示了一款Switch 2的实体模型,这引发了任天堂法务部关注。据报道
2025-01-12 10:22:00
CFO,全面接管中国互联网大厂
作者:徐晓倩过去一年,中国互联网的权力中心逐渐向CFO倾斜。2024年最后一天,盒马鲜生(以下简称盒马)新任CEO严筱磊宣布
2025-01-12 16:11:00
高速突现事故车 问界M7自动变道刹停!车主:华为智驾保我全家性命
快科技1月12日消息,近日,有问界M7 Ultra车主发布视频称,感谢赛力斯、华为智驾保我全家性命。车主公布的行车记录仪视频显示
2025-01-12 10:22:00
设计不会变了 蔚来萤火虫“三眼灯”确认:辨识度超高
快科技1月12日消息,在去年举办的蔚来NIO DAY上,蔚来第三品牌萤火虫首发,采用了非常独特的“复眼”大灯,这样的方案引发了不少争议
2025-01-12 10:22:00
本文转自:人民网人民网北京1月12日电 (唐佳)1月11日,中国国土经济学会低空经济专业委员会在京成立,并举行了低空经济与国土空间高质量发展论坛
2025-01-12 10:46:00
三轮车逆行全责撞上宾利 修车要几十万!宾利车主走代位追偿引热议
快科技1月12日消息,据报道,近日,浙江衢州,一位卖猪肉的老人开三轮车逆行下山,撞上了正常行驶的宾利欧陆GT轿车。事故现场照片显示
2025-01-12 10:52:00
福特电马突然变砖:婴儿一度被困车内、砸窗解救
快科技1月12日消息,海外媒体报道,近日,美国洛杉矶一辆福特电马电动门突然失灵无法解锁,导致车主9个月大的孩子被困车内将近1小时
2025-01-12 10:52:00
曝新款特斯拉Model Y九大产品核心亮点:舒适性提升占比超一半
快科技1月12日消息,毫无征兆,新款特斯拉Model Y就这样上市开卖了,仅提供两个版本,价格为26.35-30.35万元
2025-01-12 11:22:00
山火失控顶级富人区被烧毁:靠海的洛杉矶为何缺水灭火
1月12日消息,本月7日,美国加利福尼亚州南部地区突发山火,在大风助推下迅速蔓延,从加州南部的洛杉矶烧至好莱坞。好莱坞是富人聚集地
2025-01-12 11:22:00
2025年1月9日,微盟集团宣布推出“微盟X微信小店”系列解决方案,旨在帮助商家在微信小店生态中实现高效整合与业务增长
2025-01-12 11:52:00
每日一图|鸳鸯戏水
本文转自:人民网-浙江频道孙鹏
2025-01-12 11:56:00
年轻人的第一台跑车!小跑车SC01发起申报:搭载双电机+四驱
快科技1月12日消息,江西江铃集团新能源汽车有限公司生产的羿驰牌小跑车SC01申报信息曝光。该车采用纯电进行驱动,搭载前后双电机四驱系统
2025-01-12 12:22:00
高速上车胎被扎破男子将道路管理方告上法庭:索赔1250元
1月12日消息,高速路上轮胎被扎破,那么能否向道路管理方索赔呢?近日,一男子驾车行驶在高速公路上,被一块铁片扎破轮胎,险些酿成车祸
2025-01-12 12:22:00
□言嘉当下招聘中,已有不少公司尤其是金融机构都使用了AI(人工智能)作为面试官,面试的地点在家里,面试考官是电脑屏幕上虚拟的AI形象
2025-01-12 12:34:00
江苏首家!江苏时代获评工业4.0奖
近日,江苏时代荣获由欧洲知名管理咨询集团瑞欧盈-埃非索管理咨询公司(ROI-EFESO)颁发的工业4.0中国奖“智能可持续奖项”
2025-01-12 12:50:00