• 我的订阅
  • 头条热搜
一文看尽Meta开源大礼包!全面覆盖图像分割、语音、文本、表征、材料发现、密码安全性等
...Meta最近开源了多个AI项目,包括图像分割模型SAM 2.1、多模态语言模型Spirit LM、自学评估器和改进的跨语言句子编码器Mexma等,提升了AI在图像处理和语音识别领域的能力,进一步推动了AI研究的进展。开源绝对是AI如今发展迅猛的...……更多
...提供坚实基础。本次“日日新5.0”另一大核心指标就是多模态能力,与此同时,在应用产品层面也实现了更卓越的多模态能力,支持高清长图的解析和理解以及文生图交互式生成,还可以实现复杂的跨文档知识抽取及总结问答展...……更多
“百模大战”,国产 GPT 大全
...om/紫东太初紫东太初是中国科学院自动化研究所研发的跨模态通用人工智能平台。实现了图、文、音三种模态的统一表达,以图生音,以音生图,将开拓AI在视频配音、语音播报、标题摘要、海报创作等更多元场景的应用。现已...……更多
AI“明星”选手巅峰对决!记者实测最新谷歌Gemini与GPT-4o
...模型能够实现无缝的文本、视频和音频输入,并生成相应模态的输出,真正意义上实现了多模态交互。紧随其后一天,年度Google I/O开发者大会如期而至,谷歌CEO Sundar Pichai宣布了一系列围绕其最新生成式AI模型Gemini的重大更新,...……更多
豆包“王炸”:字节跳动一天发布两款视频生成大模型
...同声传译模型,已全面覆盖语言、语音、图像、视频等全模态,全方位满足不同行业和领域的业务场景需求。在产品能力日益完善的同时,豆包大模型的使用量也在极速增长。据火山引擎披露,截至9月,豆包语言模型的日均token...……更多
喜马拉雅音频大模型亮相,AI赋能内容创作者
...展示AI时代云上创新的潮流科技。喜马拉雅珠峰AI音频多模态大模型亮相云栖大会,在“人工智能+”主题馆吸引众多市民驻足围观体验。AI(人工智能)已经在深刻影响着我们的生活,也影响和改变着内容创作行业。作为在线音...……更多
群核科技(酷家乐)陈卓:用多模态AI助理赋能设计产业,用合成数据服务反哺AI | 新质生产力·AI Partner大会
...3D空间领域生成式AI引擎,包括底层的超级算力中心、多模态的海量产业数据,以及自研空间AIGC大模型。在这个引擎之上,已经开始生长出丰富的,服务于不同场景和需求的AI应用,它们正在解决每个应用场景中的个性化问题。...……更多
中国首个音乐SOTA模型「天工音乐大模型」今日公测
...赋予「天工3.0」超强的性能表现。在MMBench等多项权威多模态测评结果中,「天工3.0」超越GPT-4V,全球领先。 (天工3.0多模态性能超越GPT-4V,全球领先) 同时,「天工3.0」旗下的「天工SkyMusic」音乐大模型也在今日面向全社会开...……更多
马斯克 xAI 展示首个多模态模型 Grok-1.5V
...下旬推出 Grok-1.5 大语言模型之后,近日再次推出首个多模态模型 Grok-1.5 Vision。xAI 表示将于近期邀请早期测试者和现有的 Grok 用户测试 Grok-1.5 Vision(Grok-1.5V),不仅能理解文本,还能处理文档、图表、截图和照片中的内容。xAI ...……更多
文心一言发布百度市值蒸发200亿,外界称缺乏亮点,应用前景难超ChatGPT
...业。但发布仅仅是一小步,更大的挑战还在后面。具备多模态,实测后或将暴露更多问题在发布会现场,李彦宏通过提前录制的视频演示了文心一言在文学创作、商业文案创作、数理推算、中文理解、多模态生成等五个方面的能...……更多
商汤升级“日日新5.0”大模型,对标GPT-4Turbo
...金融、数据分析等场景落地提供基础。“日日新5.0”的多模态能力在多模态大模型权威综合基准测试MMBench中综合得分排名首位,在多模态榜单MathVista、AI2D、ChartQA、TextVQA、DocVQA、MMMU中取得领先成绩。“日日新5.0”支持高清长图...……更多
华中科技大学白翔教授发布多模态大模型
...华中科技大学软件学院白翔教授领衔的VLRLab团队发布了多模态大模型——“Monkey”。该模型号称能够实现对世界的“观察”,对图片进行深入的问答交流和精确描述。▲图源Monkey项目的GitHub页面IT之家注:多模态大模型是一类可...……更多
生成式人工智能新时代
...?张亚林介绍,文本、音频、图像、视频、游戏生成,跨模态、多模态的生成,虚拟人的生成等,都可以通过各种素材的生成进行互换,这对我们周围的传统媒体带来巨大冲击。怎样支撑生成式AI大模型的发展?张亚林说,我们...……更多
突破视频多模态大模型瓶颈!「合成数据」立大功,项目已开源
... S-Lab 的博士生 Bo Li, 字节跳动研究员 Wei Li, Zejun Ma.视频多模态大模型(LMMs)的发展受限于从网络获取大量高质量视频数据。为解决这一问题,我们提出了一种替代方法,创建一个专为视频指令跟随任务设计的高质量合成数据集...……更多
Sora为何没能诞生在中国?
...种物理现象。OpenAI一定会在文本、图像、音频、视频等多模态领域发展。视频是发展多模态最重要的一步,包含了世界运转的基本规律。”Sora生成的视频效果仍令刘子纬感到震撼。刘子纬3年前便开始研究AI视频生成。相较文字...……更多
全面叫板OpenAI!谷歌发布多模态大模型全家桶:从AI助手到文生视频模型
...先一天后,科技巨头谷歌不甘示弱,推出了自己的最新多模态AI(人工智能)产品。当地时间5月14日,在谷歌I/O开发者大会上的主题演讲中,谷歌展示了由升级后Gemini模型驱动的AI助手项目Project Astra、对标Sora的文生视频模型Veo,...……更多
视觉理解、3D生成,豆包这次又玩出了什么新花样?
...做呢,月之暗面Kimi发布视觉思考模型k1;腾讯微信推出多模态大模型POINTS1.5;巨人网络发布千影有声游戏生成大模型,还有不胜枚举的初创公司带着自家模型的新进展试图刷个脸熟。所以呢,豆包又又又更新了。(图源:雷科技...……更多
GPT-4V暴露致命缺陷?JHU等发布首个多模态ToM 测试集
...来自 JHU, NYU, MIT, Harvard 等机构的研究团队开创了第一个多模态的 ToM 测试基准,发现现有的多模态模型和 LLM 都表现存在系统性缺陷,同时他们提出了一种有效的新方法。在刚结束的 ACL 2024 会议中,这篇论文获得杰出论文奖。论...……更多
这周,5家公司发了AI新品 | 最前线
...力,钉钉个人版对目前企业版进行了“瘦身”,在提供多模态交互的AI能力的同时,整合了wolai知识库、阿里云盘以及视频会议、通讯等基础功能。接入“通义千问”后,钉钉个人版对个人办公流程的最大改造之处,在于用敲入...……更多
智源研究院发布FlagEval“百模”评测结果
...年下半年大模型发展更聚焦综合能力提升与实际应用。多模态模型发展迅速,涌现了不少新的厂商与新模型,语言模型发展相对放缓。模型开源生态中,除了持续坚定开源的海内外机构,还出现了新的开源贡献者。语言模型,针...……更多
每日与世界30亿次交互!这家AI独角兽企业发布视频、音乐生成模型
...字交互只是很小的一部分,更多的是语音和视频交互。多模态的内容,比如声音、图文和视频,已经成为信息传递的主流。为了能够提高渗透率,多模态是必经之路。”闫俊杰透露,目前video-01只提供了文生视频,在未来产品会...……更多
清华团队提出大模型“密度定律”;足球领域首个视觉语言基础模型
...究团队及其合作者旨在为足球视频理解开发一个全面的多模态框架。具体来说,他们做出了以下贡献:(1)他们提出了 SoccerReplay-1988,这是迄今为止最大的多模态足球数据集,其中包括来自 1988 场完整比赛的视频和详细注释,...……更多
从空间智能到具身智能,跨维践行Sim2Real AI最高效路径
...使用双眼感知世界一样,具身智能要求机器人能够通过多模态传感器进行感知、交互和决策,形成综合的空间认知和操作能力。问:空间智能与具身智能的异同点是什么?贾奎:就像前面提到的,空间智能赋予 AI 感知并理解现...……更多
多模态AI午前大涨,游戏ETF半日涨幅近4%
今日午前,多模态AI题材午前崛起,Sora方向领涨,其中,游戏ETF(516010)和游戏ETF(159869)半日涨幅分别达到3.95%和3.93%,领涨整个ETF市场。投资逻辑方面,日前,谷歌发布了基础世界模型Genie,Genie是一个110亿参数的基础世界模...……更多
谷歌发博文介绍vloggerai模型可让人物“动起来”
...表情地朗读音频内容。VLOGGERAI是一种适用于虚拟肖像的多模态Diffusion模型,使用MENTOR数据库进行训练,该数据库中包含超过80万名人物肖像,以及累计超过2200小时的影片,从而让VLOGGER生成不同种族、不同年龄、不同穿着、不同...……更多
“1024 直接对标 ChatGPT!”科大讯飞星火大模型立 Flag、一手实测来了
...言理解、知识问答、逻辑推理、数学能力、代码能力、多模态能力。基于此, 人类只要做画龙点睛的加工,就能得到 “懂你所言,答你所问,创你所需,解你所难,学你所教”的所有内容。讯飞星火认知大模型是基于科大讯飞 ...……更多
联通元景大模型亮相2024年中国品牌日 打造产业智能化新范式
...供互联网实时资讯问答以及更好的数学计算等服务。在多模态大模型的视觉能力方面,工作人员分别提供了不同场景的视频和图片,“元景看见”迅速对视频、图像画面进行实时识别理解,并以文字描述方式呈现出来。除通用视觉能...……更多
中文大模型最新评测出炉:腾讯混元国内第一!
快科技8月5日消息,在最新发布的中文多模态大模型SuperCLUE-V基准评测中,腾讯混元大模型获国内排名第一,稳居卓越领导者象限。此次评测聚焦于大模型理解复杂现实世界的关键能力,即多模态理解,俗称“图生文”。多模态...……更多
英国ai初创公司wayve公布gaia-1最新进展
...驶车辆的行为和场景特征进行细致的控制,且由于GAIA-1多模态的性质,能够从多种提示模式和组合中生成相关视频。▲图源Wayve官方提到,GAIA-1可对环境进行学习,从而提供结构性的环境理解,协助自动驾驶系统做出明智的决策...……更多
京东要给实体产业做个GPT
...测试,都会为AI带来点滴新的进步。决战大模型:走向多模态与实体京东云今年将发布的新一代产业大模型 ——言犀大规模预训练语言模型,被视为是AI角逐产业场景的开端。京东云言犀团队前后耗费多年时间,持续深耕对话式A...……更多
更多关于科技的资讯:
震撼!一千四百年前古人竟已用上储粮黑科技
快科技3月1日消息,近日,据央视报道,一项关于古代储粮技术的发现再次引发了热议。原来,在一千四百年前,古人就已经掌握了一种堪称“黑科技”的储粮秘诀
2025-03-01 13:38:00
春晚出圈的宇树科技招人了:年薪可达百万!
快科技3月1日消息,蛇年春晚舞台上,来自杭州的宇树科技凭借出色表现刷屏热搜。而就在今日,杭州今年新春最大规模的线下人才招聘会于上午9时在杭州大会展中心盛大启幕
2025-03-01 14:08:00
凌晨退税喜提5万多!网友直呼:3月第一份快乐
快科技3月1日消息,三月第一天,许多网友卡点干的第一件事,就是退税!2024年度个人所得税综合所得汇算清缴今天开始了,汇算的时间为3月1日至6月30日
2025-03-01 14:38:00
抗病5年 知名歌手方大同去世:年仅41岁
快科技3月1日消息,今日中午,歌手方大同独立音乐厂牌@赋音乐FUMUSIC 发布消息称:以积极的态度面对顽疾5年, 方大同于2025年2月21日早晨
2025-03-01 14:38:00
董明珠回应500亿做芯片质疑:国家和企业发展都需要
快科技3月1日消息,近日,董明珠在央视频的视频中回应了外界对于格力投资500亿做芯片的质疑。此前,格力大价钱投资造芯片引发热议
2025-03-01 15:08:00
DeepSeek大胆披露:理论利润率高达545%!
快科技3月1日消息,今日,DeepSeek正式在知乎平台开设了其官方账号,并发布了一篇名为《DeepSeek-V3/R1推理系统概览》的技术文章
2025-03-01 15:08:00
同比增长62.2%:蔚来公司2月交付新车13192辆
快科技3月1日消息,在刚刚过去的2月份,蔚来公司交付新车13192台,同比增长62.2%。其中,蔚来品牌交付新车9143台
2025-03-01 16:08:00
气胸是什么病、为什么高瘦男性容易得:医生科普
快科技3月1日消息,歌手方大同因病去世,享年41岁,据报道,2010年他因操劳过度,出现(气胸)爆肺而数度住院。那么什么是气胸
2025-03-01 16:38:00
每年导致40万人截肢:这种动物被联合国列入“危险疾病名单”
在非洲肯尼亚的一个小镇,11 岁的比阿特丽斯坐在路边,用手划拉着地上的泥土打发时间。忽然,石缝中弹出一条“红线”,她还没来得及反应
2025-03-01 17:08:00
9.98万 赛力斯蓝电E5 PLUS长续航先享版上市:纯电能跑165公里
快科技3月1日消息,就在今日,蓝电E5 PLUS 165km长续航先享版车型上市,限时一口价9.98万元,限量1000台
2025-03-01 17:08:00
英特尔再度推迟“千亿美元”芯片工厂的建设!投产起码再等5年
陷入困境的芯片制造商英特尔周五(2月28日)宣布,该公司将推迟在俄亥俄州开设芯片制造工厂的进程。2022年时,英特尔曾承诺将投资高达1000亿美元
2025-03-01 17:38:00
骁龙8 Elite近乎“白菜价”!有厂商要干到2500元以内:网友担心会不会赔钱
快科技3月1日消息,博主数码闲聊站爆料,某款骁龙8 Elite机型好像要干到2500元以内。这条微博引发热议,有网友担心“厂商会不会赔钱”
2025-03-01 17:38:00
因“方向感不清晰”:车主控诉小鹏P7+智驾时撞上护栏
快科技3月1日消息,当前一切高阶智能驾驶均为辅助驾驶,使用时还需小心谨慎,时刻准备接管,以防事故发生。据“1818黄金眼”最新报道
2025-03-01 18:08:00
老了也有依靠!京东外卖骑手感谢刘强东
快科技3月1日消息,据媒体报道,近日京东首批全职外卖骑手代表正式签约,引发热议。多位外卖骑手表示,公司为其缴纳五险一金对房贷
2025-03-01 18:08:00
皮鞋批发行业作为传统制造业的重要组成部分,一直以来都扮演着连接生产与消费的关键角色。近年来,随着互联网的快速发展和普及
2025-03-01 18:18:00