• 我的订阅
  • 头条热搜
本周硅谷发生了什么?|OpenAI推出5项更新;微软组建新的AI团队;Googe发布文生视频模型Lumiere
...GenAI团队研发小模型,减少对OpenAI的依赖。Adept AI发布多模态模型Fuyu-Heavy,官方称跑分表现仅次于GPT4-V和Gemini Ultra。同时,国内大模型也有不少进展,通义千问团队升级了视觉语言模型Qwen-VL,图片内文字处理能力得到提升。此外...……更多
小米开启“小爱同学多模态功能内测”
3月15日消息,小米现已开启“小爱同学多模态功能内测”,拥有以下机型的用户可以在3月23日之前申请报名,将从3月18日到4月15日推送内测:XiaomiMIXFold3XiaomiMIXFold2XiaomiMIX4Xiaomi14系列(含14/14Pro/14Ultra)Xiaomi13系列(含……更多
AI生成式视频往何处去 “灵动 AI”亮相网易未来大会
...的。现在试想,如果上传的商品信息既能在文字、图像等模态上保持不变,又能够与文字、图片、视频等模态模型实现很好的融合,从而为商家产出AI商品图、海报、短视频,甚至是3D交互内容,这个市场需求是很大的。今年,...……更多
...等跟涨。东莞证券研报指出,随着Gen-2、Pika1.0、Gemini等多模态模型的快速涌现,全球大模型多模态化趋势日益显著,有望带动AIGC应用加速落地。展望后续,关注经营边际向好,同时作为AI应用主阵地的游戏、出版、影视、广告营...……更多
功耗低至毫瓦级!苹芯科技发布存算一体NPU,交付多模态智能感知芯片
...京AI芯片创企苹芯科技发布存算一体NPU“PiMCHIP-N300”和多模态智能感知SoC芯片“PiMCHIP-S300”。两款产品是存算一体技术在28nm及22nm制程节点上的首次产品化实现。N300已有客户,S300预计在今年第四季度推向市场。通过将计算和存储...……更多
大华股份:自研星汉大模型,推动智慧应用商业落地
...(002236)。事件:近日大华股份发布公告,公司发布了多模态融合的行业视觉大模型——大华星汉大模型,通过融合图像、点云、文本、语音等多模态数据,显著提升了视觉解析能力。点评:机器视觉垂类龙头厂商,业绩持续高...……更多
字节布局AI硬件:首款智能体耳机售价1199元,接入豆包大模型
...这个助理不仅仅有大语言模型的文字创造能力,还会有多模态功能。开源证券表示,大模型推理及多模态能力的持续提升、端侧AI的突破及API成本的下降,将推动AI应用商业化空间进一步打开,建议继续布局AI。 ……更多
AI智能体将迎爆发点,市场空间近300亿美元!中科金财6天5
...系统,以大型语音模型(LLM)作为核心引擎,基于复杂多模态数据的处理能力,他们可以感知环境,做出决策,并执行任务以实现特定目标。目前,国内外科技巨头都在加速布局AI智能体领域。其中,OpenAI计划在明年1月发布一款...……更多
蔚蓝 BabyAlpha A2 机器狗发售:国内首发多模态交互,6099 元起
...yAlpha Dev 定价 6699 元起。BabyAlpha A2 号称是国内首款具备多模态交互能力的 AI 机器人,可定制、支持绘本功能,支持多模态音视频通话、远程遥控拍照,内置大语言模型,支持中英文双语无缝切换,以及搭载智能体操作系统 Agent O...……更多
WPS AI以“慢”制胜 金山办公36年技术积淀助力飞跃发展
...会上,熊龙飞展示了WPS AI专业应用领域的最新成果,如跨模态技术、高度可复用的引擎系统等方面的突破。这些技术成果不仅提升了文档处理的效率和准确性,更为用户带来了全新的智慧办公体验。在多模态技术在文档处理中的...……更多
喜马拉雅音频大模型亮相,AI赋能内容创作者
...展示AI时代云上创新的潮流科技。喜马拉雅珠峰AI音频多模态大模型亮相云栖大会,在“人工智能+”主题馆吸引众多市民驻足围观体验。AI(人工智能)已经在深刻影响着我们的生活,也影响和改变着内容创作行业。作为在线音...……更多
多模态3D“透视眼”引导精准切除颅内肿瘤
...。近日,武汉市中心医院杨春湖院区神经外科团队应用多模态3D重建技术成功为这名患者精准切除了肿瘤。患者张先生今年50岁,半个月前在家中突然说不清话了,家属赶紧将他送到附近医院,经脑部磁共振检查在其右侧顶叶及...……更多
国内首款多模态AI交互四足机器人BabyAlpha A2发布,售价不到万元
...人新品 BabyAlpha A2,聚焦家庭场景,这是国内首款具备多模态交互能力的 AI 机器人,产品售价低至 1 万元以内。此次公布的蔚蓝全新 BabyAlpha A2,是一款具身智能四足机器人,可定制、支持绘本功能,支持多模态音视频通话、远程...……更多
每日与世界30亿次交互!这家AI独角兽企业发布视频、音乐生成模型
...字交互只是很小的一部分,更多的是语音和视频交互。多模态的内容,比如声音、图文和视频,已经成为信息传递的主流。为了能够提高渗透率,多模态是必经之路。”闫俊杰透露,目前video-01只提供了文生视频,在未来产品会...……更多
AI翻译界杀手诞生!阿里国际翻译大模型吊打谷歌和GPT-4
...rcoPolo由此诞生。 并且,实现了更低成本更优效果。在多模态方面,多模态大模型MarcoPolo-VL能够用「眼睛」精准识别,进行推荐。还有团队最新发布的多模态大模型Ovi,直接拿下开源第一。在ICCV 2023顶会上,一向低调的阿里国际...……更多
谷歌chrome地址栏整合gemini聊天机器人
...Gemini是谷歌Deepmind最新、最强大的AI模型。它原生支持多模态,具备跨模态推理能力,包括文本,图像,视频,音频和代码。Gemini分为三个版本Ultra-三个模型版本中功能最强大,适用于高度复杂的任务Pro-适用于广泛任务的最佳模...……更多
人工智能来袭!虹口区携手有连云等AI+企业驶入发展快车道
...融专业语料库进行专项训练,集成自然语言处理、OCR、跨模态与多模态等技术,通过准确、实时、智能化地获取各类金融事件指标,自由实现各类金融应用模型的自定义与配置需求,在内容的自动化生产和推送流程中,客户可实...……更多
商汤升级“日日新5.0”大模型,对标GPT-4Turbo
...金融、数据分析等场景落地提供基础。“日日新5.0”的多模态能力在多模态大模型权威综合基准测试MMBench中综合得分排名首位,在多模态榜单MathVista、AI2D、ChartQA、TextVQA、DocVQA、MMMU中取得领先成绩。“日日新5.0”支持高清长图...……更多
苹果300亿参数大模型首亮相,还买了家AI公司|焦点分析
...时间,苹果低调的在arxiv.org网站上发布论文,官宣了在多模态大模型领域的最新成果。在论文《MM1: Methods, Analysis & Insights from Multimodal LLM Pre-training》(MM1: 多模式LLM预训练的方法、分析和见解)中可以……更多
谷歌 VS OpenAI:当搜索霸主和屠龙少年迈入同一条河流
...、代码等方面的表现也都高过GPT-4。而作为首个「原生多模态」模型,在一系列多模态基准测试中,对标GPT-4V,Gemini Ultra 也展现出了先进的性能。图源:谷歌新闻稿在chatGPT发布一周年之际,谷歌通过 Gemini 赶了个晚集,想要再度...……更多
李开复AI公司首发大模型,阿里云领投 | 36氪独家
...,零一万物已经启动100B以上参数规模的模型训练,而多模态大模型团队已经集结了十多个人。“几周之内我们就有新的发布和大家分享。”李开复透露,“Yi”的定位是通用底座,同时,Yi系列量化版本、对话模型、数学模型、...……更多
Pika、阿里同日炫技!国产视频大模型奋起直追
...频,表情、五官、姿势都会产生非常自然的变化。在AI多模态领域,科技巨头、明星初创企业似乎把火力集中到了同一个方向——AI视频生成,Sora的火热更是一石激起千层浪,同类产品发布你追我赶,战况之焦灼可见一斑。在该...……更多
推动数智+大健康产业深度融合 又一研发总部落子长沙天心经开区
...会现场。单位供图活动现场发布了最新的深思考Dongni.ai多模态搜索引擎、智能终端(AI PC Suite、AI 摄像头、AI 显微镜)、重大疾病早期筛查等重磅产品,并宣布深思考人工智能机器人科技有限公司研发总部正式落户天心经开区。...……更多
“Sora”王炸,20篇研报带你走进人工智能(下载)
...手段;三是专属、自建模型将在中大型企业涌现;四是多模态大模型拓展服务边界,带来更丰富的用户体验;五是AI Agent(人工智能代理)是大模型落地业务场景的主流形式;六是AIGC加速超级入口的形成;七是业务流程转向“无...……更多
伦敦证券交易所集团:视中国市场为未来增长市场、全球战略核心
...都可以用AI重塑。上一代金融信息产品其实是一维、单一模态的、小数据样本的,实际上,大部分信息是多维、多模态、非结构化的。AI可以让全域信息的捕捉和处理更高效,未来AI bots将成为每个企业的核心资产。“快速发展的...……更多
讯飞星火V3.5春季上新,科大讯飞首发星火图文识别大模型
...你也能化身法律专家。越来越多的从业者已经认识到,多模态能力将是未来衡量大模型可用性、易用性的重要指标。视觉作为多模态能力的最重要的一环,可以帮助大模型实现从单纯的文本能力到感知物理世界的巨大飞跃,为未...……更多
他用AI让交通“更懂你”
...乘客进行线路、票价等信息查询和快速购票,同时基于多模态大模型TransCore-M则能对站内的拥堵、异常情况进行实时判断,为相应的站内管控和车辆调度提供辅助决策和应急处置。通过完成这一系列乘客从进站到出站的全流程举...……更多
迎着应用爆发的曙光,百度将推出新版文心大模型
...,张冠李戴的幻觉现象普遍存在,这也是为什么今天的多模态大模型还没有什么成规模应用跑出来的原因。今年年初时,在整个中文互联网都为Sora而捶胸顿足的时候,百度决定解决图像生成的幻觉问题。百度最新发布的检索增...……更多
...团队采用红外动捕、肌电、惯性传感器、足底压力垫等多模态技术,构建健康步态以及多种异常步态数据集,建立算法模型,实现跨人群、跨模态、跨类型的连续步态轨迹高性能追踪,为脑脊接口技术奠定基础。步态轨迹多模态...……更多
...互动,没法解决更多的问题,但其实更多的场景是需要多模态组合,结合不同其他的模块,做你自己的产品。一个小公司,把GPT和相关的能够结合的模块熟悉掌握了,就已经能够涉及很多的行业领域了,也能够实解决很多的痛点...……更多
更多关于科技的资讯:
厦门抢占具身智能产业新赛道
第十四届中国创新创业大赛——首届具身智能专业赛成果在厦发布。厦门网讯(文/厦门日报记者 吴晓菁 通讯员 高菲 康潇潇 图/厦门日报记者 卢剑豪)昨日的厦门国际会议中心酒店
2025-09-26 08:38:00
具身智能孵化加速器在厦正式揭牌第十四届中国创新创业大赛首届具身智能专业赛昨日发布成果东南网9月26日讯(海峡导报记者 黄奕琳)昨日
2025-09-26 10:17:00
全国26家实验室参与!由雷沃支持的这场“田间论剑”举行
日前,2025年农业机械检测实验室间比对活动在山东潍坊举行。该活动由中国农业机械化协会主办、农机鉴定检测分会承办、潍柴雷沃智慧农业协助开展
2025-09-26 07:05:00
人们依托脑力开展思维活动,而人工智能则依赖算力进行“思考”。“十四五”期间,中国在算力建设上的投入力度相当大,发展成效显著
2025-09-26 07:31:00
王灿:以笔为犁 深耕“城事”
王灿。 臧翔宇 摄□胡欣玥芮天舒祁绩外出采访结束后,王灿轻轻推开南京报业传媒集团融媒中心时政新闻部的门。工位上屏幕亮起
2025-09-26 07:41:00
560余家企业携4.8万余个岗位来东大揽才“AI+”岗位热度不减,实战经验是核心指标□南京日报/紫金山新闻记者何洁 实习生黄佳琪杨久久9月25日
2025-09-26 07:41:00
厦门网讯(厦门日报记者 沈彦彦 应洁)明日,厦门岛外首家永辉“胖东来模式”调改店将在杏林万科里正式开业。作为厦门第二家
2025-09-25 08:53:00
9月24日,“青春华章・向西而歌”网络大思政课活动上,西安交通大学微电子学院集成电路工程专业博士研究生魏上杰介绍,集成电路是“国之重器”的“心脏”
2025-09-25 09:44:00
杜建英一持股公司被吊销,名下关联60家企业其中8家已注销或吊销
企查查APP显示,近日,杜建英持股的杭州芸台文化创意有限公司被吊销,原因是公司成立后无正当理由超过6个月未开业,或者开业后自行停业连续6个月以上
2025-09-25 11:20:00
雷军“五十来岁正是闯的年纪”,出生于1969年,和余承东、陈明永同龄
9月25日,雷军发文:这5年,小米一路摸爬滚打、跌宕起伏,依然启动了造车、芯片和高端化……没什么好犹豫的,五十来岁,正是闯的年纪
2025-09-25 11:20:00
贵州国企“智”变攻坚推动数实融合
赤水河畔,国内首台高温复合型仿生压曲机稳定运转,物联网实时优化发酵参数……这场酿酒的“数字革命”,也是贵州习酒公司以全链数智革新推动产业跃迁的生动缩影
2025-09-25 11:57:00
近8成职场人每周都会用AI工具 “人机互信”仍在磨合期
在人工智能技术日臻成熟的2025年,AI已是深度融入职场生态的“数字同事”,在AI辅助下的2025年职场迎来了哪些变化
2025-09-25 13:30:00
9月23日下午,2025北京文化论坛“破界共生:科技激发文化原创力”平行论坛在京举办。本场论坛由中国文联、中国作协指导
2025-09-25 13:38:00
国庆前夕,房山区物美超市“胖改店”、居然之家房山店、瑞莱广场分别于9月26日、27日、28日开业,进一步丰富了房山区消费场景
2025-09-25 13:38:00
OPPO杭州研发总部项目易主,山子高科接手公司95%股权
企查查APP显示,近日,负责OPPO项目的杭州逗酷软件科技有限公司发生工商变更,新增山子高科旗下浙江山子超影科技有限公司为股东
2025-09-25 16:25:00