• 我的订阅
  • 头条热搜
...模型检索问答一体机;财跃星辰发布国内首个千亿参数多模态金融大模型;幂方科技发布大模型驱动的外脑穿戴智能硬件等。 ……更多
突发!谷歌发布史上最强大模型Gemini,打爆GPT-4
...萨比斯在谷歌官网联名发文,宣布推出这一万众瞩目的多模态大模型。标题明晃晃写着“最大”、“最强”,主打的就是一个干爆GPT-4。具体来说,此次谷歌一共带来了Gemini的三个版本:Gemini Ultra:谷歌最大、最强模型,适用于...……更多
多模态LLM视觉推理能力堪忧,浙大领衔用GPT-4合成数据构建多模态基准
...进模型在视觉推理方面同样不足。为此他们提出了一种多模态的视觉推理基准,并设计了一种新颖的数据合成方法。无论是语言模型还是视觉模型,似乎都很难完成更抽象层次上的理解和推理任务。语言模型已经可以写诗写小说...……更多
年轻人的好友列表,AI越来越多
...字人,还可以实时进行沉浸式语言、肢体互动。“以前多模态交互是一个连续生成过程,会有延时,Soul 现在语音对话延迟不到 200 毫秒,因为我们已经推出了端到端大模型能力——过去先生成文本/图像再转换为语音,现在能将...……更多
奥林匹克竞赛里选最聪明的AI:Claude-3.5-Sonnet vs. GPT-4o?
...数据泄露,从而反映模型的真实性能。研究团队测试了多模态大模型(LMMs)和纯文本大模型(LLMs)。对于LLMs的测试,输入时不提供任何与图像相关的信息给模型,仅提供文本。所有评估均采用零样本(zero-shot)思维链(Chain of ...……更多
...能沉浸式体验3D生成、音视频生成、智能编码等十余项多模态模型如何一步步化作生产力。“值得一提的是,由生数科技团队打造的首个国产纯自研视频大模型Vidu将进行公开展示。”刘湘雯介绍,大会也邀请到十余家多模态模型...……更多
OpenAI o1模型到博士水平了?复旦教授:没有真正推理能力,学到的还是概率相关性
...超过90%。在启用视觉感知能力的情况下,o1模型在MMMU(多模态理解)测试中获得了78.2%的高分,成为首个能与人类专家展开竞争的AI模型。在 MMLU(大规模多任务语言理解)测试中,在总计57个子类别中,o1在54个类别上都超越了GPT...……更多
多模态模型评测框架lmms-eval发布!全面覆盖,低成本,零污染
...qizhixin.com随着大模型研究的深入,如何将其推广到更多的模态上已经成为了学术界和产业界的热点。最近发布的闭源大模型如 GPT-4o、Claude 3.5 等都已经具备了超强的图像理解能力,LLaVA-NeXT、MiniCPM、InternVL 等开源领域模型也展现...……更多
微软新专利:构建多模态3d面部模型
...单,微软公司获得了一项新的专利,通过深度学习构建多模态3D面部模型,可以创建非常逼真的虚拟肖像。这项专利全称为《多模态三维面部建模和跟踪,生成富有表现力的虚拟肖像》,该系统涉及处理器和存储系统,处理器负...……更多
前商汤通用模型负责人打造3D大模型「Tripo」,3D生成迈入「秒级」时代 | 早期项目
...VAST团队认为通过统一表示、模型和数据,以及借鉴其他模态的成功经验,可以有效地解决当前3D内容生成面临的挑战,实现通用且可扩展的解决方案。这对算法、数据量、服务器等有很高的要求一一不过这恰恰也是VAST团队的核...……更多
字节跳动计划在欧洲设立AI研发中心,已开始招募大模型等领域技术人才
...大模型团队于2023年2月开始组建,分别在语言和图像两种模态上发力,由TikTok产品技术负责人朱文佳带队。2023年8月,字节自研的底层大模型“云雀”上线,随即推出AI对话产品“豆包”。今年5月,字节发布“豆包大模型”家族...……更多
珠海加速布局具身智能!灵巧操作巅峰对决,官宣明年百万美元奖励
...完整的末端执行器,比如主被动混合柔顺的夹爪,以及多模态感知、多模态抓取的抓夹来适应不同物体的抓取任务,在软件上也进行了一系列算法的创新。后续,他希望继续通过训练更多的数列数据集,提升算法,并针对不同的...……更多
哪里不会扫哪里!全球最强数学大模型在线玩,阿里多模态模型加持
...wen2-Math还是各自负责一部分。但不久的将来,我们会把多模态能力和数学推理能力结合到一个模型上哟。不少网友对这种交互模式挺买账:歪瑞古德!用图像来上传,然后等大模型解决问题,喜欢! 那么,最强数学大模型Qwen2-M...……更多
中国首个音乐SOTA模型「天工音乐大模型」今日公测
...赋予「天工3.0」超强的性能表现。在MMBench等多项权威多模态测评结果中,「天工3.0」超越GPT-4V,全球领先。 (天工3.0多模态性能超越GPT-4V,全球领先) 同时,「天工3.0」旗下的「天工SkyMusic」音乐大模型也在今日面向全社会开...……更多
...批12个长三角跨区域创新联合体正式发布。其中长三角多模态大模型创新联合体由科大讯飞牵头,德清阿尔法研究院等6家机构参与。为头部互联网企业提供技术支撑长三角多模态大模型创新联合体主要研究什么项目?德清阿尔法...……更多
大模型通向AGI,腾讯云携手业界专家探索创新应用新风向
...项目,而非“AI+”的项目;· 保持前瞻性眼光,如关注多模态等前沿方向;· 强调“产业闭环”。向量数据库:实现多模态数据打通和人与数据的互动“大语言模型的本质是把治理范式进行了转移,它的作用主要体现在即使是非程...……更多
本周硅谷发生了什么?|苹果Vision Pro正式开售;Neuralink完成人类脑机接口植入;字节Coze国内版上线;
...布Baichuan 3大模型,更好理解中文阿里巴巴开发的自主多模态AI代理MobileAgent上线苹果Vision Pro正式在美开售,库克称将很快登陆中国脑机接口公司Neuralink完成首例人脑植入手术 Hugging Face推出可定制AI个人助手苹果发布2024年Q1财报...……更多
自研视频生成模型实现升级,「CreativeFitting」即将面向海外市场发布AI短剧APP | 早期项目
...作内容的门槛,一些具有AI生成特点——有想象力的、多模态的——内容会聚集起来形成新一代ToC超级内容平台,CreativeFitting就在打造这样的平台。”其实,朱江对于公司的长远规划是,创业前期,先专注在研发针对高质量情节...……更多
开源证券:多模态模型再迎新突破,继续布局AI应用及算力
...议关注券商、银行。(三)券商行业掘金 开源证券:多模态模型再迎新突破,继续布局AI应用及算力1、OpenAI发布首个文生视频模型Sora,可输出长达60秒的视频2月16日凌晨,OpenAI发布了首个文生视频模型Sora。Sora可以直接输出长...……更多
林达华谈大模型发展之路:未来会有更高效的模型结构出现
...一年,人工智能领域风起云涌,模型架构、训练数据、多模态、超长上下文、智能体发展突飞猛进。大模型的技术演进路在何方?3月24日,在2024全球开发者先锋大会的大模型前沿论坛上,上海人工智能实验室领军科学家林达华...……更多
...晨,美国科技公司OpenAI在春季发布会上发布了最新GPT-4o多模态大模型。据OpenAI公司首席技术官米拉·穆拉蒂(Mira Murati)介绍,GPT-4o可以接收文本、音频和图像的任意组合作为输入,并实时生成文本、音频和图像的任意组合进行...……更多
...磁共振技术具备无创无辐射的优势,并且能呈现大脑的多模态信息,因此能在胎儿和婴幼儿等特殊人群中发挥独特优势。这无疑是一项“米粒雕花”的艰辛探索。历时5年,吴丹和团队开发出胎儿和婴幼儿的成像和后处理技术,...……更多
...驾驶外,光轮智能的合成数据也开始服务于具身智能、多模态大模型等领域。随着AI技术,尤其是大模型的飞速发展,数据作为核心驱动力变得愈发重要。近日数据标注和合成数据公司Scale AI获得了新一轮10亿美金融资,新投资人...……更多
AIGC落地应用:腾讯云如何助力产业智能化升级?
...用同行,充分释放生产力。 此外,腾讯混元大模型在多模态能力上也持续迭代升级。在生图领域,腾讯混元文生图基础架构已全面升级至Sora同款的DiT架构,支持中英文双语输入及理解,具备多轮绘图能力,测评结果国内领先;...……更多
机器人成了我的遛弯搭子!室外复杂地形难不住,还能上“健身房”
...。除此外,天工的另一大升级是搭载了大模型,具备了多模态操作能力。现在能开口说话和人类交互,支持中英文。还能听从人类指令抓取物品:【此处无法插入视频,遗憾……可到量子位公众号查看~】而这些只是其中的一部...……更多
养老机器人真来了!国产顶流泡茶喂猫练咏春,帮十亿人做家务
...中进行感知、认知、实时决策,而且还具备智能理解和多模态交互执行能力。从而实现物体、任务和环境级别通用操作泛化。更厉害的是,S1还具备持续学习进化的能力。从前文的demo中不难看出,S1能像人一样去理解和分析、与...……更多
谷歌 VS OpenAI:当搜索霸主和屠龙少年迈入同一条河流
...、代码等方面的表现也都高过GPT-4。而作为首个「原生多模态」模型,在一系列多模态基准测试中,对标GPT-4V,Gemini Ultra 也展现出了先进的性能。图源:谷歌新闻稿在chatGPT发布一周年之际,谷歌通过 Gemini 赶了个晚集,想要再度...……更多
Meta推出AI新模型VFusion3D,微美全息布局AIGC+3D内容加速产业转型升级
...AI+ 3D模型受青睐自 ChatGPT 火爆全球,以支持图像输入的多模态大模型 GPT-4 的推出作为契机。大模型的多模态计算潜力开始在内容生成领域发挥技术优势,顶尖的科技公司和想要抓住 AIGC 风口的初创企业开始争先恐后地推出 AI 驱...……更多
谷歌发布Gemini,机构看好多模态AI应用商业变现前景,软件ETF(159852)年内份额增长近1.5倍丨ETF观察
近日,多模态AI概念持续活跃。谷歌等科技公司也纷纷推出了新的多模态AI产品,大模型多模态化有望成为AI领域的热门趋势。综合多家机构观点,AI多模态模型的不断突破和加速落地,有望进一步打开AI应用商业化空间。截至12...……更多
国产GPU万卡集群终于来了!摩尔线程CEO张建中:做难而正确的事
...ansformer架构不能实现大一统,从稠密到稀疏模型,再到多模态模型的融合,多元架构持续演进并共存,面向特定领域设计的专用芯片难以适应未来算法,通用型算力才具备更强的抗风险能力。三是AI、3D、高性能计算(HPC)跨技...……更多
更多关于科技的资讯:
目前,安装ETC的车主越来越多,使用ETC通行高速,也成为越来越多现代车主出行的便捷选择。然而,在使用过程中,有时可能会遇到一些问题
2024-12-22 17:48:00
新时代的奔腾!Intel Wildcat Lake首次曝光:可能18A工艺
快科技12月22日消息,我们第一次看到了Intel一款新处理器的名字“Wildcat Lake”(野猫湖),目前看定位于入门级
2024-12-22 18:33:00
酷睿Ultra 200 65W包装盒首曝:没有无核显285F、没有3系列
快科技12月22日消息,Arrow Lake桌面版酷睿Ultra 200系列目前发布的只有K/KF系列,65W主流版本和35W节能版本将在明年初发布
2024-12-22 18:33:00
男孩在澳大利亚海滩发现奇怪生物 专家警告:恐有剧毒
快科技12月22日消息,据报道,一名男孩在澳大利亚巴特曼斯湾海滩惊现形似“外星生物”的物种。据悉,这种生物呈现出独特的蓝色管状形态
2024-12-22 18:33:00
最高时速250km/h!广汽集团发布GOVY AirJet飞行汽车官宣:2025年开启预订
快科技12月22日消息,广汽集团近日详细介绍了其全新飞行汽车品牌GOVY高域及首款复合翼飞行汽车GOVY AirJet
2024-12-22 18:33:00
CPU-Z小升级:支持Intel四大新品、新内存
CPU-Z近日迎来了一个小幅升级版本,v2.13,但内容相当丰富,重点支持Intel四大新品。首先是显卡方面,正式支持新发布的锐炫B580
2024-12-22 19:03:00
上海地铁11号线预计今晚9时恢复运营
本文转自:人民日报客户端据@上海地铁shmetro ,经全力抢修,11号线受损区段预计今晚9时左右恢复开通运营。
2024-12-22 19:07:00
石头居然长出了\
在秋天的阿拉斯加冰川湾公园,人们发现,石头居然长出了头发。看起来还挺浓密的。|atlasobscura而在墨西哥的查帕拉湖
2024-12-22 19:33:00
机械师K600G键盘首发299元:弹床式Gasket结构、定制HIFI轴
快科技12月22日消息,机械师K600G机械键盘目前已经上市,首发299元。据悉,该款键盘采用弹床式Gasket结构设计+多层复合降噪填充
2024-12-22 19:33:00
AMD显卡又双叒叕改名了!下代可能叫RX 9070
快科技12月22日消息,按照惯例延续下来,AMD RDNA4架构的下一代显卡应该是RX 8000系列,预计有RX 8800
2024-12-22 19:33:00
鲁网12月22日讯(记者 孙强 通讯员 冷梅)为学习日本知名企业管理经验,积极助力民营企业经营管理现代化、国际化,增强企业创新发展源动力
2024-12-22 19:57:00
印尼女子海边洗脚 突遭4米长鳄鱼死亡翻滚:逃生可能为0
12月16日,印尼北苏门答腊省南尼亚斯县,一名女子在海边洗脚时,遭遇了一条3.94米长的大鳄鱼袭击。附近居民听到了女子惨叫
2024-12-22 20:03:00
江南时报讯 域名作为企业的网络身份标识,停用后若不及时注销,不仅可能导致品牌方形象受损,还可能被一些境外服务器的不良网站抢注并用于播放侵犯他人著作权的影视作品
2024-12-22 20:52:00
9岁女孩长期吃头发胃里取出大块头发团:胃酸无法分解
快科技12月22日消息,据报道,南宁市妇幼保健院为9岁女孩小琪进行了开腹手术,从她胃里取出直径约4厘米的头发团,以及小肠内条索状头发丝绳约30厘米长
2024-12-22 21:03:00
江南时报讯 泰州某知名医药公司与某文化公司签订冠名合作协议,约定冠名费50万元,文化公司承诺3个月内完成500万元直播带货销售额
2024-12-22 21:25:00