• 我的订阅
  • 头条热搜
空间智能版ImageNet来了!李飞飞吴佳俊团队出品
空间智能版ImageNet来了,来自斯坦福李飞飞吴佳俊团队!HourVideo,一个用于评估多模态模型对长达一小时视频理解能力的基准数据集,包含多种任务。通过与现有模型对比,揭示当前模型在长视频理解上与人类水平的差距。2009...……更多
空间智能新进展:教机器人组装家具,实现操作步骤与真实视频对齐
斯坦福吴佳俊团队,给机器人设计了一套组装宜家家具的视频教程!具体来说,团队提出了用于机器人的大型多模态数据集IKEA Video Manuals,已入选NeurIPS。数据集涵盖了6大类IKEA家具,每种家具都包含完整的3D模型、组装说明书和...……更多
...市场上已公开的大多数模型出自初创公司和小型技术开发团队,包括Runaway、Pika等,且目前已呈现较为可观的完成效果和商业模式。(实习生张泊洋对此文亦有贡献) ……更多
GPT-4V暴露致命缺陷?JHU等发布首个多模态ToM 测试集
...的重要基础。近日,来自 JHU, NYU, MIT, Harvard 等机构的研究团队开创了第一个多模态的 ToM 测试基准,发现现有的多模态模型和 LLM 都表现存在系统性缺陷,同时他们提出了一种有效的新方法。在刚结束的 ACL 2024 会议中,这篇论文...……更多
苹果的封闭生态为大模型打开!发布开源多模态大模型、每天为 AI 烧百万美元,零碎的 Android 生态打得过吗?
...模态大模型中处理自由形式区域输入的成果。”项目研发团队在论文中写道。Ferret 是一种新颖的引用与定位多模态大语言模型(MLLM)。之所以选择多模态大模型作为 Ferret 的设计前提,是因为其拥有强大的视觉语言全局理解能...……更多
大模型“遍地”都是,谁能真正解放生产力?
...市场现实情况是,供不应求:除了大厂以外,少有大模型团队具备多模态大模型开放能力。深耕于产业多年的考拉悠然,听到了太多客户关于大模型难以落地的抱怨,正致力于解决以上困境,给出两全法。相较于其他两百多个大...……更多
“杜甫很忙”梗图变视频!智谱AI生成视频模型上线
...态到多模态,再到全模态的演进。就在本月初的世界人工智能大会上,腾讯集团副总裁蒋杰率先透露,腾讯混元大模型本身正在积极部署多模态甚至全模态技术。本月除了腾讯与智谱,快手视频生成大模型可灵AI也宣布基础模型...……更多
中国也有Sora同款训练架构公司,清华班底,智谱也投了 | 36氪首发
...aS(模型即服务)服务和To C的应用产品。生数科技的核心团队成员,出自清华大学人工智能研究院。联合创始人兼CEO唐家渝出身清华大学自然语言处理实验室,曾任瑞莱只会副总裁、腾讯优图实验室高级产品经理。CTO鲍凡在清华...……更多
从空间智能到具身智能,跨维践行Sim2Real AI最高效路径
...对这一领域关注得很早,有深厚的历史沉淀和技术积累。团队在早期就成立了 “几何感知与智能实验室”,当时这一领域尚未被大家所熟知的 “大厂” 涉足。我们是中国最早将人工智能技术应用于三维等非欧数据的学者和团队...……更多
萤石推出智能家居AI主机!接入自研蓝海大模型,智能手表抬手就能看血糖
...融合难,而且单一产品往往没法解决场景系统问题,所以团队做这款产品时是想解决复杂场景下缺乏统一系统方案的问题。智能家居AI主机采用端云协同框架,云端大模型为复杂场景问题提供了解法,一些简单问题则由本地小模...……更多
2024WAIC热议大模型助力产业新趋势,可信应用成焦点
...多模态模型」实现了规模与模态的双重突破。在规模上,团队积累了万亿级别的文本语料与百亿级图文、视频、音频数据,创新「跨模动态对齐」技术,融合大语言模型,实现千亿参数视觉语言模型。在模态上,团队建设模态动...……更多
智谱AI发布视频生成大模型,B站参与研发,亦庄提供算力|甲子光年
...、Relay Diffusion(ICLR’24)、CogView3 (2024)。基于CogView,团队研发基于大模型的文本到视频生成模型CogVideo,采用了多帧率分层训练策略生成高质量的视频片段,提出一种基于递归插值的方法,逐步生成与每个子描述相对应的视...……更多
Sora爆火96小时国内大模型进场
... 查睿春节期间,大洋彼岸又放出大招——美国人工智能团队OpenAI发布“文字生成视频”大模型Sora,特别是官方公布的长达60秒未经修改的AI视频,引发业界极大的震撼,网友惊呼“现实不存在了”。发布短短96个小时内,国内已...……更多
更快、更强、更可控:智谱“起舞弄清影”,视频生成卷出新高度!
...智谱清言打造的视频创作智能体,清影依托于智谱大模型团队自研打造的视频生成大模型CogVideoX,现已支持文生视频、图生视频多个能力,让用户“自助式”地完成艺术视频创作,首发测试期间,所有用户均可免费使用。同时,...……更多
联汇科技发布最新智能体应用——第二代多模态智能体OmAgent
近日,2024世界人工智能大会(WAIC 2024)期间,中国移动产业链发展基金与杭州联汇科技股份有限公司在上海世博中心联合主办“Om Al,智能体重新定义世界”自主智能+创新应用论坛,该论坛是本次世界人工智能大会核心专业论坛...……更多
别只盯着ChatGPT版Her,多模态AI拟人互动上,国内玩家也支棱起来了
...其中Semi 赛道第一名由社交平台 Soul App 摘得,其语音技术团队凭借可行性创新技术方案拔得头筹。 不过,在揭秘 Soul 团队技术方案之前,我们有必要先来了解 AI 在多种模态中的情感识别能力。人机交互下一步要让 AI 懂情感如...……更多
...机器人“Samantha”用充满智慧和幽默的回答展示出高度的智能性和适应性。当下,这些来自过去的科幻想象正加速照入现实中。北京时间5月14日凌晨,美国科技公司OpenAI在春季发布会上发布了最新GPT-4o多模态大模型。据OpenAI公司...……更多
全模态对齐框架align-anything来啦:实现跨模态指令跟随
...。本开源项目由北京大学对齐小组开发并进行长期维护,团队专注于人工智能系统的安全交互与价值对齐,指导老师为北京大学人工智能研究院杨耀东助理教授。核心成员包括吉嘉铭、周嘉懿、邱天异、陈博远、王恺乐、洪东海...……更多
奥林匹克竞赛里选最聪明的AI:Claude-3.5-Sonnet vs. GPT-4o?
...in.com上海交通大学生成式人工智能实验室 (GAIR Lab) 的研究团队,主要研究方向是:大模型训练、对齐与评估。团队主页:https://plms.ai/AI技术日新月异,近来Anthropic公司最新发布的Claude-3.5-Sonnet因在知识型推理、数学推理、编程任...……更多
给机器人装上大模型大脑,「若愚科技」获超5000万天使轮融资|36氪首发
...顾问。公司称,资金将主要用于产品研发,业务拓展以及团队搭建等方面。若愚科技是一支源自哈工大的团队,创立于2023年,旨在通过多模态大模型技术打造机器人大脑。公司创始人聂礼强现任哈尔滨工业大学(深圳)计算机...……更多
Gemini引领多模态AI热潮,产业发展有望加速
...音频、视频和代码等,这使得AI基础能力更具多样性。在智能营销领域,Gemini的推出将进一步优化用户体验并降低成本,诸如文本、图像、视频等都将进入到“能听会看”的时代。多模态的意义在于,为AI应用带来更多的可能性...……更多
...24日 第 09 版)本报电 (记者刘峣)近日,北京智源人工智能研究院正式发布原生多模态世界模型Emu3。该模型实现了视频、图像、文本三种模态的统一理解与生成,成功验证了基于下一个token(词元)预测的多模态技术范式,释...……更多
智源评测体系发布 国内外“百模”评估结果出炉
...更懂中国用户。在语言模型客观评测中,OpenAI GPT-4、百川智能Baichuan3位列第一、第二。百度文心一言4.0、智谱华章GLM-4和月之暗面Kimi均进入语言模型主客观评测前五。多模态理解模型客观评测结果显示,图文问答方面,阿里巴巴...……更多
不要小看「实而不华」的腾讯 AI
...纲等新功能,大大提升用户的阅读效率和体验。腾讯客服团队基于混元大模型升级智能客服体系,独创智能客服垂直领域精调模型,大幅提升智能对话的意图理解准确性和多轮问答流畅性,相比传统小模型下文准确性提升了 38%...……更多
群核科技(酷家乐)陈卓:用多模态AI助理赋能设计产业,用合成数据服务反哺AI | 新质生产力·AI Partner大会
...资源与AI行业的数据需求通道打通,我们成立了Coohom Cloud团队,这是团队专门面向前沿科学领域,以高性能渲染和数据加工能力,将群核科技的数字矿山提炼为AI行业所需要的各种数字燃料,包括视频集,3D数据集等。大家可以看...……更多
迎着应用爆发的曙光,百度将推出新版文心大模型
...”背后过去一年,百模大战如火如荼,国内外不少大模型团队热衷于跑分与对标。李彦宏则在多个公开场合向行业呼吁应用的重要性,称“要卷AI原生应用,不要卷大模型”。在不久前的一次访谈中,李彦宏在回应什么是百度战...……更多
开源证券:多模态模型再迎新突破,继续布局AI应用及算力
...储备,做好前瞻技术布局,横向扩展AI使用场景。4、初创团队引领下游硬件多点开花,重量级硬件应用涌现可期“人工智能技术+互联网平台”给传统行业带去创新动力,AI下流应用层出不穷,未来有可能出现颠覆性的应用。我们...……更多
神仙打架!谷歌新款大模型Gemini 和GPT-4谁能笑到最后?丨科技观察
... 30 个测试集的性能超过当前 SOTA 结果。 Gemini是谷歌各个团队大规模合作的成果,包括谷歌研究院的研究者,这个模型从发布之初就定位为原生多模态结构,这意味着它能够跨越文本、图像、视频、音频和代码进行无缝推理。这...……更多
Sora为何没能诞生在中国?
...。刘子纬向《中国新闻周刊》介绍,去年起,国际上已有团队在探索利用DiT架构训练文生视频模型,包括其所在团队。“这是很自然的选择。”Sora官网发布的部分由文字生成的视频(截图)。(图/Sora官网)彼时,文生视频模型...……更多
多款技术产品问世!山东省新型智慧媒体重点实验室亮点纷呈
...由齐鲁晚报•齐鲁壹点主办,山东财经大学大数据与人工智能研究院、浪潮智能终端有限公司协办的2023新型智慧媒体建设研讨会将在济南举行。会上,山东省新型智慧媒体重点实验室将展示众多研究成果和拳头产品。目前实验...……更多
更多关于科技的资讯:
打了微软修复补丁也没用!Win11 BitLocker加密仍被轻易攻破
快科技1月1日消息,在混沌计算机俱乐部(CCC)年度混沌通信大会上,黑客托马斯·兰伯特兹(Thomas Lambertz)展示了“Windows BitLocker: Screw
2025-01-01 20:13:00
历时五年!路特斯品牌重夺莲花商标
快科技1月1日消息,莲花集团CEO冯擎峰宣布,经过长达五年的努力,莲花集团在中国取得了历史性的法务胜利。从2024年12月7日起
2025-01-01 21:13:00
2025年第一款重磅大作!雷军预热REDMI Turbo 4:越冷越能打
快科技1月1日消息,小米创办人雷军表示,REDMI Turbo 4将挑战冬季续航之王。该机配备6550mAh最大小米金沙江电池
2025-01-01 21:13:00
海口王府井海垦广场用北极光跨年电音节奏响新年华章 点燃消费热潮
南海网1月1日消息(记者 潘頔)2024年12月31日,海口王府井海垦广场开启跨年不打烊模式,用北极光跨年电音节、超燃live show
2025-01-01 21:42:00
老太迎124岁生日:阎王爷把我忘了
1月1日消息,据媒体报道,四川省南充市南部县一位老人迎来她的124岁生日。据了解,这位老人出生于1901年1月1日,2025年元旦是她的124岁生辰
2025-01-01 21:43:00
1000多块旧笔记本电池组合:完美为家庭供电长达8年
快科技1月1日消息,据报道,一位名为Glubux的论坛用户通过回收利用1000多块废旧笔记本电脑电池,成功打造了一套家用供电系统
2025-01-01 22:13:00
暴雪游戏国服登录方式官宣调整:需要绑定网易账号
快科技1月1日消息,今天,暴雪官方发布了《关于调整暴雪游戏登录方式的公告》,称暴雪游戏国服运营团队将于2025年2月11日起调整暴雪游戏的登录方式
2025-01-01 22:13:00
探秘东北夏威夷,美的空调全屋智慧空气新体验
横跨50℃的极限温差,将“夏威夷”搬到哈尔滨,这并不是什么异想天开,而是科技实力的体现。在今年的哈尔滨冰雪大世界内,美的空调凭借全屋智慧空气解决方案的硬核科技
2025-01-01 22:42:00
吃一口脖子伸出二里地 干噎酸奶到底是什么
近期,一种可以嚼着吃的“干噎酸奶”引起大家关注。不少网友发布品尝视频,展示其干噎程度,并调侃“咽的时候脖子要伸得很长”“吃完这款酸奶脖子能长出八块腹肌”
2025-01-01 22:43:00
日本电视塔跨年倒数完竟直接关灯:现场观众都愣住了
1月1日消息,据媒体报道,在日本札幌大通公园,人群聚集在日本札幌电视塔下倒数跨年,结果到0点后灯塔直接关灯下班,现场观众被抽象一幕给惊呆了
2025-01-01 22:43:00
雷军跨年直播:redmiturbo4清爽亮相
1月1日消息,昨晚雷军召开了一场跨年直播,耗时四个半小时,直播与网友一起跨过了2024-2025年。直播中,雷军透露了不少产品和公司信息
2025-01-01 22:43:00
《永劫无间》与《拳皇》联动来了:不知火舞将登场
《永劫无间》与SNK旗下《拳皇》系列的联动将于2025年1月8日开启。此次联动将为胡桃和特木尔推出新服装及饰品,游戏中的角色将被打造成《拳皇》中的麻宫雅典娜和不知火舞的形象
2025-01-01 12:12:00
红米turbo4将配备6550mah最大小米金沙江电池
12月31日,小米公关部总经理王化发微博称,最近手机圈都流行挑战低温长续航,作为一个北方的手机企业研发的新产品,红米Turbo4要做2025年第一款新机的冬季续航之王
2025-01-01 12:42:00
阿里巴巴AI“生意管家”: 400万商家的秘密武器
快科技1月1日消息,阿里巴巴今日揭晓2024年度AI成绩单,亮点之一为淘宝平台上线的AI服务产品“生意管家”。据悉,该产品自推出以来
2025-01-01 12:42:00
从几千到上万的大路灯是智商税吗!第一批买护眼灯的用户已近视了
快科技1月1日消息,不知从何时起,大路灯成了中产书房的必备单品,但这却是你交的智商税。爆火的大路灯,哪里值5000?每个初次接触大路灯的人
2025-01-01 12:42:00