• 我的订阅
  • 头条热搜
meta推出“v-jepa”视频预测模型
...高效预测生成图片/视频中被遮蔽的部分。IT之家注意到,研究人员使用一系列经过遮蔽处理的特定视频训练I-JEPA/V-JEPA模型,研究人员要求模型利用“抽象方式”填充视频中缺失的内容,从而让模型在填充间学习场景,进一步预...……更多
迎战GPT-4V!谷歌PaLI-3视觉语言模型问世,更小、更快、更强
...模型与相似的体积大 10 倍的模型相比具有显著竞争力。研究人员使用分类目标预训练的视觉变换器(ViT)模型与对比性预训练的模型(SigLIP)进行了比较,结果发现,PaLI-3 虽然在标准图像分类基准上略微表现不佳,但基于 SigLIP...……更多
o1金牌团队揭秘AI超越人类惊人时刻!22分完整版视频全公开
...一个推理模型,也就是会比以往「思考」得更多。在OpenAI研究人员看来,「思考」就是推理的一种最直观的方式。有时候,当被问及意大利首都是什么问题时,我们几乎不用思考,即刻就能得出答案。但有时候,涉及商业企划书...……更多
谷歌推出“文生视频”扩散模型
.../24FPS下约3.34秒视频),虽然这一数据看起来很短,不过研究人员提到,5秒视频长度实际上“已经超过大多数媒体作品中的平均镜头时长”。除了应用“Space-TimeU-Net”基础架构外,谷歌还介绍了Lumiere的基础特性,该AI建立在一个...……更多
...者水平。德国卡尔斯鲁厄理工学院和杜伊斯堡-埃森大学研究人员在新一期人工智能领域学术期刊《知识系统》上发表论文说,他们使用真实的比赛场景而非模拟或人工合成数据来训练人工智能系统。研究人员在特定环境中录制...……更多
Meta版Sora深夜横空出世,小扎放出16秒高清大片!92页论文曝光技术细节,Llama 3架构立功
...Movie Gen Video沿用了Transformer的设计,尤其借鉴了Llama 3。而研究人员引入的「流匹配」(Flow Matching),让视频在精度和细节表现上,都优于扩散模型。稍显遗憾的是,这次Meta发的也是「期货」,产品预计明年才正式向公众开放。...……更多
研究人员提出版权授权方案,能将艺术家风格和IP版权授权给AIGC模型
...代下的“版权授权”方案,为解决该类问题提供了方法。研究人员表示:“我们此次研究的背景是源自于网上冲浪的时候,看到很多艺术家社区呼吁抵制文字生成图像模型,因为模型剽窃能力太强了,人类创作者创作效率跟不上...……更多
行业报告 | 2023年9月全球AIGC行业月报-要闻篇
...毁模型\"技术,抵制大型AI模型的恶意应用斯坦福大学的研究人员最近推出一项创新性研究,旨在防止大型AI模型被恶意应用于有害任务。他们提出了一种名为“自毁模型”的新技术,通过这一方法,即使大型模型是开源的,也可...……更多
deepmind开发音乐创作工具dreamtrack
...,声称可令视频创作者“更有效率地将想法变为作品”。研究人员介绍了当前通过AI模型生成音乐的挑战,这是因为音乐本身包含极高的信息密度,其中每一秒钟都可能拥有多个节拍、音符及和声。而这也使得“生成音乐”相较...……更多
meta推出两款基于ai的图像编辑工具
...型中,进而在视频生成和编辑中,提供更好的控制能力。研究人员指出,当前的图像编辑模型,通常会过度修改图像,或是修改不足,而EmuEdit的优势在于能够准确按照指令进行编辑。Meta使用了1000万个合成数据集训练EmuEdit,号...……更多
空间智能版ImageNet来了!李飞飞吴佳俊团队出品
...而道远。HourVideo如何炼成? 之所以提出HourVideo,是因为研究人员发现目前长视频理解越来越重要,而现有评估benchmark存在不足。多模态越来越卷,人们期待AI被赋予autonomous agents的类似能力;而从人类角度来看,由于人类具备处...……更多
下载次数破39万!CMU、Meta联合发布VQAScore文生图优化方案:Imagen3已采用
...用于挑战和提升现有的图像生成模型。两个工具可以帮助研究人员自动评估AI模型的性能,还能通过选择最佳候选图像来实际改善生成的图像。近年来,生成式人工智能(AIGC)引发广泛关注。Midjourney、Imagen3、Stable Diffusion和Sora...……更多
空间智能新进展:教机器人组装家具,实现操作步骤与真实视频对齐
...PS。数据集涵盖了6大类IKEA家具,每种家具都包含完整的3D模型、组装说明书和实际组装视频。而且划分精细,拆解出的安装子步骤多达1000多个。作者介绍,该数据集首次实现了组装指令在真实场景中的4D对齐,为研究这一复杂问...……更多
机器人轻松模仿人类,还能泛化到不同任务和智能体
...帧的基础上执行各个潜在动作之后的未来视频帧。为此,研究人员选择从预训练的视频生成模型上进行微调,将条件从文本换成了潜在动作表示和FDM的重建输出。 在具身智能的相关数据集上进行微调之后,研究人员观察到World M...……更多
...工智能研究院理事长、北京大学教授黄铁军表示,构建大模型生态首先要建立数据流通机制,推动从数据到智能的正反馈。汇聚数据超700万亿字节“如果没有开源数据集,很难想象人工智能怎样才能实现如此快速的迭代,然而,...……更多
谷歌员工曝AI改进速度放缓,Gemini已成立新团队解决问题
...该公司希望模型性能提升的速度可以与去年相当,这促使研究人员专注于其他方法来勉强取得效果。这种情况和OpenAI的遭遇类似。此前有报道称,OpenAI模型性能提升速度有所放缓,该公司正改变技术策略来解决问题。回到谷歌本...……更多
科学家开发多模态音乐理解和生成大模型,兼具理解和创作音乐能力
...”刘山松表示。在调研和确定研究现状和研究目标之后,研究人员先选用 MERT、ViT 和 ViViT 这三个特征处理器,来分别处理音乐、图像和视频输入。接着,将编码器的输出引入所选用的 LLaMA2 开源大模型,让其能够理解、处理多模...……更多
微软推出全新vasa-1模型
...,最重要的是几乎没有人工痕迹,如果不细看很难发现。研究人员承认,与所有其他模型一样,该模型目前还无法妥善处理头发等非刚性元素,但整体效果要比其它同类模型要更为优秀。研究人员还表示VASA-1支持离线batch处理模...……更多
本周硅谷发生了什么?|OpenAI推出5项更新;微软组建新的AI团队;Googe发布文生视频模型Lumiere
...在运动幅度和一致性表现良好。微软集中公司内部顶尖AI研究人员力量,组建新的GenAI团队研发小模型,减少对OpenAI的依赖。Adept AI发布多模态模型Fuyu-Heavy,官方称跑分表现仅次于GPT4-V和Gemini Ultra。同时,国内大模型也有不少进...……更多
Sora为何没能诞生在中国?
...家AI初创公司Pika lab(以下简称Pika),推出自研视频生成模型的新功能,可同时生成画面和声音。此前,人们看到的所有AI生成的视频都没有声音。此功能尚未向公众开放,但足以让人见识到AI的进化之快。今年2月16日,OpenAI发布...……更多
Meta联合开发机器人AI模型,任务成功率达90%
...过的环境中执行任务一直是一个棘手的问题。一般来说,研究人员需要针对每个新环境对机器人进行额外的训练,这个过程既耗时又昂贵。然而,最近的一项新研究为解决这一难题带来了新的希望。美国纽约大学、Meta和机器人...……更多
一文看尽Meta开源大礼包!全面覆盖图像分割、语音、文本、表征、材料发现、密码安全性等
...强。开源链接:https://github.com/facebookresearch/sam2相比SAM2,研究人员引入了额外的数据增强技术来模拟视觉相似物体和小物体,并且通过在较长的帧序列上训练模型并对「空间」和「物体指向记忆」(object pointer memory)的位置编码...……更多
字节回应“中文版Sora”:目前无法作为完善产品落地,与...
...物或物体的动作。Boximator的数据来源是WebVid-10M数据集,研究人员从中过滤出110万段动态明显的视频片段,并为其注释220万个对象的边界框,在PixelDance和ModelScope这两个模型上训练了Boximator。字节跳动的研究人员表示,目前这款模...……更多
瑞士研究人员成功训练一只机器狗
近日,瑞士苏黎世联邦理工学院机器人系统实验室的研究人员成功训练了一只机器狗,使其能够利用一条腿完成开门、移动物体等任务,并依靠其他三条腿行走和保持平衡。这种“新颖的”运动方式具有潜在的应用前景,尤其...……更多
谷歌DeepMind展示大模型Genie,能从零制作类似超级马里奥的游戏
...看他们造出了什么。”他说。虚拟游乐场谷歌 DeepMind 的研究人员感兴趣的不仅仅是游戏生成。Genie 背后的团队致力于研究开放式学习,将人工智能控制的机器人放入虚拟环境中,通过试错(一种被称为强化学习的技术)来解决...……更多
...12日报道 据美国趣味科学网站5月13日报道,麻省理工学院研究人员开发了一种新的方式,帮助人工智能(AI)系统在编码、战略规划和机器人科学三个领域执行复杂推理任务。聊天生成预训练转换器(ChatGPT)和“克劳德3-奥普斯”(Claud...……更多
OpenAI机器人亮相,大模型有了“肉身”,英伟达微软都有投资
文|尚恩编辑|邓咏仪封面来源|Figure“大模型”终于有实体了。美国时间3月13日,由OpenAI投资的机器人公司Figure发布了一段视频demo,视频里的机器人,不仅可以与人进行对话交互,理解人类的意图,而且还拥有记忆力。当工...……更多
openai发布sora模型:支持一次性生成多机位视频
...。OpenAI称,该模型正在接受测试,只分享给了一批精选的研究人员和学者。 ……更多
谷歌DeepMind推Imagen2;ChatGPT Plus恢复订阅;OpenAI提出用小模型监督大模型 | 本周硅谷发生了什么?
...Converge 2加速器计划。该计划面向杰出工程师、设计师、研究人员和使用人工智能重新构想世界的产品开发者。通过技术讲座、办公时间、社交活动以及与领先从业者的对话,OpenAI将一起探索在人工智能前沿建设中最重要的机遇...……更多
瑞士研究人员展现四足机器人新技术
...报道,近日瑞士苏黎世联邦理工学院机器人系统实验室的研究人员展现了新的试验成果:训练自己的机器狗,使其利用其中一条腿来完成开门、移动物体等任务,并依靠其他三条腿来行走、保持平衡。研究人员表示,相信这种“...……更多
更多关于科技的资讯:
卓易科技荣获第十四届公益节2024科技企业社会责任奖
2025年1月9日至10日,由数央网、数央公益联合众媒体共同举办的第十四届公益节暨2024ESG影响力年会在北京举行。大会活动主题为“共筑可持续发展未来”
2025-01-10 21:19:00
可持续发展获《时代周刊》认可,药明康德做对了什么?
近日,知名媒体《时代周刊》(TIME)联合全球顶尖商业数据平台Statista重磅发布了2025年全球最佳公司榜单(World’s Best Companies in Sustainable Growth 2025)
2025-01-10 21:30:00
用户错选地点支付3600元天价车费 哈啰顺风车:司机已将车费提现
快科技1月10日消息,据报道,深圳的刘女士向媒体反映,去年12月25日,她弟弟因急事回家,从广东深圳市打了一辆哈啰顺风车
2025-01-10 21:51:00
女子花4.5万买羽绒服:穿4天就起毛 门店称“顾客穿着不当”
1月10日消息,据媒体报道,台州一名女士称,她花4万多买了一件LV羽绒服,才穿了四天,就出现多处起毛的情况。门店回应称是顾客穿着不当
2025-01-10 22:51:00
比亚迪全新性能怪兽汉L登场:马力超千匹 单颗电机功率580kW
快科技1月10日消息,今日晚间,工信部公布了新一批新车申报目录,比亚迪全新旗舰轿车汉L现身其中。动力系统是汉L的最大亮点
2025-01-10 22:51:00
桐梓:以旧换新引领消费市场“焕新”
多彩贵州网讯 促销费,惠民生。2024年以来,随着以旧换新工作的不断推进,桐梓县消费市场活力持续释放,不仅有力推动了居民绿色消费
2025-01-10 23:04:00
极氪应战特斯拉!极氪7X对比焕新版Model Y:赢面很多
快科技1月10日消息,今日上午,特斯拉焕新Model Y正式上线中国官网,官方对新Model Y相当自信,称“尽管对比”
2025-01-10 19:21:00
狂飙10000MB/s!铠侠EXCERIA PLUS G4 1TB SSD图赏
快科技1月10日消息,日前铠侠推出全新消费级固态硬盘“EXCERIA PLUS G4系列”。该系列固态硬盘内置先进的BiCS FLASH 3D闪存技术
2025-01-10 19:21:00
快科技1月10日消息,据媒体报道,近日,长沙某小区给垃圾桶装了个“开盖神器”在网络走红。据了解,这个开盖神器,是由手环
2025-01-10 19:21:00
重大突破!我国鄂尔多斯盆地发现特大型铀矿
快科技1月10日消息,据报道,我国在鄂尔多斯盆地泾川地区取得了铀矿勘探的重大成就,成功探明一座特大型铀矿床。这一发现不仅预示着我国铀资源储量的显著提升
2025-01-10 19:21:00
华硕旗下AAEON杀进显卡市场!首款产品竟是Intel Arc A750E
快科技1月10日消息,华硕旗下的AAEON公司进军显卡市场,推出了其首款高级显卡——GAR-A750E。这款显卡基于Intel Arc A750E GPU
2025-01-10 19:21:00
乘客腹痛难忍恳请司机闯红灯 的哥一路鸣笛送医
快科技1月10日消息,近日,据央视报道,山东潍坊一位乘客在出租车上腹痛难忍,出租车司机一路鸣笛,连闯多个红灯,将乘客紧急送医
2025-01-10 19:21:00
479元起!玄派玄熊猫PD100M机械键盘上市:全铝机身、标配旋钮屏幕
快科技1月10日消息,玄派玄熊猫PD100M三模全铝机械键盘现已开启预售,将于1月13日上午10:00正式开售。键盘采用100键98配列设计
2025-01-10 19:21:00
Redmi Note 14走向全球:新增4G版本
快科技1月10日消息,小米今日将Redmi Note 14推向全球市场,一个月前该手机已在印度发布。此次国际版与印度版基本相同
2025-01-10 19:51:00
极摩客G9全闪4盘位NAS首发1399元起:英特尔N150、双系统设计
快科技1月10日消息,极摩客G9全闪4盘位NAS目前已经上市,首发1399元起。据介绍,新款NAS搭载英特尔N150处理器
2025-01-10 19:51:00