• 我的订阅
  • 头条热搜
微软新专利:构建多模态3d面部模型
...单,微软公司获得了一项新的专利,通过深度学习构建多模态3D面部模型,可以创建非常逼真的虚拟肖像。这项专利全称为《多模态三维面部建模和跟踪,生成富有表现力的虚拟肖像》,该系统涉及处理器和存储系统,处理器负...……更多
微软机器学习模型专利曝光:可创作逼真头像
11月16日消息,微软的一项新专利于当地时间周二在美国专利商标局网站上公开,这是一种新的机器学习模型专利,可为用户创作出“更加有生命力”的逼真头像。据介绍,通过新的机器学习模型,头像或照片可针对细节部分进...……更多
全球AI大事记·疯狂三月盘点:9万亿AIGC时代即将到来|钛媒体AGI
...数十名员工已加入苹果的AI部门。苹果推出300亿参数MM1多模态大模型在一篇由多位作者署名的论文《MM1: Methods, Analysis & Insights from Multimodal LLM Pre-training》中,苹果正式公布自家的多模态大模型研究成果。这是一个具……更多
微软正研发面部照明AI技术:视频时可自动调整屏幕亮度
快科技8月14日消息,据媒体报道,微软正致力于一项创新性的面部照明技术研发,旨在视频会议场景中自动优化屏幕亮度,为用户带来前所未有的视觉体验。这项技术的核心在于智能调节,确保每位参与者的面部在会议中都能...……更多
国产地表最强视频模型震惊歪果仁,官方现场摇人30s直出!视觉模型进入上下文时代
【新智元导读】全球首个支持多主体一致性的多模态模型,刚刚诞生!Vidu 1.5一上线,全网网友都震惊了:LLM独有的上下文学习优势,视觉模型居然也有了。来自中国的视频生成模型,再一次震惊了全球大模型圈。生数科技推出...……更多
Pika、阿里同日炫技!国产视频大模型奋起直追
...频,表情、五官、姿势都会产生非常自然的变化。在AI多模态领域,科技巨头、明星初创企业似乎把火力集中到了同一个方向——AI视频生成,Sora的火热更是一石激起千层浪,同类产品发布你追我赶,战况之焦灼可见一斑。在该...……更多
...提供标准化交互方式不同的AI技术,该技术利用声音等多模态数据,结合每位用户的特征来创建对应的账号文件,以更加个性化地响应和反馈用户需求。据了解,该专利适用于多用户办公等环境,能够差异化满足不同用户的需求...……更多
微软修改azure人工智能行为准则
5月8日消息,微软似乎并不希望执法部门利用AzureOpenAI进行实时面部识别,该公司最近修改了其有关警方使用人工智能服务的行为准则。图源Pixabay注意到,执法机构近年来越来越多地采用人工智能技术。例如,军警技术供应商Axo...……更多
杨幂+小兰会是什么样?中山大学新AI成果,实现人脸个性化SOTA
...山大学、联想的研究团队推出了ConsistentID,可在细粒度多模态面部提示下,仅利用单张参考图像生成多样的肖像,且保持五官的一致性。 最终在人脸个性化任务处理上,相比腾讯的photomaker和小红书的instantID,在五官一致性保持...……更多
AI视野:OpenAI发布GPT-4Turbo;xAI推出PromptIDE工具;
...定义GPTs服务,以及其他新功能和API,如Assistants API和新的模态API。百家号宣布“AI笔记”功能将下线百度百家号将于2023年11月30日下线其创作工具平台的“AI笔记”功能,但其他功能不受影响,创作者可以继续使用。 xAI推出PromptI...……更多
微软win1123h2更新中已整合copilotai功能
...和提供标准化交互的传统AI模型不同,可以基于声音等多模态数据,结合每位用户的特征来创建对应的账号文件,可以更加个性化地响应和反馈用户需求。这项专利适合拥有多名用户的办公等环境下,可以区分不同用户的需求,...……更多
微软推出全新vasa-1模型
4月19日消息,微软亚洲研究院(MicrosoftResearchAsia)近日发表论文,介绍了全新的VASA-1模型,用户只需要提供一张静态肖像图片和一段语音音频片段,该模型就能自动让图片中的人物自动说话。VASA-1特别有趣的地方在于,它能够...……更多
谷歌发博文介绍vloggerai模型可让人物“动起来”
...表情地朗读音频内容。VLOGGERAI是一种适用于虚拟肖像的多模态Diffusion模型,使用MENTOR数据库进行训练,该数据库中包含超过80万名人物肖像,以及累计超过2200小时的影片,从而让VLOGGER生成不同种族、不同年龄、不同穿着、不同...……更多
Cyan 青心意创“全面拟人”机器人 Orca Ⅰ 发布
...器人视觉观测和自身状态向量输出运动轨迹,将端到端多模态模型置于模仿学习框架下,并结合数据回收系统,让机器人具备拟人的双臂操作能力。Cyan 青心意创表示,OrcaⅠ 从操作模型、多模态处理能力、数据及传感器等方方...……更多
...在逻辑推理、语言理解、文本生成、数学答题、代码、多模态等核心能力均显著提升。星火语音大模型、星火开源大模型“星火开源-13B”也将同步发布。 马斯克:脑机接口公司Neuralink的首个产品名为“心灵感应”马斯克称,脑...……更多
...度学习的音乐练习行为分析指导云平台V1.0”通过建构AI多模态情感对话系统,关联语言、面部表情、肢体动作等多方面的信息,基于语音识别模型、意图识别模型、多模态情感计算算法、闲聊模型、语音合成技术等,在人机交互...……更多
双录视频,创造你与偶像的私密时刻!
...案提供商。通过自主研发的领域大模型、大数据分析、多模态交互三大核心技术,打造了数字化洞察与营销、数字化服务与运营、数“智”底座三大产品矩阵,全面升级云呼叫中心、智能客服、智能外呼、质检陪练、智能音视频...……更多
谷歌和微软两位“印度老乡”CEO,正面硬刚
...,不同于ChatGPT、GPT-4模型率先发布文本功能再逐渐扩充多模态功能,Gemini被设计为原生多模态大模型,从一开始就支持多模态输入输出。Pichai对此讲道:“就像人一样,它不仅从文本中学习,还能通过视频、音频和代码进行学习...……更多
...混合专家模型,并将同步选择开源。天工3.0是全球首个多模态“超级模型”(Super Model),集成了AI搜索、AI写作、AI长文本阅读、AI对话、AI语音合成、AI漫画创作、AI音乐生成等多项能力。其中,AI音乐生成大模型SkyMusic还将于4月...……更多
世优科技携手人民中科打造AI数字人智能体助力智慧校园
...体,接入人民中科研发的“白泽”大模型,使用先进的跨模态智能理解技术,对文本、图像、视频等多种模态信息进行统一理解、统一表达、统一度量,从而实现跨模态生成、跨模态搜索、跨模态对话等功能。 AI数字人智能体...……更多
微软宣布:copilot将持续实现创新
...bing.com/create或要求Copilot创建一个图像来访问此功能。多模态搜索基础此功能结合了GPT-4功能、视觉、Bing图像搜索和网页搜索数据的能力,从而提供更好的图像理解能力。如下图所示。传统的多模态系统只能泛泛地描述图像中的...……更多
微软宣布Team Copilot发布,年内将推出初步预览版
...型GPT-4o,现已在AzureAIStudio中提供,并作为API提供。该多模态模型集成了文本、图像和音频处理能力,带来了全新的生成式和对话式AI体验。此外,由微软开发的Phi-3列AI小型语言模型(SLM)中的一种新型多模态模型Phi-3-vision现已...……更多
本周硅谷发生了什么?|OpenAI推出5项更新;微软组建新的AI团队;Googe发布文生视频模型Lumiere
...GenAI团队研发小模型,减少对OpenAI的依赖。Adept AI发布多模态模型Fuyu-Heavy,官方称跑分表现仅次于GPT4-V和Gemini Ultra。同时,国内大模型也有不少进展,通义千问团队升级了视觉语言模型Qwen-VL,图片内文字处理能力得到提升。此外...……更多
唯一躲过韩国空气酵母的神颜顶流,怎么脖子比脸还粗啊?
...挡地物体,会自动估计被遮挡部分的样子,专业术语称为模态补全。例如帽子、口罩是男人最好的医美,很容易营造出帅哥氛围感。图源网络然而这种模态补全并不总是准确的,大部分时候都是偏向于可见部分。所以才会有那么...……更多
...公告,中国第一汽车股份有限公司申请一项名为“副车架模态计算有限元建模方法、装置、终端及存储介质“,公开号CN117216865A,申请日期为2023年7月。专利摘要显示,本发明属于汽车技术领域,具体的说是一种副车架模态计算...……更多
新扩散模型OmniGen一统图像生成,架构还高度简化、易用
...的扩散模型架构 OmniGen,一种新的用于统一图像生成的多模态模型。OmniGen 具有以下特点:统一性:OmniGen 天然地支持各种图像生成任务,例如文生图、图像编辑、主题驱动生成和视觉条件生成等。此外,OmniGen 可以处理经典的计...……更多
烟台曙光整形金琳琳馒化脸修复攻略
...网9月14日讯(记者 魏萱)在医美领域,\"馒化脸\"是指因面部过度填充注射剂所引起的一种综合征,表现为面部饱满而缺乏起伏感,没有正常的骨相结构和高光点,看起来充气感、肿泡感,且随着年龄增加可能出现下垂和松弛问...……更多
机器人笑了,我却笑不出来
...一款名叫Emo的机器人就不会这么瘆人。它可以分析人类的面部表情,并在人类做出表情前的0.839秒就预测出人类即将做出的表情,于是它可以和人类几乎同时一起微笑,从而避免尴尬或让人害怕。机器人Emo会预测人类的微笑,并...……更多
GPT-4o:“更像人”的人工智能模型
...目前GPT-4o已经支持包括中文在内的20种语言进行音频等多模态交互,这次更新在多语言方面更加强大。 GPT-4o数据优势明显。在数据层面,根据传统基准测试,GPT-4o的性能对比GPT-4 Turbo处于优势,对比其他模型更是大幅领先。GPT-4o...……更多
出门问问重磅发布全新2.5D数字人系统 WetaAvatar 4.0
...、逻辑、推理、规划”六个维度。凭借「序列猴子」在跨模态迁移方面的出众表现,出门问问的技术团队推出了MeetVoice Pro语音大模型。此外,我们团队也计划利用「序列猴子」的核心能力,打造多模态数字人模型,进一步拓展...……更多
更多关于科技的资讯:
北京天空出现三个太阳:三日凌空!大太阳左右两边各有一个“小太阳”
快科技12月11日讯 据媒体报道,12月10日午后,北京上空出现美丽的幻日景观,太阳左右两边各有一个“小太阳”,午间天空幻境多彩
2024-12-11 11:44:00
一种低成本就能缓解压力的小玩意儿:真的推荐你试试!
香薰蜡烛,这种融合了照明与香薰功能的工艺品,已逐渐成为现代生活中的一个重要元素。它们不仅为居住空间带来温暖的光线,还能通过释放的香气营造出一种宁静和放松的氛围
2024-12-11 11:44:00
周黑鸭创始人鸭哥“毁容”坚持直播:没用道具 被卡磁炉炸伤
快科技12月11日消息,近日,周黑鸭创始人周富裕“毁容”坚持直播,直播间人气高涨,引发网友关注。随后,周富裕发视频称,前几天自己在户外用卡磁炉烧开水的时候遇到爆炸被炸伤
2024-12-11 11:44:00
王牌功能丨法大大“合同归档”,让AI解放混乱的合同管理工作!
管过合同的可能都发出过这种嚎叫: 合同比我头发都多,我就一双手,怎么管得过来啊! 合同里面的发票抬头、收支款、履约时间全要我挨个找
2024-12-11 11:45:00
子力制冷 | 低温冷水机水循环系统设计的核心要点在哪?
低温冷水机的水循环系统设计是一个复杂且至关重要的过程,它直接关系到设备的制冷效率、稳定性和使用寿命。那么低温冷水机水循环系统设计的核心要点在哪
2024-12-11 11:51:00
博通推出3.5D XDSiP平台:可整合6000mm²的3D堆叠硅片与12个HBM
近日,博通推出了3.5D XDSiP(3.5D eXtreme Dimension System in Package)平台
2024-12-11 13:34:00
游得更快的升级版机器鳐鱼采用更简单、更高效的设计
就在两年前,一台微型机器人鳐鱼成为世界上游泳速度最快的软体机器人。 现在,它的后代之一打破了这一记录--而且它使用的能源比它的前辈还要少
2024-12-11 13:34:00
Duolingo与Netflix合作帮助《鱿鱼游戏》粉丝学习韩语
玩家们注意了。你即将参加一项新的挑战——但首先,你会说韩语吗?为了准备 Netflix 最受欢迎的韩国惊悚剧集之一《鱿鱼游戏》第二季
2024-12-11 13:35:00
专利文档显示苹果正在继续开发折叠屏iPhone可能使用的铰链
一项新授予的专利表明,苹果已经改进了之前的铰链设计,现在正在描述具有更复杂齿轮的可折叠 iPhone 显示屏。当折叠式 iPhone
2024-12-11 13:35:00
5分钟完成目前超算需要“10的25次方”年的运算!巨头宣布重大突破!马斯克、阿尔特曼点赞
据第一财经,2019年,谷歌曾在《Nature》发布了一项量子计算突破,在世界第一超级计算机需要计算1万年的实验中,谷歌研究的量子计算机只用了短短3分20秒
2024-12-11 13:40:00
149元畅享高品质音乐生活,vivo TWS 3e真无线蓝牙耳机深度评测
#双12年终好物节#在科技日新月异的今天,蓝牙耳机已经成为我们生活中不可或缺的一部分。无论是运动时的陪伴、通勤途中的娱乐
2024-12-11 13:54:00
荣耀GT新机再次被确认:AI护眼电竞屏+5300mAh电池,主打轻薄
为了在市场中脱颖而出,如今有很多手机厂商都在走不一样的道路,其中荣耀手机就是如此,旗下的GT新机开始进行发力。这次不仅要真正的走电竞路线
2024-12-11 13:54:00
小米11月新机激活率登顶,超500万台,击败华为和苹果
最近,中国手机市场11月新机激活榜已经出炉。排名也是出现了不一样的变化。根据榜中的情况来看,小米超越了华为、苹果成为了11月里新机激活量最高的厂商
2024-12-11 13:55:00
一加Ace 5核心参数确认,就看李杰如何定价了
近一段时间或者说今年面向线上用户主打性能、游戏体验的机型越来越多。不知道是这样的机型越来越好卖还是什么原因。最近即将要发布的几款机型全部是这样的定位
2024-12-11 13:56:00
科技巨头齐聚MEET2025:共话AI、Agent、具身智能机器人等浪潮趋势
今天上午,MEET2025智能未来大会在北京隆重召开。大会以「智变千行,慧及百业」为主题,汇聚了科技界的璀璨星光,AI
2024-12-11 13:56:00