• 我的订阅
  • 头条热搜
华人团队爆火instructblip抢跑看图聊天
碾压GPT-4识图能力的多模态生成模型来了。华人团队最新提出的InstructBLIP在多项任务上实现SOTA。GPT-4看图聊天还没上线,就已经被超越了。近来,华人团队开源了多模态基础模型InstructBLIP,是从BLIP2模型微调而来的模型。BLIP家族...……更多
阿里达摩院发布业内首个遥感ai大模型,支持多模态交互
...业应用。IT之家归纳总结该遥感大模型特点如下:支持多模态交互,如输入“提取影像中的耕地农田”,会自动识别所选目标▲图源达摩院DAMO官方公众号支持任意地表目标识别,并建立多级语义标签体系▲图源达摩院DAMO官方公...……更多
全面对标 OpenAI,智谱 AI 想要开发者 | 独家
...增强,逼近 GPT-4。可以支持更长的上下文,具备更强的多模态能力,有着更快的推理速度、响应高并发的能力,推理成本得到了更进一步的降低,还对智能体能力进行了大幅增强。除了模型本身之外,智谱 AI 还带来了 GLM-4 All Too...……更多
东方证券:谷歌发布多模态模型Gemini,多模态应用前景广阔
...办公、法律、医疗有望率先落地。东方证券:谷歌发布多模态模型Gemini,多模态应用前景广阔12月6日晚,谷歌正式发布了Gemini大模型,是谷歌目前最强大最通用的模型。其尺寸最大的版本GeminiUltra在32项基准测试中有30项能力都超...……更多
谷歌chrome地址栏整合gemini聊天机器人
...Gemini是谷歌Deepmind最新、最强大的AI模型。它原生支持多模态,具备跨模态推理能力,包括文本,图像,视频,音频和代码。Gemini分为三个版本Ultra-三个模型版本中功能最强大,适用于高度复杂的任务Pro-适用于广泛任务的最佳模...……更多
中国AI领军人物、商汤集团执行董事汤晓鸥去世,享年55岁
据红星资本局、橙柿互动、潮新闻12月16日报道,商汤集团(00020.HK)执行董事、商汤科技创始人、人工智能科学家汤晓鸥去世,享年55岁。汤晓鸥图源:中国科学院大学官网公开信息显示,汤晓鸥从事计算机视觉相关领域的研究,...……更多
Gemini 开启大模型路线之争,新战场将“数流成河”
...一种可能性:具有原生数据优势的互联网巨头,可能在多模态大模型竞争中占据优势。这意味着,谷歌、马斯克、Meta以及中国的腾讯、抖音、阿里、百度等公司都有可能在Gemini 开创的路线上加速迭代大模型。大模型战局,进入...……更多
商汤 AI 办公小程序“Raccoon 智能助手”上线:提炼文章重点
IT之家 6 月 24 日消息,商汤科技宣布,基于商汤“日日新 SenseNova”大模型能力开发的数据分析产品“办公小浣熊”今天正式上线小程序版 ——“Raccoon 智能助手”。官方表示,可在小程序中,直接插入微信聊天中的文件(xls / x...……更多
vivo自研大模型全家桶炸场,亮出PhoneGPT智能体,蓝心小V一键搞定衣食住行
...幕的力度、圈搜文字或图片、还是拖拽一段地址信息,多模态大模型都可以深度解读你的意图,进而给你需要的反馈和服务。依托文本大模型,结合自监督学习语音编解码、多语音任务学习和模态对齐等技术,蓝心小V在文本能...……更多
中国也有Sora同款训练架构公司,清华班底,智谱也投了 | 36氪首发
...也出现了大模型独角兽智谱AI的身影。36氪获悉,近日多模态AI模型公司生数科技完成新一轮数亿元融资。该轮融资由启明创投领投,达泰资本、鸿福厚德、智谱AI、老股东BV百度风投和卓源亚洲跟投。据介绍,融资主要用于多模...……更多
通义千问再放大招:720亿大模型开源,全尺寸赶上LLaMA-2,还有移动端可用的18亿模型
...阿里云也首次开源了音频理解大模型Qwen-Audio,这是在多模态领域的一次探索。Qwen-Audio能够感知和理解人声、自然声、动物声、音乐声等各类语音信号。用户可以输入一段音频,要求模型给出对音频的理解,甚至基于音频进行文...……更多
语言≠思维,大模型学不了推理:一篇Nature让AI社区炸锅了
...两个非常重要的特性:首先,语言区域表现出输入和输出模态的独立性,这是表征抽象性的关键特征。主要表现为在理解过程中,这些大脑区域对跨模态(口头、书面或手语)的语言输入做出反应。同样,在语言生成过程中,无...……更多
开源证券:多模态模型再迎新突破,继续布局AI应用及算力
...议关注券商、银行。(三)券商行业掘金 开源证券:多模态模型再迎新突破,继续布局AI应用及算力1、OpenAI发布首个文生视频模型Sora,可输出长达60秒的视频2月16日凌晨,OpenAI发布了首个文生视频模型Sora。Sora可以直接输出长...……更多
百度与优必选合作,人形机器人“大脑”有了AI大模型
...r S在具身智能理应用等方面又迎来了新进展,在已有的多模态感知与运动控制能力上,通过接入文心大模型,获得了高级的意图理解能力和细粒度规划能力。从视频来看,接入了AI大模型的Walker S在语义理解与交互、智能任务管...……更多
养老政策大模型发布
本文转自:解放日报上咨集团与商汤科技战略合作养老政策大模型发布吴丹璐本报讯(记者 吴丹璐)AI正在改变咨询行业。昨天,上海投资咨询集团有限公司(下称“上咨集团”)与上海商汤智能科技有限公司(下称“商汤科...……更多
京东要给实体产业做个GPT
...测试,都会为AI带来点滴新的进步。决战大模型:走向多模态与实体京东云今年将发布的新一代产业大模型 ——言犀大规模预训练语言模型,被视为是AI角逐产业场景的开端。京东云言犀团队前后耗费多年时间,持续深耕对话式A...……更多
...家企业每年“算力券”申领最高不超过800万元,生成式多模态基础大模型企业可以放宽。扩容“算力券”发放的背后,是杭州鼓励广大企业进行模型应用。相比于去年的产业政策,《措施》更侧重于对创新型应用的支持。比如,...……更多
谷歌和微软两位“印度老乡”CEO,正面硬刚
...,不同于ChatGPT、GPT-4模型率先发布文本功能再逐渐扩充多模态功能,Gemini被设计为原生多模态大模型,从一开始就支持多模态输入输出。Pichai对此讲道:“就像人一样,它不仅从文本中学习,还能通过视频、音频和代码进行学习...……更多
朱秋国:云深处开展1+X+N战略 拓展足式机器人新赛道
...苏黎世联邦理工学院旗下Anymal四足机器人开始尝试使用多模态大模型,来完成通过手肘支撑攀爬以及跑酷、足部关灯开门等动作。足式机器人开始像人类一样加速进化,如果说决定足式机器人下限的是其硬件水平,那么决定其上...……更多
北京经开区:加快打造AI原生产业创新高地,每年发放1亿元...
...系3.构建“1+N”高效协同创新体系。支持头部企业开展多模态通用大模型关键技术攻关,围绕多模态通用模型基础架构、训练数据集构建、多模态学习算法、高效并行训练、对齐调优、具身智能等领域,开展算法创新和核心技术...……更多
打造全球智能消费决策社区,「阿尔特科技」希望提供“像闺蜜一样”有针对性的消费决策辅助 | 早期项目
...评测和信息验证;在需求端,这款App以团队内部开发的多模态模型为支撑,能捕捉细微的用户行为,进而根据用户的实际需求和消费习惯精准推送用户可能感兴趣的产品,帮助用户挑选更合适的、更高性价比的产品,降低客户遇...……更多
大模型“遍地”都是,谁能真正解放生产力?
...,其苦于人工标注久矣,不想再人工打标视频、图片等多模态信息。但市场现实情况是,供不应求:除了大厂以外,少有大模型团队具备多模态大模型开放能力。深耕于产业多年的考拉悠然,听到了太多客户关于大模型难以落地...……更多
若愚科技推出九天机器人大脑,大模型总参数规模达130亿 |项目报道
...商合作,提供先进的机器人大脑产品。若愚科技的基于多模态大模型的通用机器人大脑研究主要聚焦在两个方向:一是负责感知层面的感知模型,二是控制层面的控制模型。感知模型通过语音交互、视觉信息传感器信号提取等方...……更多
鬼手操控着你的手机?大模型GUI智能体易遭受环境劫持
...对用户指令的忠实性。具体而言,AI 是否能够在复杂的多模态环境中不受眼花缭乱的内容所干扰,忠实地完成用户预设的目标,是一个尚待研究的问题,也是实际应用之前必须回答的问题。针对上述问题,本文以图形用户界面智...……更多
清华全球最大双臂机器人扩散大模型RDT,懂调酒能遛狗,登顶热榜
...进行统一的处理。在本文中,研究者通过提出创新型的多模态模型架构,以及统一的物理可解释动作空间,来解决这些挑战。设计 RDT:双臂机器人操作的新架构「模仿学习」是当前开发通用机器人模型的主流方法。即机器人通...……更多
小红书技术副总裁王晓博:大模型让AI越来越像人,更懂小红书的内容与用户
...力的建设。目前,小红书技术团队同时针对语言模型和多模态能力进行了综合研发,结合小红书自身的业务场景和需求,更早做了视觉理解大模型方向的技术攻关:在多模模型架构、多模态alignment和整个数据体系和视觉感知能力...……更多
...2023年中国大模型行研能力评测报告》。评测结果显示,商汤语言大模型“日日新·商量”以总分7.73(满分10分)斩获总榜第一,并在报告撰写能力、模型基础能力两个子榜位居第一。 ……更多
斯坦福AI团队抄袭国产大模型?连识别“清华简”都抄了!清华系团队发文回应
...,引起舆论哗然。起因是这个团队在5月29日发布了一个多模态大模型Llama3-V,声称只花500美元训练,就能实现在多个基准测试中比肩GPT-4的性能。但很快有人发现,该模型跟清华系大模型创企面壁智能5月发布的MiniCPM-Llama3-V 2.5模...……更多
...大量通用数据、行业数据,支持文本、图像、视频等多种模态,并打造了全流程的数据处理工具。超过700万亿字节的通用数据集可以开展通用模型训练,同时,4.33万亿字节的行业垂类数据对模型训练也极为重要。当前已知的全...……更多
...征点的三维模型快速匹配系统高逼真数字人快速构建与多模态交互系统虚拟空间创作平台3D沉浸式实时通信系统3D实景地图平台基于文本描述的3D场景生成系统元宇宙数字身份标识技术解决方案人形机器人揭榜挂帅任务榜单:全身...……更多
更多关于科技的资讯:
OPPO Pad3上手:生产力工具实至名归
在当今数字化工作与学习日益普及的时代,平板电脑已经从单纯的娱乐设备进化为不可或缺的生产力工具,长时间使用需求也让显示素质成为了选购产品时的重要指标之一
2024-11-26 18:01:00
国产版劳斯莱斯!鸿蒙智行尊界S800亮相:星汉灿烂大灯、星空顶上车
快科技11月26日消息,今天下午举办的华为Mate品牌盛典上,尊界S800正式亮相。余承东介绍,尊界S800采用天地人和的设计理念
2024-11-26 18:01:00
22.98万起!华为智界新S7正式上市 12月1日开启交付
快科技11月26日消息,新款智界S7已正式上市,售价22.98-31.98万元,提供Pro、Max、Max RS三款车型
2024-11-26 18:01:00
全系800V 智界新S7入门就配82度大电池:能跑705km
快科技11月26日消息,在今日举办的华为发布会上,余承东带来了智界新S7,该车定位于纯电轿跑,一共有Pro、Max和Ultra三种版本
2024-11-26 18:01:00
华为Mate X6标准版和典藏版有啥区别 一文看懂
快科技11月26日消息,华为正式发布了旗下第4款横向内折机Mate X6系列,带来了Mate X6和Mate X6典藏版
2024-11-26 18:01:00
突然!任天堂国行Switch 2026年停止运营:多款游戏无法联机
快科技11月26日消息,今日,腾讯官方宣布任天堂国行Switch将于2026年3月31日起至2026年5月15日,逐步停止Nintendo e商店和其他网络相关运营服务
2024-11-26 18:01:00
极越CEO回应抄袭特斯拉:理念相似并非抄袭
快科技11月26日消息,极越汽车CEO夏一平最近在视频中回应了关于公司抄袭特斯拉的争议。他明确指出,极越的设计灵感来源于自家的全球首款AI智驾超跑ROBO X
2024-11-26 18:01:00
100-150万元!华为百万豪车尊界S800预售:意向金2万
快科技11月26日消息,由华为和江淮合作打造的尊界品牌首车尊界S800正式开启预售,价格为100-150万元,意向金2万元
2024-11-26 18:01:00
长春机场完成“96665”自助语音系统升级
为了进一步提升“96665”自助语音系统的稳定性和安全性,确保为旅客提供更加优质和高效的问询服务,11月24日,长春机场顺利完成了“96665”自助语音系统的全面升级工作
2024-11-26 18:26:00
玄奘之路“宏才戈友会”成立大会暨宏才千人盛典年会盛大起航
宏才戈友会成立大会暨2024年宏才同学年会,于11月24日圆满落下帷幕!大会特邀玄奘文旅集团创始人张文峰、玄奘文旅集团联合创始人兼赛事总监张晓菲
2024-11-26 18:28:00
中国人民银行近日公布2023年度金融科技发展奖获奖项目名单。山西证券及其子公司山证科技申报的“FICC数字资产管理平台”项目获二等奖
2024-11-26 18:29:00
499元起!大疆发布DJI Mic Mini迷你无线麦克风:可400米传输
快科技11月26日消息,大疆今晚发布了DJI Mic Mini迷你无线麦克风,售价499元起!DJl Mic Mini 发射器小巧轻便
2024-11-26 22:01:00
比5.5G还快!华为Mate 70 Pro+网速实测:比Mate 60 Pro快一倍
快科技11月26日消息,今天,华为正式推出了备受期待的Mate 70系列手机。在发布会上,华为消费者业务CEO余承东特别强调了该系列手机在通信技术方面的卓越表现
2024-11-26 22:01:00
听歌APP会员到期将扣1800元 女子差点被骗365万元
快科技11月26日消息,近日,杭州上城一女子遭遇冒充客服的电信网络诈骗。在银行工作人员与民警的共同努力下,她账户中的365万元被成功保住
2024-11-26 22:31:00
中国汽车流通协会:全年预计关停4S店数量将达4000家
快科技11月26日消息,中国汽车流通协会副秘书长郎学红预测,今年将有约4000家4S店退网,下半年退网数量可能超过上半年的1500家
2024-11-26 22:31:00