• 我的订阅
  • 头条热搜
免训练大模型知识编辑,吸收新数据更高效|EMNLP\'24
...务中保持模型整体性能。之前各种知识编辑的模型方法和架构包括类似于:修改模型内部参数、增加额外参数和基于检索方法都会有冗长的编辑前缀影响推理效率。对模型本身进行微调可能会导致过拟合,从而影响其原始性能。...……更多
别只盯着ChatGPT版Her,多模态AI拟人互动上,国内玩家也支棱起来了
...,Semi 赛道侧重于考验核心主干技术,即更多地关注模型架构的选择以及特征提取泛化能力,对多模态大模型技术技术积累以及创新性要求比较高。 针对赛道少标签数据、高技术要求的特征,Soul 团队基于此前积累的自研大模型...……更多
GPT-4劲敌,谷歌进入高能+高产模式
...模型的标准提到了一个新高度。一、极致性能背后的模型架构当地时间2月15日,Alphabet与Google公司首席执行官Sundar Pichai携首席科学家Jeff Dean等众高管在X平台发布了多模态模型Gemini 1.5 Pro。这是继2月7日的Gemini 1.0 Ultra后,谷歌在……更多
非Transformer架构站起来了!首个纯无注意力大模型,超越Llama 3.1
Mamba 架构的大模型又一次向 Transformer 发起了挑战。Mamba 架构模型这次终于要「站」起来了?自 2023 年 12 月首次推出以来,Mamba 便成为了 Transformer 的强有力竞争对手。此后,采用 Mamba 架构的模型不断出现,比如 Mistral 发布的首...……更多
多模态竞技场对标90B Llama 3.2!Pixtral 12B技术报告全公开
...Pixtral都做了哪些工作。模型结构Pixtral 12B整体为Transformer架构,在大规模交错图像和文本文档上进行了预训练,具备多轮、多图像对话的能力。多模态解码器Pixtral的大语言模型主干选择了自家的Mistral Nemo 12B,decoder-only架构。内...……更多
超擎数智重磅发布擎天、锋锐、元景系列AI服务器,打造人工智能新质生产力强劲引擎
...务器搭载 NVIDIA H20 GPU,6U8卡 NVLink,是基于全新一代 AI超融合架构平台,面向超大规模数据中心的强劲性能,极致扩展的AI服务器,最强算力密度6U空间内搭载1块 NVIDIA Hopper架构 HGX-8GPU模组,系统支持4.0Tbps网络带宽,满足万亿级参数超大模.……更多
蔚来智能驾驶研发部架构调整,探索端到端大模型?
...,据晚点LatePost报道,蔚来智能驾驶研发部于近日完成了架构调整。此前,蔚来智能驾驶研发部分为感知、规控和集成等部分。调整后,感知和规控团队合并为大模型团队,集成团队重组为交付团队。合并后的大模型团队由原蔚...……更多
NeurIPS 2024 | FaceChain团队新作,开源拓扑对齐人脸表征模型
...于设计更高效的基于 Margin 的损失函数或者更复杂的网络架构,以此来帮助卷积神经网络更好地捕捉细腻度的人脸特征。近年来,无监督学习和图神经网络的成功已经表明了数据结构在提升模型泛化能力中的重要性。大规模人脸...……更多
浙大校友自研跨模态模型,打造具身智能的“通用语法”
...训练变得极为困难甚至无法实现。而大模型中 Transformer 架构的引入,则使模型具有高效的并行计算能力与灵活性,从而可以处理大规模数据集,并能通过微调预训练模型,快速适应不同任务场景。同时,其层次化结构能做到对...……更多
大模型“遍地”都是,谁能真正解放生产力?
...各自发挥了不同的价值。通用大模型解决基础性问题统一架构、统一模态、统一任务,而专用大模型解决专业领域知识问题,通过结合行业数据的预训练实现业务场景应用。而迫切寻求数字化转型的客户们需要的是,更精准、更...……更多
今日明星“端到端”,能否撑起智能驾驶的未来?|OpenTalk 回顾
...。直到2023年上海人工智能实验室发表的端到端自动驾驶架构UniAD获得CVPR 2023最佳论文、马斯克直播展示FSD,以及聚焦研发端到端自动驾驶系统的初创公司Wayve在2024年获10亿美元融资,各界才真的开始形成一个共识:端到端已经是...……更多
OpenAI发布文生视频模型Sora,奥尔特曼选取网友提示词
...用扩散模型(diffusionprobabilisticmodels)技术,基于Transformer架构,但为了解决Transformer架构核心组件注意力机制的长文本、高分辨率图像处理等问题,扩散模型用可扩展性更强的状态空间模型(SSM)主干替代了传统架构中的注意力...……更多
让OpenAI o1逆天的慢思考,360两月前就做出来了?周鸿祎CoE媲美CoT,应用太前瞻
...出得更早,方法更前瞻,落地应用也更快。他们所采用的架构,已经可以和o1匹敌,如果更新到下一代大模型,甚至还有可能实现领先。没错,这次周鸿祎和OpenAI所采用的路线殊途同归,不谋而合了。360首创的CoE架构,已经可以...……更多
新一轮ai算力调度平台的重要性
...中,客户对于算力的需求、对应用的要求,以及对于底层架构都在发生变化。”青云科技总裁林源在接受记者采访时表示,新一轮的变化就是新一轮的机会。AI算力开启“数智化”时代,带来新机遇当前,自动驾驶、人脸识别、...……更多
幻觉不一定有害,新框架用AI的「幻觉」优化图像分割技术
...它们可能有助于更有效地执行下游任务。图 2. ProMaC 整体架构 实现方法如图 2 所示,该研究提出了一个循环优化的 ProMaC 框架,它包括两部分:利用幻觉来从任务通用提示中推理出样本特有提示的 multi-scale chain of thought prompting ...……更多
国产模型指令跟随全球第一!来自LeCun亲推的最难作弊LLM新榜单
...韵、意境等方面,都能有精准的把控。完全自主研发,MoE架构,万亿参数在这次因为LiveBench又出来炸场一波之前,Step-2留给外界的最深刻印象,一定有一个是“国内首个由初创公司推出的万亿参数大模型”。这有点像阶跃风格的...……更多
自研芯片三国杀,头部智驾新战场,蔚小理谁强?
...模型,理想为了解决端到端大模型可解释性差的问题,将架构升级为「端到端+VLM」,而小鹏则和特斯拉一样坚信纯视觉才是智能驾驶的终局,发布了下一代AI鹰眼纯视觉方案。但是要最大限度的发挥算法的能力,必须要有和软件...……更多
0提示词就能续写小说!彩云科技首创DCFormer架构大模型,AI秒变网文产粮神器
...沟通会上,AI技术公司彩云科技正式推出首款基于DCFormer架构开发的通用大模型“云锦天章”,旗下AI RPG平台“彩云小梦”也成为首款基于DCFormer架构开发的AI产品。与此同时,彩云科技CEO袁行远就AI大模型落地应用难、大模型未...……更多
让大模型能听会说,国内机构开源首个端到端语音对话模型Mini-Omni
...成数据使任意语言模型具备语音交互能力。Mini-Omni 模型架构Mini-Omni 整体模型框架如下图所示,模型输入端可以是语音或文本,输出端同时包含文本和语音。为复用语言模型「预测下一个 token」的学习范式,输出侧语音采用离散...……更多
林达华谈大模型发展之路:未来会有更高效的模型结构出现
...科学家林达华。过去一年,人工智能领域风起云涌,模型架构、训练数据、多模态、超长上下文、智能体发展突飞猛进。大模型的技术演进路在何方?3月24日,在2024全球开发者先锋大会的大模型前沿论坛上,上海人工智能实验...……更多
智谱AI新一代基座大模型GLM-4在司南评测中跻身前列,位居国内第一
...工智能基础模型迫在眉睫。智谱AI于2020年底研发GLM预训练架构,三年多来始终坚持全自研路线,新一代基座大模型GLM-4是智谱 AI专注于大模型创新的最新成果。智谱 AI愿与人工智能行业所有的参与者、产业链上下游合作伙伴、开...……更多
AI大模型有望再扩1000倍!剑桥耶鲁康奈尔:PNN是变革关键
...处理。 计算模拟训练可以快速探索、验证和测试各种PNN架构,有助于在进行实际的物理建构之前提高PNN的准确性和功能性。这种方法不仅速度更快,成本效益更高,无需为每次设计迭代建立和优化昂贵而耗时的物理系统,还具...……更多
光芯片再次突破!清华大学研制出“太极-II”光训练芯片:首创全前向智能光计算训练架构【附光芯片行业现状分析】
...琼海院士课题组另辟蹊径,首创了全前向智能光计算训练架构,研制了“太极-II”光训练芯片,实现了光计算系统大规模神经网络的高效精准训练。该研究成果以“光神经网络全前向训练”为题,于北京时间8月7日晚在线发表于...……更多
围绕算力+数据,矩阵起源建设开源 AI 原生软件平台
...语言交互能力撼动了整个世界。之后十几个月,Transformer架构和大语言模型LLM成为划时代的技术,激发了整个AGI领域的创业和创新。OpenAI和Google相继推出了GPT-4o、ProjectAstra等「AI全家桶」、字节跳动发布「豆包」大模型家族、腾...……更多
利润暴涨628%,AI霸主英伟达全产业链投资图鉴|智氪
...,要关注哪些产品?根据英伟达官网披露,在每一代的GPU架构下,公司会将旗下的GPU按品牌分类进入GeForce、NVIDIA RTX/Quadro、数据中心三个品类。其中,GeForce系列主要应用于游戏行业,属于消费级GPU;NVIDIA RTX/Quadro主要应用于工业...……更多
比AI更热的行业,跑出了头部选手
...技术也正在迎来技术变革。那么首先要变革的,就是底层架构。在车辆的电子电气架构方面,特斯拉是早期变革者,在2012年 Model S有较为明显的功能域划分,包括动力域、底盘域、车身域, ADAS模块,到2017 年特斯拉又在Model3 突...……更多
腾讯自研大模型助力长三角打造世界级产业集群
...中文能力已追平GPT-4。多模态能力层面,混元文生图基础架构全面升级至Sora同款DiT架构,成为国内首个中文开源文生图Dit架构的大模型。为服务大模型产业发展,腾讯云推出大模型训练“黄金三件套”。新一代HCC高性能计算集群...……更多
3天把Llama训成Mamba,性能不降,推理更快!
...a这样的大型Transformer提炼成了Mamba模型, 并且成功在Mamba架构上应用了带有硬件感知的推测解码算法,提高了整个模型的推理速度。为什么要把Llama变成Mamba?因为从头开始训练一个大模型太贵了。Mamba也火了这么长时间了,相关...……更多
谷歌「诚意之作」,开源9B、27B版Gemma2,主打高效、经济!
...现,从而大大降低了部署成本。 谷歌团队在重新设计的架构上构建了Gemma 2,使得这位Gemma家族的新成员既能提供卓越的性能,又具有高效的推理能力。简要概括一下,性能、成本、推理是它的突出特点:性能卓越:Gemma 2 27B模...……更多
独家对话岩芯数智CEO刘凡平:“百模大战”下,AIGC新玩家如何杀出重围?|钛媒体焦点
...其他大模型产品,目前岩芯数智不仅拥有自研的Transformer架构大模型,而且其拥有的非transformer的记忆逻辑架构大模型,在训练效率、推理效率、模型幻觉、应用效果等方面都得到很大提升,已开始应用于金融、政务、互联网等...……更多
更多关于科技的资讯:
山东鲁班建安引入高端吊装设备 加速向“一流生产服务商”战略转型
大众网记者 徐德波 李威 济南报道6月17日,山东鲁班建安智慧工程施工有限公司举行新接吊车交接仪式,此次共交付7台高端吊装设备
2025-06-19 17:06:00
齐鲁晚报·齐鲁壹点记者 尚青龙近日,交通银行青岛分行成功为青岛自贸片区企业落地GUI模式CIPS标准收发器国际信用证开证业务
2025-06-19 17:08:00
李想:理想汽车国内充电站数量超特斯拉,网友:理想不语,只是默默搞基建
6月19日,理想汽车CEO李想发布微博:今天,理想5C超充站达到2500座了。2500座超充站,意味着理想汽车的超充站数量已经超过了特斯拉在国内的充电站数量
2025-06-19 17:08:00
中国消费者报上海讯(记者武晓莉)日前,智元机器人携旗下远征A2、精灵G1、灵犀X2等多款机器人及智能化解决方案集体亮相2025年世界移动通信大会(上海)
2025-06-19 17:34:00
中国消费者报上海讯(记者武晓莉)日前,以“预见未来 从5G-A到6G”为主题的2025年GTI国际产业大会在上海召开。作为GTI的发起方之一
2025-06-19 17:34:00
2025京东“6•18”呈现四大消费趋势
中国消费者报北京讯(记者桑雪骐)6月18日,2025京东“6•18”媒体开放日在北京举行。今年京东“6•18”立足“又好又便宜”
2025-06-19 17:34:00
通讯员 唐伟张晓君仲夏六月,水美虾肥,又是一年龙虾节。6月15日至22日,2025山东“大宋不夜城”暑期旅游季—东平湖第二届龙虾啤酒节活动拉开帷幕
2025-06-19 17:45:00
义乌艺星C+Rest超舒适?热玛吉全新技术发布暨国际模特初体验!
6月19日大咖齐聚义乌艺星,共同见证C+Rest超舒适?热玛吉的震撼发布!此次盛会不仅展现了Yestar艺星在抗衰领域的领先实力
2025-06-19 17:50:00
城市服务总门户、总平台“i西安”焕新升级
2025年6月19日上午,在第六届数字经济博览会开幕式上,“i西安”正式焕新发布。此次焕新通过服务定位升级、品牌形象焕新
2025-06-19 18:00:00
盛夏时节,暑气愈发浓烈,蚊虫也开始肆意出没,侵扰着人们的正常生活。每到这个季节,市场上相关的驱蚊产品便成了市民们的“刚需”
2025-06-19 21:25:00
6月19日至21日,第二届雄安未来之城场景汇“网络安全技术应用大赛”决赛在雄安新区场景汇科创园举行。北京神州绿盟科技有限公司带来的绿盟加密流量分析系统
2025-06-19 22:36:00
【跟着毕业生找工作】数据中心的“体温”守护者
又是一年栀子花开时,毕业生即将踏入社会,开启人生新篇章。他们如何完成从学生到职场人的角色转变?这不仅是个人的成长课题,更折射出高等教育与市场需求的适配程度
2025-06-19 20:45:00
菏泽联通匠心保障第二十届西瓜节 信号满格赋能云上盛宴
齐鲁晚报·齐鲁壹点 宋秋梅 通讯员 陈芳“鲜见东明 瓜香天下”—2025中国·东明第二十届西瓜节开幕式于6月15日盛大启幕
2025-06-19 18:53:00
国内首家“知行哲学运动馆”落地临沂 打造身心智发展综合体
6月18日,以王阳明“知行合一”为核心理念的国内首个哲学运动综合体“知行哲学运动馆”在山东临沂正式启幕。该场馆突破传统模式
2025-06-19 19:09:00
通讯员 杨乐曼 王燕男在老龄化社会加速到来的今天,如何让老年客户享受便捷、安全、温暖的金融服务,成为金融行业的重要课题
2025-06-19 19:27:00