• 我的订阅
  • 头条热搜
黄仁勋对话Transformer七子:我们被困在原始模型里,还需要更强大的新架构
...名为Attention is all you need 的论文,其中所提出的Transformer架构,为当下大热的ChatGPT、Gemini等大模型打下基础,人工智能领域从此变天。论文的八位作者,也被称为“Transformer八子”。不过,八位作者后来也陆续离开谷歌。除Lukasz K.……更多
滴普科技董事长兼CEO赵杰辉:从数据驱动到智能驱动,大模型释放数据平台全新生产力|WISE2023商业之王大会
...度释放生产力。他认为,未来,整个企业领域的数据智能架构将基于数据的基础设施建设,加上基于大模型的AI Agent,形成一个新的数字经济体架构。演讲正文如下:大家好,非常荣幸有机会在36氪WISE平台上跟大家分享我们的行...……更多
林达华谈大模型发展之路:未来会有更高效的模型结构出现
...科学家林达华。过去一年,人工智能领域风起云涌,模型架构、训练数据、多模态、超长上下文、智能体发展突飞猛进。大模型的技术演进路在何方?3月24日,在2024全球开发者先锋大会的大模型前沿论坛上,上海人工智能实验...……更多
黄仁勋对话Transformer七作者:很多计算资源被浪费,世界需要更好的模型
...I的过去、现在与未来。当地时间3月21日,提出了Transformer架构、改写AI领域发展历程的论文《注意力就是你所需要的一切(Attention Is All You Need)》的作者们现身英伟达GTC大会,在名为Transforming AI(变革AI)的圆桌会议上与黄仁勋...……更多
AI大模型行业报告:大模型发展迈入爆发期,开启AI新纪元(附下载)
...用,当前主流大模型中,诞生了以BERT为代表的Encoder-only架构、以T5为代表的Encoder-decoder架构、以GPT为代表的Decoder-only架构的大规模预训练语言模型。1.3 GPT系列模型技术发展历程回顾从技术角度来看,结合中国人民大学《大语言...……更多
挑战Scaling Law,Meta发布移动端350M小模型MobileLLM,性能比肩7B LLaMA-v2
...。但是别被Scaling Law局限,参数小不意味着能力弱,模型架构的重要性应该重新进入我们的视线。MobileLLM不仅在同等大小的模型中达到了SOTA性能,而且提出,架构的深度比宽度更重要。一个「深而窄」的「瘦长」小模型同样可以...……更多
...行业异构多云场景下的应用上云支撑问题,实现从传统IT架构向基于云平台的高可靠、高并发、高弹性的分布式架构转型,帮助客户快速构建稳定、可靠、高效的行业云平台。目前,该产品已通过中国信通院多云管理平台解决方...……更多
字节跳动推出对话式ai实时交互解决方案
...端大模型的实时语音通话。▲对话式AI实时交互服务方案架构字节跳动介绍称,对话式AI实时交互解决方案支持开箱即用快速搭建,只需调用标准的OpenAPI接口即可配置所需的语音识别(ASR)、大语音模型(LLM)、语音合成(TTS)...……更多
11项指标击败GPT-4o!360攒局让16家大模型联手作战
...手的背后,又运用了什么样的技术呢?独创“专家协同”架构实际上,这种根据需求调度大模型的用法,也刚好是360推出的一项新技术——CoE(Collaboration-of-Experts),即专家协同架构。我们知道,很多国产模型在单项指标上都打...……更多
“云+AI”风起云涌:火山引擎拥抱多云战略,加速企业业务创新增长
...助力企业智能化演进。此外,据火山引擎大模型服务算法架构师孙帆介绍,2023年6月,火山引擎发布火山方舟一站式大模型服务平台,集成了多款大模型应用,能够向用户提供字节云雀大模型、第三方闭源模型及开源模型的“1+N+...……更多
浪潮海岳数据中台inDataX 7.0全新发布,打造企业数据管理智能化新引擎
...理上基于高性能MPP分析引擎,在数据采集上采用流批一体架构,支持对存量数据的批量采集及增量数据的实时采集,借助流计算能力还可实现随采随算,从采集阶段即保证了数据时效性。在数据模型上,支持事实明细、聚合汇总...……更多
大模型的未来,快手在自己身上找答案
...上来说已经远优于同类数字人产品效果。这是因为在工程架构方面,「AI 关小芳」实现了端云结合的技术架构设计,通过搭建分布式流媒体计算调度框架、自研大模型能力算子化适配和专有网络协议加速,支持用户双工和 AI 智...……更多
0提示词就能续写小说!彩云科技首创DCFormer架构大模型,AI秒变网文产粮神器
...沟通会上,AI技术公司彩云科技正式推出首款基于DCFormer架构开发的通用大模型“云锦天章”,旗下AI RPG平台“彩云小梦”也成为首款基于DCFormer架构开发的AI产品。与此同时,彩云科技CEO袁行远就AI大模型落地应用难、大模型未...……更多
AI大模型时代,如何用RAG技术重塑传统智能客服问答机器人?
...结果进行规划。目前的这个解决方案有什么收益和成本?架构图:实际开发中需要注意的点?如何搭建整体和RAG相关框架:总之,选择什么样的实现方式需要综合考虑。举个例子,初期可以使用Langchain框架或现有平台快速搭建原...……更多
马斯克承诺开源版大模型 来了!Grok-1:3140亿参数迄今最大,权重架构全开放
...混合专家(MoE)模型‘Grok-1’,以及该模型的权重和网络架构。这也使得Grok-1成为当前参数量最大的开源大语言模型。封面图根据 Grok 提示使用 Midjourney 生成的:神经网络的 3D 插图,具有透明节点和发光连接,以不同粗细和颜...……更多
对话腾讯汤道生:大模型和云一样,难以被垄断|36氪专访
...服务能力获得市场竞争力,而不是单纯的低价。新的技术架构,也能为客户降本,比如大数据的湖仓一体架构,就比传统做法性价比更高。最近推出的新一代云服务器,基于性价比更高的Bergamo芯片,也能给到客户更低的单位计...……更多
独家对话岩芯数智CEO刘凡平:“百模大战”下,AIGC新玩家如何杀出重围?|钛媒体焦点
...其他大模型产品,目前岩芯数智不仅拥有自研的Transformer架构大模型,而且其拥有的非transformer的记忆逻辑架构大模型,在训练效率、推理效率、模型幻觉、应用效果等方面都得到很大提升,已开始应用于金融、政务、互联网等...……更多
对话贾扬清:明年AI推理成本还会降低10倍以上,一两年内AI使用成本或低于人工
...模型,规模会变得越来越小,计算效率会越来越高,模型架构会变得更加开放和标准,这是我观察到的未来趋势。”如果说前两年的AI是在“卷”技术,那今年无疑都转向了“卷”应用。在贾扬清看来,今天是做应用最好的年代...……更多
大模型步入推理Scaling时代,SambaNova如何挑战英伟达的霸主地位
...igurable Dataflow Unit)为代表的动态可重构数据流(Dataflow)架构的芯片,能够通过并行处理和高效数据移动来优化性能和效率,近年越来越被认为是一个重要的发展方向。数倍于 GPU 推理性能来自 SambaNova 最新一代 RDU SN40L近日的芯...……更多
5年投资超1000亿,北京公布一系列AI重磅成果,北大清华百度蚂蚁微软大佬齐谈AI未来|钛媒体AGI
...覆性技术路线创新,北京将设立创新专项,前瞻布局新型架构芯片、脑智能、类脑智能等新路径探索,《若干措施》择优纳入市级科技研发计划,最高支持3000万元。在数据方面,鼓励各类主体开放共享高质量训练数据,根据数...……更多
豆包大模型综合能力提升20.3%,火山引擎成立零售大模型联盟
...体系产品,都生长于同一朵云上。数据中心、软硬件基础架构的统一,避免了“算力孤岛”和“数据孤岛”问题,结合火山引擎自研服务器、自研 DPU 卡、调度算法等技术能力,火山引擎 AI 全栈云在性能、稳定性和成本上具备了...……更多
小模型正在成为AI界的新宠
...)的发展,使得训练更大规模的模型成为可能;新的模型架构和训练技术的出现,如 Transformer 架构和预训练技术,使得模型能够更有效地扩展到更大的规模。此外,模型的大小往往被视为技术创新和研发实力的一种体现。因此...……更多
手机市场深陷泥沼,厂商如何破冰?
...颈不断,手机厂商该如何破冰,进入下一个增长期?潮汐架构,一份关键答案性能不再是手机的瓶颈,前几年手机厂商都选择了新的影像赛道,通过与传统相机企业的携手同行,让高端手机市场迎来了新的增长机会。如今市面上...……更多
vivo发布自研大模型,为用户和开发者带来诸多惊喜
... 让图像生成技术触手可及,实现AI普惠随着扩散模型与AI架构的深度融合,图像生成技术迎来了指数级飞跃,其中文生图技术尤为显著。vivoAIGC图像大模型技术总监阮晓虎在论坛上介绍了vivo的文生图大模型——蓝心图像大模型Blu...……更多
彩云科技发布基于DCFormer架构通用大模型云锦天章
...景等热点话题进行了交流,并正式推出了首款基于DCFormer架构开发的通用大模型云锦天章,与此同时,彩云科技旗下AI RPG平台彩云小梦,也成为首款基于DCFormer架构开发的AI产品。早在2017年,谷歌发布《Attention Is All You Need》论文...……更多
对话清华刘知远:Scaling Law已被OpenAI验证,知识密度将是未来的核心
...它。但如何高质量地做这件事?需要什么样的数据、模型架构、学习过程?他认为,还没有形成共识。“数据驱动的方向大致确定,但技术路线还远远没有被收敛,还是在高速演进。”“未来大模型面临着如何把更多的知识放到...……更多
百度智能云晒大模型落地成绩单:5个第一!
...成、代码审查、优化代码等能力。此次发布了企业级代码架构解释、企业级代码审查能力和企业级代码辅助能力。其中,企业级代码架构解释能让大模型快速解读代码库,梳理整个业务逻辑以及工程架构。程序员接手项目后就不...……更多
腾讯云公布多项大模型产品进展
...模型也持续迭代升级。在生图领域,腾讯混元文生图基础架构已全面升级至Sora同款的DiT架构,支持中英文双语输入及理解,具备多轮绘图能力,测评结果国内领先;在生视频领域,腾讯混元支持文生视频、图生视频、图文生视...……更多
猿辅导竟然是一家AI公司?大模型全家桶曝光
...那一刻带来的智能涌现。“就像没有人能在2017年Transformer架构论文发布时就笃定地认为这是未来,除了OpenAI。”杨元祖透露。直到GPT-4发布后,猿辅导敏锐意识到两代生成式大模型能力之间质的差异,转而开启自研之路。这不是...……更多
腾讯开源最大MoE大语言模型!3D大模型同时支持文/图生成,晒混元模型及应用全家桶
...尺度物体,大到建筑,小到工具花草。 Hunyuan3D-1.0采用DiT架构,与混元DiT生图联合,支持原生中文,支持风格定制。其技术架构引入多视图扩散,借助二维数据优势提升3D泛化性,改进点包括:1、持续扩展数据规模、类目、质量...……更多
更多关于科技的资讯:
微星AfterBurner升级:RTX 5080三个风扇可以不同转速
快科技1月4日消息,微星AfterBurner(小飞机)的开发者、维护者Alexey Nicolaychuk近日确认,该软件将在本月晚些时候升级新版本
2025-01-04 22:45:00
本文转自:人民日报营造竞争有序、繁荣活跃的数据产业生态保障企业敢用数、会用数、用好数(政策解读)本报记者 王云杉《人民日报》(2025年01月05日第 02 版)随着数字技术持续迭代
2025-01-05 05:22:00
机车圈男博主“波哥”出车祸身亡引热议 知情人:与逆行渣土车相撞
1月5日消息,据国内媒体报道称,又有机车网红出事了(被称为“龙泉山车神”)。报道中提到,网络上突然传来了一条知名机车博主死亡的消息
2025-01-05 07:15:00
麒麟影像之王!华为Pura 80 Ultra堆料前所未有 全新自研技术落地
快科技1月5日消息,进入2025年后,一大波超大杯影像旗舰将陆续登场,其中,最受关注的自然是华为Pura 80 Ultra
2025-01-05 07:15:00
号称能“百分百有效预防”的长效艾滋病药物来了:国内上市申请已获批准
1月5日消息,据国内媒体报道称,号称能“百分百有效预防”的长效艾滋病药物上市申请已获批准。国家药监局(NMPA)官网显示
2025-01-05 07:15:00
感受下!三大运营商等97家央企“一把手”年薪披露:最高不过百万
1月5日消息,据国内媒体报道称,近日,国务院国资委网站发布了一则“2023年度中央企业负责人薪酬信息”,详细披露了97家央企主要负责人的年薪收入情况
2025-01-05 07:15:00
北美新天地:来“潮流秀场”感受“时尚浓度”
北美新天地外景。王韵菲 摄入冬的太原韵味悠长,尤其夜色渐浓,流光溢彩中好一座令人惊艳的“不夜城”。伴着华灯初上,太原市的亲贤—长风商圈更是犹如一个展现时尚潮流的巨大秀场
2025-01-05 07:17:00
每位遇难者赔4000万元!韩国空难179具遗体仅5具完好无损
1月5日消息,据韩国媒体报道称,韩国国土交通部此前在记者会上表示,救援部门在事故现场找到的179具遗体中,只有5具完好无损
2025-01-05 07:15:00
4.8万公里全球还有谁!2024年新开通14条高铁一览:有你家吗
2024年,又有多条普铁、高铁新线相继建成通车,全国铁路营业里程达到16.2万公里,其中高铁4.8万公里,傲居全球第一
2025-01-04 16:15:00
高弹耳带 振德医用灭菌口罩100只11.85元
天猫【认养一头牛旗舰店】振德医用灭菌口罩100只日常售价为 19.8 元,领取 3 元优惠券,叠加打折优惠,到手价为 11
2025-01-04 16:45:00
精选黄牛后腿 牧牛班熟食卤牛肉礼盒15元/袋发车
天猫【牧牛班食品旗舰店】牧牛班 南阳黄牛肉礼盒 150g*6 袋(熟食卤牛肉)日常售价 139 元,今日下单领取 39 元优惠券
2025-01-04 16:45:00
2024年观众高满意度影片榜单TOP25出炉:《热辣滚烫》排名第五
快科技1月4日消息,据中国电影艺术研究中心,中国电影观众满意度调查结果出炉。25部影片获2024年观众高满意度影片,前三名分别为《好东西》《飞驰人生2》《第二十条》
2025-01-04 17:15:00
粉丝自制RTX 5080公版渲染图:还挺帅的
快科技1月4日消息,近日,NVIDIA的一张宣传图疑似泄露了RTX 50公版卡的样式,和以往有很大不同,猜测大概率是RTX 5080/5070 Ti
2025-01-04 17:15:00
美国又将11个中国机构列入实体清单!还有巴基斯坦1个
美国的实体清单(Entity List)又变长了!2025年1月3日,美国商务部工业与安全局(BIS)通告,将中国、缅甸
2025-01-04 17:45:00
曾在空军服役!韩国遇难机长最后画面:伸手摸向操控面板
1月4日消息,最近,一张疑似韩国济州航空遇难机长的最后画面曝光,引发网友热议。画面显示,客机用腹部着陆,即将撞上外墙前
2025-01-04 17:45:00