• 我的订阅
  • 头条热搜
OpenAI o1太贵?那就自己做一个!纯提示方法让普通LLM进化出复杂推理能力
...没有任何阻碍。——但其实还是有的,那就是新东西通常太贵。o1-preview的每百万输入token为15美元,每百万输出token为60美元,而对位的GPT-4o分别是5美元和15美元。本来GPT-4o就不便宜,现在想体验更强大的推理能力则需要再付出几...……更多
模拟5亿年自然进化史,全新蛋白质大模型ESM3诞生!前Meta老将力作LeCun转赞
...白质语言模型ESM3。不仅支持序列、结构、功能的all-to-all推理,团队还在实验中发现,它设计的新蛋白质相当于模拟自然界5亿年的进化。继AlphaFold 3更新后,我们又看到了一个生命科学领域的大模型ESM3。模型开发团队来自于名为...……更多
3天把Llama训成Mamba,性能不降,推理更快!
...为什么要把Llama变成Mamba?因为从头开始训练一个大模型太贵了。Mamba也火了这么长时间了,相关的研究每天都有,但自己训练大尺寸Mamba模型的却很少。目前比较有名的是AI21的Jamba(进化到了1.5版本,最大398B,MoE),以及NVIDIA的...……更多
整合长期记忆,AI实现自我进化,探索大模型这一可能性
...也能让模型在处理长期、分散和个性化的数据时逐步提升推理和学习能力。用 LTM 数据提升模型能力,使其能够自我进化在传统 LLM 中,更新模型通常需要调整所有参数,而如果目的是处理个体数据,那这种操作明显不切实际。...……更多
苹果AI震撼上线iPhone,进化版Siri却没有ChatGPT!47页技术报告揭秘自研模型
...复适配器进行微调,它们不会产生任何额外的内存使用或推理成本。关于适配器的大小,团队发现秩为16的适配器在模型容量和推理性能之间提供了最佳平衡。然而,为了提供更多的灵活性,苹果提供了一套不同秩的精度恢复适...……更多
4轮暴训,Llama 7B击败GPT-4!Meta等让LLM「分饰三角」自评自进化
...judge提示模板。除了给出评价结果,meta-judge还需要生成CoT推理过程。为减少meta-judge可能存在的位置偏好(可能倾向于选择最先出现的Judgment A),对同一对数据(jm, jn)会交换顺序让meta-judge进行两次评价,得到单次结果rmn: 引入...……更多
罗格斯大学团队提出思想链概念,提高大模型的算数推理能力
...概念,提高了大语言模型(LLM,large language models)在复杂推理任务上的性能,例如算术推理、常识推理和符号推理等。图 | 金明宇(来源:金明宇)CoT 的原理是通过提供推理过程的示例,来教会模型处理推理,详细说明导致最...……更多
调研219篇文献,全面了解GenAI在自适应系统中的现状与研究路线图
...泛应用,尤其是大型语言模型(LLMs)在语言理解和逻辑推理方面表现突出,为自适应系统提供了新的可能性。GenAI 与自适应系统的核心功能相结合,能够显著增强系统的自适应能力。例如,GenAI 可以分析并规划系统策略,自动...……更多
刚刚,OpenAI震撼发布o1大模型!强化学习突破LLM推理极限
...专门解决难题。这是一个重大突破,新模型可以实现复杂推理,一个通用模型解决比此前的科学、代码和数学模型能做到的更难的问题。OpenAI 称,今天在 ChatGPT 和大模型 API 中新发布的是该系列中的第一款模型,而且还只是预览...……更多
免训练大模型知识编辑,吸收新数据更高效|EMNLP\\\'24
...的连续提示学习新方法,可以提高知识终身学习的编辑和推理效率。模型编辑旨在纠正大语言模型中过时或错误的知识,同时不需要昂贵的代价进行再训练。终身模型编辑是满足LLM持续编辑要求的最具挑战性的任务。之前的工作...……更多
LLM群体智能崛起,数学性能暴增11.6%!谷歌DeepMind四大机构联手新作
...认知,数学最考验元认知,原本是指,人类对自己思维、推理过程的直观认识。那么,大模型也具备「元认知」的能力吗?研究人员对此,提出了一种假设,并设想是否可以通过知识引导,进一步提高LLM的能力。 其实,此前的...……更多
o1带火的CoT到底行不行?新论文引发了论战
...To CoT or not to CoT?OpenAI ο1 的诞生极大地提升了人们对 LLM 推理能力和思维链(CoT)的兴趣。一时之间,似乎思维链很快就会成为所有 LLM 的标配,但思维链并非万能,就连 OpenAI 自己也提到 o1 在某些任务上的表现并不比 GPT-4o 强...……更多
研究人员给了人工智能一个“内心独白”,结果大大提高了其性能
...工智能系统,让它在说话前先思考。内心独白提高了常识推理能力,并使其数学成绩翻了一番。一项新的研究表明,给人工智能系统一个“内心独白”会大大提高它们的推理能力。这种方法训练的人工智能系统,会在对提示做出...……更多
大模型步入推理Scaling时代,SambaNova如何挑战英伟达的霸主地位
...震。o1 能像人类一样「思考」复杂问题,拥有优秀的通用推理能力。在未经专门训练的情况下,o1 能够直接拿下数学奥赛金牌,甚至能在博士级别的科学问答环节上超越人类专家。在性能跃升之外,更重要的是,它揭示了大模型...……更多
科学家推出大模型数据集,涵盖奥赛数学题,有望让AI辅导数学课程
...解决复杂数学问题的能力。通过此,他们不仅提高了算法推理速度,还提高了算法搜索中间结果的质量。所新推出的数据集 TriMaster100,也更加符合算法在复杂数学问题下的评价场景。目前,赵子龙的合作者正在基于本次成果开...……更多
...AI)系统在编码、战略规划和机器人科学三个领域执行复杂推理任务。聊天生成预训练转换器(ChatGPT)和“克劳德3-奥普斯”(Claude 3 Opus)等大语言模型(LLM),根据人类输入“提示词”处理和生成文本。研究人员说,过去18个月,这些技...……更多
谷歌大模型推理范式,主要分为两个阶段
...新研究“自我发现”(Self-Discover),重新定义了大模型推理范式。与已成行业标准的思维链(CoT)相比,新方法不仅让模型在面对复杂任务时表现更佳,还把同等效果下的推理成本压缩至1/40。核心策略其实很简单:千人千面。...……更多
科学家竞相破解大型语言模型背后的谜团
...复杂行为。面对复杂问题,人类在潜意识里会进行分步骤推理。受此启发,谷歌团队2022年引入了“思维链提示”,以描述一种让LLM展示其“思维”的方法。简单来说,思维链提示是一种特殊的上下文学习。不同于标准提示只给...……更多
高德宣布逐步开放AI能力 助力打造时空智能城市
...‘升维’成了必然趋势。”为此,高德云图将在感知层、推理层、决策层推动三大升级,助力智慧城市向时空智能城市进化。在感知层,云境AI三维重建平台将推动城市从二维还原向三维升级,真实还原城市静态世界;在推理层...……更多
文心大模型4.0 Turbo来了!百度推出文心快码2.5,已覆盖内部80%程序员
...考虑到大模型和异构多芯发展趋势,为了保障大模型训练推理性能、简化大模型开发调优过程以及更好地适配各种芯片,飞桨与文心联合,在训练、推理两个方面定向优化。▲飞桨框架设计理念具体来说,动静统一的自动并行能...……更多
清华提出CharacterGLM;DeepMind联创发全新一代大模型;大模型版“5年高考3年模拟”来了丨AI新零售早报
...|微软&UCLA&UW联合出品》MathVista是一个多模态数学推理基准数据集,由微软、UCLA和UW联合开发,包含6141个数学问题,涵盖丰富的任务类型、推理能力和图像类型。特点:旨在提供一个全面、多样、复杂的视觉数学推理挑战...……更多
...理陈宁介绍,DeepEdge10是国内首创的国产14nm Chiplet大模型推理芯片,采用自主可控的国产工艺,内含国产RISC-V核,支持大模型推理部署。依托自研芯片DeepEdge10创新的D2D chiplet架构打造的X5000推理卡,已适配并可承载SAM CV大模型、Lla...……更多
RAG没有银弹!四级难度,最新综述覆盖数据集、解决方案,教你「LLM+外部数据」的正确使用姿势
...成到LLMs中的三种主要方式。从简单的事实检索到复杂的推理任务,每个级别都有其独特的难点和解决方案,需要不同的技术和方法来优化性能。受参数量和知识更新的限制,大模型在执行很多真实场景下的任务时,都需要连接...……更多
刚刚,Llama 3.2 来了!支持图像推理,还有可在手机上运行的版本
... Meta 对 Llama 模型来了一波大更新:不仅推出了支持图像推理任务的新一代 Llama 11B 和 90B 模型,还发布了可在边缘和移动设备上的运行的轻量级模型 Llama 3.2 1B 和 3B。不仅如此,Meta 还正式发布了 Llama Stack Distribution,其可……更多
文生图参数量升至240亿!Playground v3发布:深度融合LLM,图形设计能力超越人类
...像描述性能。实验结果表明,PGv3在文本提示遵循、复杂推理和文本渲染准确率方面表现出色;用户偏好研究表明,PGv3模型在常见的设计应用中,如表情包(stickers)、海报和logo设计,具有超越人类的图形设计能力,还能够精确...……更多
Meta祭出三篇最详尽Llama微调指南!千字长文,0基础小白必备
...类型的信息:- 仅输入和输出文本,也就是少样本学习- 推理追踪:添加中间推理步骤,可参阅思维链(COT)提示- 计划和反思追踪:添加信息,教LLM计划和反思其解决问题的策略,可参阅ReACT 选择正确的适配方法要决定上述哪...……更多
超级干货:企业如何用AI工具做好营销实战?
...能力已经超过我们过去的想象了,现在它不但可以做逻辑推理,还能识别人类语言中的感情,进行风格模仿并做出人性化、情感化的内容创作。未来大量的内容都可以交给AI来做。第三个理由:营销方法有套路。营销一半是科学...……更多
GPT刚刚公开「草莓」项目:推理能力翻倍,定价200美元?
... OpenAI 在大语言模型领域的新尝试,也可能是对人工智能推理能力一次新的革命性提升。根据目前流出的信息来看,相比以往的 GPT 模型,「草莓」在处理复杂问题、执行多步骤任务方面展现出前所未有的潜力,使其成为通用人...……更多
LLM仍然不能规划,刷屏的OpenAI o1远未达到饱和
...模型,一举创造了很多历史记录。o1 模型拥有真正的通用推理能力。在一系列高难基准测试中展现出了超强实力,相比 GPT-4o 有巨大提升,让大模型的上限从「没法看」直接上升到优秀水平,不专门训练直接数学奥赛金牌,甚至...……更多
OpenAI-o1思考替代法火了!焦剑涛高徒一作提出思考偏好优化
...,大模型能根据任务复杂度进行不同时间的思考。不限于推理性的逻辑或数学任务,一般问答也能思考的那种。最近畅销书《Python机器学习》作者Sebastian Raschka推荐了一项新研究,被网友们齐刷刷码住了。论文一作为华人学者Tian...……更多
更多关于科技的资讯:
诺奖得主迈克尔·莱维特担任然益多益生菌首席科学顾问
近日,然益多“自然的,益处更多”品牌母公司、专注基因细胞科学的自然有益集团宣布将由诺奖得主迈克尔·莱维特担任其首席科学顾问
2024-12-18 10:12:00
中国太保上海金融科技国际论坛 “共建数字金融,共享数智生态”
12月14日,由中国太保主办的第六届上海金融科技国际论坛“共建数字金融,共享数智生态”平行论坛在上海陆家嘴中国金融信息中心成功举行
2024-12-18 10:16:00
近日,人保财险唐山市分公司中标唐山市住宅专项维修资金增值收益购买电梯综合保险项目,将联合共保体保险机构为唐山市主城区提供“保险+科技+服务”新模式电梯综合保险服务
2024-12-18 10:56:00
荣耀gt正式登场,有什么亮眼之处
时间来到12月,中端性能手机市场展开了一场激烈的竞争,各家性能旗舰纷纷登场,各种满配让人看得眼花缭乱。12月16日晚,荣耀GT也正式登场
2024-12-18 11:03:00
天津地铁可以刷支付宝微信乘车了 扫码阅读手机版
图片由轨道交通集团提供天津北方网讯:昨日记者发现,天津地铁乘车码在支付宝和微信都已上线,对于市民和外地游客来说更加友好
2024-12-18 11:11:00
揭秘加装电梯的钢结构工程费用:你的预算,真的准备好了
加装电梯,对于老旧小区来说,无疑是一项提升居住品质的重大工程。而在电梯加装过程中,钢结构工程费用是其中一个重要的组成部分
2024-12-18 11:12:00
“真抢不到票啊!”近日,在社交媒体上,如何送父母去刀郎演唱会现场的讨论帖、攻略帖热度颇高。票务软件中,刀郎已经“战胜”凤凰传奇
2024-12-18 11:15:00
□ 本报综合整理12月11日至12日,中央经济工作会议提出“积极发展首发经济”,引爆市场热度,多只首发经济概念股12月16日涨停
2024-12-18 11:16:00
威海首个!全省仅入选8个
齐鲁晚报·齐鲁壹点客户端 田佳玉 通讯员 林慧芹近日,工信部公布了2024年物联网赋能行业发展典型案例名单,三角轮胎股份有限公司申报的“物联网在高性能乘用车胎智能工厂的应用”案例入选
2024-12-18 11:17:00
余承东官宣智界R7增程版12月19日上市,价格或低于纯电版?
12月16日,余承东发布微博:智界R7增程版不止续航超长!更多惊喜,12月19日见!这也是智界系列首款增程车型。目前纯电版智界R7起售价为25
2024-12-18 11:17:00
世界最大压缩空气储能电站开工建设:一次储能可充10万辆新能源汽车
快科技12月18日消息,据报道,世界规模最大的压缩空气储能电站——华能金坛盐穴压缩空气储能发电二期项目,在江苏省常州市隆重宣布启动建设
2024-12-18 11:20:00
闪迪惊艳变身!全新像素风品牌Logo亮相
快科技12月18日消息,闪迪(Sandisk)正式对外公布了其采用像素风格设计的全新商标,并宣布该商标计划于2025年初正式启用
2024-12-18 11:20:00
本文转自:人民网人民网记者 许维娜“最近咨询空调、中央集成暖气片这些品类的用户明显增多。”位于北京朝阳区的一家家电卖场经理表示
2024-12-18 11:28:00
慕思第七次被授予“全国家具标准化先进集体”称号
2024年12月6日,全国家具行业标准化工作会暨全国家具标准化技术委员会第四届一次全体委员会议日前在杭州召开,会上,慕思被授予“2024年度全国家具标准化先进集体“荣誉称号
2024-12-18 11:47:00
一加Ace 5系列手机或12月26日发布,价格将会极具竞争力
12月17日,一加举行了一加11周年·加油班会,在这次活动上,一加科技李杰透露了一加Ace 5系列的部分细节:一加Ace 5系列大概是今年最香的骁龙8至尊版手机
2024-12-18 11:50:00