推理,架构,混合,人类,能力,语言头条新闻资讯订阅

我的订阅
头条热搜

我们正处于一个信息大暴发的时代，每天都能产生数以百万计的新闻资讯！

虽然有大数据推荐，但面对海量数据，通过我们的调研发现，在一个小时的时间里，您通常无法真正有效地获取您感兴趣的资讯！

头条新闻资讯订阅，旨在帮助您收集感兴趣的资讯内容，并且在第一时间通知到您。可以有效节约您获取资讯的时间，避免错过一些关键信息。

混合架构赋予AI人类推理能力

...AI)系统在编码、战略规划和机器人科学三个领域执行复杂推理任务。聊天生成预训练转换器(ChatGPT)和“克劳德3-奥普斯”(Claude 3 Opus)等大语言模型(LLM)，根据人类输入“提示词”处理和生成文本。研究人员说，过去18个月，这些技...……更多

2024-06-12 18:15:00推理,架构,混合,人类,能力,语言

语言≠思维，大模型学不了推理：一篇Nature让AI社区炸锅

...到，人类大脑生成和解析语言的神经网络并不负责形式化推理，而且提出推理并不需要语言作为媒介。这篇论文声称「语言主要是用于交流的工具，而不是思考的工具，对于任何经过测试的思维形式都不是必需的」，引发了科技...……更多

2024-06-25 09:45:00推理,模型,思维,语言,社区,语言

英伟达开源NVLM 1.0屠榜多模态！纯文本性能不降反升

...例如，OCRBench）的性能，但与低分辨率版本模型相比，在推理相关任务（例如，MMMU）上的准确率却会下降。此外，虽然开源的多模态大模型在视觉-语言任务上取得了非常亮眼的基准测试结果，但在纯文本任务上的性能却有显著...……更多

2024-09-24 13:36:00英伟,模态,文本,性能,模态,模型

研究人员给了人工智能一个“内心独白”，结果大大提高了其性能

...工智能系统，让它在说话前先思考。内心独白提高了常识推理能力，并使其数学成绩翻了一番。一项新的研究表明，给人工智能系统一个“内心独白”会大大提高它们的推理能力。这种方法训练的人工智能系统，会在对提示做出...……更多

2024-03-21 16:13:00人工智能,研究人员,独白,人工,内心,性能

都可赋予大模型慢思考能力 360首创CoE架构媲美OpenA

9月13日，OpenAI发布具有推理能力的人工智能模型“o1”，备受行业瞩目。o1通过模仿人类的思维过程，强化学习和“思维链”技术，引导模型自主解决问题。这一特点在解决复杂问题，尤其是在科学、编码和数学等领域，展现出...……更多

2024-09-16 17:42:00架构,模型,思维,能力,模式,模型

微软连发3款Phi-3.5模型：128K上下文，首用MoE架

...支持128k上下文长度。Phi-3.5-mini-instruct主要面向基础快速推理任务，Phi-3.5-MoE-instruct可胜任复杂推理任务，Phi-3.5-vision-instruct则兼具文本与视觉能力。性能最强大的Phi-3.5-MoE-instruct模型有419亿个参数，……更多

2024-08-22 09:49:00上下文,微软,架构,模型,上下,性能

全球首篇！调研近400篇文献，鹏城实验室&中大深度解析具身智

...感知未来视觉感知的 “北极星” 是以具身为中心的视觉推理和社会智能。如下图所示，不同于仅仅识别图像中的物体，具有具身感知能力的智能体必须在物理世界中移动并与环境互动，这需要对三维空间和动态环境有更透彻的...……更多

2024-07-29 09:39:00中大,文献,调研,深度,实验室,实验

LeCun最新万字演讲：纯语言模型到不了人类水平，我们基本已

...：完全是胡说八道。最新的公开演讲中，他表示，系统要推理、规划和理解物理世界，至少还需要几年甚至十年的时间，这时候人工智能才能达到人类水平。他还透露，现在Meta基本已经放弃纯语言模型，因为，仅通过文本训练...……更多

2024-10-18 09:42:00模型,人类,水平,语言,系统,模型

全球最强开源大模型Llama 3发布：使用15T数据预训练，

...业基准测试中达到了 SOTA，并提供了新的功能，如改进的推理能力。最强开源 LLM 来了Meta 官方博客写道，“得益于预训练和后训练的改进，我们的预训练和指令微调模型是目前 8B 和 70B 参数尺度下最好的模型。”他们表示，后期...……更多

2024-04-20 11:03:00模型,训练,参数,数据,全球,模型

让OpenAI o1逆天的慢思考，360两月前就做出来了？周

...读】o1大火背后，最关键的技术是CoT。模型通过一步一步推理，恰恰是「慢思考」的核心要义。而这一观点，其实这家国内大厂早就率先实现了。OpenAI的理念，居然被国内公司抢先践行了？比起OpenAI，这家公司的idea提出得更早，...……更多

2024-09-21 09:50:00周鸿,前瞻,应用,模型,推理,协作

全模态对齐框架align-anything来啦：实现跨模态指

...-Vision-11B 既准确地识别出了餐厅，还提供了细致的思考与推理过程。在 Meta 并未披露 Llama-3.2-11B-Vision-Instruct 对齐技术细节情况下，北大对齐小组愿开源数据、训练、模型、评估的全流程，为全模态对齐研究贡献力量。对齐框架...……更多

2024-10-18 09:47:00模态,指令,框架,模态,模型,数据

什么是AGI？人工智能的未来

...Artificial Intelligence）指的是能够像人类一样思考、学习和推理的机器或计算机程序 – 其能够具备人类的普遍智慧，即能够学习各领域知识，并能将知识输出在各个领域。当时，约翰·麦卡锡预计人工智能将在几个月内实现。约翰...……更多

2024-03-19 06:00:00人工智能,人工,智能,人工智能,智能,人工

大模型新趋势之MoE：现状、挑战及研究方向

...，MoE在训练过程通过门控模型实现“因材施教”，进而在推理过程实现专家模型之间的“博采众长”。图1MoE架构原理示意图1MoE的特征优势是专家化、动态化、稀疏化，在模型研发成本、训练/推理效率和整体性能之间实现最佳...……更多

2024-11-04 16:00:00研究方向,模型,现状,方向,趋势,研究

微软被曝未来3年花1000亿美金囤芯片；杨元庆：AI不是取代

...柱。开源大模型Llama3推出，百度智能云支持其全系列训练推理北京时间4月19日凌晨，Meta公布期待已久的多模态开源大模型Llama 3系列，目前包括80亿和700亿两个参数的调优版本。与此同时，Meta还推出了其首款基于Llama 3开源模型的...……更多

2024-04-30 11:00:00杨元庆,微软,美金,芯片,人类,智能

商汤升级“日日新5.0”大模型，对标GPT-4Turbo

...用混合专家架构，超10TB tokens训练，覆盖大量合成数据，推理时上下文窗口达200K左右。云、端、边全栈大模型产品矩阵中，用于终端设备的“商汤端侧大模型”可满足各类终端用户对大模型技术的应用需求。“日日新5.0”和GPT-4...……更多

2024-04-24 09:32:00商汤,模型,升级,商汤,模型,推理

谷歌大模型推理范式，主要分为两个阶段

...新研究“自我发现”（Self-Discover），重新定义了大模型推理范式。与已成行业标准的思维链（CoT）相比，新方法不仅让模型在面对复杂任务时表现更佳，还把同等效果下的推理成本压缩至1/40。核心策略其实很简单：千人千面。...……更多

2024-02-10 21:09:00范式,推理,模型,阶段,两个,模型

文生图参数量升至240亿！Playground v3发布：深

...像描述性能。实验结果表明，PGv3在文本提示遵循、复杂推理和文本渲染准确率方面表现出色；用户偏好研究表明，PGv3模型在常见的设计应用中，如表情包（stickers）、海报和logo设计，具有超越人类的图形设计能力，还能够精确...……更多

2024-10-08 09:48:00文生,图形设计,深度,图形,人类,参数

三个大模型组队挑战o1，实测360多模型协作干掉提示词工程

...横空出世，开启了大模型演化的新范式——Inference law（推理定律）。正如英伟达AI科学家Jim Fan所说，o1的出现标志着大模型研发者开始把集中在训练阶段的投入，开始转移到了推理过程。Jim还引用了机器学习先驱Rich Sutton的经典...……更多

2024-09-21 09:45:00模型,实测,协作,三个,提示,工程

昆仑万维：“天工大模型3.0”将于4月17日正式发布同步开

...“天工2.0”MoE大模型，“天工3.0”在模型语义理解、逻辑推理、以及通用性、泛化性、不确定性知识、学习能力等领域拥有惊人的性能提升，其模型技术知识能力提升超过20%，数学/推理/代码/文创能力提升超过30%。同时，“天工...……更多

2024-04-01 19:56:00万维,昆仑,模型,将于,同步,参数

蚂蚁自研知识增强大模型服务框架KAG，可显著提升知识推理准确

...地，也一定要对时间、数字和逻辑敏感，无论让它做多跳推理，还是逻辑规则数字计算，而这些恰好是大语言模型所不擅长的，包括前一段时间热议的 9.9 和 9.12 比大小的例子。基于此，我们认为在垂直领域落地的时候，大语言...……更多

2024-09-13 13:33:00知识,准确率,推理,蚂蚁,框架,模型

马斯克承诺开源版大模型来了！Grok-1：3140亿参数迄

...能力，但只使用了一半的训练资源。之后，他们对模型的推理和编码能力进行了重大改进，最终开发出了 Grok-1，这是一款功能更为强大的 SOTA 语言模型，在 HumanEval 编码任务中达到了 63.2% 的成绩，在 MMLU 中达到了 73%。xAI 使用了...……更多

2024-03-18 11:51:00马斯,马斯克,权重,架构,模型,参数

智启新元年：PC成为AI落地首选终端

...了具备高性能计算能力的通用加速芯片，是大模型训练、推理的主要算力来源；云计算的发展和普及，则使软硬件充分解耦，大模型开发者可以以相对低的成本调用大规模的算力、存储和网络资源，开发进程大大加快；同时，Tra...……更多

2023-12-22 12:43:00启新,落地,终端,模型,终端,应用

2024北京国际车展｜加速智能汽车驶入AGI时代商汤绝影系

...向认知驱动的跃迁。依托多模态大模型强大的世界理解、推理能力、决策能力以及交互能力，DriveAGI将是目前最贴近人类思维模式、最能理解人类意图并有最强解决驾驶困难场景能力的技术方案。值得一提的是，前不久上市的小...……更多

2024-04-28 21:29:00商汤,原生态,北京,车展,模型,智能

数字员工、超级个体、具身智能，AI Agent未来发展十大研

...侧大模型加速部署，或将成为未来交互新入口。AI在数学推理、新药研发、材料发现、蛋白质合成等领域大显身手， \"AI科学家\"有望加速问世。这三个报告，一方面预测了AI Agent的未来发展趋势，另一方面也同时提及了多模态大...……更多

2024-02-02 17:00:00研究方向,个体,方向,员工,数字,智能

英伟达地表最强，黄教主被称作AI界“霉霉”

...来支持高达10万亿参数的AI模型训练和大语言模型的实时推理。有望在数据处理、工程模拟、电子设计自动化、计算机辅助药物设计、量子计算和生成人工智能等领域实现新的突破。用黄仁勋的原话来说，它就是“当今世界上最...……更多

2024-03-19 11:56:00英伟,地表,教主,英伟,模型,人工智能

人类和AI在推理任务中的表现相似，Google DeepMi

...人工智能（AI），特别是大型Transformer语言模型（LMs）在推理任务中的表现及其局限性。研究结果显示，尽管这些模型在处理自然语言方面表现卓越，但在复杂逻辑推理任务中，人类和语言模型都会受到语义内容合理性和可信度...……更多

2024-08-19 13:49:00局限性,推理,人类,任务,研究,模型

商汤科技sensetime推出“云端边”全栈大模型体系

...的指导下，会持续探索大模型能力的KRE三层架构（知识-推理-执行），不断突破大模型能力边界。”“日日新SenseNova5.0”性能超越GPT-4 Turbo：文理双修能力大幅提升，新增多模态交互自去年4月首次发布，商汤“日日新SenseNova”大...……更多

2024-04-25 01:02:00商汤,云端,模型,体系,科技,商汤

商汤 AI 办公小程序“Raccoon 智能助手”上线：提炼

... 大模型，该模型采用 MOE 混合专家架构，在知识、数学、推理和代码能力方面大幅提升。该模型基于超过 10TB tokens 训练，具备 200K 推理上下文窗口（相当于 36.5 万个汉字），推理时上下文窗口达到 200K 左右，提供自然语言处理...……更多

2024-06-25 09:43:00商汤,助手,重点,智能,办公,程序

语音克隆达到人类水平，微软全新VALL-E 2模型让Deep

...零样本TTS依旧是一个有挑战性的问题。「零样本」意味着推理过程中，模型只能参照一段简短的陌生语音样本，用相同的声音说出文本内容，就像一个能即时模仿的口技大师。听到这里，不知道你会不会突然警觉——有这种能力...……更多

2024-07-25 09:34:00堪比,微软,配音,语音,模型,人类

苹果发布mm1.5-ui模型

...从10亿到300亿的多种参数规模，拥有图像识别和自然语言推理能力。在新版本中，苹果公司的研发人员改进了数据混合策略，极大地增强了模型在多文本图像理解、视觉引用与定位以及多图像推理等方面的能力。参考论文可知，...……更多

2024-10-13 10:57:00模型,苹果,模型,苹果公司,数据,苹果

page 1/3334 首页上一页 12 3 4 5 6 下一页末页

更多关于科技的资讯：

netflix撤下英雄联盟双城之战海报，工作人员直言不

据gamesradar+当地时间周五报道，Netflix在观众指出问题后，撤下了一张疑似由AI生成的《英雄联盟：双城之战》第二季海报

2024-11-24 21:58:00

三星新增云游戏服务，包含23款游戏

三星为其北美市场的 Galaxy 手机/平板的“三星游戏中心”应用新增云游戏服务，用户无需耗费流量/存储空间安装手游，即可利用网络远程畅玩

2024-11-24 21:59:00

真显眼包！Caviar定制款Vision Pro亮相

11月21日消息，说起Caviar，大家最不陌生的就是他们推出的各种定制款手机了，堪称数码界的奢侈品。现在，他们又开始对苹果VisionPro下手了

2024-11-24 22:33:00

字母全部大写！Redmi变成REDMI，这次不用花200万

前不久有细心的网友发现Redmi红米手机公众号名称更改为“REDMI红米手机”，据此推测红米可能会迎来新的品牌标识升级

2024-11-24 22:34:00

RTX 4050显卡继续生产不停产：新的太贵怕消费者不接受

目前NVIDIA已经开始全力为RTX50系显卡做着准备，其中就包括停产海量的RTX40系显卡，我们也报道过由于NVIDIA的停产

2024-11-24 22:34:00

OPPO Find X8 Pro体验：双潜望长焦加AI

相信去年OPPOFindX7系列给不少喜爱影像的小伙伴留下了深刻的印象，Ultra版本双潜望长焦配置一枝独秀，再加上不断OTA更新优化体验

2024-11-24 22:35:00

AMD计划2026年推出UDNA架构显卡

关于AMD下一代显卡实在是没有什么特别期待的，毕竟就现在的消息可知，AMDRadeonRX8000显卡基于RDNA4架构打造

2024-11-24 22:35:00

紧跟苹果脚步：三星也要推出Galaxy S25 Slim手机

目前关于iPhone17Air手机的消息是越来越多，例如苹果希望将其打造成苹果旗下最为轻薄的iPhone手机，不过也有消息称

2024-11-24 22:36:00

iPhone再现bug，备忘录数据丢失，苹果紧急给出修复方案

11月19日消息，近年来，苹果时不时会出现一些极为影响使用体验的bug，近日，就又爆出了丢失备忘录的bug。据部分用户反馈

2024-11-24 22:36:00

苹果M4 Max 在显卡渲染测试中超越RTX 4070

前不久我们曾报道，苹果M4Max相较于最新的英特尔酷睿Ultra9285K以及AMDRazen9950X在CPU单核与多核性能上都具有领先的优势

2024-11-24 22:36:00

开始青苗不接了：RTX 50系显卡还没到，40系显卡开始断货

NVIDIARTX50系显卡可以说是目前最受大家关注的显卡，尤其是RTX50系显卡更是如此，特别是RTX5090这样的显卡巨兽

2024-11-24 22:36:00

英特尔又要挤牙膏：酷睿Ultra 200U纯马甲

英特尔目前似乎在CPU市场上频频触壁，刚刚推出的酷睿Ultra200S处理器在游戏性能上也是落后于AMD的锐龙9000系处理器

2024-11-24 22:36:00

vivo X200 Pro影像体验：一个月后再看，还是真香！

2024年底的新机上市来得更早，刺刀见红也比去年更猛。MTK比去年早了约一个月，在10月9日发布新一代旗舰SoC天玑9400

2024-11-24 22:37:00

OPPO Reno 13公布外观：四种配色，11月25日发布

随着11月中旬的到来，下半年的第二批手机即将陆续和大家见面，这些手机相比较首批旗舰手机更加偏向于年轻用户，因此整体外观更加时尚

2024-11-24 22:37:00

AMD统一架构显卡2026年推出同架构GPU将用于PS6

此前AMD已经官宣将再度统一游戏显卡以及服务器显卡的架构，在后续产品当中引入统一的UDNA架构。而最新的爆料表明，AMD基于下一代UDNA架构的Radeon游戏显卡将于2026年第二季度投入量产

2024-11-24 22:38:00

头条订阅服务