• 我的订阅
  • 头条热搜
蚂蚁自研知识增强大模型服务框架KAG,可显著提升知识推理准确率
...AI 原生 App “支小宝” 采用这套框架,在政务问答场景的准确率提升到了 91%,医疗问答垂直的指标解读准确率可达 90% 以上。梁磊还透露,KAG 框架会进一步向社区开放,并在开源框架 OpenSPG (https://github.com/OpenSPG/openspg) 中原生支..……更多
未来医院变形记:生成式AI将病历书写从8小时缩短至25分钟
...海市一医院联合蚂蚁做了九大类30+个细分意图,意图识别准确率在90%以上,上海市一医院称,接下来准确率有望提高到95%。那么,AI陪诊师的实际应用究竟如何?钛媒体App也进行了现场体验:打开支付宝,平台若定位到上海市一...……更多
蚂蚁井贤栋:通过专业智能体的深度连接,AI会像互联网一样带来服务的代际升级
...用大模型落地严谨产业,面临着三个“能力短板”:领域知识相对缺乏、复杂决策难以胜任,以及对话交互不等于有效协同。井贤栋介绍,为了破解这些难题,蚂蚁选择了构建专业智能体生态的路径,“从我们的实践来看,专业...……更多
突破时间序列组合推理难题!南加大发布一站式多步推理框架TS-Reasoner
...-Reasoner在所有测试指标上仍然略胜一筹。在因果关系分类准确率(CRA)和因果图准确率(CGA)上,TS-Reasoner分别实现了相对较高的成功率,进一步证明了其在复杂因果推理任务中的潜力。此外,本文对错误类型进行了详细分析,...……更多
2024WAIC热议大模型助力产业新趋势,可信应用成焦点
...型实现千亿级别参数的视觉语言识别,报告、药物等识别准确率高达 90%,中英文医疗水平测试超越 GPT-4,在 PromptCBLUE 中实现 A 榜第一,B榜第二。另外,百灵医疗可信一体机的算力支持实现国产化的训推一体,交付周期降低90%;...……更多
...与没有“动作域获取”影响的情况下执行相同任务相比,准确率分别提高了59%和89%。研究人员希望在可预见的未来为“动作域获取”找到其他家务用途。能够解决问题“语言引导的抽象”框架也让机器人能够像人一样更好地理解...……更多
奥林匹克竞赛里选最聪明的AI:Claude-3.5-Sonnet vs. GPT-4o?
...过基于规则的匹配进行评估,研究团队对非编程任务使用准确率,并对编程任务使用公正的pass@k指标,定义如下: 本次评估中设定k = 1且n = 5,c表示通过所有测试用例的正确样本数量。奥林匹克竞技场奖牌榜:与奥运会使用的...……更多
谷歌大模型推理范式,主要分为两个阶段
...ncy,而且准确性更高。如果想要达到和自发现步骤同样的准确率,需要的推理计算量则是其40倍。研究团队本项研究由南加州大学和谷歌DeepMind联合推出。第一作者是PeiZhou,他现在正在南加州大学的NLP小组攻读博士。两位通讯作...……更多
给小学数学题加句废话,OpenAI o1就翻车了,苹果论文质疑AI推理
...据集之间,模型存在显著的性能波动,以及与原始 GSM8K 准确率相当的性能下降。这种差异表明,大型语言模型所采用的推理过程可能不是形式化的,因此容易受到某些变化的影响。一个可能的解释是这些模型主要专注于分布内...……更多
LLM群体智能崛起,数学性能暴增11.6%!谷歌DeepMind四大机构联手新作
...6呈现了,新论文所提出的方法,在4个案例中实现了最高准确率。总之,作者提出一个LLM提取元认知知识框架,其形式是根据解决问题所需的概念,对数学数据集中的问题进行分类的技能。目前,新框架依赖于GPT-4等高级模型的...……更多
首个o1复现开源RL框架OpenR来了,UCL、上交等高校联合团队发布
...法在推理过程中的性能。y 轴表示 MATH500 数据集上的测试准确率,而 x 轴显示生成预算(每个问题的平均标记数),反映了每个问题的计算消耗或标记使用情况。该图表明,随着生成预算的增加,最佳 N 选择和束搜索方法的性能...……更多
多模态模型免微调接入互联网,即插即用新框架,效果超闭源方案
...ini 1.5 Pro、InternVL-1.5、LLaVA-1.6等。在UDK-VQA数据集上的回答准确率,则配备了SearchLVLMs的SOTA LVLMs超过了自带互联网检索增强的GPT-4o模型35%。开源框架SearchLVLMsSearchLVLMs框架主要由三部分组成:查询生成……更多
整合长期记忆,AI实现自我进化,探索大模型这一可能性
...,Omne 在最复杂、要求最高的 3 级问题上达到了 26.53% 的准确率。这证明了其通过利用强大的基础模型(尤其是具有强大推理和逻辑能力的模型)解决现实问题的潜力。未来计划该团队并不打算止步于此,他们已经制定了未来研...……更多
...、民生诉求接待等场景,其业务覆盖率达到95%,多轮理解准确率达到90%。早在2023年11月,中国电信就在2023数字科技生态大会上发布了千亿参数“星辰语义大模型”,并公布了后续的开源开放的时间表。IT之家发现,本次TeleChat-7B...……更多
百倍提升7B模型推理能力!颜水成团队携手新加坡南洋理工大学发布Q*算法
...推理能力:在GSM8K数据集上,Q*帮助Llama-2-7b提升至80.8%的准确率,超越了ChatGPT;在MATH数据集上,Q*帮助DeepSeek-Math-7b提升至55.4%的准确率,超越了Gemini Ultra;在MBPP数据集上,Q*帮助CodeQwen1.5-7b-Chat提……更多
...文档知识库检索方法,提高了专业模型在下游任务的推理准确率,得到了评委老师的认可。我们有种‘初生牛犊不怕虎’的心态,学校也特别注重培养学生的创新精神、创新能力,日常在社团我们也有很多真实项目做演练,这些...……更多
超越YOLOv10/11、RT-DETRv2/3!D-FINE重新定义边界框回归任务
...%)。在 Objects365 上进行了简单的有监督预训练后,D-FINE 的准确率达到了 59.3% AP。在 paperwithcode 网站的 Real-Time Object Detection on MS COCO benchmark 上,D-FINE 的速度和性能都远超其他方法……更多
趣丸科技副总裁兼CTO谢睿:多模态智能激发应用新场景 | 新质生产力·AI Partner大会
...架NCNN的改造,打造了一款具备低延迟、低资源消耗和高准确率、高安全性的的移动端轻量级语音识别方案。它适配不同口音、语速和环境噪声,可应用在语音直播、多人聊天等场景。例如,多人聊天场景中,我们帮助客户开发...……更多
科学家提出大模型分子交互学习框架,已在400多万分子对中验证
...次序给出分子的关键生化性质,从而提升分子交互的预测准确率。图 | 预训练阶段的提示词和预期回复的设计(来源:arXiv)期间,预训练阶段的数据来自 Drugbank 和 PubChem,它们都是包含分子-性质对的权威生化数据库。此外,为...……更多
罗格斯大学团队提出思想链概念,提高大模型的算数推理能力
...概念,提高了大语言模型(LLM,large language models)在复杂推理任务上的性能,例如算术推理、常识推理和符号推理等。图 | 金明宇(来源:金明宇)CoT 的原理是通过提供推理过程的示例,来教会模型处理推理,详细说明导致最...……更多
支持1024帧、准确率近100%,英伟达「LongVILA」开始发力长视频
...的 LongVILA 模型在 1400 帧的大海捞针实验中实现了 99.5% 的准确率,相当于 274k 个 token 的上下文长度。此外, MM-SP 系统可以有效地将上下文长度扩展到 200 万个 token 而无需梯度检查点,与环形序列并行(ring sequence parallel……更多
文档处理效能飙升!浩鲸科技“文档大模型”核心技术揭秘!
...多路径召回的文本内容,进行重排序,进一步提升回答的准确率。 其中,“界面识别模型” 强化了对用户手册中最常见软件界面的支持,主要得益于很多用户都喜欢使用截图来对知识库进行提问。该模型训练数据提取自浩鲸科...……更多
LLM仍然不能规划,刷屏的OpenAI o1远未达到饱和
...模型中,LLaMA 3.1 405B 在常规 Blocksworld 测试中表现最佳,准确率达到 62.6%。然而模型在 Mystery Blocksworld 的表现却远远落后——没有一个 LLM 在测试集上达到 5%,并且在一个领域上的性能并不能清楚地预测另一个领域的性能。这种结...……更多
长上下文能力只是吹牛?最强GPT-4o正确率仅55.8%,开源模型不如瞎蒙
...绩直接惨不忍睹,表现最好的Command R(simple)只有22.47%的准确率。——要知道,这考试瞎蒙也能得25分(四选一)。 当然,这也说明人家不是瞎蒙的,确实动脑子了。视觉上的长上下文另一篇研究来自UCSB,考察的是视觉大模型...……更多
阿里推出AI数据科学家,全流程自动化,科研小白也能用
...”。步骤2:规范化计算。如果指标是“越大越好”(如准确率、F1分数、AUC),NPS等于原始值;如果指标是“越小越好”(如损失值),则需要将原始值映射到接近1的较高NPS值。规范化后的性能得分范围通常是0到1,其中1表示...……更多
大模型重构生命科学!最大基础模型面世,解锁DNA超长序列
...等,这样一来在各种具体下游任务下,实现更好的性能和准确率。还有像DNA大模型序列长度跃升至128K,可以更好的捕获远端调控信息,实现了超长序列解码生命的可能性。这有点类似于通用大模型具备了长文本读取能力,由此...……更多
表格增强生成TAG登场:解锁AI自然语言与数据库的完美结合
...来总结评论。实验及结果表 1 显示了每种方法的精确匹配准确率和执行时间。如表所示,在选定的 BIRD (一个数据集,用于测试 LMs 的文本到 sql 的能力)查询类型中,研究者发现手写 TAG(hand-written TAG)基线始终能达到 40% 或更...……更多
百度文心大模型4.0技术进展
...确知识,最后把这些找到的知识组装进Prompt送入大模型,准确率好,效率也高;另一方面,对大模型的输出进行反思,从生成结果中拆解出知识点,然后再利用搜索引擎、知识图谱、数据库,以及大模型本身进行确认,进而对有...……更多
空间智能版ImageNet来了!李飞飞吴佳俊团队出品
...验评估方面,HourVideo采用五选多任务问答(MCQ)任务,以准确率作为评估指标,分别报告每个任务以及整个数据集的准确率。由于防止信息泄露是评估长视频中的MCQ时的一个重要挑战——理想情况下,每个MCQ应独立评估,但这种...……更多
媲美OpenAI事实性基准,这个中文评测集让o1-preview刚刚及格
...T-4o mini 仅 37.6 分,ChatGLM3-6B 和 Qwen2.5-1.5B 仅 11.2 和 11.1 的准确率。基于中文 SimpleQA,我们对现有 LLM 的事实性能力进行了全面的评估。并维护一个全面的 leaderboard 榜单。同时我们也在评测集上实验分析了推理 s……更多
更多关于科技的资讯:
新春百吋电视选购指南:认准真百吋,看清真门道
蛇年将至,添新成了头等大事。尤其是准备买大屏电视的朋友,一想到除夕夜里,全家大小用沉浸式巨幕看春晚心情那个爽;亲戚朋友来拜年
2025-01-22 19:03:00
蔚来高管回应进军机器狗:没有的事儿
快科技1月22日消息,此前有消息称,蔚来已组建约20人团队调研机器狗项目,由前Momenta算法专家徐抗负责。对此,蔚来智能驾驶产品与体验负责人向徐抗进行了询问
2025-01-22 20:32:00
1299元 追风者发布Evolv X2系列机箱:三面钢化玻璃
快科技1月22日消息,追风者推出了Evolv X2系列机箱,首发1299元。这款机箱采用了卓越的垂直气流设计,通过底部进气
2025-01-22 20:32:00
比二手还便宜!iPad mini 7 eSIM版叠加国补仅3399元
快科技1月22日消息,近日北京、浙江、湖北、江苏、广东等地已经陆续上线了手机、平板等数码国补,可以叠加在电商等优惠,进一步补贴15%的价格
2025-01-22 21:02:00
便民惠民!2025年以旧换新政策全新升级
十堰广电讯(全媒体记者 何旭 魏俊)近日,记者从十堰市商务部门获悉,今年以旧换新政策继续实施,而且进行了全新升级提档扩围
2025-01-22 21:26:00
《X战警》凤凰女Cos美图欣赏:胶衣完美展示好身材
近日国外美女Coser Lady Melamori在推特上分享了她的《X战警》凤凰女Cos作品,完美还原该角色,并展示了自己的性感好身材
2025-01-22 21:32:00
OPPO Find N3 Flip新春直降800元 还可叠加500元国家补贴
快科技1月22日消息,OPPO宣布旗下小折叠手机Find N3 Flip大促,新春直降800元 还可叠加500元国家补贴
2025-01-22 21:32:00
冷冷冷 多地将冻成“紫色”!今年首场寒潮来袭:大规模雨雪上线
快科技1月22日消息,前段时间我国气温偏高明显,在遇上即将到来的今年首场寒潮后,会带来大幅降温。据中国天气网最新预报,我国大部气温普遍下降8至12℃
2025-01-22 21:32:00
2025全年可领!“一码贵州”上线以旧换新补贴申领通道
1月20日,一码贵州平台上线家电、数码产品、汽车、家居等品类的购新与申领补贴通道,活动将持续至2025年12月31日。活动期间
2025-01-22 21:53:00
车里也能看烟花!小米SU7智能双表盘“小年彩蛋表情”上线
快科技1月22日消息,小米汽车SU7智能双表盘“小年彩蛋表情”正式上线。用户只需语音指令“小爱同学放烟花”,表盘即刻展现烟花效果
2025-01-22 22:32:00
济南公司积极探索短视频营销新路径,通过精心策划和高效运营,短视频品牌效应日益显著,大幅提升了公司的品牌知名度和美誉度。去年11月至今共征集短视频40余个
2025-01-22 22:33:00
浙江在线1月22日讯(通讯员 张超 徐紫琪) 国网舟山供电公司信通分公司于1月19日完成信通数智平台系统级部署工作,平台建设聚焦信通业务数字化升级
2025-01-22 17:18:00
中信恒泰董事长陆霖带队赴广州晟能电子科技有限公司考察交流
近日,中信恒泰董事长陆霖携公司总经理助理、低空经济产业研究院院长黄毅,集团企业技术中心经理、工程数智医院院长张融等技术骨干前往广州晟能电子科技有限公司(以下简称“广州晟能”)考察交流
2025-01-22 17:22:00
亚商投顾:客户至上的理念与技术创新并行
在2024年,证券投资咨询行业经历了多方面的变革和挑战。市场的竞争愈发激烈,投资者的需求日益多元化,尤其是对于专业性、个性化和高效服务的要求逐步提升
2025-01-22 17:30:00
城市领航+代客泊车上车!2025款汉家族正式开启内测用户OTA推送
快科技1月22日消息,日前,比亚迪2025款汉家族的城市领航和代客泊车功能已向首批内测用户推送OTA升级,包含5项新增功能和6项体验优化
2025-01-22 17:31:00