• 我的订阅
  • 头条热搜
OpenAI o1模型到博士水平了?复旦教授:没有真正推理能力,学到的还是概率相关性
...无法进行类人的演绎和归纳推理,它学习到的仍然是概率相关性。”张奇表示。 他提到,换一些简单题目,与训练语料不同的数据,o1-preview的结果就会变的很差。比如虽然它数学能力突出,但对9.11和9.8哪个大这种问题,第一...……更多
RAG真能提升LLM推理能力?人大最新研究:数据有噪声,RAG性能不升反降
...来的帮助,那么RAG将无法提升推理能力。令 表示标记的相关性,=0 表示标记 第 个token 是噪声,否则该token是相关的。令表示LLM的原始注意力层。我们假设期望的自注意力函数为:对模型的微调可以表示为其中,ΔW 表示其余项。...……更多
复旦大学漆远:DeepSeek将推理成本降至百万token仅1元人民币,加速AI普及
上海科学智能研究院院长、复旦大学浩清特聘教授漆远出品|搜狐科技作者|郑松毅2月21日-23日,2025全球开发者先锋大会在上海举办。在开幕式论坛上,上海科学智能研究院院长、复旦大学浩清特聘教授漆远,发表题为《共建...……更多
大模型不会推理,为什么也能有思路?有人把原理搞明白了
...层推理任务的查询,文档的影响力得分之间存在显著的正相关性,表明了这些文档与「需要对不同数字应用相同程序」的问题相关。研究者计算了所有 500 万个文档得分对于所有查询组合的 Pearson R 相关性(每个模型有 802 个相关...……更多
自动化、可复现,基于大语言模型群体智能的多维评估基准
...ntralized Arena 与 Chatbot Arena 的 “整体” 排名表现出最强的相关性。Decentralized Arena 的关键优势包括:稳健且无偏:去中心化避免了单个或少数评委模型所带来的偏见,并且不容易通过过拟合评委模型进行操控。参与竞技场的 LLM ...……更多
幻觉不一定有害,新框架用AI的「幻觉」优化图像分割技术
...的语义相似性。这种方法有助于确保分割结果的准确性和相关性:归一化后的相似度用作权重,以加权合成最终的掩码。这个掩码在下一次迭代中有助于生成更优质的背景图片,进而引导更有效的提示生成。这能充分利用幻觉来...……更多
蚂蚁自研知识增强大模型服务框架KAG,可显著提升知识推理准确率
...论引入知识图谱技术的也越来越多。通过知识图谱的语义相关性来提升模型内容的相关性,以此可以做更好的语义计算和语义的召回。大模型幻觉也是阻碍应用的关键挑战之一。那么,引入了 RAG、知识库之后,大模型就能解决...……更多
MMMU华人团队更新Pro版!多模态基准升至史诗级难度:过滤纯文本问题、引入纯视觉问答
...才能正确回答,但模型通常也能找到候选选项中的捷径或相关性,根据预训练中获得的先验知识来得出正确答案。所以MMMU-Pro在构建的时候,更加细致地考虑问题与图像之间的关联性,以及智能体是否真正理解了问题的本质,而...……更多
清华领衔发布多模态评估MultiTrust:GPT-4可信度有几何?
...果表明,多模态大模型的可信性与其通用能力存在一定的相关性,但在不同的可信评估维度上模型表现也依然存在差异。当前常见的多模态大模型相关算法,如GPT-4V辅助生成的微调数据集、针对幻觉的RLHF等,尚不足以全面增强...……更多
为什么要重读凯恩斯
...,凯恩斯越是盛名在外,人们对他的误解也就越深。正如复旦大学经济学院韦森教授在最近所写的新作《重读凯恩斯》中所言,“尽管从世界范围来看,20世纪以来在经济学中的影响无人超越凯恩斯,但是直到今天,很少人认真...……更多
从通用人工智能到科学智能,“AI爱因斯坦”还远吗?
...主题论坛上,上海科学智能研究院院长(下称上智院)、复旦大学浩清特聘教授漆远,讲述了他对于通用人工智能(AGI)和科学智能的发展判断。参与此次论坛的两院院士、国内外知名科学家也认为,AI必须具备超越简单数据处...……更多
多个中国团队斩获EMNLP\'24最佳论文!UCLA华人学者中三篇杰出论文
...千言万语,但每个人都能倾听吗?关于图像再创造的文化相关性)这篇来自CMU的论文研究了图像跨文化再创作任务。鉴于多媒体内容兴起,翻译需涵盖图像等模态,传统翻译局限于处理语音和文本中的语言,跨文化再创作应运而...……更多
科学家推出大模型数据集,涵盖奥赛数学题,有望让AI辅导数学课程
...0。根据 OpenAI 自己的说法,使用 ChatGPT 来解决这一问题的概率大概是 0.1%。他当时非常好奇 ChatGPT 到底能解答到什么程度。之后,他自己尝试使用不同的提示词,并将不同的中间结果给到 ChatGPT,看看是否可以提高成功率。结果...……更多
「学术版ChatGPT」登场!Ai2打造科研效率神器OpenScholar,让LLM帮你搞定文献综述
...包含大量已发表文献的数据库中,根据与输入查询的语意相关性 x检索到一组段落 ={p1,p2,…,pN},作为下一步的上下文。然后,负责生成的语言模型根据段落和输入查询x产生输出y以及相应的引文, 这个过程可以形式化表示为:其...……更多
9.11和9.9哪个大?实测12个大模型8个都答错,ChatGPT也翻车了
...科生。实际上语言模型在这样的数据训练过程中学到的是相关性,使得AI在文字创作上达到人类平均水平,而数学推理更需要的是因果性,数学是高度抽象和逻辑驱动的,与语言模型处理的语言数据在本质上有所不同。这意味着...……更多
...3等于12”。最令人惊讶的是什么?答案往往与基于逻辑和概率的推理脱节。例如,在盒子测试中,“克劳德2”有一半次数能给出正确答案,但它的每次推理看上去都带有逻辑,类似于人类的逻辑推理。更令人吃惊的是,一些大...……更多
RAG没有银弹!四级难度,最新综述覆盖数据集、解决方案,教你「LLM+外部数据」的正确使用姿势
...具有强大的数据解释和分析能力,能够有效地从碎片化或相关性不大的数据源中得出连贯的答案。参考资料:https://arxiv.org/abs/2409.14924 ……更多
搭建交流平台 推动技术创新 “认知世界 智创未来”主题论坛在沪举办
...工智能前沿领域的技术创新与未来发展。论坛现场论坛由复旦大学数学科学学院教授林伟主持,来自卡内基梅隆大学、牛津大学和香港大学、复旦大学的知名专家教授分享了他们的研究成果、行业见解和实践经验,众多海内外著...……更多
英伟达最新技术分享:手把手教你用Llama 3.1合成数据改进模型!附代码
...导致问题重叠。接下来,我们使用LLM来判断问题与段落的相关性,确保这些问题能够完全通过段落中的信息回答。然后,我们将所有相关问题重写为对话语气。最后,我们会进行另一次过滤,分类并剔除那些可能过于笼统的问题...……更多
大语言模型如何宣告心理学的死亡?
...制约领域发展,盘旋上空的三个幽灵:行为主义的遗留,相关性的困惑,以及隐性知识的挑战。每一个幽灵都暗指传统心理学曾经忽略的问题,本文将从大语言模型的视角提供新的见解。行为主义的幽灵延续人类心理学的研究方...……更多
大数据分析方法在期末考试成绩分析中的运用
...件为分析工具,分别从统计分析描述、平均数和标准差、相关性分析和回归分析等方面进行论述;同时,对学生的物理期末成绩做出合理性预测,及时了解和掌握学生对知识的掌握程度,为后续的教学工作提供参考,有利于学校...……更多
年度生成式AI大会上海站公布最新嘉宾,报名进入最后阶段
...绍主峰会新增参会的嘉宾。在首日进行的大模型峰会上,复旦大学计算机科学技术学院教授、上海市智能信息处理实验室副主任张奇将带来主题报告,联汇科技CEO兼首席科学家赵天成、VAST CTO梁鼎、蚂蚁集团资深算法专家李龙飞...……更多
关于LLM-as-a-judge范式,终于有综述讲明白了
...括:回复的帮助性,无害性,可靠性,生成 / 检索文档的相关性,推理过程中每一步的可行性,以及生成文本的综合质量。Methodology:如何评判 表 1:LLM-as-a-judge 训练方法(1)微调:最近许多工作开始探索如何使用微调技术来...……更多
推动大模型自我进化,北理工推出「流星雨计划」
...方法后 LLM 前后各维度的性能变化。在准确性、完整性、相关性、连贯性和可靠性方面,LLaMA3-8B-Instruct 和 Qwen2-7B-Instruct 取得了性能的提升(评估方法:通过 GPT-4 筛选进化前和进化后答案的 win rate)。未来工作该工作初步探索和...……更多
...CTL的高浸润与良好的治疗反应和延长的总生存率呈密切正相关性。据悉,该研究成果在线发表于知名学术期刊《Cancer Immunology Research》。(完) ……更多
Bengio团队提出多模态新基准,直指Claude 3.5和GPT-4o弱点
...是识别可见字符,而无需理解它们在图像叙事中的上下文相关性。相比之下,VCR 要求模型协同利用可用的部分像素级文本提示和视觉上下文来准确地重建被遮挡的内容。这不仅测试了模型处理嵌入文本和视觉元素的能力,还考...……更多
复旦微电董事会完成换届:多名复旦教授当选董事 三位元老级人物未留任|直击股东会
...集成电路与系统国家重点实验室从事集成电路设计与工艺相关性研究等工作,为复旦大学博士生导师及教授级高级工程师。2001年加入复旦微电,2023年9月起一直在复旦微电子公司担任董事。闫娜同样为复旦大学博导。复旦微电202...……更多
大模型“翻车”小学题?
...科生。实际上语言模型在这样的数据训练过程中学到的是相关性,使得AI在文字创作上达到人类平均水平,而数学推理更需要的是因果性,数学是高度抽象和逻辑驱动的,与语言模型处理的语言数据在本质上有所不同。这意味着...……更多
科研也完了,AI暴虐170位人类专家!Nature子刊:大模型精准预测研究结果,准确率高达81%
...样,所有大型语言模型都展现出准确性和置信度之间的正相关性。当大型语言模型对自己的决策有信心时,更有可能做出正确的选择。此外,研究人员还在个体层面上拟合了模型困惑度差异与正确性之间的逻辑回归,以及人类置...……更多
推理成本直降99%!百川智能「1+3」矩阵揭秘,两张4090玩转旗舰新模型
...,此时模型无需深层理解用户的全部行为,只需提供较高相关性的推荐即可。而在智能客服场景,银行、零售、物流等企业的在线客服系统往往有高并发的用户咨询,用户问题相对简单、重复性高,不涉及复杂情感理解和多轮对...……更多
更多关于科技的资讯:
京东开启第6届孝老爱老购物节 发放亿元暖阳孝心券、免费送装拆旧
10月27日,在民政部养老服务司、北京市民政局的指导组织下,京东举办第6届孝老爱老购物节暨暖阳行动发布会。在适老消费需求高速增长
2025-10-28 12:01:00
方家铺子亮相深圳礼品展:AI赋能东方滋养,助力“一人一方”落地
摘要:方家铺子亮相深圳礼品展,以AI赋能个性化滋补,展现了东方养生的智能化新趋势。10月23日,为期4天的第33届中国(深圳)国际礼品及家居用品展览会圆满落幕
2025-10-28 12:04:00
京东七鲜京津冀布局再加速!石家庄首店12月裕华万达开业
石家庄的“新鲜”生活要来了!据官方确认,石家庄京东七鲜首店将于12月在裕华万达广场正式开业,为市民带来生鲜购物与生活方式的全新升级
2025-10-28 12:05:00
OPPO携手火山引擎,Find X9 新机里藏了个“AI旅拍创作神器”
近日,OPPO发布了Find X9系列新机,以“画质革命”为核心,全面升级了移动影像能力,致力于打造手机摄影的旗舰新标杆
2025-10-28 12:07:00
第八届世界声博会11月2日在合肥开幕!讯飞星火大模型升级版即将亮相
大皖新闻讯 10月28日,安徽省人民政府新闻办公室召开第八届世界声博会暨2025科大讯飞全球1024开发者节筹备情况新闻发布会
2025-10-28 13:23:00
智推互联:以“开拓求新”破传播边界,用“精进不止”筑服务壁垒
当AI浪潮席卷全球,企业品牌传播正面临前所未有的挑战。某企业市场部负责人看着一组棘手的数据:预算投入持续,但品牌声量始终不温不火
2025-10-28 13:51:00
记者走基层|裸眼3D,让影像“悬浮”在空中
10月27日,河北景优数字仿真科技有限公司,三维视觉设计师正在制作3D片源。河北日报记者 常方圆摄一只蜜蜂翩然“飞”离播放设备
2025-10-28 08:33:00
10月27日,第三届山西省智能制造推进大会在太原举行。在山西省卓越级智能工厂和智能制造优秀供应商授牌仪式上,太钢不锈钢股份有限公司
2025-10-28 07:23:00
从“复活”一只龙鸟到定义一个产业,越疆用具身智能撬动文化科技新生态
当电影《博物馆奇妙夜》中展品“活”过来的奇幻场景照进现实,一场由科技驱动的文旅产业变革正悄然拉开序幕。近日,越疆初息工厂宣布成功打造全球首个超仿生具身智能体——以多模态具身智能技术“复活”的中华龙鸟
2025-10-28 07:48:00
近400名人才角逐南京市“双创项目”人才“赛马”金陵城,创新与产业双向奔赴□南京日报/紫金山新闻记者 张安琪10月26日
2025-10-28 07:50:00
中国消费者协会与中国物品编码中心合作,于近日在“全国消协智慧315”小程序上线“消协帮您找,扫码辨商品”新功能。该功能依托编码中心国家商品数据库的权威信息
2025-10-28 07:58:00
近日,大金科工(天津)车业有限公司(以下简称“大金科工”)开业仪式在武清开发区举行。大金科工由大行科工(深圳)股份有限公司与金轮集团共同注资成立
2025-10-27 14:11:00
电竞赛事下沉 重构经济文化新生态
第十二届王者荣耀全国大赛举办颁奖礼第十二届王者荣耀全国大赛总决赛落地天津五大道民园广场无畏契约嘉年华 前王者荣耀职业联赛选手刺痛(右)与粉丝合影无畏契约瓦友社迎新季线下活动和平精英村镇赛广东清远站
2025-10-27 14:11:00
据IDC数据显示,2025年中国GEO市场规模突破200亿元,年复合增长率高达67%,超过78%的企业已将GEO纳入品牌增长与智能营销的核心战略
2025-10-27 14:20:00
中国品牌出海:从产品制造向品牌价值跃升
“不出海,就出局。”这句话听起来很极端,但折射出中国制造业在全球化时代的现实处境。今天,中国企业出海,已不再是讨生活般的生存选择
2025-10-27 14:23:00