• 我的订阅
  • 头条热搜
OpenAI o1模型到博士水平了?复旦教授:没有真正推理能力,学到的还是概率相关性
...无法进行类人的演绎和归纳推理,它学习到的仍然是概率相关性。”张奇表示。 他提到,换一些简单题目,与训练语料不同的数据,o1-preview的结果就会变的很差。比如虽然它数学能力突出,但对9.11和9.8哪个大这种问题,第一...……更多
蚂蚁自研知识增强大模型服务框架KAG,可显著提升知识推理准确率
...论引入知识图谱技术的也越来越多。通过知识图谱的语义相关性来提升模型内容的相关性,以此可以做更好的语义计算和语义的召回。大模型幻觉也是阻碍应用的关键挑战之一。那么,引入了 RAG、知识库之后,大模型就能解决...……更多
清华领衔发布多模态评估MultiTrust:GPT-4可信度有几何?
...果表明,多模态大模型的可信性与其通用能力存在一定的相关性,但在不同的可信评估维度上模型表现也依然存在差异。当前常见的多模态大模型相关算法,如GPT-4V辅助生成的微调数据集、针对幻觉的RLHF等,尚不足以全面增强...……更多
为什么要重读凯恩斯
...,凯恩斯越是盛名在外,人们对他的误解也就越深。正如复旦大学经济学院韦森教授在最近所写的新作《重读凯恩斯》中所言,“尽管从世界范围来看,20世纪以来在经济学中的影响无人超越凯恩斯,但是直到今天,很少人认真...……更多
从通用人工智能到科学智能,“AI爱因斯坦”还远吗?
...主题论坛上,上海科学智能研究院院长(下称上智院)、复旦大学浩清特聘教授漆远,讲述了他对于通用人工智能(AGI)和科学智能的发展判断。参与此次论坛的两院院士、国内外知名科学家也认为,AI必须具备超越简单数据处...……更多
科学家推出大模型数据集,涵盖奥赛数学题,有望让AI辅导数学课程
...0。根据 OpenAI 自己的说法,使用 ChatGPT 来解决这一问题的概率大概是 0.1%。他当时非常好奇 ChatGPT 到底能解答到什么程度。之后,他自己尝试使用不同的提示词,并将不同的中间结果给到 ChatGPT,看看是否可以提高成功率。结果...……更多
9.11和9.9哪个大?实测12个大模型8个都答错,ChatGPT也翻车了
...科生。实际上语言模型在这样的数据训练过程中学到的是相关性,使得AI在文字创作上达到人类平均水平,而数学推理更需要的是因果性,数学是高度抽象和逻辑驱动的,与语言模型处理的语言数据在本质上有所不同。这意味着...……更多
...3等于12”。最令人惊讶的是什么?答案往往与基于逻辑和概率的推理脱节。例如,在盒子测试中,“克劳德2”有一半次数能给出正确答案,但它的每次推理看上去都带有逻辑,类似于人类的逻辑推理。更令人吃惊的是,一些大...……更多
搭建交流平台 推动技术创新 “认知世界 智创未来”主题论坛在沪举办
...工智能前沿领域的技术创新与未来发展。论坛现场论坛由复旦大学数学科学学院教授林伟主持,来自卡内基梅隆大学、牛津大学和香港大学、复旦大学的知名专家教授分享了他们的研究成果、行业见解和实践经验,众多海内外著...……更多
英伟达最新技术分享:手把手教你用Llama 3.1合成数据改进模型!附代码
...导致问题重叠。接下来,我们使用LLM来判断问题与段落的相关性,确保这些问题能够完全通过段落中的信息回答。然后,我们将所有相关问题重写为对话语气。最后,我们会进行另一次过滤,分类并剔除那些可能过于笼统的问题...……更多
大语言模型如何宣告心理学的死亡?
...制约领域发展,盘旋上空的三个幽灵:行为主义的遗留,相关性的困惑,以及隐性知识的挑战。每一个幽灵都暗指传统心理学曾经忽略的问题,本文将从大语言模型的视角提供新的见解。行为主义的幽灵延续人类心理学的研究方...……更多
大数据分析方法在期末考试成绩分析中的运用
...件为分析工具,分别从统计分析描述、平均数和标准差、相关性分析和回归分析等方面进行论述;同时,对学生的物理期末成绩做出合理性预测,及时了解和掌握学生对知识的掌握程度,为后续的教学工作提供参考,有利于学校...……更多
Bengio团队提出多模态新基准,直指Claude 3.5和GPT-4o弱点
...是识别可见字符,而无需理解它们在图像叙事中的上下文相关性。相比之下,VCR 要求模型协同利用可用的部分像素级文本提示和视觉上下文来准确地重建被遮挡的内容。这不仅测试了模型处理嵌入文本和视觉元素的能力,还考...……更多
大模型“翻车”小学题?
...科生。实际上语言模型在这样的数据训练过程中学到的是相关性,使得AI在文字创作上达到人类平均水平,而数学推理更需要的是因果性,数学是高度抽象和逻辑驱动的,与语言模型处理的语言数据在本质上有所不同。这意味着...……更多
Kimi爆火背后:访问量仅次于文心一言和阿里通义,国内外大模型都在卷上下文
...挑战。实际上,长文本能力已是国内外大模型追逐热点。复旦大学计算机科学技术学院教授张奇对搜狐科技表示,很多大模型仅停留在长度和简单的事实检索能力方面,在更加重要的阅读理解和推理能力方面还有待加强。上下文...……更多
牛津团队提出多年生DToU方案,能有效检查应用程序的使用请求
...程序)是否符合 DToU 的规定。义务识别和合规性检查存在相关性。但是更软性的规定,也就是数据使用者在被赋予了数据使用权之后,还需要额外做哪些事情来满足数据提供方的规定?一个典型例子就是“如果你使用了我们的数...……更多
零样本即可时空预测!港大、华南理工等发布时空大模型UrbanGPT | KDD 2024
...景中出现的复杂情况,本文设计的时空编码器在处理空间相关性时不依赖于特定的图结构。这是因为在零样本预测环境中,实体间的空间联系往往是未知的或难以预测的。这样的设计使得UrbanGPT能够在广泛的城市应用场景中保持...……更多
...临床评估了母亲外周血中galectin-9水平与子痫前期发病的相关性,发现血清中galectin-9具有子痫前期早期预测的潜在价值。(完)【编辑:房家梁】 ……更多
我国学者发现乳腺癌化疗耐药“元凶”
...的耐药“元凶”被找到。为了解耐药“元凶”作用机制和相关性,以便为后续优化治疗策略找到方向,团队开展了相关试验。结果显示,当用相同剂量的多西他赛和阿霉素治疗时,与TSPAN8-CAFs相比,TSPAN8﹢CAFs存活率显著提高,并...……更多
疱疹病毒感染关键因子找到
...,干扰素诱导的跨膜蛋白1(IFITM1)与EB病毒感染有潜在负相关性。研究人员在上皮细胞中敲减IFITM1,上皮细胞在EB病毒中暴露3小时和72小时之后,EB病毒拷贝数和病毒感染阳性细胞比率均增加。研究人员证实,将外源可溶性IFITM1...……更多
字节跳动豆包大模型发布,火山引擎全栈AI服务助力企业智能化转型
...流式知识库索引更新,内嵌豆包向量化模型,提高搜索的相关性和准确性。除以上核心插件升级之外,火山方舟2.0也全面升级了系统承载能力、安全防护能力和算法服务能力。在系统承载力上,提供充沛的GPU算力资源,分钟级千...……更多
中文大模型最新评测出炉:腾讯混元国内第一!
...获得总分71.95的高分。评测标准涵盖了理解准确性、回应相关性和推理深度等维度,确保了评估的科学性和公正性。腾讯混元大模型在基础能力方面紧追海外顶尖模型,总成绩仅略低于GPT-4o,表现优于CLaude3.5-Sonnet和Gemini-1.5-Pro。...……更多
「衔远科技」,以ChatGPT助企业数智化创新
...队的成员分别来自北京大学、清华大学、中国科技大学、复旦大学、上海交通大学、哈尔滨工业大学、中国人民大学,及美国科罗拉多大学、密歇根州立大学,澳大利亚悉尼大学等国内外知名院校,拥有丰富的产业经验和深厚的...……更多
阿里云全面升级GPU云服务:AI大模型推理性能可提升100%
...共底座。零一万物、百川智能、智谱AI、昆仑万维、vivo、复旦大学、巨人网络等大批企业和机构在阿里云上训练大模型,并通过阿里云对外提供服务。小鹏汽车、联想、德勤、微博、完美世界、喜马拉雅等已接入阿里云通义大模...……更多
科学家开发神经元模型,帮助确定阿尔茨海默病药物开发的治疗靶点
...在模拟位于外显子 10 的显性家族额颞叶变性突变方面的相关性。此外,要想在人类诱导多能干细胞衍生的神经元中重现稳健的 Tau 蛋白聚集,也非常困难。虽然在 MAPT-P301L 或 MAPT-IVS10+16 iPSC 神经元中,研究人员并未观察到不溶性 ...……更多
亚洲银行家2024中国未来金融峰会在京举行
...能和区块链的发展,银行业必须重新定义自身角色以保持相关性。银行需要从传统的居间业务模式转变为更加个性化、技术驱动的服务提供者。这一转型不仅关系到银行业的未来,还将对社会整体产生深远影响,包括金融个性化...……更多
鼎森投资:股票中性与期权套利并驾齐驱,别样策略造就亮眼业绩!
...值上就是产品在维持较好收益的同时,和同类产品的净值相关性很低。1.逻辑驱动、多策略分散!具体来说,多头端,鼎森的股票中性策略特点是:逻辑驱动、多策略分散。当前有不少量化私募直接大规模用算法挖掘因子,每个...……更多
4轮暴训,Llama 7B击败GPT-4!Meta等让LLM「分饰三角」自评自进化
...官「评」的怎么样,实验测量了LLM给的分数与人类偏好的相关性。如果没有可用的人类标注数据,则使用较强的AI法官代替。 指令跟随评估图3展示了在AlpacaEval基准上,元奖励方法(带有长度控制机制)胜率随训练迭代的变化。...……更多
“保险智能专家”在复旦诞生
...转自:青年报探索保险行业前沿科技“保险智能专家”在复旦诞生复旦保险红人节的圆桌论坛。本版均为受访者供图日前,在复旦保险红人节上,发布了由复旦保险团队研发的保险垂直大模型——“保险智酷”,深入探索了保险...……更多
美图大模型再更新,创始人吴欣鸿:全员拥抱AI,今年研发投入将超6亿元
...狐科技等媒体,在选择行业的过程中,更关注与互联网的相关性。另外,也会注重行业内的长尾效应,他认为,长尾性强的会有更多中小玩家,这类客户对生成效果相对不敏感,更利于快速跑通售卖链路,产生商业价值。美图认...……更多
更多关于科技的资讯:
省数据和政务服务局发布公告公开征集一批河北省高质量数据集河北日报讯(记者解楚楚)9月26日,河北省数据和政务服务局发布公告
2025-10-04 08:03:00
央媒看太原9月30日,央视财经频道《经济信息联播》栏目以《双节市场备货足美食特产受青睐》为题,报道了假期到来,太原市各大综合市场提前备货
2025-10-04 07:17:00
厦门网讯(厦门日报记者 朱道衡)近日,2025鼓浪屿世遗文创作品征集活动启动。此次活动面向全国(含港澳台地区)高校、企业
2025-10-03 08:37:00
厦门网讯(厦门日报记者 楚燕 通讯员 石青青)长假期间,许多人从忙碌的工作中解脱出来,趁机好好休息。可是,如果休息方式不得当
2025-10-03 08:37:00
渤海之潮涌动着澎湃的脉搏,海河之畔镌刻着科技的印记。10年前,一颗带有“清华”基因的种子在天津这片沃土扎根;10年后,它长成一棵枝繁叶茂的参天大树
2025-10-03 09:25:00
太燃了!无人机空中展旗!高新区国庆“氛围组”已上线!
2025-10-03 23:48:00
抖音生活服务联合北京卫视发起“老板驾到”直播活动,吸引用户下单超100万元团购券
9月29日,抖音生活服务联合北京卫视发起“老板驾到”直播活动,助力北京国庆中秋消费。抖音用户在@北京卫视 直播间下单超1万次
2025-10-03 18:36:00
“FutureBOT未来引力”2025北京机器人文化节首日盛况 打造国庆科技打卡新地标
国庆首日,“FutureBOT未来引力”2025北京机器人文化节在北京昌平超极合生汇正式拉开帷幕,成为国庆假期极具科技温度的打卡地
2025-10-03 19:06:00
走到白石山巅的尽头,这家建在悬崖边的“云端咖啡厅”绝对让你惊呼。
2025-10-03 11:37:00
泰康人寿发布新品“泰康百万药无忧(庆典版)医疗保险”(以下‬简称“百万药无忧”),以广覆盖、易投保、强保障、低费率为优势
2025-10-03 09:17:00
厦门网讯(厦门日报记者 翁华鸿 通讯员 林雨新)在近日举行的2025全球数据管理峰会“数据要素分论坛暨大数据统计与人工智能技术创新管理研讨会”上
2025-10-03 08:38:00
兴趣-实践-视野:达芬奇金奖少年带来的教育启示录
摘要:2025“你是达芬奇”全球青少年科学与艺术创新赛圆满落幕,其中金奖获奖少年的亲身实践告诉我们,在AI赋能的新时代
2025-10-02 16:22:00
单日调用近1万亿次,高德助力北斗规模化民用跨入新量级
2025年10月1日,随着国庆长假首日出行高峰的到来,高德基于北斗卫星导航系统的定位数量接近1万亿次,支撑导航总里程数超90亿公里
2025-10-02 22:31:00
10月1日,从太钢获悉,今年以来,太钢不锈进料加工团队以“精准备案、高效协同”为核心,在进料铬铁镍铁资源利用方面取得突破性进展
2025-10-02 17:39:00
厦门网讯(厦门日报记者 林露虹)记者昨日从中国移动咪咕公司获悉,该公司打造的“鼓浪屿AI伴游”服务已正式上线。市民和游客只需打开“鼓浪屿元宇宙”微信小程序
2025-10-02 08:57:00