• 我的订阅
  • 教育

让AI去高考,豆包等四款大模型考上文科“一本”

类别:教育 发布时间:2024-06-26 11:14:00 来源:每日看点快看

本文转自:中国新闻网

高考不仅仅是检测国内莘莘学子的一项重要考试,在大模型“百家争鸣”的今天,也是对国内AI大模型的一次考验。

如果让大模型和国内学子同台竞技,做同一套高考真题试卷,结果会是怎样?

大模型考上文科本科,豆包获国内头筹

在极客公园最新发布的高考新课标Ⅰ卷大模型评测报告中,GPT-4o以562分排名文科总分第一。国内产品中,字节跳动旗下的豆包拔得头筹,成绩是542.5分。

据介绍,本次评测以新课标Ⅰ卷为考题,与河南省考卷完全相同。

河南省教育考试院公布的高考录取分数线,文科本科一批分数线为521。根据测试结果,这意味着,GPT-4o、豆包、文心4.0、百小应等四款AI大模型在测试中的得分冲上了“一本”线。

与文科相比,大模型的理科成绩要差很多,最高分还不到480分,多数大模型的理科总分在400分以下,数学普遍不及格,相比河南理科511分的“一本”线,大模型还需努力。

文科舒适区,英语具有压倒性优势

大模型处理自然语言方面的能力不容置疑,三款国产大模型产品获得了语文考试前三名,分别是百小应、字节豆包和腾讯元宝,得分依次为128分、125.5分和120.5分。丢分主要在语文写作上。

在匿名阅卷中,豆包获得阅卷老师的好评:文章中显出的对就业结构、伦理方面的担心,展现出豆包已经具有不错的思想深度和思辨能力。

具体看,在立住“问题”后,豆包随即用反问句自然过渡,引出三个排比段提出解决问题的方法。然后用发展的眼光分析问题,结合现实生活揭示问题产生的根源和危害的部分颇为亮点。

作为本次评测的语文作文阅卷人,北京市级骨干教师、怀柔区语文学科带头人夏老师曾多次参加全国高考语文阅卷。夏老师认为:“Al写出的文章大多有清晰完整的结构,有逻辑性,语言通顺流畅。但其理性有余,感性不足,缺乏感情色彩,自然就缺乏感染力。”

在历史和政治两科中,测试选手中有三至四家能达到80%以上的得分率。历史单科的桂冠归属豆包82.5的平均分。出乎意料的是,地理考试是文综三科中大模型表现最差的,最高分仅仅是 GPT-4o的68分。原因之一可能是地理涉及图片更多,AI识图能力有待提升。

大模型在高考英语测试中的优势更是压倒性的。一张150分满分的英语卷子,平均分达到132分,其中客观题几乎都是满分或接近满分,丢分主要在应用文写作和读后续写的作文部分,表达空泛、缺少细节上是弊端。

理科“掉链子”,AI有待提升

如上提到,大模型理科普遍不行,成绩要差很多,在数学、物理、化学等数理学科上差距极大,包括GPT-4o在内的所有大模型都无法达到及格水平。大模型的理科最好成绩还无法进入人类考生的前30%。

以数学试卷为例,9款大模型产品中,仅GPT-4o、文心一言4.0和豆包获得60分以上成绩(满分150分),目前的大模型只能正确推理步骤相对简单的问题。

据测试机构透露,豆包等大模型能准确运用求导公式和三角函数定理,但是面对较为复杂的推导和证明问题就很难继续得分。

重点考查实验探究能力的化学和物理试卷,各模型平均分更是只有34分和39分(满分为100和110)。化学单项最高分由豆包获得,成绩为49.5分,GPT-4o仅有42分。

另外,测试显示,大模型在应对考试的灵活性上也不如人类。例如物理有一道“送分”题,人类考生根据“时间不会倒流”可以排除错误选项,轻易选对正确答案“C”,大模型则几乎全军覆没。要学会像人类一样思考和解决问题,大模型还有很长的路要走。(完)

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2024-06-26 15:45:03

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

AI大模型参加高考 GPT-4o文科成绩最好 理科普遍不行
...以562分排名文科总分第一。国内产品中,字节跳动旗下的豆包拔得头筹,成绩是542.5分。根据介绍,本次大模型高考评测与河南省考卷完全相同,而河南高考录取分数线显示,文科本科一
2024-06-27 19:06:00
...报告中,GPT-4o 以562分排名文科总分第一。国内产品中,豆包等三款国产AI考上文科一本线。字节跳动旗下的豆包拔得头筹,成绩是542.5分,其后依次是百度文心、百川智能“
2024-06-26 11:03:00
9.11和9.9哪个大?实测12个大模型8个都答错,ChatGPT也翻车了
...百度文心一言、Minimax和腾讯元宝答对,但ChatGPT-4o、字节豆包、月之暗面kimi、智谱清言、零一万物万知
2024-07-17 11:56:00
9.11比9.9大?多个大模型翻车!业内人士:就是偏科,文科强理科弱
...学试卷为例,9款大模型产品中,仅GPT-4o、文心一言4.0和豆包获得60分以上成绩(满分150分),目前的大模型只能正确推理步骤相对简单的问题
2024-07-17 20:56:00
AI大模型也高考?成绩单出来了,星火综合第一
...度文心一言以超过50分的成绩位居前列,智谱清言、字节豆包与讯飞星火则并列第三。Kimi、阿里通义、百川、海螺排名相对靠后。而在潇湘晨报的“AI写作”评测中,讯飞星火不仅平均分
2024-06-12 09:29:00
大模型“翻车”小学题?
...心一言、智谱清言、腾讯元宝、科大讯飞星火、字节跳动豆包、学而思九章大模型、面壁智能Luca、月之暗面Kimi等9家国产大模型
2024-07-18 16:39:00
...纷下场,使用市面上常见的大模型产品如通义千问、字节豆包、讯飞星火、文心一言、腾讯元宝、月之暗面Kimi等作为“考生”,围绕“大模型高考测试”得出了一系列结果,为人们更好地了解
2024-06-26 07:26:00
AI大模型开启“免费午餐”?字节直降99%,阿里一折甩卖,百度高喊免费!
...序幕。5月15日,字节跳动在火山引擎原动力大会上,宣布豆包大模型32K主力模型企业级定价为0.0008元 / 千Tokens
2024-05-22 15:38:00
腾讯元宝“上桌”,AI助手之争再起波澜
...的“AI问书”已经在用户群体中引发了热议。无论是抖音豆包、文心一言还是天工、Kimi,短时间内都很难追赶微信读书数百万正版图书的内容生态,这一高质量语料库,也将助力混元大模型
2024-06-03 16:59:00
更多关于教育的资讯:
锚定产业升级 郑州城市职业学院赴多家龙头企业搭建就业快车道
大河网讯 为严格落实高校毕业生就业工作“一把手工程”,抢抓春季招聘关键窗口期,全力护航毕业生高质量充分就业,3月9日至13日
2026-03-23 14:10:00
河南这位高校教师,为何受邀做客央视?
大河网讯 3月20日晚,河南师范大学教师刘影受邀登上央视社教频道国际幸福日特别直播《把幸福还给日常》。作为高校嘉宾代表
2026-03-23 14:10:00
黄河科技学院附属中学:当“成人礼”遇上“龙抬头”
春分到,龙抬头,万物生,少年志。2026年3月20日,恰逢春分与农历二月初二“龙抬头”双节同庆,黄河科技学院附属中学在东操场隆重举行2026届高三成人礼暨高考80天冲刺誓师大会
2026-03-23 14:10:00
大河网讯 春风和畅,陌上花开。3月19日,郑州信息工程职业学院“云鬓簪春·陌上花开”春分非遗雅集暨手作体验活动在南校区“龙子之湾”竹林与北校区艺术与教育学院北广场同步温情举办
2026-03-23 14:10:00
以课堂“微改革”撬动育人“大成效” 郑州这所院校走出产教融合新路径
大河网讯 近日,郑州城市职业学院接连收到长兴兴鹰新型耐火建材有限公司、湖北斯曼新材料股份有限公司两家国家级高新技术企业的感谢信
2026-03-23 14:10:00
河南机电职业学院绘就志愿服务新图景
大河网讯 在新郑龙湖先锋至善幼儿园里,孩子们捧着属于自己的“非遗丝巾”,脸上笑开了花,嘴角咧到了耳根,有的兴奋地举着丝巾小跑展示
2026-03-23 14:11:00
承办国家级教材定稿会 郑州医药健康职业学院深化口腔专业内涵建设
大河网讯 3月16日,由人民卫生出版社主办、郑州医药健康职业学院承办的《口腔卫生保健学》创新教材定稿会在郑州举行。会议汇聚来自全国各地的口腔医学领域顶尖专家
2026-03-23 14:11:00
常州工程职业技术学院:关注睡眠健康 护航学子成长
为引导广大学生树立科学的睡眠理念,养成健康的作息习惯,日前,常州工程职业技术学院在“一站式”学生社区开展“世界睡眠日”主题宣传活动
2026-03-23 15:50:00
首批实习生全员获录!武汉文理学院深化产教融合
荆楚网(湖北日报网)讯(记者唐天琪 通讯员施慧丽)3月17日,武汉文理学院·现代牙科(东莞)有限公司“2.5+1.5”人才培养开班仪式暨就业基地揭牌仪式在现代牙科(东莞)有限公司举行
2026-03-23 09:53:00
沸腾汉马!武昌学子花样闪耀音乐加油站
荆楚网(湖北日报网)讯(记者齐一璇 通讯员张煜、陈婧、张家祺、谭德美、陈奕帆、杨戈砂、孟晶、田佳琪、廖波、邓荔)长江之畔
2026-03-23 09:53:00
雷锋月,这群学生用镜头为老人送上一份“爱情礼物”
荆楚网(湖北日报网)讯(记者唐天琪 通讯员韩玮、孙丰)3月18日,一场由武汉文理学院智能制造与无损检测学院团委学生会组织的“为爱留影”公益拍摄活动
2026-03-23 09:53:00
高校学子以志愿微光点亮“汉马”赛道
荆楚网(湖北日报网)讯(记者唐天琪 通讯员李津、黄思婧)3月22日上午,2026年武汉马拉松在春日暖阳中激情开跑。湖北工业大学工程技术学院的学子们以饱满的热情和专业的服务
2026-03-23 09:53:00
“原来雨水还能这样用!”世界水日,武汉小学生沉浸式探秘“中水回用”
荆楚网(湖北日报网)讯(记者齐一璇 通讯员邓正媛、刘园)在第34届“世界水日”之际,武汉市育才华岭小学以“童心护水源,同筑绿色梦”为主题
2026-03-22 17:45:00
干货满满暖意浓 河南新东方考研全流程解读会助力学子高效备考
大河网讯 3月21日下午,河南新东方“考研高分秘籍发布会暨考研全流程解读会”在龙子湖仟那元熙酒店顺利举行。此次活动聚焦考研学子备考需求
2026-03-22 18:43:00
春分日 蔡甸这群孩子用黏土“留”住春天
荆楚网(湖北日报网)讯(记者林杉 通讯员李赛 谢妍)春分这天,蔡甸区知语城幼儿园里,孩子们用各自的方式触碰传统节气。小班幼儿执笔涂画
2026-03-22 16:43:00