• 我的订阅
  • 教育

让AI去高考,豆包等四款大模型考上文科“一本”

类别:教育 发布时间:2024-06-26 11:14:00 来源:每日看点快看

本文转自:中国新闻网

高考不仅仅是检测国内莘莘学子的一项重要考试,在大模型“百家争鸣”的今天,也是对国内AI大模型的一次考验。

如果让大模型和国内学子同台竞技,做同一套高考真题试卷,结果会是怎样?

大模型考上文科本科,豆包获国内头筹

在极客公园最新发布的高考新课标Ⅰ卷大模型评测报告中,GPT-4o以562分排名文科总分第一。国内产品中,字节跳动旗下的豆包拔得头筹,成绩是542.5分。

据介绍,本次评测以新课标Ⅰ卷为考题,与河南省考卷完全相同。

河南省教育考试院公布的高考录取分数线,文科本科一批分数线为521。根据测试结果,这意味着,GPT-4o、豆包、文心4.0、百小应等四款AI大模型在测试中的得分冲上了“一本”线。

与文科相比,大模型的理科成绩要差很多,最高分还不到480分,多数大模型的理科总分在400分以下,数学普遍不及格,相比河南理科511分的“一本”线,大模型还需努力。

文科舒适区,英语具有压倒性优势

大模型处理自然语言方面的能力不容置疑,三款国产大模型产品获得了语文考试前三名,分别是百小应、字节豆包和腾讯元宝,得分依次为128分、125.5分和120.5分。丢分主要在语文写作上。

在匿名阅卷中,豆包获得阅卷老师的好评:文章中显出的对就业结构、伦理方面的担心,展现出豆包已经具有不错的思想深度和思辨能力。

具体看,在立住“问题”后,豆包随即用反问句自然过渡,引出三个排比段提出解决问题的方法。然后用发展的眼光分析问题,结合现实生活揭示问题产生的根源和危害的部分颇为亮点。

作为本次评测的语文作文阅卷人,北京市级骨干教师、怀柔区语文学科带头人夏老师曾多次参加全国高考语文阅卷。夏老师认为:“Al写出的文章大多有清晰完整的结构,有逻辑性,语言通顺流畅。但其理性有余,感性不足,缺乏感情色彩,自然就缺乏感染力。”

在历史和政治两科中,测试选手中有三至四家能达到80%以上的得分率。历史单科的桂冠归属豆包82.5的平均分。出乎意料的是,地理考试是文综三科中大模型表现最差的,最高分仅仅是 GPT-4o的68分。原因之一可能是地理涉及图片更多,AI识图能力有待提升。

大模型在高考英语测试中的优势更是压倒性的。一张150分满分的英语卷子,平均分达到132分,其中客观题几乎都是满分或接近满分,丢分主要在应用文写作和读后续写的作文部分,表达空泛、缺少细节上是弊端。

理科“掉链子”,AI有待提升

如上提到,大模型理科普遍不行,成绩要差很多,在数学、物理、化学等数理学科上差距极大,包括GPT-4o在内的所有大模型都无法达到及格水平。大模型的理科最好成绩还无法进入人类考生的前30%。

以数学试卷为例,9款大模型产品中,仅GPT-4o、文心一言4.0和豆包获得60分以上成绩(满分150分),目前的大模型只能正确推理步骤相对简单的问题。

据测试机构透露,豆包等大模型能准确运用求导公式和三角函数定理,但是面对较为复杂的推导和证明问题就很难继续得分。

重点考查实验探究能力的化学和物理试卷,各模型平均分更是只有34分和39分(满分为100和110)。化学单项最高分由豆包获得,成绩为49.5分,GPT-4o仅有42分。

另外,测试显示,大模型在应对考试的灵活性上也不如人类。例如物理有一道“送分”题,人类考生根据“时间不会倒流”可以排除错误选项,轻易选对正确答案“C”,大模型则几乎全军覆没。要学会像人类一样思考和解决问题,大模型还有很长的路要走。(完)

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2024-06-26 15:45:03

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

AI大模型参加高考 GPT-4o文科成绩最好 理科普遍不行
...以562分排名文科总分第一。国内产品中,字节跳动旗下的豆包拔得头筹,成绩是542.5分。根据介绍,本次大模型高考评测与河南省考卷完全相同,而河南高考录取分数线显示,文科本科一
2024-06-27 19:06:00
...报告中,GPT-4o 以562分排名文科总分第一。国内产品中,豆包等三款国产AI考上文科一本线。字节跳动旗下的豆包拔得头筹,成绩是542.5分,其后依次是百度文心、百川智能“
2024-06-26 11:03:00
9.11和9.9哪个大?实测12个大模型8个都答错,ChatGPT也翻车了
...百度文心一言、Minimax和腾讯元宝答对,但ChatGPT-4o、字节豆包、月之暗面kimi、智谱清言、零一万物万知
2024-07-17 11:56:00
9.11比9.9大?多个大模型翻车!业内人士:就是偏科,文科强理科弱
...学试卷为例,9款大模型产品中,仅GPT-4o、文心一言4.0和豆包获得60分以上成绩(满分150分),目前的大模型只能正确推理步骤相对简单的问题
2024-07-17 20:56:00
AI大模型也高考?成绩单出来了,星火综合第一
...度文心一言以超过50分的成绩位居前列,智谱清言、字节豆包与讯飞星火则并列第三。Kimi、阿里通义、百川、海螺排名相对靠后。而在潇湘晨报的“AI写作”评测中,讯飞星火不仅平均分
2024-06-12 09:29:00
大模型“翻车”小学题?
...心一言、智谱清言、腾讯元宝、科大讯飞星火、字节跳动豆包、学而思九章大模型、面壁智能Luca、月之暗面Kimi等9家国产大模型
2024-07-18 16:39:00
...纷下场,使用市面上常见的大模型产品如通义千问、字节豆包、讯飞星火、文心一言、腾讯元宝、月之暗面Kimi等作为“考生”,围绕“大模型高考测试”得出了一系列结果,为人们更好地了解
2024-06-26 07:26:00
AI大模型开启“免费午餐”?字节直降99%,阿里一折甩卖,百度高喊免费!
...序幕。5月15日,字节跳动在火山引擎原动力大会上,宣布豆包大模型32K主力模型企业级定价为0.0008元 / 千Tokens
2024-05-22 15:38:00
腾讯元宝“上桌”,AI助手之争再起波澜
...的“AI问书”已经在用户群体中引发了热议。无论是抖音豆包、文心一言还是天工、Kimi,短时间内都很难追赶微信读书数百万正版图书的内容生态,这一高质量语料库,也将助力混元大模型
2024-06-03 16:59:00
更多关于教育的资讯:
大河网讯 10月30日下午,第十四届河南大学大学生广告艺术节暨第七届中原广告艺术大赛开幕式在河南大学郑州龙子湖校区启幕
2025-11-01 23:22:00
河南省普通高中省级语文学科联盟成立仪式举行
大河网讯(记者 刘高雅)10月31日,河南省普通高中省级语文学科联盟成立仪式暨语文学科高质量发展研讨会在郑州市第一〇一中学举办
2025-11-01 23:22:00
好未来2026财年Q2净收入8.61亿美元,素质课程和学习设备业务均环比同比增长
来源:多知 作者:Penny多知10月30日消息,中国智能学习解决方案提供商好未来(NYSE:TAL)公布其截至 2025年 8 月 31 日的2026财年第二季度未经审计财务报告
2025-10-31 09:21:00
洛阳科技职业学院:打造“专业+思政”IT人才培养新高地
大河网讯 在数字经济发展浪潮中,如何培养既精通技术又恪守职业操守的IT人才,成为高校面临的重要课题。近日,洛阳科技职业学院通过创新的“双院协同”育人模式
2025-10-31 12:35:00
从城市到山村 郑州欧曼谛时尚美业学校以义剪为笔绘就重阳节党建新图景
大河网讯 10月28日,重阳节前日,郑州欧曼谛时尚美业学校党支部联合中共大河网党支部,顶着浓雾驱车数百里,奔赴汝州市焦村镇水沟村
2025-10-31 12:35:00
黄河科技学院受邀参加云南省高等教育学会2025年学术年会并作专题报告
10月23-25日,云南省高等教育学会2025年学术年会在大理召开。黄河科技学院教育教学中心副主任李海霞副教授受邀出席
2025-10-31 12:35:00
黄河科技学院新建党性教育培训、思政课教学实践和红色文化研究基地
为更好地开展党性教育培训、推进思政课教育教学和红色文化研究,经与河南大别山干部学院充分协商,10月28日,黄河科技学院“党性教育培训基地”“思政课教育教学实践基地”“红色文化研究基地”合作签约暨揭牌仪式在河南大别山干部学院举行
2025-10-31 12:35:00
同心筑梦家园 携手共育未来 济南历下一幼召开第八届一次家委会、膳委会会议
鲁网10月31日讯近日,济南市历下区第一实验幼教集团召开第八届一次家长委员会和家长膳食监督委员会,家委们肩负共同的使命
2025-10-31 13:30:00
两校区联动研课堂 大单元教学绽芳华 济南高新区凤凰路小学语文联合教研活动纪实
鲁网10月31日讯为深化语文课程改革,推动大单元教学理念落地生根,近日,济南高新区凤凰路小学东西两校区携手开展语文联合教研活动
2025-10-31 13:30:00
耕耘绿意,守护成长——济南高新区凤凰路小学“小凤宝生态科技农耕园”养护记
鲁网10月31日讯当一粒种子落入土壤,便开启了与生命的奇妙对话。在济南高新区凤凰路小学西校区小凤宝生态科技农耕园中,一场关于“种植与养护”的实践之旅正悄然展开
2025-10-31 13:31:00
探寻自然之美,赋能素养美术课堂
鲁网10月31日讯为深化大单元教学改革,近日,凤凰路小学东西校区美术组联合开展以人教版二年级上册第一单元《身边的自然》为主题的公开课教研活动
2025-10-31 13:31:00
唇枪舌战辩榜样——济南高新区凤凰路小学举办五六年级辩论赛
鲁网10月31日讯近日,济南高新区凤凰路小学(东校区)一场围绕 “悲剧英雄还是成功人士谁更适合做榜样” 的辩论赛激烈开战
2025-10-31 13:32:00
深耕班本课程沃土,绘就多元成长画卷——济南高新区凤凰路小学各年级班本课程绽放育人新活力
鲁网10月31日讯为落实“五育并举”育人目标,让课程真正贴近学生成长需求,济南高新区凤凰路小学西校区立足各年级学情特点
2025-10-31 13:32:00
家校携手防网瘾,共筑成长“防护墙”
鲁网10月31日讯2025年10月23日晚,济南高新区凤凰路小学的报告厅内灯火通明,一场关于“防网瘾,护成长”的家庭教育讲座正在这里温情开讲
2025-10-31 13:34:00