• 我的订阅
  • 头条热搜
首个AI高考全卷评测结果发布:最高分303,数学全不及格
...能力测试。6月19日, OpenCompass发布了首个大模型高考全卷评测结果。语数外三科加起来的满分为420分,此次高考测试结果显示,阿里通义千问2-72B排名第一,为303分,OpenAI的GPT-4o排名第二,得分296分,上海人工智能实验室的书生...……更多
...考语、数、外全卷能力测试。据OpenCompass于6月19日发布的评测结果,大模型的语文、英语考试水平还不错,但数学都不及格,最高分只有75分(满分150分)。参加OpenCompass此次高考测试的大模型,分别是来自阿里巴巴、零一万物、...……更多
上海人工智能实验室公布首个ai高考全卷评测结果
...20日消息,上海人工智能实验室19日公布了首个AI高考全卷评测结果。据介绍,2024年全国高考甫一结束,该实验室旗下司南评测体系OpenCompass选取6个开源模型及GPT-4o进行高考“语数外”全卷能力测试。评测采用全国新课标I卷,参...……更多
...“一本”线。与文科相比,大模型的理科成绩要差很多,最高分还不到480分,多数大模型的理科总分在400分以下,数学普遍不及格,相比河南理科511分的“一本”线,大模型还需努力。文科舒适区,英语具有压倒性优势大模型处...……更多
首个AI高考全卷评测结果发布:数学全都不及格
6月19日,上海人工智能实验室发布首个AI高考全卷评测结果,月初开源的阿里通义千问大模型Qwen2-72B排名第一,在语数外三科420分的满分中获得303分,OpenAI的GPT-4o和上海人工智能实验室的书生·浦语2.0文曲星(InternLM2-20B-WQX)排...……更多
清华发布2024年3月版《SuperBench大模型综合能力评测报告》
...重的安全性评测上,国内模型文心一言4.0表现亮眼,拿下最高分(89.1分),Claude-3仅列第四。自去年3月16日文心一言首发至今,用户数已突破2亿,每天API调用量也突破了2亿。 ……更多
安兔兔评测pc版正式发布,欢迎大家下载体验
...会显示详细的信息,比如页面顶端显示的是所测项目中的最高分,这个分数反映了电脑在CPU和GPU中和测试中的最佳表现。10万分以下表示设备可能难以高效处理复杂AI任务,10万-50万分之间则表示设备性能良好,能够处理大多数常...……更多
月狐数据发布中国市场首份《AIGC应用app智能化评测报告》
...,另一方面能够直观体现国产大模型的最新发展进程。 评测结果显示,文心一言app在智能体能力方面表现突出。在用户创建智能体功能方面,文心一言app支持用户通过上传图片或拍照的方式制作智能体形象,同时支持用户通过...……更多
华为pura70ultra霸榜dxomark评测结果公布
...影像评测机构DXOMARK公布了华为影像新旗舰Pura70Ultra的影像评测结果:以163分的总得分,位居全球榜首,更在五个子项目中荣获三个最高分。值得关注的是,华为Pura70Ultra此次的得分并非微小优势,而是以显著的5分差距,远超第二...……更多
用AI来做全国高考试卷,真的有人试了!结果:成绩偏科很严重
...,还真的有人试了。上海人工智能实验室近日公布了司南评测体系OpenCompass选取开源大模型测试今年高考的全国新课标I卷“语数外”的结果,为了确保“闭卷”考试,大模型的开源时间早于高考,同时邀请有高考评卷经验的教师...……更多
AI大模型也高考?成绩单出来了,星火综合第一
...”评测中,讯飞星火不仅平均分位居首位,且获得了全场最高分56分。潇湘晨报邀请湖南知名作家、编辑作为阅卷老师,对国内五大AI大模型产品——百度文心一言、讯飞星火、阿里通义千问、字节豆包、腾讯元宝的高考作文进...……更多
amd64核心锐龙线程撕裂者7980x首发评测
...恐怖的世界纪录,是撕裂者7980X默频下的整整两倍。此前最高分来自两颗EPYC9654组成的192核心384线程系统,但也不到15万分。当然代价也不小,在超过17万分的时候,系统峰值功耗就跨越了1500W。CineBench2024多核最高8052分,将世界纪...……更多
9.11和9.9哪个大?实测12个大模型8个都答错,ChatGPT也翻车了
...中语文和英语考试水平普遍不错,但数学这科全不及格,最高分也只有75分。在批阅大模型的数学试卷时,老师们发现,大模型的主观题回答相对凌乱,且过程具有迷惑性,甚至出现过程错误但得到正确答案的情况。这意味着,...……更多
OPPO Find X7 Ultra影像与华为并排第一,远超vivo与小米同期新旗舰
近日, DXOMARK 公布了 OPPO Find X7 Ultra的影像评测结果,摄像头总体分数达到157分,与华为Mate60 Pro+并排在第一名。根据DXOMARK的评测结果显示,OPPO Find X7 Ultra在照片、变焦、散景、视频、人像、低光表现均获得了较高的分数,与不...……更多
港中文团队提出大模型元推理范式,革新大模型的评价体系
...计意义思考不足,起码会带来以下几个潜在危害:其一,评测结果能否真实反映大模型的能力?如果对此认识不足,往往会过分夸大模型的效果。其二,会让人以为指标的提升,等价于大模型能力的提升、以及等价于真实场景的...……更多
阿维塔11荣获IVISTA中国智能汽车指数五星智能评价
...时,阿维塔11还刷新了导航智能驾驶评测(NP测试)历史最高分,以96.10分拿下G+(极优秀)评价,斩获该排行榜第一名。阿维塔11荣获IVISTA中国智能汽车指数五星智能星级评价。 阿维塔科技供图 华龙网发中国汽车工程研究院股份...……更多
智源评测体系发布 国内外“百模”评估结果出炉
...140余个开源和商业闭源的语言及多模态大模型全方位能力评测结果。本次智源评测,分别从主观、客观两个维度考察了语言模型的简单理解、知识运用、推理能力、数学能力、代码能力、任务解决、安全与价值观七大能力;针对...……更多
DC 240W+PD 100W+90Wh快充续航,华硕 ROG幻16 2022笔记本充电评测
...解这款笔记本的 Type-C 端口充电兼容性。如上图,是本次评测选用的全部百瓦档位的第三方充电器,其中包括努比亚、绿联、苹果等品牌。 使用氘锋 165W 氮化镓充电器为ROG幻16 2022笔记本充电,使用 POWER-Z KM003C 实测功率为 19.11V 4...……更多
高通骁龙xelite核显adrenox1评测
...了英特尔酷睿Ultra7155H、AMD7840HS等处理器核显性能。综合评测结果来看相比较AMD的Phoenix、英特尔的MeteorLake核显,AdrenoX1在基本的32位和16位浮点数学运算方面的吞吐量很有竞争力。此外得益于速度极快的LPDDR5X主控,AdrenoX1的DRAM带.……更多
长江存储PC411 1TB固态硬盘评测 新一代OEM神盘诞生
...性能和较低的功耗的DRAMLess产品,或将成为一代OEM神盘。评测开始前,我们先快速了解一下长江存储PC411固态硬盘的产品特性1、容量高达2TB;2、标称连续读取写速度达到7000MB/s和6000MB/s;3、采用高性能DRAMLess无缓存主控方案;4、...……更多
AI大模型参加高考 GPT-4o文科成绩最好 理科普遍不行
...分,豆包和文心4.0也接近满分。但在40分的写作考试中,最高分仅为29分,由GPT-4o和百小应获得。不过在理科方面,大模型的水平相比人类顶尖考生的差距就有点过大了。大模型的理科最高分还不到480分,多数大模型的理科总分...……更多
AI界新晋王者被曝抄袭、作弊、做假,脸都丢光了
...比如,谷歌引以为傲的MMLU,是一个由伯克利大学主导的评测,囊括阅读理解、大学数学以及物理和社会科学等57项测验。但如果说,这些题目,是可以事先得知的呢?9月,中国人民大学与伊利诺伊大学香槟分校联合推出了一个...……更多
EVNIA 32M2N6800MW 显示器评测
前段时间,我们有幸评测了飞利浦Evnia旗下最新推出的31.5英寸4K+240HzQD-OLED显示器32M2N8800。这款显示器凭借其震撼的大尺寸屏幕,无限对比度带来的富有层次的视觉感受,以及丰富细腻的色彩表现,加上Evnia为游戏玩家精心设计的...……更多
OpenAI o1模型到博士水平了?复旦教授:没有真正推理能力,学到的还是概率相关性
...OpenAI表示, o1模型在推理能力上相比GPT-4o显著进步。综合评测显示,在绝大多数需要深入思考和复杂推理的任务中,新模型都展现出了明显优于GPT-4o的表现,并在多个细分测试上超过90%。在启用视觉感知能力的情况下,o1模型在M...……更多
惠普ProBook 450 G10 评测:6K价位的酷睿i5也能做主力机
【大泽科技SHOW】平时上班你是用公司配的电脑还是用自己的笔记本电脑呢?相信很多人都会选择用自己的笔记本电脑,其中一个原因是有些公司会给一些补助。当然最重要的还是自己的电脑用着更习惯,工作数据也能随身带着...……更多
iQOO Neo9S Pro评测:旗舰双芯加持
...QOONeo9SPro的安兔兔跑分达到了2287515分,是当前安卓阵营的最高分之一,实际使用起来自然也是非常流畅,即使重度性能玩家也能轻松满足其使用需求。 为了测试双芯加持的iQOONeo9SPro在游戏方面实际表现,笔者首先选取了高负载...……更多
科大讯飞:打造自主创新的大模型底座,为全球产业链提供更多选择
...于大模型的评测报告——《人工智能大模型体验报告3.0》评测结果显示,由科大讯飞研发的讯飞星火认知大模型获得1775最高分蝉联冠军,并获得基础能力指数、智商指数、工具提效指数三项评测指标第一。 在通用人工智能全球...……更多
真我GT7 Pro评测:同档唯一骁龙8至尊版带来越级性能
...这么低,会不会体验上有什么短板?下面,我们一起全面评测下真我GT7Pro,看看这款手机到底能不能带来全面出众的“越级”体验。星环流线工艺打造,极具档次感相较上代产品,真我GT7Pro的外观有了很大变化,不光不再采用双...……更多
腾讯大模型混元Turbo:御气升昺云,梓桐金鼎开
...5T基础平台软件产品兼容国内主流芯片。一、混元Turbo之评测混元Turbo的核心技术混元Turbo的发布凝聚了腾讯团队长期以来对大模型技术的深入研究。该模型采用全新的分层异构MoE架构,创新之处在于通过合理配置专家数量与激活...……更多
好一个响当当的铜豌豆 星途瑶光家族如何以安全定义豪华?
3月19日,最新一期中国保险汽车安全指数(C-IASI)评测车型结果公布,星途瑶光斩获了“车内乘员安全”、“车外行人安全”和“车辆辅助安全”三大核心关键指数全优G评级,连同此前2023年9月份获得中国首批零甲醛座舱汽车...……更多
更多关于科技的资讯:
“实地”感受月球!嫦娥五号月球样品今日向公众开放
快科技12月28日消息,2020年12月,嫦娥五号成功从月球带回月壤样品,我国成为世界上第三个成功带回月球样品的国家,实现了我国及人类探月史上里程碑式的跨越
2024-12-28 09:39:00
奉节脐橙的流量范本③ | 下一个“100万单”在哪里?
2024年12月18日,知名头部主播董宇辉通过“与辉同行”奉节脐橙溯源专场直播,用短短2小时“爆卖”奉节脐橙60万单、约300万斤
2024-12-28 09:45:00
完胜百万保时捷卡宴:极氪7X成功登顶“中国最具挑战大雪道”
快科技12月28日消息,电动化的迅猛发展,带来了真正意义上的科技平权,让20多万的车也能获得超越百万级的享受。近日,极氪使用一台7X成功登顶了“中国最具挑战雪道”——新疆天山艾文大道
2024-12-28 10:09:00
男子22万买车投保29万故意开进湖里 终被诈骗罪调查:网友直呼行为愚蠢
快科技12月28日消息,据国内媒体报道称,近日一男子将自己22万买的车故意开进湖里引发围观,这到底是什么神操作?报道中提到
2024-12-28 10:09:00
北京玉渊潭公园生态巡护机器人上岗
本文转自:人民网2024年12月27日,在北京海淀区的玉渊潭公园内,一台生态巡护机器人正在执行生态监测任务。据悉,自今年4月以来
2024-12-28 10:29:00
小米汽车正式亮相一周年:交付量破13万 提前完成全年目标
快科技12月28日消息,去年的今天,小米SU7正式亮相。如今一周年过去,小米汽车官宣:SU7全年交付量已超13万,提前完成全年所有目标
2024-12-28 10:39:00
本文转自:人民网人民网记者 杨曦提到自动化的工厂,也许你脑中会浮现这样的场景:无人叉车在立体仓库中穿梭自如、机械手臂在流水线旁上下挥舞
2024-12-28 10:40:00
沐光前行丨深圳科华荣获2024年度充电行业质量金奖!
在政策和市场的双轮驱动下,2024年我国新能源汽车年度产量首次突破1000万大关。与此同时,第四季度末我国充电基础设施累计数量也达到了1200+万台
2024-12-28 10:45:00
掌动智能入选广州市产教评技能生态区“样板工程”建设项目单位
近期,广州市人力资源和社会保障局发布了《关于广州市产教评技能生态区“样板工程”建设项目单位的公示》的公告。广州掌动智能科技有限公司(以下简称“掌动智能”)与广州小鹏汽车科技有限公司
2024-12-28 10:45:00
智界R7车主调研报告出炉:“华为”成金字招牌
快科技12月28日消息,由华为和奇瑞共同打造的智界品牌第二款车型R7已经上市,该车销量非常相当好,当前已经交付超过2万辆
2024-12-28 11:09:00
我国自研600公斤推力级涡扇发动机成功点火:助力1.5-4吨级高端无人机
快科技12月28日消息,据国内媒体报道称,中国航发自主研制的600公斤推力级高端涡扇发动机在天府轻动成功点火。报道中提到
2024-12-28 11:09:00
怕冷的人VS抗冻的人:哪个更健康
随着气温逐渐下降,有人裹着厚厚的羽绒服仍旧冷得发抖,有人却穿着单衣在寒风中悠然自得。这不禁让人好奇:为什么有人这么抗冻
2024-12-28 12:09:00
让人失望!松下、川崎重工40多年就开始造假 就是故意篡改测试数据
快科技12月28日消息,日本不少老牌企业公然造假,让日本制造彻底颜面扫地。据国外媒体报道称,日本知名企业松下公司表示,其部分商用空调产品有关空调性能的数据造假
2024-12-28 12:09:00
第九次荣获“五星钻石奖”!为什么是青岛银行?
齐鲁晚报·齐鲁壹点 王会广2024年12月18日,本年度全球服务领域最高荣誉——第十八届“五星钻石奖”(Five Star Diamond Brand)在香港举行的“世界经理人峰会”上揭晓
2024-12-28 12:11:00
吉林大学胡封晔团队:十年科研磨一剑,智感技术铸辉煌
在当今科技飞速发展的时代,智能感知与交互技术成为众多领域实现突破的关键所在。吉林大学胡封晔教授带领的科研团队,凭借其在“智能感知与交互系统关键技术及应用”成果上的卓越成就
2024-12-28 12:13:00