• 我的订阅
  • 科技

逢考必过?新版ChatGPT通过美放射学委员会考试

类别:科技 发布时间:2023-05-18 11:00:00 来源:手机中国

【CNMO新闻】说起ChatGPT,想必大家并不陌生,此前许多朋友可能或多或少都被ChatGPT刷屏了,它是由OpenAI开发的一个人工智能聊天机器人程序。仅上线两个月,ChatGPT的活跃用户已经超过1亿人,火爆全球。今年3月份,OpenAI正式发布了其最新一代大型语言模型GPT-4。5月18日,CNMO注意到,加拿大科学家在近日出版的《放射学》杂志上刊登新论文称,最新版本的ChatGPT通过了美国放射学委员会的考试。

逢考必过?新版ChatGPT通过美放射学委员会考试

ChatGPT

据了解,为评估ChatGPT在美国放射学委员会考试问题上的表现并探索其优势和局限性,多伦多大学研究人员首先测试了基于GPT-3.5的ChatGPT的表现。具体来看,研究团队使用了150道选择题,这些选择题与加拿大皇家学院和美国放射学委员会考试的风格、内容和难度相当。

对此,研究人员发现,基于GPT-3.5的ChatGPT的正确率为69%,接近70%的及格线。该模型在低阶思维问题上表现相对较好,正确率为84%,但回答高级思维问题时的正确率仅为60%。

与此同时,性能更优异的GPT-4的正确率为81%,并且在高阶思维问题上的正确率为81%。不过需要注意的是,GPT-4在低阶思维问题上的正确率仅为80%,答错了12道题,而GPT-3.5全部答对了这些题目,这引发了研究团队对GPT-4收集信息的可靠性的担忧。返回搜狐,查看更多

责任编辑:

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2023-05-18 14:45:03

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

...志上刊登新论文称,最新版本的ChatGPT通过了美国放射学委员会的考试,突出了大型语言模型的潜力,但它也给出了一些错误答案,表明人们仍需对其提供的答案进行核查。为评估Chat
2023-05-29 05:46:00
研究显示chatgpt在会计考试中的表现远不及人类
...学运算能力。在问题类型上,ChatGPT比较擅长判断题(68.7%正确率)和选择题(59.5%正确率),但是在简答题上就很吃力(正确率在28
2023-04-25 19:40:00
GPT-4V医学执照考试成绩超过大部分医学生,AI加入临床还有多远?
...工智能之间的信任,让 AI 通过一个医生必须通过的资格考试或许是一个有效的方法。医学执照考试是用来评估医生专业知识和技能的标准化考试,是衡量一个医生是否有能力安全有效地护理患
2023-11-21 13:59:00
上赛季CBA联赛判罚正确率超九成 姚明:希望大家对裁判工作多提意见
...徐济成(左)、中国篮协主席姚明(中)、中国篮协裁判委员会副主任陆永明(右)出席媒体日活动。 图片来源:中国篮协人民网北京12月20日电 (记者杨磊)12月19日下午,中国篮协
2023-12-20 09:42:00
史上ai最高分,谷歌大模型创美国医师执照试题新纪录
...评估。结果显示,在科学常识方面,Med-PaLM和人类医生的正确率都达到了92%以上,而Flan-PaLM对应的数字为61
2022-12-28 16:09:00
OpenAI GPT-4 AI 模型无需额外训练可通过日本理疗师考试
...格的问题时显得有些吃力。该模型在常规问题上的表现(正确率为 80.1%)远远好于实际问题(正确率为 46.6%)。 同样
2024-09-02 09:54:00
五莲县人民医院特色科室丨影像科:设备先进技术一流
...业道德模范及先进工作者称号。现任日照市放射学专业学委员会委员,日照市中西医结合学会影像专业委员会委员。
2023-12-26 22:04:00
...分块学习的孩子课后做对了100%的练习,但第二天他们的正确率下降到了38%。交织学习的孩子在即时评估中做对了81%的题目,但第二天的正确率仍为78%。5.避免边学习边听音乐工
2024-05-24 15:40:00
anthropic发布全新claude2大语言模型
...进:其在美国律师资格考试的多选题部分可以取得76.5%的正确率,前代Claude1.3为70%;在GRE阅读和写作测试中
2023-07-12 18:35:00
更多关于科技的资讯: