我们每个人都有自己的潜力和兴趣,有自己独特的人生轨迹。有人高考考的很好,不仅仅是靠自己,还有家庭的支持,学校的培养,社会的机会。有人高考考的不好,也不是自己的问题,可能是家庭的原因,学校的原因,甚至社会的原因。
高考分数最高的人,往往在学业上有着出色的表现,展现出卓越的学*能力和才华。但是,高分并不代表一切,成功与否,更多的是后续的努力和机遇的结合。
河南省的何碧玉,14岁时以750分满分考入清华大学,后来留学美国,获得博士学位,但是并没有履行当初的承诺,回国工作。
王瑞鹏,是历史上高考分数最高的人,总分749分,裸分729分,竞赛分20分,2004年山东省理科状元。但是,他后来也并没有在学术上有太大的成就,只是做了一些与专业无关的工作。
首个AI高考全卷评测结果发布:最高分303,数学全不及格
高考覆盖各类学科及题型,同时因其开考前的“绝密性”,被视作中国最具权威的考试之一。这一面向人类设计的高难度综合性测试,目前普遍被研究者用于考察大模型的智能水平。
在前不久高考结束后,上海人工智能实验室旗下司南评测体系OpenCompass选取了7个大模型进行高考“语数外”全卷能力测试。6月19日, OpenCompass发布了首个大模型高考全卷评测结果。
语数外三科加起来的满分为420分,此次高考测试结果显示,阿里通义千问2-72B排名第一,为303分,OpenAI的GPT-4o排名第二,得分296分,上海人工智能实验室的书生·浦语2.0排名第三,三个大模型的得分率均超过70%。来自法国大模型初创公司的Mistral排名末尾。
此次测试的模型分别来自阿里巴巴、零一万物、智谱AI、上海人工智能实验室、法国Mistral的开源模型,以及来自OpenAI的闭源模型GPT-4o。实验室表示,因无法确定闭源模型的更新时间,为公平起见,此次评测没有纳入商用闭源模型,仅引入GPT-4o作为评测参考。这次选择参与高考的“考生”均在高考前(2024年4月-6月)开源,避免了“刷题风险”。
从结果来看,大模型的语文、英语考试水平普遍不错,但数学都不及格,最高分也只有75分,来自书生·浦语2.0,其次是GPT-4o,得分73分。语文最高分是通义千问,英语最高分是GPT-4o。
在数学方面大模型还有很大的提升空间。数学关乎复杂推理相关能力,这是大模型普遍面临的难题,也是大模型在金融、工业等要求可靠的场景落地需要的关键能力。
上海人工智能实验室领军科学家林达华此前在采访中对第一财经介绍,复杂推理关系到落地应用时大模型的可靠性,例如在金融这样的场景下不能在数字上有差错,会对数学上的可靠性有较高的要求。另外随着大模型进入商用,若要分析一家公司的财报,甚至是工业领域要去分析一些技术文档,这时数学方面的计算能力就会成为一个壁垒。
“现在很多大模型的应用场景是客服、聊天等等,在聊天场景一本正经胡说八道影响不太大,但它很难在非常严肃的商业场合去落地。”林达华此前表示。
对于此次测试细节,上海人工智能实验室介绍,评测采用全国新课标I卷,“语数外”三科全卷测试,包括客观题与主观题。成绩由具备高考评卷经验的老师匿名人工判分,阅卷开始前,阅卷教师未被告知答卷均由模型生成,使阅卷教师完全以面对真实考生的标准评判回答效果。
值得注意的是,大模型犯错误的方式和人类考生有差异,从实践上来看阅卷老师们不完全适应给大模型评分,因此存在有题目误判的可能。实验室表示,每个题目都邀请了至少三位老师评阅取均分,团队对分差较大的题目还进行了再次审核,贴近高考真实阅卷标准。
实验室表示,在打分前,老师们并未被告知答案由大模型生成,但由于有的模型会存在完全不理解题意导致乱答、重复生成、回答更像解析而非解答的问题,老师们在阅卷过程中基本都会和团队确认这些情况是否是正常情况,团队会要求老师将离谱的错误直接视为答题错误,解析类型的回答以是否包含正确解题过程作为唯一准则。
在完成所有大模型答卷的评卷工作后,阅卷教师被告知所评“考生”的为大模型。研究人员同时邀请各科教师对大模型表现进行了整体分析,为模型能力提升策略提供参考。
语文方面,老师们认为,模型的现代文阅读理解能力普遍较强,但是不同模型的文言文阅读理解能力差距较大。大模型作文更像问答题,虽然有针对性但缺乏修饰,几乎不存在人类考生都会使用举例论证、引用论证、名人名言和人物素材等手法 。多数模型无法理解“本体”“喻体”“暗喻”等语文概念。语言中的一些“潜台词”,大模型尚无法完全理解。
在数学试卷上,老师们发现,大模型的主观题回答相对凌乱,且过程具有迷惑性,甚至出现过程错误但得到正确答案的情况。大模型的公式记忆能力较强,但是无法在解题过程中灵活引用。
英语则整体表现良好,但部分模型由于不适应题型,在七选五、完形填空等题型得分率较低。大模型英语作文普遍存在因超出字数限制而扣分的情况,而人类考生多因为字数不够扣分。
用户评论
哇,想到考出高考最高分的人,感觉太厉害了!
有10位网友表示赞同!
不知道这次高考的最高分是多高,一直很好奇啊。
有19位网友表示赞同!
看到高考最高分就想起自己当年考试的经历,想想压力好大。
有19位网友表示赞同!
每年高考总会有个最高 scorer,佩服他们的学*能力和毅力。
有12位网友表示赞同!
我一直觉得高考最高分是个神话一样的东西,实现起来不容易啊。
有8位网友表示赞同!
高分肯定对未来有很大帮助,能去更好的学校学*。
有5位网友表示赞同!
我想知道高考最高分的得主后来怎么样了,都做了什么工作呢?
有12位网友表示赞同!
希望能看到今年有一个学生也能考出最高分,真是太厉害了!
有14位网友表示赞同!
高考是人生的一次重要考验,希望每一位考生都能取得好成绩。
有19位网友表示赞同!
以前总想问最高的总分的多少,现在终于可以知道啦!
有12位网友表示赞同!
想知道今年哪个考生的成绩最棒?期待公布答案。
有9位网友表示赞同!
高考难度也越来越高了,能考到最高分确实很不容易啊。
有5位网友表示赞同!
最高分代表着付出和努力的成果,非常值得尊敬。
有14位网友表示赞同!
学*成绩好并不意味就能获得人生的成功,还要注意其他方面的发展。
有17位网友表示赞同!
高考只是人生的一个阶段,以后还有更多的机会和挑战等待着我们。
有16位网友表示赞同!
对于那些想要考出最高分的学生,一定要努力练*,不要放弃希望。
有12位网友表示赞同!
高考史上最高分是多少?这真的让人好奇啊!
有18位网友表示赞同!
其实不光看分数,更要注重学*的兴趣和热情。
有12位网友表示赞同!
每个人的能力不同,都应该找到适合自己的发展方向。
有6位网友表示赞同!
学*是为了积累知识和技能,而不是为了追求成绩排名。
有20位网友表示赞同!