跟着高考的驱散,寰宇各地的高三学子们终于可以卸下千里重的背负,粗情愫财假期。与往年不同的是,本年的高考战场上还有一支出类拔萃的队列引东谈主详实——国产东谈主工智能大模子。
在这场零星的高录取,包括搜狐科技、潇湘晨报、量子位等多家巨擘媒体对近10款国产东谈主工智能大模子进行了高考作文、数学、物理三个科方向评测,并公布了收获。咱们来一谈转头一下:
领先进行的是高考作文的评测。在搜狐科技的评测中,三位资深语文西宾当作巨擘大师为各大模子的作文打分。腾讯元宝和百度文心一言以越过50分的收获位居前哨,智谱清言、字节豆包与讯飞星火则并排第三。Kimi、阿里通义、百川、海螺名次相对靠后。
而在潇湘晨报的“AI写稿”评测中,讯飞星火不仅平平分位居首位,且获取了全场最高分56分。潇湘晨报邀请湖南着名作者、剪辑当作阅卷敦朴,对国内五大AI大模子产物——百度文心一言、讯飞星火、阿里通义千问、字节豆包、腾讯元宝的高考作文进行评分,历程四位阅卷敦朴的详细打分,讯飞星火以49分的平平分高居首位。
给讯飞星火打出“全场最高分”56分的阅卷敦朴示意:“本文不雅点了了,论说连合且层层激动, 定安定城密密服装有限公司许多句子齐省略有劲, 福州宜美电子有限公司颇有想想性。淌若是某个学生写的,首页-湖西艾有限公司无疑是艰辛的佳作。”另外,从网友的热点驳斥中也能看出讯飞星火摘得高分的原因。
网友@2024:嗅觉星火好点,更像作文,有些更像酬金问题。
网友@烟花绽开的节日:讯飞星火更有高考味。
接下来是数学科方向较量。在搜狐科技的数学评测中,讯飞星火、文心一言、豆包均以63%的正确率位列第一梯队,二极管智谱清言、阿里通义则以50%的正确率位居第二梯队,其他大模子相对落伍。
在量子位的高考数学评测中,诚然莫得给出详备收获单,但展示了各家大模子详备的解题想路,交由网友打分,通过网友的投票打分可以看出,讯飞星火的“识图+解数学题”才调收到了最高认同,位居自后的折柳是Kimi、通义千问、文心一言、豆包等。
临了是高考物理的测试。在量子位的评测中,阿里通义千问与讯飞星火以71.4%的准确率高居第一梯队,而Kimi、海螺和腾讯元宝则以42.9%的准确率位于第二梯队。百川百小应和万知答对一题位于第三梯队。
文心一言、豆包、天工、智谱清言、策动因为出现了不同进度读图失败的问题,在告成识别的题目中,策动和文心一言的正确率为2/4,即正确率为28.6%;豆包、天工、智谱清言正确率为1/2,即正确率为14.3%。
详细以上媒体在作文、数学、物理三门科方向收获,咱们得出了2024年东谈主工智能大模子高考“收获单”。来自科大讯飞的讯飞星火以52.49分高居第又名,通义千问、文心一言折柳位列第二、第三名,而Kimi、字节豆包、海螺AI等其他大模子也有可以的发达。
第又名:52.49 讯飞星火
第二名:46.08 通义千问
第三名:37.67 文心一言
第四名:34.68 Kimi
第五名:33.57 字节豆包
第六名:31.92 海螺AI
第七名:30.61 腾讯元宝
第八名:30.28 智谱清言
第九名:21.56 百川百小应
尽管评测神气可能不够严谨科学,但此次大模子高考无疑展示了国产东谈主工智能在多个学科的优秀发达和长足向上,尤其是讯飞星火的发达号称“文理兼修”!期待国产大模子再接再厉,在来岁的高录取取得愈加出色的收获!