Warning: Array to string conversion in /www/wwwroot/wordpress/wp-content/themes/onenav/inc/wp-optimization.php on line 108
讯飞星火认知大模型和chatgpt 五大模型解高考数学：阿里通义千问、360智脑10题全错得0分；讯飞星火答对一半 | AI8864.COM AI全导航

讯飞星火认知大模型和chatgpt 五大模型解高考数学：阿里通义千问、360智脑10题全错得0分；讯飞星火答对一半

AI资讯3年前 (2023)发布 fengdao

169 0 0

出品 | 搜狐科技、搜狐教育

一年一度高考季，高考试题是大众关注的焦点，也成为了AI能力的试金石。AI大模型数学功底到底如何？比人类“聪明”吗？搜狐科技使用五款AI大模型对2023高考上海数学试卷进行了同题测试。

在测试中，搜狐科技选取了高考试卷前10道填空题，让百度文心一言、阿里通义千问、科大讯飞星火认知大模型、360智脑、进行回答。

测试结果显示，这五款大模型在答数学题的能力上差异显著。

最“聪明”的讯飞星火答对了5题，正确率50％。百度文心一言和“紧跟其后”，答对了4题，正确率为40％。

360智脑和通义千问则“全军覆没”，一道题也没答对，交了白卷。

值得一提的是，昨天搜狐科技也用五款大语言模型产品，对高考作文全国卷（甲）进行了测试，并邀请了5位语文名师打分。

讯飞星火认知大模型和chatgpt_讯飞星火认知大模型和chatgpt_讯飞星火认知大模型和chatgpt

打分结果显示，高考作文得分最高，文心一言、讯飞星火得分稍低，但跟处于同一水平。360智脑和通义千问得分最低。

虽然语文作文题和数学计算题，对大模型能力考察的维度并不尽相同。但巧合的是，不擅长写作文的360智脑和通义千问，似乎也不擅长做数学题。

通过这两次高考题测试，也能从侧面反应出各家大模型的能力确实是“参差不齐”。如果、文心一言、讯飞星火是“学霸”，那么360智脑和通义千问则是妥妥的“学渣”。

附测试中使用的高考数学题题目：

1.不等式|x-2|

2.a=(2,3)，b=(-1,2)，则a·b=__

讯飞星火认知大模型和chatgpt_讯飞星火认知大模型和chatgpt_讯飞星火认知大模型和chatgpt

3.首项为3，公比为2的等比数列的前六项和S6=__

4.tanA=3，tan2A=__

5.f(x)={2^xx>0;1，x≤0}的值域为__

6.复数z=1-i，则|1+iz|=__

7.圆的方程x^2+y^2-4y-m=0的面积为π，则m=__

8.三角形的三边长为a=4，b=5，c=6，则sinA=__

9.某地一年四个季度的GDP(亿元)，第一季度GDP为232，第四季度GDP为241，且四个季度的GDP逐季度增长，中位数、平均数相等。则该地一年的GDP为__

10.(1+2023x)^100+(2023-x)^100=a0+a1x+a2x^2+…+a100x^100。若ak

# AI资讯 # 数学 # 讯飞 # 阿里 # 高考 # 高考数学

© 版权声明

文章版权归作者所有，未经允许请勿转载。

相关文章

阿里版chatgpt相关股票阿里天猫精灵刷屏，三六零天价离婚，ChatGPT暂停服务，释放什么信号？

fengdao

157 0

chatgpt进行产品结构设计科大讯飞刘聪：“直道冲锋”挑战ChatGPT，技术力和产品力的系统工程

fengdao

180 0

chatgpt主要是什么编程语言带你简单了解Chatgpt背后的秘密：大语言模型所需要条件（数据算法算力）以及其

fengdao

157 0

国内互联网巨头chatgpt ChatGPT爆火，国内巨头坐不住了！

fengdao

176 0

ai里的形状生成工具怎么用数学表达式一键变图，CMU开发实用工具Penrose，堪称图解界LaTeX

fengdao

152 0

阿里回应研发类chatgpt机器人自主研发机器人　小伙逐梦智能科技

fengdao

199 0

暂无评论

暂无评论...