.hd-box .hd-fr

七家主流大模型挑战 2025 高考数学:仅 DeepSeek、讯飞星火得分超 140

2025-06-08 17:31IT之家(汐元)2评

2025 年高考还在进行中,昨天已经考完了语文和数学,相信大家也在网上看到了很多关于这两门学科试卷难度的讨论,比如昨天数学考完后,关于“数学难不难”的话题瞬间爆上了热搜。

当然,试卷的难度对于不同的同学来说可能会有不同的感受,不过作为科技编辑,小编比较感兴趣的是,今年的数学试卷对于目前很火的 AI 来说难不难呢?

想到这,今天我们不妨就这次高考的数学卷来一次大模型之间的比拼,让各家的大模型化身“高考学子”,完整地做一套高考数学卷,看看它们各自能拿多少分。

在模拟过程中,小编选择了以下几名具有代表性的大模型“考生”,分别是:

另外需要说明的是,由于目前网络流出的试题存在多个版本(回忆题),不完全一致,存在题目不完整的情况,IT之家通过多版本交叉验证 + 老师解题验证的方式进行评测,总分是 150 分。

同时IT之家还邀请了一位专业的评分老师来辅助我们对大模型的答案进行评分:

汪鹏:十年高中数学一线教研专家,主导省级数学教学创新课题,精研命题策略与高分突破路径。

此外,因 DeepSeek 网页版 OCR 转写不稳定,还有腾讯混元在高考时间段不能用拍图识别的功能,针对类似情况,我们采用 OCR 转写后输入答题。

由于考题较多,我们无法把所有题目的大模型答题流程和答案都一一呈现,所以这里我们仅挑选一些题目来说明。

话不多说,我们先来看题吧。

1、第 1 题

首先是比较简单的选择题第 1 题:

这道题比较容易,DeepSeek R1 的回答如下:

然后是通义千问:

讯飞星火作答:

豆包也给出了正确答案:

文心一言的答案如下:

腾讯混元的回答:

GPT o3 的答案:

对于选择题第 1 题,各家大模型都给出了正确的答案,仔细看具体的解题流程可能不同,但不影响答案的正确性。

2、第 5 题

下面稍微上点难度,选择题第 5 题是一道函数题:

各家大模型的答案和截图过程如下:

DeepSeek :

通义千问:

讯飞星火:

豆包:

文心一言:

腾讯混元:

GPT o3:

这一道选择题的正确答案是 A,全部答对。

3、第 8 题

广告声明:文内含有的对外跳转链接(包括不限于超链接、二维码、口令等形式),用于传递更多信息,节省甄选时间,结果仅供参考,IT之家所有文章均包含本声明。

下载IT之家APP,分享赚金币换豪礼
相关文章
大家都在买广告
热门评论
查看更多评论