2026年高考:12款顶级AI全面挑战语文与数学试卷表现揭秘
2026年高考如期而至,吸引了科技与教育界的广泛关注。今年,我们首次邀请了12款国内外顶级大模型AI,全面参与语文和数学两科高考试卷测试,意在探索其在传统学科知识理解与应用上的能力表现。
顶级AI阵容及考试设计
此次参赛的AI模型囊括了国内外主流旗舰产品。国外方面,有闻名遐迩的Claude Opus 4.8、GPT-5.5和Gemini 3.1 Pro,称得上是“三驾马车”。国内阵容则涵盖千问3.7 max、文心Ernie 5.1、星火Spark X2、智谱GLM5.1、Kimi k2.6、MiniMax M3、DeepSeek V4 Pro、小米MiMo v2.5 Pro及混元3等多款实力派模型,展现了当前中国AI产品的综合实力。
为了保证测评的严谨性,本次测试采用了全国一卷的语文和数学真题。语文试题由于完整版尚未完全公布,只能依赖官方发布的部分试题及参考答案,并根据得分转换成统一满分150分;数学试卷则为完整真题。
严格的阅卷流程确保评价公平
考虑到语文评分的主观性与复杂性,我们特邀了三位具备阅卷经验的高中语文教师参与主观题评分,最终取其平均分作为AI的语文成绩。此外,一位数学老师对数学试卷进行了细致批改,确保评分专业。各位老师全程认真审阅了10余份答卷,贡献了大量时间和精力,保障了本次测试的公正性。
AI语文能力引发关注
当前AI模型在自然语言处理、代码生成及Agent任务上表现突出,但在语文理解与表达方面仍存在挑战。因此,本次测试特别强调语文试卷的考查,旨在检验AI模型在文化素养和语言应用层面的综合能力。
后续关注与展望
本次12款顶级AI参与高考语文和数学考试,为传统教育评价体系带来新的视角,也反映了AI技术在教育领域的潜力。未来,随着模型持续优化及考试题库的完善,人工智能或将成为辅助教学与评估的重要工具。我们将持续关注后续成绩公布与技术突破带来的行业影响。
文章来源:https://finance.sina.com.cn/cj/2026-06-08/doc-iniasfpu5655196.shtml