如何看待機器之心重測高考數學全卷,Gemini奪冠,豆包DeepSeek并列第二?
作者: 發布日期:2025-06-26 02:55:10
當務之急最該解決的問題是大眾對于 AI大模型的正確認知以及最基本的AI用法。
你看這是前兩天的測試結果,突出了一個政治正確,6款大模型,OpenAI的o3倒數第一,我當時看到的時候就覺得很奇怪,o3好歹也是曾經的一代王者,高考數學這種題它排名這么低怕不是有什么貓膩。
我們就拿單選題的第五題來測試下,因為這道題除了o3,其他的國產模型都答對了。
這是第五題的原題,正確答案是A. - 1/2。
這是之前的第三方的測試結果,6個模型…。









