你有没有想过:一个人类能闭着眼睛读出现在是几点,但一个能赢数学奥赛金牌的AI,却经常搞不清楚指针在哪儿?
这不是段子,是斯坦福大学发布的《2026年AI指数报告》里真实记录的数字。
01
一件让科学家都挠头的事
报告测了当前全球最强的几个AI模型,让它们读时钟——那种有时针和分针的普通钟面。
结果,最好的AI模型读对指针位置的概率只有50%左右。
人类呢?咱们中国中学生的正确率肯定是100%吧。
这是什么概念?
做个对比:2025年,谷歌的Gemini Deep Think模型在国际数学奥林匹克竞赛中拿到了金牌级别的高分——35分(满分42分),4.5小时解完全部题目。你知道这有多难吗?每年能解出全部题目的只有几十人。
可是同一个“天才”,看个时钟却只能靠猜。
斯坦福的研究者给这种现象起了个名字: 锯齿前沿 。

意思是:AI的能力像锯子一样,突出来的齿很长,凹进去的槽也很深。它在某些地方特别厉害,在另一些地方却意外地笨。

02
机器人也一样:实验室里厉害,家里就歇菜
不只是读时钟。报告里还有一个更扎心的数据。
在实验室的仿真环境里,机器人操作任务的成功率达到了89.4%。看起来很牛吧?
但把这个机器人放进真实家庭环境里,让它叠衣服、洗碗,成功率立刻掉到了12.4%。
差了七倍。
03
为什么会这样?
简单说:AI很会做它被大量训练过的事,但在没练过的领域,它就像一个偏科严重的学生——有些课门门满分,有些课连及格都悬。
读时钟这件事,AI训练数据里这类图片太少了,而且时钟的指针角度变化是连续的,不像数字那样清晰,所以AI很难像人类一样凭直觉判断。
但数学奥赛不一样——历年真题、解题思路、逻辑推演,数据量巨大,而且题目有明确的验证标准,AI可以反复练习、不断改进。
04
这件事对你意味着什么?

下次有人跟你说“AI比人强多了”,你可以反问他:那它能告诉我现在是几点吗?哈哈
