精选2天前0 投票
AI在这些智力测试中频频失误,你能比它们做得更好吗?
自人工智能诞生之初,谜题和游戏就一直是其发展的核心。正如人类喜欢用填字游戏或逻辑谜题来测试自己的智慧,开发者也可以通过一系列游戏挑战来检验模型的进步程度。
“机器学习”这一术语在1959年由IBM计算机科学家Arthur Samuel的一篇文章中普及,该文章描述了一种学会下棋的算法。国际象棋和中国围棋也是著名的AI测试平台。仅从解谜能力来看,AI正在快速进步。2024年底,哥伦比亚大学的科学家团队发现,即使是最先进的模型也只能解决臭名昭著的《纽约时报》Connections谜题的18%;到2025年初,一些模型几乎每次都能完美解决。
但谜题不仅仅凸显了AI能力的不断进步。观察模型在哪里成功、在哪里失败——以及我们人类在哪里仍然胜过它们——可以为我们提供一个了解这项技术优缺点的窗口。尽管取得了进展,今天的模型仍然会犯错:经典谜题的细微变化常常让它们出错,视觉谜题更是它们的软肋。
在这里,你将有机会测试自己的智慧,挑战那些曾让模型困惑的谜题。有些谜题对你来说可能和AI一样棘手;而另一些则简单到让你怀疑AI是否真的智能。每一个谜题都至少揭示了机器认知与人类认知的一种不同。如果你通过了测试,你就证明了你能在解谜上胜过AI——至少目前如此。