IT之家 2024年11月02日
苹果 AI 研究:“猕猴桃”简单算术考倒 o1 和 Llama 等 20 多个最先进模型
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_guoji1.html

 

苹果研究团队测试20个先进AI模型处理算术问题,发现其在有干扰项时表现不佳,如计算Oliver三天采摘猕猴桃的数量,AI模型大多得出错误结果。研究认为AI模型依赖语言模式,非真正理解数学概念,此发现提醒AI智能并非完全可靠,且简单扩展数据或计算能力不能根本解决问题。

🍎苹果研究团队对20个最先进的AI模型进行测试,用一道包含干扰项的简单算术题考验它们,题目是计算Oliver三天采摘猕猴桃的总数。

🤖测试中,AI模型大多无法排除干扰项,得出错误结果。正确答案是190个,而AI模型的结果大多是185个,原因是它们未理解猕猴桃大小与数量无关。

🧐苹果团队发现,当问题含看似相关但无关信息时,AI模型表现急剧下降,表明其主要依赖训练数据中的语言模式,而非真正理解数学概念。

IT之家 11 月 2 日消息,《洛杉矶时报》昨日(11 月 1 日)发布博文,报道称苹果研究团队测试了 20 个最先进的 AI 模型,发现在有干扰项存在的情况下,它们处理简单的算术问题时表现不佳,甚至不如小学生。

苹果公司用以下这道简单的算术题测试 20 多个最先进的 AI 模型,IT之家附上题目如下:

Oliver 在星期五采摘了 44 个猕猴桃、然后他在星期六采摘了 58 个猕猴桃,星期日采摘的数量是星期五的两倍,不过其中有 5 个猕猴桃的块头要比平均值要小,请问 Oliver 这三天共摘了多少个猕猴桃?

正确答案是 190 个,计算公式为 44(星期五)+58(星期六)+88(44*2,星期日)。

不过测试的 20 多个最先进 AI 模型无法排除干扰项,通常不理解猕猴桃的大小和数量无关,大部分的结果是 185 个。

苹果团队发现,当问题包含看似相关但实际上无关的信息时,AI 模型的表现急剧下降。对此研究认为,AI 模型主要依赖于训练数据中的语言模式,而非真正理解数学概念。

苹果的研究表明,目前的 AI 模型“无法进行真正的逻辑推理”。这一发现提醒我们,尽管 AI 在某些任务上表现出色,但其智能并不如表面看起来那样可靠。

苹果团队指出,简单地扩展数据或计算能力并不能根本解决这个问题,苹果的论文并非旨在削弱对 AI 能力的热情,而是提供一种理性的认知。

Fish AI Reader

Fish AI Reader

AI辅助创作,多种专业模板,深度分析,高质量内容生成。从观点提取到深度思考,FishAI为您提供全方位的创作支持。新版本引入自定义参数,让您的创作更加个性化和精准。

FishAI

FishAI

鱼阅,AI 时代的下一个智能信息助手,助你摆脱信息焦虑

联系邮箱 441953276@qq.com

相关标签

苹果研究 AI模型 算术问题 逻辑推理
相关文章