您的当前位置:首页>科技咨询>资讯详情

苹果AI研究:“猕猴桃”简单算术考倒o1和Llama等20多个最先进模型

发表于:2024-11-02 19:00:02 浏览:91次 发布者: 砍柴网

11 月 2 日消息,《洛杉矶时报》昨日(11 月 1 日)发布博文,报道称苹果研究团队测试了 20 个最先进的 AI 模型,发现在有干扰项存在的情况下,它们处理简单的算术问题时表现不佳,甚至不如小学生。

苹果公司用以下这道简单的算术题测试 20 多个最先进的 AI 模型,IT之家附上题目如下:

Oliver 在星期五采摘了 44 个猕猴桃、然后他在星期六采摘了 58 个猕猴桃,星期日采摘的数量是星期五的两倍,不过其中有 5 个猕猴桃的块头要比平均值要小,请问 Oliver 这三天共摘了多少个猕猴桃?

正确答案是 190 个,计算公式为 44(星期五)+58(星期六)+88(44*2,星期日)。

不过测试的 20 多个最先进 AI 模型无法排除干扰项,通常不理解猕猴桃的大小和数量无关,大部分的结果是 185 个。

苹果团队发现,当问题包含看似相关但实际上无关的信息时,AI 模型的表现急剧下降。对此研究认为,AI 模型主要依赖于训练数据中的语言模式,而非真正理解数学概念。

苹果的研究表明,目前的 AI 模型“无法进行真正的逻辑推理”。这一发现提醒我们,尽管 AI 在某些任务上表现出色,但其智能并不如表面看起来那样可靠。

苹果团队指出,简单地扩展数据或计算能力并不能根本解决这个问题,苹果的论文并非旨在削弱对 AI 能力的热情,而是提供一种理性的认知。

【来源:IT之家】

猜你喜欢

快手一季度毛利率同比微降,可灵AI营收超1.5亿
快手一季度毛利率同比微降,可灵AI营收超1.5亿
发表于:2025-05-28 浏览:33 发布者: 网易互联网
曹操出行更新招股书:2024年收入147亿元,同比
曹操出行更新招股书:2024年收入147亿元,同比
发表于:2025-04-30 浏览:38 发布者: 网易互联网
小红书相关人士回应,无授权不会读取用户信息
小红书相关人士回应,无授权不会读取用户信息
发表于:2025-03-27 浏览:34 发布者: 网易互联网
被指受特朗普威胁影响,引发虚假消息泛滥担忧,
被指受特朗普威胁影响,引发虚假消息泛滥担忧,
发表于:2025-01-09 浏览:53 发布者: 网易互联网
Rokid AR Lite 眼镜套装发布,3699 元
Rokid AR Lite 眼镜套装发布,3699 元
发表于:2025-05-14 浏览:31 发布者: 网易科技
快手侵权,被罚上亿!
快手侵权,被罚上亿!
发表于:2025-08-28 浏览:15 发布者: 网易互联网
极飞科技创始人兼CEO彭斌:低空经济最大的落地场景是农业,暂时不会做非农产品
极飞科技创始人兼CEO彭斌:低空经济最大的落地场景是农业,暂时不会做非农产品
发表于:2024-11-21 浏览:63 发布者: 每日经济新闻
电厂 | 美团想熄火,阿里不答应
电厂 | 美团想熄火,阿里不答应
发表于:2025-08-30 浏览:17 发布者: 网易互联网
闲鱼推出互动直播新频道“闲鱼夜市”
闲鱼推出互动直播新频道“闲鱼夜市”
发表于:2025-06-06 浏览:31 发布者: 网易互联网
AR商业化的“AI转身”
AR商业化的“AI转身”
发表于:2024-11-27 浏览:53 发布者: 网易科技