IT之家 11 月 2 日消息,《洛杉矶时报》昨日(11 月 1 日)发布博文,报道称苹果研究团队测试了 20 个最先进的 AI 模型,发现在有干扰项存在的情况下,它们处理简单的算术问题时表现不佳,甚至不如小学生。
苹果公司用以下这道简单的算术题测试 20 多个最先进的 AI 模型,IT之家附上题目如下:
Oliver 在星期五采摘了 44 个猕猴桃、然后他在星期六采摘了 58 个猕猴桃,星期日采摘的数量是星期五的两倍,不过其中有 5 个猕猴桃的块头要比平均值要小,请问 Oliver 这三天共摘了多少个猕猴桃?
正确答案是 190 个,计算公式为 44(星期五)+58(星期六)+88(44*2,星期日)。
不过测试的 20 多个最先进 AI 模型无法排除干扰项,通常不理解猕猴桃的大小和数量无关,大部分的结果是 185 个。
苹果团队发现,当问题包含看似相关但实际上无关的信息时,AI 模型的表现急剧下降。对此研究认为,AI 模型主要依赖于训练数据中的语言模式,而非真正理解数学概念。
苹果的研究表明,目前的 AI 模型“无法进行真正的逻辑推理”。这一发现提醒我们,尽管 AI 在某些任务上表现出色,但其智能并不如表面看起来那样可靠。
苹果团队指出,简单地扩展数据或计算能力并不能根本解决这个问题,苹果的论文并非旨在削弱对 AI 能力的热情,而是提供一种理性的认知。
黄金市场的隐忧——价格泡沫的破裂信号近年来,黄金一直被视为避险资产,尤其是在全球经济不确定性增加的背景下,许多人将其作为保值增值的工具。随着全球经济复苏步伐加快以及各国央行货币政策逐渐收紧,黄金的“黄...
...
据路透社、美国福克斯新闻网1月3日报道,在美国当选总统特朗普表示美国拥有格陵兰岛“绝对必要”后,丹麦自治领地格陵兰岛自治政府总理穆特·埃格德在新年致辞中表示,“有必要”采取重大措施脱离丹麦实现独...
在民营眼科医疗机构的规模化之路上,越来越多后来者开始走上“老大哥”爱尔眼科的老路:并购扩张。 12月6日,辽宁何氏眼科医...
12月18日,永辉超市(601933.SH,股价6.87元,市值623.46亿元)公告,公司全资子公司重庆永辉于2024年12月3日至12月17日交易日期间...
专题:第十五届陆家嘴论坛(2024)...