IT之家 11 月 2 日消息,《洛杉矶时报》昨日(11 月 1 日)发布博文,报道称苹果研究团队测试了 20 个最先进的 AI 模型,发现在有干扰项存在的情况下,它们处理简单的算术问题时表现不佳,甚至不如小学生。
苹果公司用以下这道简单的算术题测试 20 多个最先进的 AI 模型,IT之家附上题目如下:
Oliver 在星期五采摘了 44 个猕猴桃、然后他在星期六采摘了 58 个猕猴桃,星期日采摘的数量是星期五的两倍,不过其中有 5 个猕猴桃的块头要比平均值要小,请问 Oliver 这三天共摘了多少个猕猴桃?
正确答案是 190 个,计算公式为 44(星期五)+58(星期六)+88(44*2,星期日)。
不过测试的 20 多个最先进 AI 模型无法排除干扰项,通常不理解猕猴桃的大小和数量无关,大部分的结果是 185 个。
苹果团队发现,当问题包含看似相关但实际上无关的信息时,AI 模型的表现急剧下降。对此研究认为,AI 模型主要依赖于训练数据中的语言模式,而非真正理解数学概念。
苹果的研究表明,目前的 AI 模型“无法进行真正的逻辑推理”。这一发现提醒我们,尽管 AI 在某些任务上表现出色,但其智能并不如表面看起来那样可靠。
苹果团队指出,简单地扩展数据或计算能力并不能根本解决这个问题,苹果的论文并非旨在削弱对 AI 能力的热情,而是提供一种理性的认知。
最新发现
相关资讯
苹果AI研究:“猕猴桃”简单算术考倒o1和Llama等20多个最先进模型
IT之家 11 月 2 日消息,《洛杉矶时报》昨日(11 月 1 日)发布博文,报道称苹果研究团队测试了 20 个最先进的 AI 模型,发现在有干扰项存在的情况下,它们处理简单的算术问题时表现不佳,甚至不如小学生。苹果公
2025-01-26 16:34:46
OpenAI首席执行官透露年内不会有GPT-5,公司目前专注于GPT-o1的运营
Chat GPT自诞生以来就受到大量关注,甚至被视为生成式AI的前沿模型之一。据Wccftech报道,近日,Chat GPT所属的OpenAI公司的首席执行官Sam Altman在接受采访时表示,OpenAI在年内不会发布Chat GPT-5,目前公司专
2025-01-26 16:14:39
今年才完成破产重整的豆神教育,搭上AI能否翻盘?
10月31日收盘,豆神教育(SZ300010,股价10 80元,市值223 2亿元)再次“20CM”涨停,已实现“四连板”。而到了11月4日收盘,公司股价报收于10 80元,全天下跌15 63%。这家今年才完成破产重整的教育企业,在北京智谱
2025-01-26 15:54:34
前OpenAI高管:AI将很快在计算机上完成人类能做的一切
IT之家 11 月 4 日消息,据《商业内幕(Business Insider)》当地时间 3 日报道,OpenAI 前政策研究与“agi (IT之家注:通用人工智能)准备工作”负责人 Miles Brundage 表示,未来几年行业可能会开发出“几乎能够
2025-01-26 15:34:30
“重生”之我是李清照?中南大学女教授的AI创作火了
在没有相机的年代,人们会聘请画师来捕捉并留下自己的肖像,宛如一幅幅生动的“照片”。近日,有人用AI绘画技术成功将北宋诗词博主——李清照的形象复原了。看到她的那一刻,仿佛经历了一场穿越时空的邂逅,令人恍若
2025-01-26 15:14:21
崂山区人工智能:飞奔的产业呼唤扎根的人才
人工智能产业加速集聚●青岛立足建设国家人工智能创新应用先导区,将人工智能列入全市重点布局的新兴产业之一●其中,崂山区将人工智能作为推动区域经济发展的核心引擎,打造了占地近3000亩的青岛市人工智能产业园
2025-01-26 14:54:17
今日热榜
马来西亚设立国家人工智能办公室
2024-12-19 16:44:28通用人工智能,是个啥智能?
2025-01-06 17:44:07首届中医人工智能高质量发展论坛开幕
2025-01-16 15:45:46谷歌发布新一代人工智能技术
2024-12-19 16:43:53聚焦人工智能、区块链、量子科技等9大前沿领域,2024年上海市产业青年创新大赛颁奖大会在静安举行
2024-12-19 17:08:14花6.5万元购“AI数字人”直播带货被禁播?买家能解约吗?法院
2024-12-19 21:30:55通用人工智能国赛为何连续两年落地安徽?
2024-12-19 23:31:31AI“魔改”短视频要严守二创边界
2024-12-20 01:31:46新华网评:AI技术不应用来造谣生事
2024-12-20 06:52:57首部《中国通用人工智能发展报告》蓝皮书发布
2024-12-20 13:34:15热门推荐