首页 » 新闻百科 » 苹果研究团队曾测试20款先进AI模型在有干扰项下简单算术题表现甚至不如小学生

苹果研究团队曾测试20款先进AI模型在有干扰项下简单算术题表现甚至不如小学生

qqweige 2024-11-03 27 0

扫一扫用手机浏览

文章目录 [+]

　　IT之家 11 月 2 日消息，《洛杉矶时报》昨日（11 月 1 日）发布博文，报道称苹果研究团队测试了 20 个最先进的 AI 模型，发现在有干扰项存在的情况下，它们处理简单的算术问题时表现不佳，甚至不如小学生。

苹果研究团队曾测试20款先进AI模型在有干扰项下简单算术题表现甚至不如小学生-第1张图片
图片来源于网络，如有侵权，请联系删除

　　苹果公司用以下这道简单的算术题测试 20 多个最先进的 AI 模型，IT之家附上题目如下：

苹果研究团队曾测试20款先进AI模型在有干扰项下简单算术题表现甚至不如小学生-第2张图片
图片来源于网络，如有侵权，请联系删除

　　Oliver 在星期五采摘了 44 个猕猴桃、然后他在星期六采摘了 58 个猕猴桃，星期日采摘的数量是星期五的两倍，不过其中有 5 个猕猴桃的块头要比平均值要小，请问 Oliver 这三天共摘了多少个猕猴桃？

　　正确答案是 190 个，计算公式为 44（星期五）+58（星期六）+88（44*2，星期日）。

　　不过测试的 20 多个最先进 AI 模型无法排除干扰项，通常不理解猕猴桃的大小和数量无关，大部分的结果是 185 个。

　　苹果团队发现，当问题包含看似相关但实际上无关的信息时，AI 模型的表现急剧下降。对此研究认为，AI 模型主要依赖于训练数据中的语言模式，而非真正理解数学概念。

　　苹果的研究表明，近来的 AI 模型“无法进行真正的逻辑推理”。这一发现提醒我们，尽管 AI 在某些任务上表现出色，但其智能并不如表面看起来那样可靠。

　　苹果团队指出，简单地扩展数据或计算能力并不能根本解决这个问题，苹果的论文并非旨在削弱对 AI 能力的热情，而是提供一种理性的认知。

上一篇：朝鲜新冠疫情，朝鲜新冠疫情为什么为零

下一篇：传马斯克社媒平台X将吞并特朗普Truth Social

相关文章

灿谷盘中异动股价大跌5.07%报3.93美元

灿谷盘中异动股价大跌5.07%报3.93美元

北京时间2024年11月22日04时32分，灿谷（CANG.us）股票出现异动，股价快速下挫5.07%。截至发稿，该股报3.93美...

新闻百科 2024-11-22 0 0

企业疫情防控，企业疫情防控具体措施

企业疫情防控，企业疫情防控具体措施

公司疫情防控应急方案模板公司疫情防控应急策划方案篇 1 为做好新冠疫情防控工作，落实全市网吧、娱乐场所、电影院等文化娱乐演出场所...

新闻百科 2024-11-22 1 0

邀疫情，邀疫情对食品行业和岗位的影响

邀疫情，邀疫情对食品行业和岗位的影响

朋友发来邀请函,疫情去不了怎么回复〖壹〗、委婉的回复。朋友发来邀请函，疫情去不了可以回复自己的高兴收到这次邀请，自己不能去了，因...

新闻百科 2024-11-22 1 0

美国OTC市场迪克希盘中异动快速拉升5.89%报0.700美元

美国OTC市场迪克希盘中异动快速拉升5.89%报0.700美元

北京时间2024年11月22日02时23分，美国OTC市场迪克希（DXYN.us）股票出现异动，股价快速上涨5.89%。截至发稿，...

新闻百科 2024-11-22 1 0

卡寇工业涨5.17% 股价突破500美元大关

卡寇工业涨5.17% 股价突破500美元大关

北京时间2024年11月22日04时32分，卡寇工业（CVCO.us）股票出现异动，股价急速拉升5.17%。截至发稿，该股报500...

新闻百科 2024-11-22 1 0

美第奇新星生物技术盘中异动下午盘股价大涨5.13%报2.05美元

美第奇新星生物技术盘中异动下午盘股价大涨5.13%报2.05美元

北京时间2024年11月22日02时14分，美第奇新星生物技术（MNOV.us）股票出现波动，股价大幅上涨5.13%。截至发稿，该...

新闻百科 2024-11-22 1 0

西安疫情最新进展，西安疫情最新通告

西安疫情最新进展，西安疫情最新通告

西安疫情最新消息:现在是什么风险地区据了解，近来西安有确诊病例出现的地方已经调整风险等级，当地有1个高风险地区和13个中风险地区...

新闻百科 2024-11-22 1 0

蒜疫情，疫情吃蒜管用吗

疫情对大蒜的影响大吗疫情过后大蒜会涨价吗〖壹〗、疫情对全球多个行业产生了深远影响，大蒜市场也不例外。由于2019年大蒜入库量高于...

新闻百科 2024-11-22 0 0

泽连斯基：乌克兰将通过外交途径收回克里米亚

泽连斯基：乌克兰将通过外交途径收回克里米亚

转自：财联社财联社11月22日讯（编辑夏军雄）乌克兰总统泽连斯基表示，乌克兰不能在法律上承认任何被占领的领土属于俄罗斯...

新闻百科 2024-11-22 2 0

拼多多电话会：增长放缓是必然的，相对于同行的劣势将会在一段时间内显著存在

拼多多电话会：增长放缓是必然的，相对于同行的劣势将会在一段时间内显著存在

来源：华尔街见闻拼多多联席CEO赵佳臻表示，受限于平台的运营模式和团队的历史经验局限和能力不足，预计公司相对于同行的劣势...

新闻百科 2024-11-22 1 0

A股协议转让现“小高峰” 大股东减持另辟蹊径？

A股协议转让现“小高峰” 大股东减持另辟蹊径？

A股震荡格局下，上市公司主要股东通过协议转让方式“减持股份”的案例开始增加。而在这类协议转让中，主要投向二级市场的私募证券基金...

新闻百科 2024-11-22 2 0

马斯克为什么支持取消电动汽车税收补贴？原因有二

马斯克为什么支持取消电动汽车税收补贴？原因有二

据报道，特斯拉CEO埃隆-马斯克支持当选总统特朗普取消联邦电动汽车税收补贴的计划。一些专家认为，该计划使他的电动汽车公司从中...

新闻百科 2024-11-22 2 0

2024年世界互联网大会乌镇峰会金融科技论坛举行

2024年世界互联网大会乌镇峰会金融科技论坛举行

专题：2024世界互联网大会乌镇峰会金融科技论坛：数智时代的金融科技来源：光明网 11月21日，2024年世界互联网大会...

新闻百科 2024-11-22 2 0

匈牙利外长：限制和制裁并不能使欧盟获益

匈牙利外长：限制和制裁并不能使欧盟获益

当地时间11月21日，匈牙利外长西雅尔多表示，加征关税、限制和制裁并不能使欧盟获益，反而会成为经济发展的严重障碍，使欧盟和匈...

新闻百科 2024-11-22 2 0

乌镇峰会热议金融科技，OceanBase杨冰：为金融行业提供数智化数据底座

乌镇峰会热议金融科技，OceanBase杨冰：为金融行业提供数智化数据底座

专题：2024世界互联网大会乌镇峰会金融科技论坛：数智时代的金融科技来源：凤凰网财经 11月21日，国产数据库Ocean...

新闻百科 2024-11-22 0 0

成都肺炎疫情，成都肺炎最新情况

成都肺炎疫情，成都肺炎最新情况

成都自9月1日18时起全体居民原则居家,还有哪些防疫信息值得关注_百度... 成都自9月1日18时起全体居民原则居家，还有哪些防疫...

新闻百科 2024-11-22 1 0

欧元区11月消费者信心指数报-13.7 预期为-12.4

欧元区11月消费者信心指数报-13.7 预期为-12.4

欧盟委员会发布的数据显示，欧元区11月消费者信心指数报-13.7，低于10月的-12.5。 22位经济学家的预测区间为-1...

新闻百科 2024-11-22 2 0

开盘：美股周四高开市场继续关注英伟达财报

开盘：美股周四高开市场继续关注英伟达财报

北京时间21日晚，美股周四高开。投资者仍在评估AI科技巨头英伟达的重要财报。比特币突破9.8万美元创历史新高，分析师看好其突...

新闻百科 2024-11-22 2 0

IMF：在看到特朗普经济政策计划细节前不会评估其影响

IMF：在看到特朗普经济政策计划细节前不会评估其影响

世界货币基金组织（IMF）发言人Julie Kozack周四表示，在看到美国当选总统特朗普的减税等政策的细节后对其进行评估，...

新闻百科 2024-11-22 2 0

瑞丽疫情最新消息多少例，瑞丽疫情最新消息多少例新冠

瑞丽疫情最新消息多少例，瑞丽疫情最新消息多少例新冠

宁阳县针对云南德宏州瑞丽新发疫情的紧急提醒〖壹〗、有效控制和降低疫情传播风险，宁阳县统筹疫情防控和经济运行工作领导小组办公室向广...

新闻百科 2024-11-22 3 0

发表评论