首页 » 新闻百科 » 苹果研究团队曾测试20款先进AI模型 在有干扰项下简单算术题表现甚至不如小学生

苹果研究团队曾测试20款先进AI模型 在有干扰项下简单算术题表现甚至不如小学生

qqweige 2024-11-03 17 0

扫一扫用手机浏览

文章目录 [+]

  IT之家 11 月 2 日消息,《洛杉矶时报》昨日(11 月 1 日)发布博文,报道称苹果研究团队测试了 20 个最先进的 AI 模型,发现在有干扰项存在的情况下,它们处理简单的算术问题时表现不佳,甚至不如小学生。

苹果研究团队曾测试20款先进AI模型 在有干扰项下简单算术题表现甚至不如小学生-第1张图片
图片来源于网络,如有侵权,请联系删除

  苹果公司用以下这道简单的算术题测试 20 多个最先进的 AI 模型,IT之家附上题目如下:

苹果研究团队曾测试20款先进AI模型 在有干扰项下简单算术题表现甚至不如小学生-第2张图片
图片来源于网络,如有侵权,请联系删除

  Oliver 在星期五采摘了 44 个猕猴桃、然后他在星期六采摘了 58 个猕猴桃,星期日采摘的数量是星期五的两倍,不过其中有 5 个猕猴桃的块头要比平均值要小,请问 Oliver 这三天共摘了多少个猕猴桃?

  正确答案是 190 个,计算公式为 44(星期五)+58(星期六)+88(44*2,星期日)。

  不过测试的 20 多个最先进 AI 模型无法排除干扰项,通常不理解猕猴桃的大小和数量无关,大部分的结果是 185 个。

  苹果团队发现,当问题包含看似相关但实际上无关的信息时,AI 模型的表现急剧下降。对此研究认为,AI 模型主要依赖于训练数据中的语言模式,而非真正理解数学概念。

  苹果的研究表明,近来 的 AI 模型“无法进行真正的逻辑推理”。这一发现提醒我们,尽管 AI 在某些任务上表现出色,但其智能并不如表面看起来那样可靠。

  苹果团队指出,简单地扩展数据或计算能力并不能根本解决这个问题,苹果的论文并非旨在削弱对 AI 能力的热情,而是提供一种理性的认知。

相关文章

疫情就业,疫情就业歧视案例有哪些

疫情期间就业难怎么办 准备考研,继续提高学历。对于2020应届毕业生没有参加考研的同学而言,如果没有找到工作,不妨去参加考研,继续...

新闻百科 2024-11-15 0 0

不卖就禁倒计时 TikTok迎转机?

来源:北京商报 特朗普当选新一任美国总统之后,TikTok的命运再次引发关注。因为特朗普在竞选时曾多次表态,如果自己当上总...

新闻百科 2024-11-15 2 0

早盘:美股转跌 纳指小幅下跌50点

北京时间14日晚,美股周四早盘小幅下滑。美国上周初请失业救济人数降至5月以来新低,10月PPI环比上升0.2%符合预期。美联...

新闻百科 2024-11-14 2 0

疫情发布会,疫情发布会口罩戴反了

11月17日呼和浩特召开新冠肺炎疫情新闻发布会(附详情 月17日,呼和浩特市举行新冠肺炎疫情防控工作新闻发布会,通报我市疫情防控...

新闻百科 2024-11-14 4 0

食疫情,疫情期间堂食

疫情阶段饮食该怎么吃? 针对新型冠状病毒患者: 饮食调节:根据医生建议,患者可采用低脂、低盐、高纤维、易消化的饮食,例如吃稀饭、汤...

新闻百科 2024-11-14 3 0

深陷亏损的极氪,砸54亿元控股领克

炒股就看金麒麟分析师研报,权威,专业,及时,全面,助您挖掘潜力主题机会! 11月14日,极氪发布三季报,今年第三季度,极氪...

新闻百科 2024-11-14 4 0

疫情狙击战,疫情阻击战狙击战意思

抗击疫情逆行者的正能量句子 武汉加油!湖北加油!中国加油!致敬最勇敢的白衣战士!致敬最美的逆行者!致敬白衣“逆行者”,戮力同心,携...

新闻百科 2024-11-14 3 0

绿地,突发!这家A股公司打算清仓!

炒股就看金麒麟分析师研报,权威,专业,及时,全面,助您挖掘潜力主题机会! 业绩连年下行后,今年前三季度,天宸股份(6006...

新闻百科 2024-11-14 3 0

发表评论