> 自媒体 > (AI)人工智能 > 不会数学了!GPT-4“智力”大幅下降
不会数学了!GPT-4“智力”大幅下降
来源:参考消息
2023-08-11 15:45:22
447
管理

参考消息网7月22日报道 据美国《财富》杂志网站7月20日报道,斯坦福大学的一项研究发现,广受关注的聊天机器人ChatGPT在6月份执行某些任务的表现比3月份的时候变得更糟了。

该研究对由开放人工智能研究中心(OpenAI)创造的这款聊天机器人数月时间内在执行4项“差异化”任务——解数学题、回答敏感问题、编写软件代码、视觉推理——的表现进行了比较。

研究人员发现这项技术执行某些任务的能力存在巨大波动——即“漂移”。该研究考察了OpenAI技术在这一时间段的两个版本:GPT-3.5和GPT-4。最值得注意的结果来自对GPT-4解答数学题能力的研究。在研究过程中,研究人员发现,在3月份时GPT-4能够在97.6%的答题时间里正确识别出数字17077为质数。但是仅仅3个月后,其答题的正确率却骤降至极低的2.4%。与此同时,GPT-3.5的表现轨迹则几乎相反,其在3月时回答同一问题的正确率仅为7.4%,而在6月时的回答大多是正确的,答题正确率达86.8%。

当研究人员要求这两个版本编写代码和接受视觉推理测试——即要求该技术预测某个图案中的下一个形象——时,出现了类似的差异化结果。

研究报告的作者之一、斯坦福大学计算机科学教授詹姆斯·邹(音)说,“如此巨大的差异程度”对于“尖端的ChatGPT”而言是意想不到的。

詹姆斯·邹说:“当我们在对大型语言模式进行调整,以改善其在某些任务中的表现时,这样做实际上可能会有许多意想不到的后果,它们或许会影响这个模型在处理其他任务时的表现。在人工智能模型如何回答问题方面,存在各式各样耐人寻味的相互依赖,它们可能在一定程度上导致我们所观察到的这些每况愈下的表现。”

0
点赞
赏礼
赏钱
0
收藏
免责声明:本文仅代表作者个人观点,与本站无关。其原创性以及文中陈述文字和内容未经本网证实,对本文以及其中全部或者 部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容。 凡本网注明 “来源:XXX(非本站)”的作品,均转载自其它媒体,转载目的在于传递更多信息,并不代表本网赞同其观点和对 其真实性负责。 如因作品内容、版权和其它问题需要同本网联系的,请在一周内进行,以便我们及时处理。 QQ:617470285 邮箱:617470285@qq.com
相关文章
微软Build 2023:用“Chat”解决问题,坚持“负责任的人工智能”..
作者:于佳卉ChatGPT于人工智能,如同蒸汽机之于工业革命的意义。由它引..
美女业务员出轨老板,两人聊天记录曝光,内容太露骨不堪入目..
《独特的职场风波》某日,一则“美女业务员出轨老板”的新闻席卷了整个城..
福昕高调接入ChatGPT,技术革命还是虚张声势?
随着人工智能技术的不断进步和发展,Chatbot技术的应用已经逐渐从娱乐和..
男子讲述被骗缅北经历:专找境外女性华人聊天,枪口下“报平安”..
日前,缅北电信网络诈骗窝点引发各方广泛关注。不少网友向长江云新闻记者..
ChatGPT别来沾边!好莱坞编剧拒绝“给AI打工”,集体罢工抗议..
克雷西 发自 凹非寺量子位 | 公众号 QbitAIChatGPT可能做梦也想不到,自..
智能人形机器人——ChatGPT论
ChatGPT论智能人形机器人一。ChatGPT论智能人形机器人一:智能人形机器人..
视频号为什么不再支持添加企业微信了?
近期,微信视频号官方称不再支持在主页和直播间配置“添加企业微信”功能..
明星刘维登不上微信上热搜!聊天记录终于有救了
7月30日晚,歌手刘维在微博发文向网友和腾讯微信团队求助,称登录不了母..
ChatGPT4.0的出现,代表人工智能时代的到来,我们准备好了吗?..
#头条创作挑战赛# 最近著名机构高盛出了一份研究报告,这个个报告认为,..
关于作者
司机(普通会员)
文章
669
关注
0
粉丝
0
点击领取今天的签到奖励!
签到排行

成员 网址收录40369 企业收录2981 印章生成216707 电子证书945 电子名片57 自媒体34015

@2022 All Rights Reserved 浙ICP备19035174号-7
0
0
分享
请选择要切换的马甲:

个人中心

每日签到

我的消息

内容搜索