> 自媒体 > (AI)人工智能 > 斯坦福大学研究发现,AI聊天机器人ChatGPT的表现很不稳定
斯坦福大学研究发现,AI聊天机器人ChatGPT的表现很不稳定
来源:IT之家
2023-09-30 10:10:04
335
管理

IT之家 9 月 7 日消息,斯坦福大学的一项新研究发现,热门生成式人工智能(AI)聊天机器人 ChatGPT 的能力在几个月内有所波动。

斯坦福大学的团队评估了 ChatGPT 在几个月内如何处理不同的任务。他们发现,ChatGPT 的能力随时间的推移而出现了不一致。目前,ChatGPT 有两个版本 —— 免费的 GPT-3.5 模型和更智能、更快速的付费 GPT-4 版本。 研究人员发现,GPT-4 在 3 月份能够有效地解决数学问题,识别质数的准确率为 97.6%。三个月后,其准确率下降到了 2.4%。而另一方面,GPT-3.5 却变得更好,从 7.4% 的准确率提高到了 86.8%。

研究人员还注意到,在编写代码和视觉推理方面也有类似的波动。斯坦福大学计算机科学教授 James Zou 称:“当我们调整一个大型语言模型来提高它在某些任务上的表现时,那可能会有很多意想不到的后果,可能会损害这个模型在其他任务上的表现…… 这个模型回答问题的方式有各种各样的相互依赖性,这可能导致我们观察到的一些恶化行为。”

研究人员认为,结果并不能真正反映 ChatGPT 性能的准确性状态,而是显示了微调模型带来的意外后果。本质上,当修改模型的一部分来改善一个任务时,其他任务可能会受到影响。为什么会这样很难确定,因为没有人知道 ChatGPT 是如何运作的,而且它的代码也不是开源的。

随着时间的推移,研究人员注意到,ChatGPT 的回答不仅变得不太准确,而且还停止了解释其推理过程。

由于 ChatGPT 的运作方式,要研究和衡量它的表现可能很困难,这项研究强调了观察和评估驱动 ChatGPT 等工具的大型语言模型(LLM)性能变化的必要性。该研究已经在 arXiv 上发布,并正在等待同行评审,IT之家附链接在此。

0
点赞
赏礼
赏钱
0
收藏
免责声明:本文仅代表作者个人观点,与本站无关。其原创性以及文中陈述文字和内容未经本网证实,对本文以及其中全部或者 部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容。 凡本网注明 “来源:XXX(非本站)”的作品,均转载自其它媒体,转载目的在于传递更多信息,并不代表本网赞同其观点和对 其真实性负责。 如因作品内容、版权和其它问题需要同本网联系的,请在一周内进行,以便我们及时处理。 QQ:617470285 邮箱:617470285@qq.com
相关文章
有中国汽车品牌杀进巴西销量前十 奇瑞长城表现也亮眼..
【CNMO科技消息】提到巴西,可能很多人第一时间想到足球。不过,对于中国..
汽车江湖的“自杀式”价格战:出路何在?
在当今汽车市场的滚滚硝烟中,一场关于“内卷”与“价格战”的论战正以排..
让“发动机重生”,日本汽车三巨头推出新发动机
5月28日,斯巴鲁、丰田汽车和马自达联合宣布,为实现碳中和,三家公司将..
国内汽车市场价格“内卷”,背后的原因是“油电不同权”?..
2024年,汽车行业整体库存压力加大,新一轮“价格战”掀起,整个行业陷入..
个性跑车,你选16万多的手动野马?还是30万的捷豹F-type?..
No.1 2015款 福特Mustang 2.3T 美规上牌时间:2016年9月交付时间:2023年..
Mission X双座概念跑车全球首秀,保时捷:“如果量产,我们将让它成为纽北..
北京商报讯(记者 刘晓梦)6月8日,保时捷双座概念跑车“Mission X”迎来..
这回真有内味儿了!体验哪吒GT,年轻人的第一台平民电动跑车?..
或许有人会说,如此强劲性能的表现下,续航里程肯定不行了吧?事实却是,..
布加迪发布Chiron继任车型预告,新旗舰跑车即将亮相
来源:环球网 【环球网科技综合报道】6月5日,据外媒消息,布加迪近日官..
598.8万起/2025年下半年交付 法拉利12 Cilindri国内首发上市..
来源:搜狐汽车|搜狐新车2024年6月6日,法拉利全新旗舰GT跑车12Cilindri..
关于作者
帝王之星(普通会员)
文章
846
关注
0
粉丝
0
点击领取今天的签到奖励!
签到排行

成员 网址收录40386 企业收录2981 印章生成229507 电子证书1008 电子名片58 自媒体46096

@2022 All Rights Reserved 浙ICP备19035174号-7
0
0
分享
请选择要切换的马甲:

个人中心

每日签到

我的消息

内容搜索