> 自媒体 > (AI)人工智能 > GPT-4参数最新爆料!1.76万亿参数,8个2200亿MoE模型,深信不疑
GPT-4参数最新爆料!1.76万亿参数,8个2200亿MoE模型,深信不疑
来源:架构师聊AI
2023-07-20 11:21:29
751
管理

家人们,GPT-4的参数可能还真不止1万亿!近来,美国知名骇客George Hotz在接受采访时透露,GPT-4由8个220B模型组成。这么算来,8 x 220B = 1.76万亿。就连PyTorch的创建者Soumith Chintala对此也深信不疑。GPT-4:8 x 220B专家模型用不同的数据/任务分布和16-iter推理进行训练。如果真是这样的话,GPT-4的训练可能更加有效。而George在接受Latent Space的采访时,对GPT4架构的描述着实让人震惊。他的部分原话如下:

GPT-4每个head都有2200亿参数,是一个8路的混合模型。所以,混合模型是当你想不出办法的时候才会做的。OpenAI训练了相同模型8次,他们有一些小技巧。他们实际上进行了16次推断。

他特别强调,OpenAI做了8个混合专家模型,任何人可以花8倍资金都能训练出来。也就是说,人们能够训练更小模型更长时间,微调后,就能找到这些技巧。OpenAI曾经发表类似关于让计算量不变的情况下,让训练更好的算法,比较像BatchNorm和NoBatchNorm。网友得知秘诀后,打算自己也要训练一个LLaMA集合体与GPT-4竞争。还有网友称,这有点像LLM-Blender。我早就听到了稍微可信的传言,说GPT-4将是MoE,但从未得到证实。MoE和大约1万亿个参数不会让我感到惊讶,这听起来极为合理。还有网友进行深度分析:老实说,我预计这将是人工智能架构的下一阶段。我们已经看到特定任务模型在任务中的表现比一般模型好得多。因此,将许多特定任务模型组合在一起将是下一个合乎逻辑的步骤。这几乎使升级系统变得容易得多,一次只能处理一个模型。话虽如此,OpenAI以一种未来可能会,也可能不会的方式做到了这一点。显然,组合系统可能会有更多的小模型,而不是几个更大的模型。如果这是真的,这是否意味着每个220B模型也有32K的上下文长度?

1
点赞
赏礼
赏钱
0
收藏
免责声明:本文仅代表作者个人观点,与本站无关。其原创性以及文中陈述文字和内容未经本网证实,对本文以及其中全部或者 部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容。 凡本网注明 “来源:XXX(非本站)”的作品,均转载自其它媒体,转载目的在于传递更多信息,并不代表本网赞同其观点和对 其真实性负责。 如因作品内容、版权和其它问题需要同本网联系的,请在一周内进行,以便我们及时处理。 QQ:617470285 邮箱:617470285@qq.com
相关文章
适合普通老百姓家庭4款合资车!轿车 SUV 都有,有没有你喜欢的..
在如今的汽车市场中,车型琳琅满目,让人挑花了眼。但对于普通老百姓家庭..
10万左右就能买到三款优质合资车,配置丰富动力强,省油又省心..
在如今的汽车市场中,价格战愈演愈烈,特别是在过去18个月里,我们见证了..
不值得买的三款合资车!销量虽高,但配置低,小毛病也不少..
在汽车消费者市场中,合资车一直占据着重要的位置。然而,随着汽车行业的..
2个月少卖39万辆,吉利对比亚迪开战,合资车销量遭殃?..
虽然吉利并没有像奇瑞那样喊出,不客气了,但曾经燃油时代的中国品牌一哥..
合资车1-9月销量降幅TOP20:有车跌80%!有热销车腰斩
毫无疑问,合资品牌正在遭受前所未有的冲击,其中不少原本热销车也在短时..
20万左右最值得买的三款合资车,均配主动刹车,动力强油耗低..
在20万元的预算范围内,为何我倾向于选择合资车呢?主要原因可以归结为三..
中国人,还需要合资车吗?
「一家合资车企,准备打破过去惯性,开启一段新旅程。」简单翻译下,是这..
合资车被国产卷怕了,开始急了,看车企大佬的言论,格局高下立判..
车企大佬急了,这次是真急了,看一下前阵子重庆论坛,再看一下这段时间比..
国产车强势崛起,合资车的优势还在吗?喵哥给你讲句实在话..
去年的一年,我们整个国产车那是崛起非常快,尤其是在新能源领域,那是强..
关于作者
乖乖(普通会员)
文章
1081
关注
0
粉丝
0
点击领取今天的签到奖励!
签到排行

成员 网址收录40404 企业收录2983 印章生成239479 电子证书1065 电子名片60 自媒体60706

@2022 All Rights Reserved 浙ICP备19035174号-7
1
0
分享
请选择要切换的马甲:

个人中心

每日签到

我的消息

内容搜索