GPT-3数学不及格，愁坏团队，于是他们出了12500道数学-脚本导航

> 自媒体 > （AI）人工智能 > GPT-3数学不及格，愁坏团队，于是他们出了12500道数学

GPT-3数学不及格，愁坏团队，于是他们出了12500道数学

来源：量子位

2023-04-11 13:07:51

688

管理

贾浩楠发自凹非寺量子位报道 | 公众号 QbitAI

GPT-3，是个严重偏科的“文科生”。

UC伯克利的研究人员，在对类似GPT-3的大型语言模型进行测试后发现，数学，就是这类AI的盲区。

12500道高中数学题，GPT-3的正确率最低不到3%，最高也没超过7%。

完全不合格啊~

此外，AI解数学题时对不同解题方法的选择组合，也是衡量算法能力的参考。

所以，即便GPT-3平时面对的多是文本任务，但让它去学数学，依然有助于人们弄明白超大模型处理数学推理任务的特点。

之前的研究已经证明，牢固掌握数学概念对AI很重要。

例如，OpenAI最近推出了GPT-f，这是Metamath形式化语言的自动证明器和证明助手。

GPT-f对一些数学问题做出的证明，已经被Metamath主库所接受，这是AI的数学论证第一次数学社区所采用。

Facebook方面也声称已经成功实验了数学AI算法。在去年1月的一篇博客文章中，该公司的研究人员表示，他们已经教会了一个模型将复杂的数学方程视为一种语言，然后将解题过程视为翻译问题。

而在对AI进行训练测试后，发现成绩依然不理想。

数据集中的分步解决方案，能让语言模型像人类数学家一样使用 “短期记忆”。

即模型不必马上得出正确答案，而是可以逐步探索解法一步步走向正确答案。

但即使有了解决方案，研究者发现，对于GPT-2和GPT-3来说，准确率仍然很低.

从上图结果中能看出，让模型在产生答案之前生成自己的解决方案，实际上降低了准确性。因为在许多错误案例中，尽管解题步骤与问题相关，但它们是不合逻辑的。

此外，简单地增加模型中的训练时间和参数数量，有时会提高性能。但事实证明，这样做的代价过于高，训练的时间和能耗都大大增加。

而在AMPS上进行预训练可将准确率提升约25%，这相当于将模型大小提高15倍。

所以，尽管恶补了12500道高中数学竞赛题，GPT-3还是不及格。

但研究人员认为，让AI学会分步解题仍然有进步意义。

与直接在问题和答案上进行训练相比，MATH上训练过的模型，可以提高10%的相对准确率。

最重要的，是模型“掌握”了一些基本数学知识。在一些错误的解法下，AI已经懂得调用相关的公式定理，而不是胡言乱语一通。

AI数学竞赛的第一课，并不是毫无收获。

GPT-3也不要灰心，伯克利的团队说了，随着对模型的改进，今后它们的数学推理能力会越来越强。

MATH和AMPS现在都已开源，有兴趣的研究者可以直接下载：

https://github.com/hendrycks/math/

0

点赞

赏礼

赏钱

0

收藏

免责声明：本文仅代表作者个人观点，与本站无关。其原创性以及文中陈述文字和内容未经本网证实，对本文以及其中全部或者部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺，请读者仅作参考，并请自行核实相关内容。凡本网注明 “来源：XXX（非本站）”的作品，均转载自其它媒体，转载目的在于传递更多信息，并不代表本网赞同其观点和对其真实性负责。如因作品内容、版权和其它问题需要同本网联系的，请在一周内进行，以便我们及时处理。 QQ：617470285 邮箱：617470285@qq.com

GPT-3没有亲自上手，不如展望一下GPT-4？

2023-04-11 13:09

中国要做GPT-3！昇腾黑科技曝光，2.4倍性能提升释放「算力狂魔」

2023-04-11 13:06

相关文章

都市车界|三菱与日产将成立合资公司从事自动驾驶等相关业务..

11月4日，据多家媒体报道，三菱商事和日产汽车已达成共识，将共同成立一..

三菱汽车因刹车隐患召回13.8万辆车针对两款车型

【CNMO科技消息】据央视新闻报道，日本三菱汽车工业公司最近采取行动，针..

日产、三菱合作将成立合资公司，从事L4自动驾驶等相关业务..

11月4号消息，三菱商事和日产汽车将成立合资公司，提供与自动驾驶和将电..

中日韩三大财团对比，三菱总资产21万亿，三星2.16万亿，中国呢？..

经济实力，从来都是一个国家在国际社会立足的根本。放眼全球，那些在世界..

新车 | 售16.98万元起，广汽三菱新欧蓝德上市，买本田CR-V还是它？..

文：懂车帝原创高帅鹏[懂车帝原创产品] 11月19日，广汽三菱新一代欧蓝..

日产拉上三菱，划分两大阵营

当前，日本汽车品牌正步入一个前所未有的活跃阶段。作为全球第三大汽车生..

日产拉上三菱，划分两大阵营

当前，日本汽车品牌正步入一个前所未有的活跃阶段。作为全球第三大汽车生..

三菱、日产将成立合资公司，部署L4自动驾驶业务

近期，海外消息称，三菱商事和日产汽车将成立合资公司，该公司将提供与L4..

三菱汽车因刹车隐患提交改善措施，涉及13.8万辆汽车

总台记者当地时间11月1日获悉，因可能存在安全隐患，日本三菱汽车工业公..

关于作者

泡沫人生(普通会员)

文章

860

关注

0

粉丝

0

点击领取今天的签到奖励!

猜你喜欢

01

微信聊天时，女人说“哼哼”，10个高情商回复

2023/10/04

02

聊天交友软件常用骗局（套路）交友需小心！

2023/07/15

03

DeepSeek 究竟是个啥？一文带你看明白

1个月前

04

彝族最美新娘果果曝光老公与小三不雅聊天记录，内容不堪入目！

2023/07/18

05

上海女家长陪睡校长，不雅聊天记录曝光！真是三观尽毁

2023/06/19

标签云

成员 网址收录40399 企业收录2981 印章生成237474 电子证书1052 电子名片60 自媒体50768

@2022 All Rights Reserved

浙ICP备19035174号-7

0

0

分享

请选择要切换的马甲:

个人中心

每日签到

我的消息

内容搜索