GPT-3数学不及格，愁坏团队，于是他们出了12500道数学-花粉乐享

> 乐学堂 > > GPT-3数学不及格，愁坏团队，于是他们出了12500道数学

GPT-3数学不及格，愁坏团队，于是他们出了12500道数学

来源：量子位

2023-04-21 16:37:08

237

管理

贾浩楠发自凹非寺量子位报道 | 公众号 QbitAI

GPT-3，是个严重偏科的“文科生”。

UC伯克利的研究人员，在对类似GPT-3的大型语言模型进行测试后发现，数学，就是这类AI的盲区。

12500道高中数学题，GPT-3的正确率最低不到3%，最高也没超过7%。

完全不合格啊~

例如，OpenAI最近推出了GPT-f，这是Metamath形式化语言的自动证明器和证明助手。

GPT-f对一些数学问题做出的证明，已经被Metamath主库所接受，这是AI的数学论证第一次数学社区所采用。

Facebook方面也声称已经成功实验了数学AI算法。在去年1月的一篇博客文章中，该公司的研究人员表示，他们已经教会了一个模型将复杂的数学方程视为一种语言，然后将解题过程视为翻译问题。

比如多项式展开、三角形面积、幂级数展开…..

而MATH与以往所有数学数据集最大的不同，就是它的每一个训练问题下，都有清晰的解题步骤和公式依据。

训练后的模型，可以学习到许多有用的启发式解决问题的思路。

除了MATH，团队还推出了一个庞大而多样化的数学预训练语料库AMPS。

AMPS的Khan子集有693个练习类型，超过100,000个问题，基本上是K-12教学中常用的。问题类型从初级数学（如加法）到多变量微积分（如斯托克斯定理），并用于教授实际的K-12学生.

团队还贡献了自己的Mathematica脚本，生成了约500万个的问题。

这个超过23GB大小的数据集，是专门用来训练超大模型用的。其中的问题包括代数、微积分、计数和统计学、几何学、线性代数和数论的各个方面。

与之前的算法生成数学问题的方法不同，由于使用了Mathematica的计算机代数系统，这样使用者就可以直接对分数、分析函数等等进行操作。

AI的数学，及格了吗？

尽管是高中竞赛题，但难度依然不小。

团队特地用MATH对人类进行了评估，结果，一名计算机科学博士学生的答题正确率为40%。

一位三次获得IMO金牌的人成功率达到了90%，这表明MATH对人类也具有挑战性.

但研究人员认为，让AI学会分步解题仍然有进步意义。

与直接在问题和答案上进行训练相比，MATH上训练过的模型，可以提高10%的相对准确率。

最重要的，是模型“掌握”了一些基本数学知识。在一些错误的解法下，AI已经懂得调用相关的公式定理，而不是胡言乱语一通。

AI数学竞赛的第一课，并不是毫无收获。

GPT-3也不要灰心，伯克利的团队说了，随着对模型的改进，今后它们的数学推理能力会越来越强。

MATH和AMPS现在都已开源，有兴趣的研究者可以直接下载：

https://github.com/hendrycks/math/

花粉社群VIP加油站

0

点赞

赏礼

赏钱

0

收藏

免责声明：本文仅代表作者个人观点，与花粉乐分享无关。其原创性以及文中陈述文字和内容未经本网证实，对本文以及其中全部或者部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺，请读者仅作参考，并请自行核实相关内容。
凡本网注明 “来源：XXX（非花粉乐分享）”的作品，均转载自其它媒体，转载目的在于传递更多信息，并不代表本网赞同其观点和对其真实性负责。
如因作品内容、版权和其它问题需要同本网联系的，请在一周内进行，以便我们及时处理。
QQ：2443165046 邮箱：info@hflfx.com

GPT-3没有亲自上手，不如展望一下GPT-4？

2023-04-21 16:38

GPT-3：是富人的游戏，还是未来的电力？

2023-04-21 16:35

相关推荐

不一样的聊天体验——用chatgpt让你的聊天更有趣

用自己的手机也能查看别人的聊天记录，操作简单，一学就会

“你聊天，我聊天，明年补考教室见……”

和ChatGPT一起了解骨科手术机器人

人工智能聊天机器人：ChatGPT和Bard，谁更厉害？

关于作者

Joker(小蜜蜂)

文章

467

主题

0

关注

0

粉丝

0

点击领取今天的签到奖励!

54个圈友 0个话题

华为手机随手拍，记录生活点滴之美好

51个圈友 0个话题

这里是华为P30pro手机交流圈，欢迎华为P30pro用户进群交流

60个圈友 2个话题

华为花粉体验官，体验官专属的交流群

登录后查看您创建的圈子

现在登陆

登录后查看您创建的圈子

现在登陆

猜你喜欢

标签云

@杭州百翼科技有限公司

杭州互联网违法和不良信息举报平台网络110报警服务

浙ICP备17046585号

0

0

分享

请选择要切换的马甲:

个人中心

每日签到

我的消息

内容搜索