OpenAI震撼研究：用GPT-4解释30万神经元，原来AI黑盒要AI去打开-花粉乐享

> 乐学堂 > > OpenAI震撼研究：用GPT-4解释30万神经元，原来AI黑盒要AI去打开

OpenAI震撼研究：用GPT-4解释30万神经元，原来AI黑盒要AI去打开

来源：量子位

2023-05-14 00:57:01

434

管理

明敏发自凹非寺

量子位 | 公众号 QbitAI

没想到，打开AI黑盒这件事，可能还要靠AI自己来实现了。

OpenAI的最新研究来了一波大胆尝试：

让GPT-4去解释GPT-2的行为模式。

结果显示，超过1000个神经元的解释得分在0.8以上——也就是说GPT-4能理解这些神经元。

要知道，“AI黑箱难题”长期以来是一个热议话题，尤其是大语言模型领域，人类对其内部工作原理的理解还非常有限，这种“不透明化”也进一步引发了人类对AI的诸多担忧。

目前推进AI可解释性研究的一个简单办法，就是逐个分析大模型中的神经元，手动检查以确定它们各自所代表的数据特征。

但对于规模已经达到百亿、千亿级别的大规模神经网络来说，工作量和工作难度就都涨了亿点点吧。

由此，OpenAI的研究人员想到，干嘛不让AI去自动化搞定这个大工程？

在这项最新的研究中，他们将GPT-4打造成了一个理解AI行为模式的工具，把GPT-2超过30万个神经单元都解释了一遍，并和实际情况比对进行评分。

最终生成的解释数据集和工具代码，已对外开源。

研究人员表示：未来，这种AI工具可能在改善LLM性能上发挥巨大作用，比如减少AI偏见和有害输出。

解释接近人类水平

具体来看，整个研究的步骤可以分为三步。

第一步，先给GPT-4一段文本，并展示GPT-2在理解这段文本时激活的神经元情况。

然后让GPT-4来解释，这段文本中神经元的激活情况。

他们还发现，不同层神经元被激活的情况，更高层的会更抽象。

当然这也引发了不少担忧，毕竟GPT-4本身不还是个黑盒嘛。

人类拿着自己不理解的东西，让它解释另一个自己不理解的东西，这个风险emm……

这项研究由OpenAI负责对齐的团队提出。

他们表示，这部分工作是他们对齐研究的第三大支柱的一部分：

我们想要实现自动化对齐。这种想法一个值得思考的方面是，它可能随着AI的发展而扩展更多。随着未来AI模型变得越来越智能，我们也能找到对AI更好的解释。

论文地址：https://openaipublic.blob.core.windows.net/neuron-explainer/paper/index.html

参考链接：[1]https://openai.com/research/language-models-can-explain-neurons-in-language-models[2]https://www.globalvillagespace.com/tech/openais-tool-explains-language-model-behavior/

— 完 —

量子位 QbitAI · 头条号签约

关注我们，第一时间获知前沿科技动态

花粉社群VIP加油站

2

点赞

赏礼

赏钱

0

收藏

免责声明：本文仅代表作者个人观点，与花粉乐分享无关。其原创性以及文中陈述文字和内容未经本网证实，对本文以及其中全部或者部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺，请读者仅作参考，并请自行核实相关内容。
凡本网注明 “来源：XXX（非花粉乐分享）”的作品，均转载自其它媒体，转载目的在于传递更多信息，并不代表本网赞同其观点和对其真实性负责。
如因作品内容、版权和其它问题需要同本网联系的，请在一周内进行，以便我们及时处理。
QQ：2443165046 邮箱：info@hflfx.com

你深入了解 OPENAI 的贡献吗？

2023-05-14 01:00

OpenAI炸裂新作：GPT-4破解GPT-2大脑！30万神经元全被看透

2023-05-14 00:56

相关推荐

不一样的聊天体验——用chatgpt让你的聊天更有趣

用自己的手机也能查看别人的聊天记录，操作简单，一学就会

“你聊天，我聊天，明年补考教室见……”

和ChatGPT一起了解骨科手术机器人

人工智能聊天机器人：ChatGPT和Bard，谁更厉害？

关于作者

Mole(蜂界传说)

文章

497

主题

0

关注

0

粉丝

0

点击领取今天的签到奖励!

54个圈友 0个话题

华为手机随手拍，记录生活点滴之美好

51个圈友 0个话题

这里是华为P30pro手机交流圈，欢迎华为P30pro用户进群交流

60个圈友 2个话题

华为花粉体验官，体验官专属的交流群

登录后查看您创建的圈子

现在登陆

登录后查看您创建的圈子

现在登陆

猜你喜欢

标签云

@杭州百翼科技有限公司

杭州互联网违法和不良信息举报平台网络110报警服务

浙ICP备17046585号

2

0

分享

请选择要切换的马甲:

个人中心

每日签到

我的消息

内容搜索