OpenAI震撼研究:用GPT-4解释30万神经元,原来AI的黑盒要AI自己去打开_今热点
来源:富途牛牛 发布时间:2023-05-10 20:02:11

来源:量子位

没想到,打开AI黑盒这件事,可能还要靠AI自己来实现了。

OpenAI的最新研究来了一波大胆尝试:


(资料图片)

让GPT-4去解释GPT-2的行为模式。

结果显示,超过1000个神经元的解释得分在0.8以上——也就是说GPT-4能理解这些神经元。

要知道,“AI黑箱难题”长期以来是一个热议话题,尤其是大语言模型领域,人类对其内部工作原理的理解还非常有限,这种“不透明化”也进一步引发了人类对AI的诸多担忧。

目前推进AI可解释性研究的一个简单办法,就是逐个分析大模型中的神经元,手动检查以确定它们各自所代表的数据特征。

但对于规模已经达到百亿、千亿级别的大规模神经网络来说,工作量和工作难度就都涨了亿点点吧。

由此,OpenAI的研究人员想到,干嘛不让AI去自动化搞定这个大工程?

在这项最新的研究中,他们将GPT-4打造成了一个理解AI行为模式的工具,把GPT-2超过30万个神经单元都解释了一遍,并和实际情况比对进行评分。

最终生成的解释数据集和工具代码,已对外开源。

研究人员表示:未来,这种AI工具可能在改善LLM性能上发挥巨大作用,比如减少AI偏见和有害输出。

解释接近人类水平

具体来看,整个研究的步骤可以分为三步。

第一步,先给GPT-4一段文本,并展示GPT-2在理解这段文本时激活的神经元情况。

然后让GPT-4来解释,这段文本中神经元的激活情况。

比如示例中给出了一段漫威复联的文本,GPT-4分析的激活神经元为:

电影、角色和娱乐

第二步,让GPT-4开始模拟,这些被解释的神经元接下来会做什么。

GPT-4给出了一段内容。

第三步,让GPT-2真实的神经元激活来生成结果,然后和GPT-4模拟的结果进行比对,研究人员会对此打分。

在博客给出的示例中,GPT-4的得分为0.34.

使用这个办法,研究人员让GPT-4解释了GPT-2一共307200个神经元。

OpenAI表示,使用这一基准,AI解释的分数能接近人类水平。

从总体结果来看,GPT-4在少数情况下的解释得分很高,在0.8分以上。

他们还发现,不同层神经元被激活的情况,更高层的会更抽象。

此外,团队还总结了如下几点结论:

如果让GPT-4重复解释,它的得分能更高

如果使用更强大的模型来解释,得分也会上升

用不同的激活函数训练模型,能提高解释分数

总结来看就是,虽然GPT-4目前的表现一般,但是这个方法和思路的提升空间还有很大。

团队也强调,现在在GPT-2上的表现都不太好,如果换成更大、更复杂的模型,表现也会比较堪忧。

同时这种模式也能适用于联网的LLM,研究人员认为可以通过简单调整,来弄清楚神经元如何决策搜索内容和访问的网站。

此外他们还表示,在创建这个解释系统时并没有考虑商业化问题,理论上除了GPT-4,其他LLM也能实现类似效果。

接下来,他们打算解决研究中的这几个问题:

AI神经元行为十分复杂,但GPT-4给的解释非常简单,所以有些复杂行为还无法解释;

希望最终自动找到并解释复杂的整个神经回路,神经元和注意力头一起工作;

目前只解释了神经元的行为,但没解释行为背后的机制;

整个过程算力消耗巨大。

网友:快进到AI创造AI

意料之中,这项研究马上在网络上引发热议。

大家的脑洞画风be like:“AI教人类理解AI。”

“AI教人类关掉AI中存在风险的神经元。”

还有人开始畅想,AI理解AI会快速发展为AI训练AI(已经开始了),然后再过不久就是AI创造新的AI了。

当然这也引发了不少担忧,毕竟GPT-4本身不还是个黑盒嘛。

人类拿着自己不理解的东西,让它解释另一个自己不理解的东西,这个风险emm……

这项研究由OpenAI负责对齐的团队提出。

他们表示,这部分工作是他们对齐研究的第三大支柱的一部分:

我们想要实现自动化对齐。这种想法一个值得思考的方面是,它可能随着AI的发展而扩展更多。随着未来AI模型变得越来越智能,我们也能找到对AI更好的解释。

关键词:

猜你喜欢

OpenAI震撼研究:用GPT-4解释30万神经元,原来AI的黑盒要AI自己去打开_今热点

OpenAI震撼研究:用GPT-4解释30万神经元,原来AI

来源:量子位没想到,打开AI黑盒这件事,可能还要靠AI自己来实现了。OpenAI的最新研究来了一波大胆...更多

2023-05-10 20:02:11
金价还能创新高?

金价还能创新高?"2年行情才走了半年"!机构犀利

来源:券商中国作者:余世鹏今年以来黄金价格在不断上涨,截至目前维持在2030美元 盎司高位水平。...更多

2023-05-10 19:10:25
5天回购22亿美元!无惧盈利下滑,美国企业大举回购股票|世界快资讯

5天回购22亿美元!无惧盈利下滑,美国企业大举回

来源:智通财经作者:庄礼佳以JillCareyHall为首的美银策略师周二表示:“在今年2月和3月的温和趋势...更多

2023-05-10 18:01:34
期权IV追踪 | 业绩指引大超预期!诺瓦瓦克斯医药隐含波动率连日上升;PacWest期权交易量大幅萎缩

期权IV追踪 | 业绩指引大超预期!诺瓦瓦克斯医

隐含波动率(IV)是对一支股票年内价格变动的预估,反映投资者对未来价格波动程度的预期,是期权定...更多

2023-05-10 18:04:20
全球观天下!内银股遭沽售!北水卖出建设银行、工商银行,逆势买入腾讯超6亿港元;南水抢筹中国平安超6亿元

全球观天下!内银股遭沽售!北水卖出建设银行、工

5月10日(周三),南向资金今日净卖出2 35亿港元。$建设银行(00939 HK)$、$中国移动(00941 HK)$、$工商银行更多

2023-05-10 18:17:10
美国M2暴跌成4月CPI“降温神器”? 天天要闻

美国M2暴跌成4月CPI“降温神器”? 天天要闻

来源:华尔街见闻今夜即将公布的美国4月CPI无疑是全场瞩目的焦点,目前有观点将CPI后续表现和M2货币供应量更多

2023-05-10 18:09:27
理想Q1营收188亿元同比接近翻倍!净利润9.3亿元实现扭亏 全球快消息

理想Q1营收188亿元同比接近翻倍!净利润9.3亿元实

来源:华尔街见闻在车市价格战硝烟浓烈的一季度,新晋蔚小理老大$理想汽车(LI US)$交出了一份亮眼的财报。更多

2023-05-10 17:53:07
港市速睇 | 科指午后小幅转涨,锂电、汽车股表现强势,天齐锂业飙涨超11%,长城汽车涨超6%

港市速睇 | 科指午后小幅转涨,锂电、汽车股表

富途资讯5月10日消息,港股三大指数涨跌不一,恒指跌0 53%,国指跌0 77%,恒生科技指数涨0 34%表现最佳。截更多

2023-05-10 16:57:12
OpenAI发布炸裂研究:让AI解释AI黑箱,人类无法理解,语言无法描述

OpenAI发布炸裂研究:让AI解释AI黑箱,人类无法理

来源:极客公园-FounderPark就算在新产品满天飞,商业文明正在被AI重建的当下,我们仍然不知道,这些令人惊更多

2023-05-10 17:11:52
对冲大神德鲁肯米勒:美国经济处于衰退边缘,预计将出现硬着陆

对冲大神德鲁肯米勒:美国经济处于衰退边缘,预计

来源:智通财经Duquesne家族办公室的亿万富翁创始人德鲁肯米勒(StanDruckenmiller)周二表示,他认为美国经更多

2023-05-10 17:09:53

© 2012-2020 财经快报网 版权所有 关于我们

网站联系邮箱:435 227 67@qq.com

琼ICP备2022009675号-3