• 我的订阅
  • 科技

用gpt-4解释30万神经元,原来ai的黑盒要ai自己去打开

类别:科技 发布时间:2023-05-11 20:04:00 来源:浅语科技

没想到,打开AI黑盒这件事,可能还要靠AI自己来实现了。

OpenAI的最新研究来了一波大胆尝试:

让GPT-4去解释GPT-2的行为模式。

结果显示,超过1000个神经元的解释得分在0.8以上 ——也就是说GPT-4能理解这些神经元。

用gpt-4解释30万神经元,原来ai的黑盒要ai自己去打开

要知道,“AI黑箱难题”长期以来是一个热议话题,尤其是大语言模型领域,人类对其内部工作原理的理解还非常有限,这种“不透明化”也进一步引发了人类对AI的诸多担忧。

目前推进AI可解释性研究的一个简单办法,就是逐个分析大模型中的神经元,手动检查以确定它们各自所代表的数据特征。

但对于规模已经达到百亿、千亿级别的大规模神经网络来说,工作量和工作难度就都涨了亿点点吧。

由此,OpenAI的研究人员想到,干嘛不让AI去自动化搞定这个大工程?

用gpt-4解释30万神经元,原来ai的黑盒要ai自己去打开

在这项最新的研究中,他们将GPT-4打造成了一个理解AI行为模式的工具,把GPT-2超过30万个神经单元都解释了一遍,并和实际情况比对进行评分。

最终生成的解释数据集和工具代码,已对外开源。

研究人员表示:未来,这种AI工具可能在改善LLM性能上发挥巨大作用,比如减少AI偏见和有害输出。解释接近人类水平

具体来看,整个研究的步骤可以分为三步。

第一步,先给GPT-4一段文本,并展示GPT-2在理解这段文本时激活的神经元情况。

然后让GPT-4来解释,这段文本中神经元的激活情况。

用gpt-4解释30万神经元,原来ai的黑盒要ai自己去打开

比如示例中给出了一段漫威复联的文本,GPT-4分析的激活神经元为:

电影、角色和娱乐

第二步,让GPT-4开始模拟,这些被解释的神经元接下来会做什么。

GPT-4给出了一段内容。

用gpt-4解释30万神经元,原来ai的黑盒要ai自己去打开

第三步,让GPT-2真实的神经元激活来生成结果,然后和GPT-4模拟的结果进行比对,研究人员会对此打分。

用gpt-4解释30万神经元,原来ai的黑盒要ai自己去打开

在博客给出的示例中,GPT-4的得分为0.34.

使用这个办法,研究人员让GPT-4解释了GPT-2一共307200个神经元。

OpenAI表示,使用这一基准,AI解释的分数能接近人类水平。

从总体结果来看,GPT-4在少数情况下的解释得分很高,在0.8分以上。

用gpt-4解释30万神经元,原来ai的黑盒要ai自己去打开

他们还发现,不同层神经元被激活的情况,更高层的会更抽象。

用gpt-4解释30万神经元,原来ai的黑盒要ai自己去打开

此外,团队还总结了如下几点结论:

如果让GPT-4重复解释,它的得分能更高

如果使用更强大的模型来解释,得分也会上升

用不同的激活函数训练模型,能提高解释分数

总结来看就是,虽然GPT-4目前的表现一般,但是这个方法和思路的提升空间还有很大。

团队也强调,现在在GPT-2上的表现都不太好,如果换成更大、更复杂的模型,表现也会比较堪忧。

同时这种模式也能适用于联网的LLM,研究人员认为可以通过简单调整,来弄清楚神经元如何决策搜索内容和访问的网站。

此外他们还表示,在创建这个解释系统时并没有考虑商业化问题,理论上除了GPT-4,其他LLM也能实现类似效果。

接下来,他们打算解决研究中的这几个问题:

AI神经元行为十分复杂,但GPT-4给的解释非常简单,所以有些复杂行为还无法解释;

希望最终自动找到并解释复杂的整个神经回路,神经元和注意力头一起工作;

目前只解释了神经元的行为,但没解释行为背后的机制;

整个过程算力消耗巨大。网友:快进到AI创造AI

意料之中,这项研究马上在网络上引发热议。

大家的脑洞画风belike:“AI教人类理解AI。”

用gpt-4解释30万神经元,原来ai的黑盒要ai自己去打开

“AI教人类关掉AI中存在风险的神经元。”

用gpt-4解释30万神经元,原来ai的黑盒要ai自己去打开

还有人开始畅想,AI理解AI会快速发展为AI训练AI(已经开始了),然后再过不久就是AI创造新的AI了。

用gpt-4解释30万神经元,原来ai的黑盒要ai自己去打开

当然这也引发了不少担忧,毕竟GPT-4本身不还是个黑盒嘛。

人类拿着自己不理解的东西,让它解释另一个自己不理解的东西,这个风险emm……

用gpt-4解释30万神经元,原来ai的黑盒要ai自己去打开

这项研究由OpenAI负责对齐的团队提出。

他们表示,这部分工作是他们对齐研究的第三大支柱的一部分:

我们想要实现自动化对齐。这种想法一个值得思考的方面是,它可能随着AI的发展而扩展更多。随着未来AI模型变得越来越智能,我们也能找到对AI更好的解释。

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2023-05-11 21:45:09

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

OpenAI 开发新工具,试图解释语言模型的行为
...(比如OpenAI自己的GPT-2)的内部结构。语言模型由许多“神经元”组成,每个神经元都可以观察文本中的某种特定模式,并影响模型下一步的输出。例如,给定一个关于超级英雄的问
2023-05-10 15:34:00
宇宙是一个庞大的生物?星系结构和人脑结构相似,可能也存在意识
...经结构也是一个复杂而精密的系统。大脑由大约1000亿个神经元组成,这些神经元相互连接形成了复杂的网络。这些神经元之间的连接和通信构成了我们的思维、情感和行为。如果我们深入比较
2024-06-21 11:23:00
《自然》:为什么“细嚼慢咽”吃不胖?越吃越瘦的秘诀终于解释清楚了
...首次实现了在小鼠清醒活跃的时候对其孤束核的不同类型神经元进行成像和记录。 他们观察到,当把流质营养液直接送入小鼠的胃里,孤束核中有一类PRLH神经元(催乳素释放激素)会在数
2023-11-27 11:09:00
科学家竞相破解大型语言模型背后的谜团
...机器学习算法使用模拟人脑结构的神经网络,信息在不同神经元间传递,以人类不易理解的方式内化数据,缺乏可视化和透明度。这个问题对ChatGPT等大型语言模型(LLM)来说尤其严重
2024-05-18 02:42:00
...言中讲述了人工智能神经网络概念的开端。人们已经知道神经元会因为一个激活阈值而放电或不放电。克里斯蒂安解释说:“如果对神经元的输入总和超过这个激活阈值,那么神经元就会放电;否则
2023-01-22 19:57:00
是否真的会在临终时看到人生回放?
...大脑是人体最为复杂和神秘的器官之一,其包含着亿万个神经元,负责记录和处理信息。记忆是大脑的重要功能之一,通过神经递质的传导和突触的连接,大脑将信息储存并形成记忆。临终回放现象
2023-10-19 16:45:00
两个基因是“幕后推手”
...的神经干细胞是“胜者”,它们最终产生了30%—40%的大脑神经元,而位于金字塔底层的10%的神经干细胞只贡献了1%—2%的神经元。值得一提的是,在发育早期被清除掉的干细胞,没
2023-04-25 01:28:00
青岛市市立医院年度十佳护士长张莉:守护患者生命的“神经元”
...把科室护理水平提升到新的高度,成为守护患者生命的“神经元”。以初心呵护患者健康 神经内科患者常因脑血管疾病、神经系统退行性疾病、癫痫、中枢神经系统感染等疾病,出现运动、感觉
2025-05-13 11:32:00
科学家揭示大脑神秘新机制:尝试解释海马体如何映射外部世界
...片“脑宇宙”里挖掘出了新的宝贝:发现一类新型海马体神经元类别。“这些细胞似乎能将生物体的外部客观信息和内在主观意图紧密相连。它们不仅映射空间信息,还同步表征了动物的探索意图。
2024-05-15 13:45:00
更多关于科技的资讯:
青春华章丨方寸之间,用“芯”绘就星图万里
华创微系列芯片产品化在即,保障天地“对话”,筑牢算力基石 方寸之间,用“芯”绘就星图万里□南京日报/紫金山新闻记者江芬芬编者按高质量发展是“十四五”乃至更长时期我国经济社会发展的主题
2025-10-13 08:05:00
宁企为能源发电站安装“智慧大脑”“一网统管”,巡检响应时间缩短一半,停机损失降低超30% □南京日报/紫金山新闻记者孙秉印通讯员麒轩“支路电流异常
2025-10-13 08:05:00
将税务服务从“送得对”到“传得开”、从“加急办”到“秒响应”、从“被动纠错”到“主动合规”……聚焦个体工商户办税缴费需求
2025-10-13 07:23:00
算力浪潮奔涌 夯实“数字底座”——河北以数字经济赋能高质量发展(一)在中国联通(怀来)大数据创新产业园的机房内,一排排机柜昼夜不息地嗡鸣
2025-10-13 08:00:00
双11重磅福利:88VIP点外卖5折,淘宝闪购1000万份免单等你抢!
淘宝闪购推出双11重磅福利:88VIP点外卖天天享五折,免单红包数量超1000万份!10月15日至11月14日,88VIP用户进入闪购频道
2025-10-12 05:27:00
这家宁企让足球邂逅时尚
本报记者 周京震 陆春花8月17日晚,“苏超”第9轮,南京迎战盐城。聚光灯下,南京队员战衣上那簇崭新的标识格外醒目——华瑞时尚
2025-10-12 05:27:00
这支“中国笔”,国内首款!
在常州经开区潞城街道江苏德尔福医疗器械有限公司的洁净工厂内工作人员正在忙碌地装配新型“电子笔”今年该企业三个型号的预充式电子笔式注射器获得国内首张医疗器械注册证标志着该类产品正式
2025-10-12 05:27:00
山东移动5G-A护航济南地铁4号线,打通地下通信“快车道”
近日,济南轨道交通4号线彭家庄站、程家庄站、唐冶站、唐冶南站(以上站名均为工程名)已完成移动5G-A通信覆盖,标志着这条串联城市东西的“黄金线路”在通信保障上迈出关键一步
2025-10-12 08:45:00
人保财险青岛分公司:科技赋能推动农险“双精准”再升级
齐鲁晚报·齐鲁壹点记者 尚青龙近日,青岛平度的肉牛也有了自己的“数字身份证”。人保财险青岛分公司借鉴内蒙古先进经验,引入内蒙古沃付国际物联网有限公司自主研发的人工智能畜牧业数字化管理平台
2025-10-12 11:53:00
一线保障人员“时刻在岗”,烟台联通守护高铁5G网络畅通运行
国庆中秋假期期间,面对持续攀升的客运高峰,烟台联通网络保障团队坚守岗位,全力投入高铁沿线5G网络实时保障工作,通过精细化运维与快速响应
2025-10-12 11:53:00
第十九届中国(临朐)家居门窗博览会12日开幕
齐鲁晚报·齐鲁壹点 王佳潼10月11日,第十九届中国(临朐)家居门窗博览会媒体见面会在临朐召开。记者在会上获悉,第十九届中国(临朐)家居门窗博览会定于2025年10月12日至15日在临朐国际会展中心举办
2025-10-12 11:55:00
济南热力以低空智巡护航聊热入济
近日,“聊热入济”长距离供热项目施工现场传来新进展——济南能源集团所属热力集团部署的无人机智慧巡检系统,正沿这条 “供热长龙” 精准巡航
2025-10-12 15:50:00
山东移动聊城分公司圆满完成高唐一中百年校庆通信保障任务
百年薪火传,同心向未来。10月2日,聊城市高唐县第一中学建校100周年庆祝大会在高唐县隆重举行。海内外校友、各界嘉宾及在校师生欢聚一堂
2025-10-12 16:23:00
冲刺四季度 打好收官战丨湖北佳恒:以“智”提“质” 产值已超去年全年
十堰广电讯(全媒体记者 何旭 通讯员 胡新)科技创新锻造核心竞争力,湖北佳恒科技以智能化改造与自主研发双轮并进,推动企业高质量发展
2025-10-12 19:27:00
西电连续三次入选教育部“人工智能+高等教育”应用场景典型案例
近日,教育部公布第三批30个“人工智能+高等教育”应用场景典型案例遴选结果。学校《“西电智评”——数智赋能学生评价的探索与实践》案例成功入选
2025-10-12 13:56:00