• 我的订阅
  • 科技

如何让“机器不学习”?学会“遗忘”将使新一代AI更出色

类别:科技 发布时间:2024-06-14 11:54:00 来源:文汇报

如何让“机器不学习”?学会“遗忘”将使新一代AI更出色

由于人们担心人工智能(AI)驱动的聊天机器人可能会泄露私人数据,计算机科学家们正努力教机器学习模型如何遗忘。虽然这非常困难,但“机器不学习”的解决方案已经开始出现。这项工作除了能解除人们对隐私和错误信息的担忧外,还能起到一个至关重要的作用——如果我们真的想让AI像人类一样学习和思考,可能需要让它们学会遗忘。

被遗忘权

由大型语言模型(LLM)支撑的新一代AI聊天机器人能根据用户的提示生成文本。这些模型是在大量数据的基础上训练出来的,其中大部分数据抓取自互联网上的公开信息。由此,它们学会了预测句子中最有可能出现的下一个词,从而流利地回答每一个问题。

与此同时,这也意味着当大模型学习到某些东西时,就无法取消学习。澳大利亚最大的国家科研机构联邦科学与工业研究组织的AI研究员兼工程师张大卫说,大语言模型根据汇总数据生成回复,因此它们无法像谷歌等搜索引擎那样轻松地遗忘或“删除”特定信息,甚至个人也无法准确追踪AI应用程序对自己的了解程度。

这在隐私方面造成一个重大问题。2018年生效的《欧盟通用数据保护条例》(GDPR)规定用户享有“被遗忘权”,即当用户要求企业清除和停止传播个人的隐私信息时,企业应当采取合理措施,及时销毁用户的个人数据,否则将面临巨额处罚。

瑞士苏黎世联邦理工学院的计算机科学家弗洛里安·特拉梅尔认为,大模型公司必须想办法解决这个问题,尤其是当这些公司开始用更敏感的信息对大模型进行训练。

更令人担忧的是,由AI驱动的聊天机器人本身也很容易受到攻击。已有研究证明,一些黑客技术可以让聊天机器人在用户设备上远程运行代码,或要求用户提交银行账户信息。

诱导“失忆”

机器学习模型对数据有很强的依赖性,尤其像ChatGPT这样拥有海量训练数据和千亿级参数的大型AI系统,面对用户频繁的删除请求,重新训练整个模型会消耗巨额资源。

那么,是否能在不用重新训练模型的情况下,移除或至少屏蔽特定信息呢?

2019年,加拿大多伦多大学的尼古拉斯·帕贝尔诺及其同事提出了一种被称为SISA的方法——它将数据集分割成不同小块,分别对每个小块进行模型训练,并像游戏一样保存节点进度,再合并结果。当遇到取消学习请求时,它可以返回节点,切断相关数据块,再从那里开始重新训练。经测试证明,这种方法大大加快了重新训练速度。

由于删除数据会严重影响机器学习模型的性能,一些团队选择了隐藏或遮蔽相关数据的策略。例如,微软和美国俄亥俄州立大学的研究人员在用于训练模型的数据中引入了噪音,使大模型随后输出的信息由数据中更泛化的模式,而不是特定的、可识别的例子所决定。这从理论上保证了大模型不会透露训练数据中的个人信息。

如何让“机器不学习”?学会“遗忘”将使新一代AI更出色

但是,这种泛化往往会在一定程度上削弱AI的学习能力。为了规避这个问题,韩国科学家尝试了一种“知识解除学习”的方法,其目的是扭转某项数据对算法的影响,而不是完全删除它,这样聊天机器人就永远不会引用它。目前,这一方法是该领域最有前途的方法之一,因为它能在更短时间内使用更少的计算资源完成工作。

为了激励研究人员提出更高效的解决方案,谷歌公司还组织了一场竞赛。这不仅表明这项挑战的重要性,也意味着或许我们将找到更多好方法,让新一代大模型拥有“遗忘”的能力。

选择性记忆

英国伦敦政治经济学院研究人工智能的哲学家阿里·博伊尔认为,虽然人类的遗忘倾向通常被视为认知缺陷,但有时也是有益的——通过遗忘,人们可以更有效地检索有用的记忆。

AI系统可能也是如此。2017年,谷歌DeepMind公司的研究人员开发了一种可以玩多种电子游戏的人工智能系统。通过存储并回忆自己玩游戏的记忆,它能更有效地归纳出知识。当研究人员改进了模型,使其优先存储和回忆一部分事件而忘记其他数据时,系统性能得到了提高。

这意味着,选择性遗忘可以提高人工智能的性能,而关键是在记忆过多和过少之间找到适当的平衡点。如果AI研究人员的最终目标是建立能像人类一样学习和思考的系统(这也是该领域的最初目标之一),那么他们就必须要设计出能选择性遗忘的系统。在博伊尔看来,遗忘不是设计缺陷,而是一个高效、运作良好的记忆系统的必要特征。

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2024-06-14 15:45:02

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

明年量产!魔法原子新一代机器人亮相:真能进厂“打螺丝”!
...的能力。据了解,魔法原子将于2025年第一季度正式发布新一代人形机器人产品MagicBot,同步小规模量产,并在工业、商业服务等场景落地应用。自从特斯拉新一代Optimus亮
2024-12-03 09:51:00
酷克数据推出AI开发工具箱HashML 加速企业级AI应用落地投产
...言的交互式数据查询分析系统Data+AI 助力企业数智化升级新一代人工智能技术正在加速企业数字化、智能化进程,长远来看,将对企业的研发、生产、经营带来深远影响。企业需要逐场景
2023-09-12 11:31:00
一文读懂黄仁勋CES重磅发布:最新5090芯片、世界最大AI计算机、首个世界模型
...分钟的演讲中,黄仁勋发布了一系列重磅技术产品,包括新一代基于Blackwell架构的RTX 50系列显卡、世界上最大最快的巨型芯片Grace Blackwell NVLink72
2025-01-07 19:00:00
创新奇智大模型工业落地初显成效,探索工业智能机器人新方向
...大学的「炒菜机器人」ALOHA 问世,引发了一片关注。利用新一代技术,机器人似乎已经可以胜任全职管家了。在斯坦福的工作中,研究者开发了一套系统,用于机器人模仿学习需要全身控制
2024-09-03 10:00:00
星环科技Sophon 3.2发布,通过“六易三仓两中心”实现新一代AI平民化
...务,让用户能够基于自身需求构建紧密贴合其业务场景的新一代AI应用。一、六易——实现新一代AI平民化Sophon 3.2从数据接入获取、模型构建训练、模型运维管理、模型发布迭代
2023-05-31 16:00:00
...,或在开放网络上分享过任何内容,那么你就有可能为最新一代人工智能的诞生做出了贡献。谷歌的Bard、OpenAI的ChatGPT、微软的新版必应以及其他初创公司提供的类似工具,
2023-05-01 09:29:00
NVIDIA GTC2024 :你必须知道的AI、机器人、自动驾驶
...式平台上。NVIDIA 创始人兼首席执行官黄仁勋表示,这款新一代自动驾驶汽车处理器将搭载专为 Transformer
2024-03-20 11:13:00
人工智能自虚向实,从re:Invent 2022看如何全面实现数智融合
...、人工智能、云计算、数字孪生、5G、物联网和区块链等新一代数字技术应用和集成创新,为企业数字化转型提供技术支撑。上云、用数、赋智,精炼地描述了企业上云的三个阶段,三重境界。上
2022-12-13 15:57:00
...,提升资源效率”。此次原动力大会上,火山引擎发布了新一代自研DPU,实现计算、存储、网络的全组件卸载,释放更多资源给业务负载。火山引擎尽管是“最年轻”的云厂商,其自研DPU已
2023-04-19 09:33:00
更多关于科技的资讯:
AI时代,“养小龙虾”就能创业成功?
有人研究怎么把企业做大,有人研究怎么把企业做快,这个人却一头扎进历史堆里,研究一件事:为什么有些企业能活很久,有些却中途消失
2026-03-10 20:17:00
当前AI技术正在深入影响内容创作行业,对于AI编曲现象,全国政协委员王黎光表示,AI虽然能代替创作过程但不能代替人工。AI编曲是以大模型的储备量和收集量为基础的
2026-03-10 20:39:00
在银行业竞争日趋激烈、利差收窄的宏观环境下,镇江农商银行坚持以精细化管理为抓手,通过实施“熵减工程”“蜂巢工程”和结构调优三大举措
2026-03-10 22:41:00
中新经纬3月10日电 小红书“薯管家”官方账号发布公告称,近期,平台发现部分用户采用AI托管模式运营账号,通过技术手段自动生成内容
2026-03-10 21:19:00
中国网3月10日讯 据“国家互联网应急中心CNCERT”微信公众号消息,近期,OpenClaw(“小龙虾”,曾用名Clawdbot
2026-03-10 20:05:00
春风送千岗,AI助求职:2026年综合专场招聘会暨春风行动就业援助活动圆满结束
3月7日上午,“AI聘·才汇来”相城区2026年综合类专场招聘会暨春风行动就业援助活动在相城区人力资源市场成功举办。作为“春风行动”系列活动之一
2026-03-10 17:45:00
国科光锐研发生产基地项目落户黄桥
江南时报讯 3月4日,国科光锐研发生产基地项目签约仪式顺利举行,抢抓高端装备制造产业发展机遇,完善先进制造业发展支撑体系
2026-03-10 17:48:00
“养龙虾”,多地砸钱支持
中新经纬3月10日电 “养龙虾”,这是近日的AI热词,即部署和使用名为OpenClaw‌的开源AI智能体框架,因其图标为一只红色龙虾
2026-03-10 19:10:00
鲁网3月10日讯(记者 张佳伟)3月9日,由中国生物发酵产业协会主办、安琪酵母股份有限公司承办的“2026第十一届发酵培养基应用与发展技术论坛”在济南黄河国际会展中心举行
2026-03-10 17:24:00
两会,就这Young!丨万亿存量市场怎么激活?全国人大代表郭兴田用“两天”作答
编者按:今年全国两会,大河网两位00后记者首次踏上两会征程,以“萌新”视角记录两会,为网友带来全新体验:不背稿、不装样
2026-03-10 14:21:00
让家陪伴成长——金隅天坛家居Mall 3月7日启幕,定义“家生活”新方式
在快速更迭的时代,人们对家的期待已超越功能满足,转而追求情感承载与成长陪伴。正是基于这一洞察,金隅天坛家居Mall提出“我家的长期主义”核心主张——让家能够伴随家庭成长
2026-03-10 14:26:00
在教育选择中,高途网课是否靠谱、教育机构是否可靠、办学是否正规,是学习者和家长最为关注的核心问题。高途 2025 财年第四季度及全年财报
2026-03-10 14:27:00
文化认同融入创新表达,“欢笑中国年”如何抓住大众情绪的小切口?
2026 年春节,红包大战再度迎来内卷与爆发,随着AI平台扎堆涌入,用户在春节期间的注意力被分散、现金激励的边际效应减弱
2026-03-10 16:50:00
灵寿县:灵活就业AI分析让求职成功率提升25%
“把这次春风行动搜集到的信息尽快录入系统,用AI分析一下,精准做好匹配。”3月8日,灵寿县零工市场有关负责人张杉认真梳理了上一场“春风行动”收集到的用工求职信息
2026-03-10 11:30:00
杭州的人形机器人太超前 德国留学生专程为它来学习
近日,浙江科技大学机器人现代产业学院实验室里,来自德国德累斯顿技术经济大学的硕士研究生马克西米利安·穆勒正在开展关于宇树人形机器人的毕业论文研究
2026-03-10 11:36:00