• 我的订阅
  • 科技

如何让“机器不学习”?学会“遗忘”将使新一代AI更出色

类别:科技 发布时间:2024-06-14 11:54:00 来源:文汇报

如何让“机器不学习”?学会“遗忘”将使新一代AI更出色

由于人们担心人工智能(AI)驱动的聊天机器人可能会泄露私人数据,计算机科学家们正努力教机器学习模型如何遗忘。虽然这非常困难,但“机器不学习”的解决方案已经开始出现。这项工作除了能解除人们对隐私和错误信息的担忧外,还能起到一个至关重要的作用——如果我们真的想让AI像人类一样学习和思考,可能需要让它们学会遗忘。

被遗忘权

由大型语言模型(LLM)支撑的新一代AI聊天机器人能根据用户的提示生成文本。这些模型是在大量数据的基础上训练出来的,其中大部分数据抓取自互联网上的公开信息。由此,它们学会了预测句子中最有可能出现的下一个词,从而流利地回答每一个问题。

与此同时,这也意味着当大模型学习到某些东西时,就无法取消学习。澳大利亚最大的国家科研机构联邦科学与工业研究组织的AI研究员兼工程师张大卫说,大语言模型根据汇总数据生成回复,因此它们无法像谷歌等搜索引擎那样轻松地遗忘或“删除”特定信息,甚至个人也无法准确追踪AI应用程序对自己的了解程度。

这在隐私方面造成一个重大问题。2018年生效的《欧盟通用数据保护条例》(GDPR)规定用户享有“被遗忘权”,即当用户要求企业清除和停止传播个人的隐私信息时,企业应当采取合理措施,及时销毁用户的个人数据,否则将面临巨额处罚。

瑞士苏黎世联邦理工学院的计算机科学家弗洛里安·特拉梅尔认为,大模型公司必须想办法解决这个问题,尤其是当这些公司开始用更敏感的信息对大模型进行训练。

更令人担忧的是,由AI驱动的聊天机器人本身也很容易受到攻击。已有研究证明,一些黑客技术可以让聊天机器人在用户设备上远程运行代码,或要求用户提交银行账户信息。

诱导“失忆”

机器学习模型对数据有很强的依赖性,尤其像ChatGPT这样拥有海量训练数据和千亿级参数的大型AI系统,面对用户频繁的删除请求,重新训练整个模型会消耗巨额资源。

那么,是否能在不用重新训练模型的情况下,移除或至少屏蔽特定信息呢?

2019年,加拿大多伦多大学的尼古拉斯·帕贝尔诺及其同事提出了一种被称为SISA的方法——它将数据集分割成不同小块,分别对每个小块进行模型训练,并像游戏一样保存节点进度,再合并结果。当遇到取消学习请求时,它可以返回节点,切断相关数据块,再从那里开始重新训练。经测试证明,这种方法大大加快了重新训练速度。

由于删除数据会严重影响机器学习模型的性能,一些团队选择了隐藏或遮蔽相关数据的策略。例如,微软和美国俄亥俄州立大学的研究人员在用于训练模型的数据中引入了噪音,使大模型随后输出的信息由数据中更泛化的模式,而不是特定的、可识别的例子所决定。这从理论上保证了大模型不会透露训练数据中的个人信息。

如何让“机器不学习”?学会“遗忘”将使新一代AI更出色

但是,这种泛化往往会在一定程度上削弱AI的学习能力。为了规避这个问题,韩国科学家尝试了一种“知识解除学习”的方法,其目的是扭转某项数据对算法的影响,而不是完全删除它,这样聊天机器人就永远不会引用它。目前,这一方法是该领域最有前途的方法之一,因为它能在更短时间内使用更少的计算资源完成工作。

为了激励研究人员提出更高效的解决方案,谷歌公司还组织了一场竞赛。这不仅表明这项挑战的重要性,也意味着或许我们将找到更多好方法,让新一代大模型拥有“遗忘”的能力。

选择性记忆

英国伦敦政治经济学院研究人工智能的哲学家阿里·博伊尔认为,虽然人类的遗忘倾向通常被视为认知缺陷,但有时也是有益的——通过遗忘,人们可以更有效地检索有用的记忆。

AI系统可能也是如此。2017年,谷歌DeepMind公司的研究人员开发了一种可以玩多种电子游戏的人工智能系统。通过存储并回忆自己玩游戏的记忆,它能更有效地归纳出知识。当研究人员改进了模型,使其优先存储和回忆一部分事件而忘记其他数据时,系统性能得到了提高。

这意味着,选择性遗忘可以提高人工智能的性能,而关键是在记忆过多和过少之间找到适当的平衡点。如果AI研究人员的最终目标是建立能像人类一样学习和思考的系统(这也是该领域的最初目标之一),那么他们就必须要设计出能选择性遗忘的系统。在博伊尔看来,遗忘不是设计缺陷,而是一个高效、运作良好的记忆系统的必要特征。

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2024-06-14 15:45:02

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

明年量产!魔法原子新一代机器人亮相:真能进厂“打螺丝”!
...的能力。据了解,魔法原子将于2025年第一季度正式发布新一代人形机器人产品MagicBot,同步小规模量产,并在工业、商业服务等场景落地应用。自从特斯拉新一代Optimus亮
2024-12-03 09:51:00
酷克数据推出AI开发工具箱HashML 加速企业级AI应用落地投产
...言的交互式数据查询分析系统Data+AI 助力企业数智化升级新一代人工智能技术正在加速企业数字化、智能化进程,长远来看,将对企业的研发、生产、经营带来深远影响。企业需要逐场景
2023-09-12 11:31:00
一文读懂黄仁勋CES重磅发布:最新5090芯片、世界最大AI计算机、首个世界模型
...分钟的演讲中,黄仁勋发布了一系列重磅技术产品,包括新一代基于Blackwell架构的RTX 50系列显卡、世界上最大最快的巨型芯片Grace Blackwell NVLink72
2025-01-07 19:00:00
创新奇智大模型工业落地初显成效,探索工业智能机器人新方向
...大学的「炒菜机器人」ALOHA 问世,引发了一片关注。利用新一代技术,机器人似乎已经可以胜任全职管家了。在斯坦福的工作中,研究者开发了一套系统,用于机器人模仿学习需要全身控制
2024-09-03 10:00:00
星环科技Sophon 3.2发布,通过“六易三仓两中心”实现新一代AI平民化
...务,让用户能够基于自身需求构建紧密贴合其业务场景的新一代AI应用。一、六易——实现新一代AI平民化Sophon 3.2从数据接入获取、模型构建训练、模型运维管理、模型发布迭代
2023-05-31 16:00:00
...,或在开放网络上分享过任何内容,那么你就有可能为最新一代人工智能的诞生做出了贡献。谷歌的Bard、OpenAI的ChatGPT、微软的新版必应以及其他初创公司提供的类似工具,
2023-05-01 09:29:00
NVIDIA GTC2024 :你必须知道的AI、机器人、自动驾驶
...式平台上。NVIDIA 创始人兼首席执行官黄仁勋表示,这款新一代自动驾驶汽车处理器将搭载专为 Transformer
2024-03-20 11:13:00
人工智能自虚向实,从re:Invent 2022看如何全面实现数智融合
...、人工智能、云计算、数字孪生、5G、物联网和区块链等新一代数字技术应用和集成创新,为企业数字化转型提供技术支撑。上云、用数、赋智,精炼地描述了企业上云的三个阶段,三重境界。上
2022-12-13 15:57:00
...,提升资源效率”。此次原动力大会上,火山引擎发布了新一代自研DPU,实现计算、存储、网络的全组件卸载,释放更多资源给业务负载。火山引擎尽管是“最年轻”的云厂商,其自研DPU已
2023-04-19 09:33:00
更多关于科技的资讯:
皖企长鑫科技向上交所递交IPO招股书
大皖新闻讯 2025年12月30日,总部位于合肥的长鑫科技集团股份有限公司(以下简称“长鑫科技”)正式向上海证券交易所递交招股书
2025-12-31 21:33:00
大河网讯 这一年,我们没有走遍世界,但世界,走进了《Global Talk》。2025年,《Global Talk》结识了来自全球近30个国家和地区的朋友——他们带着各自的故事
2025-12-31 22:33:00
近日,上药控股山东总部携手浪潮智慧建筑,构建涵盖16大智能化系统的智慧园区体系,以智慧云平台为中枢推进全要素数字化升级
2025-12-31 22:59:00
石家庄二中新添“AI学伴”,有道AI答疑笔以“引导式答疑”助力启发式教学
河北新闻网讯 为推动教育资源均衡发展,让智能科技惠及更多青少年,12月18日,石家庄市“希望工程”事业发展中心、石家庄市青少年发展基金会联合网易有道
2025-12-31 17:18:00
中国消费者报福州讯(记者张文章)12月31日,福建省消费者权益保护委员会聚焦“科技+消费”核心场景发布消费提示,提醒广大消费者警惕伪智能陷阱
2025-12-31 17:33:00
中国消费者报海口讯(记者黄劼)2025年12月30日,三亚海旅免税城迎来开业五周年。海旅免税以“High Five 5•五周年狂欢庆典”为主题
2025-12-31 17:33:00
麦当劳中国第4400家LEED认证绿色餐厅落户福州
福州新华都大厦餐厅盛大开业,“开心书屋”全国首发麦当劳中国第4400家LEED认证绿色餐厅落户福州辞旧迎新之际,麦当劳中国第4400家LEED认证绿色餐厅“福州新华都大厦(五四路)餐厅”盛大开业
2025-12-31 17:49:00
“艾白”来了!12月31日,福州日报社首位机器人员工正式上岗!
2025-12-31 17:49:00
嘀嗒出行发布《2025职场顺风车用户画像及体验洞察报告》
河北新闻网讯(记者 李春炜)12月31日,嘀嗒出行发布《2025职场顺风车用户画像及体验洞察报告》,基于嘀嗒顺风车大数据和近万名嘀嗒顺风车用户调研
2025-12-31 18:04:00
中新经纬12月31日电 “市说新语”微信号31日消息,2026年1月1日起,婴幼儿及儿童家具安全、光伏组件报废、汽车维护检测和诊断
2025-12-31 18:57:00
河北天翼农担业务系统实现关键技术突破
图为国和公司办公大楼。河北新闻网讯(吴建春)近日,河北天翼科贸发展有限公司(简称“河北天翼”)为某农担公司量身打造的担保业务系统业务提报模块
2025-12-31 19:36:00
冬虫夏草产业进入供给侧重构期,东阳光鲜虫草以成熟生态繁育技术,形成产业化优势
在大健康消费持续增长的大背景下,滋补品类正在经历结构性调整,其中冬虫夏草行业尤为突出。长期依赖野生采挖的供给模式,使行业在产量
2025-12-31 14:26:00
猿编程亮相2025新华网教育论坛,创始人李翊:以“4C体系”重塑未来AI教育
2025年12月11日,以“凝聚时代智慧 引领教育创新”为主题的第十六届新华网教育论坛在京举办。教育部相关司局负责人、全国知名高校及中小学代表
2025-12-31 14:26:00
新年礼赠 “去包装化”,驼奶粉成营养市场现象级单品
岁末年初的礼赠市场,正悄然发生一场“价值回归”。曾经风靡的贵价包装礼品逐渐遇冷,而“长期实用、精准营养”的实用型礼品成为新主流
2025-12-31 14:28:00