AGI 安全的挑战:理解 DeepMind 的 145 页论文

人工智能的演变和人类面临的风险:DeepMind 视角下的 AGI 未来

到 2030 年,具有类人智能的人工智能将被创造出来——谷歌 DeepMind 令人震惊的预测正在科技界掀起波澜。从智能手机语音助手到人工智能聊天,人工智能已经融入我们的日常生活。然而,等待这种进化的是“通用人工智能(AGI)”的出现,它可以像人类一样解决各种问题。

虽然这种演变有可能丰富我们的生活,但它也带来了无法控制的风险。 DeepMind 的最新论文超过 145 页,详细警告了 AGI 带来的“严重危害”和“生存风险”。在本文中,我们深入探讨了人工智能研究前沿组织对通用人工智能的未来愿景以及如何管理其潜在危险。对于每一个对技术演进抱有期待和担忧的人来说,这样的讨论是不可避免的。

🎧 单击此处查看本文的播客风格音频评论 ↓

什么是通用人工智能? AGI的定义及其2030年的实现路径

通用人工智能(AGI)是指几乎可以执行人类执行的任何智力任务的人工智能系统,而不仅仅是在特定领域。当前的人工智能在图像识别、语言处理等单项任务中表现出卓越的能力,而通用人工智能将全面具备人类特有的能力,如解决问题、创造力和判断力等。

AI研究界对于AGI出现的时机存在分歧。尽管有人警告说这还需要几十年的时间,但 DeepMind 的一篇新论文做出了令人震惊的预测:AGI 可能会在 2030 年成为现实。

如果这一预测成为现实,社会结构、经济体系乃至人类自身的角色都有可能发生根本性的转变。然而,与此同时,DeepMind 也警告称,可能会出现“严重伤害”,包括威胁人类生存的“生存风险”。科学技术进步带来的好处和威胁如此鲜明对比的情况可能很少见。

AI 安全的三方方法:比较 DeepMind、Anthropic 和 OpenAI 的策略

处于 AGI 开发前沿的领先组织正在采取不同的方法来确保安全。这种差异形成了有趣的对比,反映了每个组织的理念和技术观点。

Anthropic采取保守立场,强调“稳健的培训、严格的监控和多层次的安全机制”。他们的“宪法人工智能”方法旨在开发符合人类价值观的人工智能,体现了他们对安全第一的承诺。

另一方面,OpenAI正在大胆致力于“自动化AI安全研究”。这是一种创新方法,旨在利用AI系统本身来推进安全研究,可以说是“用AI监控AI”。

DeepMind 在这些问题上采取了更加实证的立场。特别值得注意的是,人们对“超级智能人工智能”的可行性表示怀疑,因为它远远超过了人类的智能。 DeepMind冷静分析当前技术局限性并设想逐步进化的态度,为AGI发展提供了现实的路线图。

DeepMind的研究人员最关心的是“递归AI改进”的场景,即AI不断地自我改进。如果这种现象加速,人工智能也许能够重写自己的代码并成倍提高其性能。结果可能是超级智能生物的思维过程甚至连他们的开发者都无法理解。

这种无法控制的人工智能所带来的威胁不仅限于科幻电影的世界。 DeepMind论文提出了三种具体的预防措施:

  • 防止滥用技术的开发:从技术上来说,恶意行为者不可能将 AGI 用于危险目的
  • 提高人工智能的可解释性:解决AI“黑匣子”问题,让人类理解决策过程成为可能
  • 营造安全的活动环境:对人工智能运行的虚拟环境设置限制,以遏制潜在的危险行为

尽管这些措施仍在制定中,但该论文警告说,“如果通用人工智能开发和安全研究不并行推进,就有可能出现不可逆转的情况。”

反对和学术辩论

为了回应 DeepMind 的警告,学术界正在提出一个基本问题:“AGI 的概念本身在科学上是否有效?”

AI Now Institute 的 Heidy Khlaaf 指出,AGI 的概念尚未明确定义,无法进行严格的科学评估。从这个角度来看,在没有明确评估标准的情况下针对目标采取安全措施可能就像在沙子上盖房子一样。

此外,阿尔伯塔大学的 Matthew Guzdial 教授对 DeepMind 警告的“递归人工智能改进”的现实性提出质疑。 “在当前的人工智能架构下,系统在技术上不可能从根本上改进自身”的观点强化了对在不久的将来实现 AGI 的怀疑的立场。

这些反对意见表明,关于通用人工智能的争论不仅仅是技术问题,还涉及诸如“什么是智能?”和“自我完善意味着什么?”等哲学问题。

人工智能的自我增强和真实性问题

目前,人工智能自我增强带来的风险之一是虚假信息的强化。特别是,随着生成式人工智能在互联网上的激增,人工智能在学习自身输出的过程中存在捕获包含虚假信息或幻觉的数据的风​​险。这有可能破坏人工智能提供的信息的可信度,增加用户相信虚假信息的风险,特别是当使用聊天机器人进行搜索和查明真相变得越来越普遍时。解决这个问题需要新的方法来保证人工智能输出的质量。

社会影响和道德考虑

AGI的发展有可能对整个社会产生深远的影响。这些范围从劳动力市场的变化到道德挑战。例如,由于自动化任务或引入可能做出道德上有问题的决策的人工智能系统而导致失业的风险。为此,有必要从伦理角度评估AGI的发展,有必要仔细考虑技术的演变将如何影响社会。如何在技术创新和社会责任之间取得平衡将是未来面临的重大挑战。

AGI 的未来和我们的选择

AGI 的未来不仅取决于技术的演变,还取决于我们如何拥抱和使用该技术。 DeepMind 论文认为,如果 AGI 的实现不可避免,就必须做好准备以尽量减少其影响。这意味着不要担心技术进步,而是探索管理风险的选择,同时最大限度地发挥其潜力。工程师、政策制定者和整个社会必须共同努力,采取措施建设可持续的未来。

概括

虽然 DeepMind 论文深入洞察了 AGI 的潜力和风险,但其内容仍然存在很多争议。在考虑技术演进的影响时,本文提出的警钟不容忽视。未来的技术发展需要找到一个道德和安全的方向,这不仅是对工程师的挑战,也是对整个社会的挑战。如何塑造通用人工智能的未来取决于我们自己。

参考)AGI 技术安全保障方法