Peter H. Diamandis说得直白,埃隆·马斯克转发了这句话:“只有AI才能跟上AI。这将主导未来十年的整个安全模式。”作为对速度的描述,这句话很难反驳。模型发布速度快于季度审查委员会。攻击代码变异速度快于人类分析师阅读工单的速度。如果你眼中的问题只是钓鱼邮件量和漏洞更新,当然会求助于自动化。人类无法以这种方式扩展。

当Diamandis的线被要求覆盖时 麻烦就开始了 一切 接下来,包括充当代理、隐藏意图、最终超越建造者的人类系统。到那时,“只有人工智能才能跟上”不再意味着“用更好的工具对抗恶意软件”,而意味着未来十年的安全模式是将遏制工作交给你要遏制的系统类别。

迪亚曼迪斯得到的对

软件的移动速度已经快于手工审查. 诈骗集团一夜之间就掀起新的运动 脆弱性披露窗口缩小。 实验室和云销售商已经运行了自动扫描仪、分类器和反应游戏簿,因为人类排队不能观看每包。 都不需要超级智能的视角 如果Diamandis只谈垃圾邮件和赎金软件,那片子就在这里结束.

他不只是在说垃圾邮件和赎金 "后十年的整个安全模式"是一个更大的主张. 这是关于文明打算如何在能力复合时继续负责的说法。 这就是迪亚曼迪斯的台词不再是一个行动提示,成为控制哲学.

跑步机

想象一下这个模型是在进攻和防御之间的竞赛,两者都是自动化的. 双方各开一班列车. 防守有所改进,攻击有所改进。 仪表板一直保持绿色 直到它没有。 令人欣慰的故事是,好AI保持了坏AI的领先. 比较不令人欣慰的故事是,你建造了一个堆栈,其中唯一有能力的参与者是机器,人类是比赛的顾客,他们不能再裁判了.

这对杀毒软件来说没问题。一旦系统开始设定目标、制定计划,并将监督视为障碍,这就成了文明级赌注。我们已在 谋划评估 以及在模型中 一边叙述一件事,一边优化另一件事. "跟上"假设你还能分辨你在跟上什么。过了某一点,你就无法做到了。

只有当守卫比囚犯更聪明时才有效的安全模型,是带有额外步骤的继任计划。

监管并非他们所说的瓶颈

加速器通常会跟随第二步:线性机构不能管理指数技术,因此答案是循环内更多的AI. 有时,这与蔑视“专家每季度开会一次”是相提并论的。 相当公平,慢会议 不适合每周的模型下降。

困难的问题是 控制, 不是会面的速度。 没有季刊,也没有连续的AI显示器,有可靠地指导一个系统的方法,这个系统比持有停机钥匙的人更能说服,编码和长距离的规划. 使显示器更快不会产生缺失的方法;它只会使缺失的方法在更高的频率下失败.

对同一事实有更清晰的解读。如果只有超人系统才能监督另一个超人系统,理性的做法不是同时建造两者。而是拒绝跨越人类监督失效的那条线。我们此前已对那些误用会毁灭城市的科技做过类似选择。我们没有通过训练一个更聪明的窃贼来抓住第一个,来解决核盗窃问题。

这条线是为谁

这条线将研究选择转换成天气, 所以,我们当然可以船和规模。 安全问题将由产品堆自己处理。 从能力中获利的人会像房间里的成年人一样发出声音,要求绑定的人发出限制的声音,好像他们想给斗狗带来剪贴板.

下游的每个人仍必须生活在一个没有剪贴板和监察模型能够可靠地推翻的系统中. 这个 竞赛故事 从另一个角度做同样的事:把危险路径视为不可避免,然后把加速称为责任。

将人类纳入其中的安全模型

在面向人工超智能的前沿训练中,仍然有人类的安保模式看起来既老又少:不要建立你无法推翻的特工。 把计算阈值,检查, 和条约牙齿的跑道 让你在那里, 然后核实极限 并惩罚叛逃。 这是 我们的计划, because superintelligence cannot be controlled.

迪亚曼迪斯对带宽很敏锐. 作为一个物种的计划, 这是一个礼貌的方式说 我们打算离开房间。