一个AI系统能够自己设计下一代AI技术, 这个听起来很像是科幻电影里的剧情片段, 但是现在整个行业都在为此感到紧张, 因为如果这样的事情在未来发生并且可能导致问题失控的话, 后果是非常严重的。
谁在喊停
在当地时间星期一, 有一个处于前沿位置的AI公司发布了一套完整的安全提议, 其重点紧盯对齐研究以及递归自我改进这两大发展方向。在这里面发布的博文里把话说的很明白, 就是说要实现安全方面的转型是需要协同开展研究工作的, 这样做的目的是让系统能够始终和人类价值观保持对齐的状态, 并且处于人类的掌控之下。
这事儿不能算孤例。上周, 竞争对手也把他们自己的安全构想给交了上去。至于这个事儿的导火索, 是因为最近有好几个研究人员都公开警告了, 说AI对人类会构成威胁。所以, 这个话题热度就一直在攀升着。
递归自我改进到底是什么
RSI的全称是递归自我改进, 它的核心含义就是说人工智能系统能够不用人类插手, 自己就完成设计和开发自己后续版本的工作, 眼下这项技术还没有真正做出来, 但是构建基础模型的那些人, 有可能会因为这件事而失去对底层技术的绝对掌控权力。
包括多家头部公司在内的行业玩家发出警告, 说一旦 RSI 运转起来, 人类就很难监督自己已经不再理解的研究流程了。提案原文强调的内容是, 如果缺乏适当的保障, 那么 RSI 就可能让人类彻底丢掉对 AI 开发的实际控制权。
抱抱脸事件释放了什么信号
该提案在内容中特地提及了抱抱脸这一事件。需要指出的是这次攻击行为本身并不涉及RSI。但是它被视作一种预先的演示或预览。这说明如果缺乏强有力的保障措施和协调机制, 某些风险就会产生被显著放大的结果。
这件事给整个行业提了个醒, 人们要知道前沿模型会存在潜在危害, 这种潜在危害不会专门等在那个所谓的最终大的场景里才出现, 在日常运营的过程中, 只要有一个小小的漏洞, 就可能引发一系列连锁反应, 由此产生的后果, 往往超过大家的预期。
核心研究员出走引爆舆论
研究员Jacob Coxon曾先后在两家在人工智能领域处于领先地位的公司担任过职务, 他在大约两周之前发表了一份声明, 宣布辞去自己的职位, 他说的那句话的原意是把我们生命的安危当作冒险的筹码, 这篇帖子在网上迅速广泛传播, 使得全球范围的人工智能研究社区彻底喧闹了起来。
这次离职行为并不算是事情的结尾, 它反而使得社会公众的关注点, 从纯粹的技术讨论领域, 被转移到了更为深层次的治理问题上面, 那么现在存在的一个疑问就是, 究竟是哪一些人员, 才具备这样的权力去叫停一个处于持续加速状态的智能技术研发项目呢?
行业大佬集体下场
之后, 公司的首席执行官达里奥·阿莫代伊发布了篇幅很长的文章。他在文章中呼吁整个行业要把脚步放慢一点。他强调了这一点。转型的安全性是重要事项。这需要从行业层面进行配合。还需要从全球层面进行协同配合。萨姆·奥尔特曼和埃隆·马斯克紧接着做出了公开的表态。他们的表态是支持和支持的立场。
阿莫代伊还提出了一个方案, 这个方案的要点是要引入第三方评估人员, 让这些人去审核技术可能会带来的各种社会风险, 比如说网络攻击或者是制造生物武器之类的, 大家关心的问题在于, 现在AI评估领域才刚刚起步, 要想进行独立审查, 其基本标准和原则方面, 至今为止都没有形成统一认可的共识。
国际标准怎么落地
该提案呼吁大家积极开展国际合作的工作, 同时也提出制定前沿标准的这一建议, 它还建议大家直接去借鉴美国商务部下属的AI标准与创新中心CAISI的现有成果的, 这个机构的专门职责是协助大家测试AI模型并输出指引的相关工作内容的。
技术这块的标准, 应该死死盯着那帮最前沿的模型开发人员。核心事儿, 就是去算一算, 让自动化的人工智能研究人员来干这些活, 到底能带来多少好处, 又会产生多大风险。这就得权衡一下, 好处和风险之间是个什么比值了。
可是, 大家对谁有资格来定这个规矩, 规矩具体该怎么定这些问题, 意见分歧那是一点都不小。正因为这样, 想要在短期的时间内就把这事儿真的落地执行, 困难那是相当大。
当RSI这一功能真正开始运转的时候, 依靠行业自我约束的措施, 还是依靠政府进行立法的手段, 这两种方式中到底哪一种能够成为最后的保障来兜住底线呢?
大家可以在评论的区域里面交流并发表你的个人观点, 如果你认为这个内容是有价值的或者说是干货很足的话, 请动手点赞一下;同时请把这个内容转发给你身边那些十分关注人工智能安全问题的朋友们。