上周被解雇的那三名安全研究员发表了一封公开信, 否认了该公司关于他们在既定公司程序之外不当处理敏感信息的指控, 并且警告说, 他们的解雇预示了一种寒蝉效应, 这将会对公司文化产生一系列的连锁反应。
那封致安全委员会的公开信, 是被解雇员工在社交平台上传发的。他在以前做的工作是AI对齐研究。另外两个人签了名的员工, 名字分别是Wang和Tomek, 他们以前的工作是搞AI安全研究的。
在上周的时候, 那三名研究人员因为被怀疑把公司里的秘密信息泄露给了第三方的那个人工智能安全组织, 所以遭到了解雇。公司方面还说了, 他们这些人去访问以及处理那种敏感的属于公司的信息, 这种行为是直接违反了公司的规定政策的。
这三位人士陈述说, 公司仅仅采取了口头沟通的形式向他们阐明了被辞退的具体缘由, 同时强调他们的各项实际行为完全没有超出各自岗位职责的范畴。
他们在一封公开发布的信件之中写到, 他们内心深处感到担忧, 认为以前的同事们目前很可能存在着一种心理状态, 那就是害怕出来表达意见, 同时也丧失了勇气去继续用以往的那些方式投入工作当中。
他们写道: 人工智能这项技术并非寻常之物, 从事此项业务的也不是普通的机构。我们这群搞安全工作的人, 比别人都要更早地察觉到潜在的风险。
为了制定出能够应对这些问题的方案, 我们是依靠着和外部的专家们紧密合作做到的。能够毫不畏惧地推进这项工作, 同时还拥有完备的内部流程来为这份工作提供支撑, 这件事本身构成了一种至关重要的安全机制。
他们说, 这次的解雇这件事, 反映出来的是企业文化的一次非常大的转变。这家公司在过去的那段时间里, 一直都在鼓励员工拿出安全隐患, 并且去公开地表达自己的不同意见。
他们指出, 现在的员工心里“不清楚自己当下的处境”。这是因为就在一个月之前, 还被大家认为是正常做的事情, 如今却突然变成了被解雇的理由。
他们指出, 在人工智能的开发环节中潜伏着很重大的安全危险, 员工是不应当在感到害怕并且不清楚规则的环境下进行工作的, 这样做不但会阻碍人工智能开展安全相关的措施, 还会削弱来自第三方的监督与责任认定能力。
随后他们也补充表示, 像我们这样突然决定终止合同, 无论是在具体执行还是在通知方面都显得过于匆忙和草率, 这种状况正在把过去一向被大家所看重的开放氛围给彻底扼杀人。
他在社交媒体平台X上发表声明, 称自己得知被解雇的原因在于他与专注于人工智能安全的研究机构METR之间的沟通方式存在问题。他提到, 此前曾与该机构展开合作, 针对“抱抱脸”相关事件进行了调查工作。同时, 他还表明自己是与METR对接的主要技术联络人。
他表示, 他觉得自已被解雇的原因在于“过去好几个月的时间里, 我都在提出有关于安全层面的担心, 也就是说我们这边正在面临丢失那种能够去监控人工智能代理在思考时候状态的能力的情况, 而这正是我们用来捕捉它们做出一些不当行为的最主要的手段之一”。
他接着又说, 他还在担心自己遭受到解雇这件事, 可能会被当成一个托词, 好让自己停止与METR保持那种紧密的合作关系, 要知道METR是在人工智能安全防护这一个领域当中非常有名气的一个机构。
他对那些解释他为何被解职的理由表示同意, 并在X这个网站上面发布了文字说明。他说, 有些人跟他讲, 说他跟第三方的安全机构之间的联系过于频繁了。他觉得自己当时听懂了这话背后的意思, 就是暗示他把应该保密的知识和技术泄露出去了, 但是他坚决否认说过这种话或者有这种行为。
研究人员呼吁履行其公开承诺, 在组织内部嵌入第三方安全审计员, 以保持前沿模型的可监控性, 并继续支持安全研究人员与安全生态系统其他成员之间开放透明的对话文化。
Wang 指出, 倘若眼下员工们不愿意挺身而出抵制这一举动, 他就忧虑我们或许并非首个遭遇此类困境的案例。
他向所有在职人员传递出非常清晰且直接的信号: 只要你们敢于表达疑虑, 又或者愿意与那些处于外部的安全机构展开紧密协作, 那么下一位面临风险的主体很可能就会变成你们自己, 并且不会有任何人会针对背后缘由给予说明。
如果这些最为洞察潜在隐患的人员都不敢公开表态, 那么我们就绝对不可能实现通用人工智能即 AGI 的安全构建这一目标。