微软CEO萨蒂亚·纳德拉在北京时间10月10日晚发表文章,认为在AI时代,使用超级智能自我监控等简单策略已不足够。
重新评估AI信任架构
纳德拉表示,传统软件系统有追踪代码路径行为的工具,但AI模型更为强大却是黑盒子。我们部署了这些复杂系统,让它们访问敏感数据并执行关键任务,因此需要重新评估新时代的信任架构。
建立封闭系统
模型提供商无法将责任外包,不能将超级智能视为嵌套黑匣子。必须建立能够观察行为、测试极限并始终容纳行为的封闭系统。将前沿封闭权重和开放权重模型视为内部风险,是因为任何有能力接触重要系统的行为者都可能犯错或被攻破。
七大设计原则
纳德拉提出开发者应围绕可观测性原则设计系统:模型多样性、观察一切、可验证性、独立控制、独立审计性、遏制和事件披露。特别是遏制机制,需假设模型已被破坏,授权人员应能随时暂停或关闭模型。
上一篇:食品安全法修订草案公开征求意见
下一篇:已经是最后一条,没有下一条