堆代码网讯 微软首席执行官萨提亚·纳德拉成为又一位就如何完善AI安全发表长篇思考的科技行业高管。纳德拉周六上午在X平台发文称,现在是时候“退一步评估AI的信任架构”了。
他在文中用特朗普政府对AI的常用表述写道:“我们不能把超级智能当成一层层嵌套的黑箱,只简单接受或拒绝它给出的建议、答案和行为。”

按照纳德拉的阐述,这套思路“意味着将模型和调度其工作的管控框架分离开来”,同时要“把控制措施和安全保障外置”。他还呼吁对“每一项有实际影响的模型操作”都留存“防篡改、人类可读的记录凭证”,并确保系统始终支持“授权人员在任务中途暂停或关停模型”。他表示:“我们必须从一开始就假设模型可能被入侵,并做好隔离防护,这就像给它装一个紧急制动器。”
纳德拉此番表态的背景是,头部AI企业正披露越来越多看似失去模型控制权的事件,此前Anthropic首席执行官达里奥·阿莫代伊也刚发布了一份更审慎的AI发展规划。