• AGI 怎么管,谷歌 DeepMind 想先把争论摆上台面
  • 发布于 1小时前
  • 3 热度
    0 评论
堆代码网讯 周三,谷歌和谷歌 DeepMind 的研究人员成立了 DeepMind 研究所。董事名单里有 DeepMind 联合创始人 Shane Legg、谷歌高管 James Manyika,以及谷歌 DeepMind 董事长 Demis Hassabis。Legg 还担任执行主编。

这家研究所要做的事,不是替谷歌给 AGI 下一个统一结论,而是要把谷歌、谷歌 DeepMind 和全球研究界的不同看法摆出来。公告写得很直接:他们不会总是一致,随着这个快速变化的前沿冒出更多数据和信息,他们也可能改变想法。第一批文章有四篇,话题从经济政策到模型推理,再到人类繁荣和前沿模型评估。具体包括:怎么用经济政策应对可能的 AGI 冲击,怎么保留人类可读的模型推理,人类繁荣的原则,以及一套评估前沿 AI 模型的框架。

其中一篇来自 DeepMind 安全研究员 Rohin Shah 和 Anca Dragan。文章盯上了一个越来越现实的问题:AI 的透明度窗口正在缩小。所谓透明度窗口,就是人能看到并检查模型一步步推理的能力。两位作者认为,这不是必然结果。新架构让最强大的模型更难监控,开发者和监管者就不该绕开安全权衡。一个办法是限制“不透明串行深度”,也就是模型在不产生可读推理轨迹的情况下能连续计算多少;另一个办法是要求开发者证明,透明度更低的系统仍然同样可监控。

另一篇由 Hassabis 署名。他提议建一个美国主导的前沿 AI 标准机构,专门评估最先进的模型。按他的设计,开发者一开始在发布前最多 30 天自愿提交模型审查。等评估体系证明有效,通过测试就可能变成在美国部署前沿模型的硬性要求。这个机构最初会和 AI 公司商量评估怎么做,但最终要自己搞一套独立、不公开的“保留”测试,防止实验室针对已知评估去调整模型。Hassabis 还留了口子:如果情况严重,框架可以逐步加码,甚至包括前沿 AI 开发者之间的协同放缓。

这些文章出现的时间点很关键。行业里的安全讨论,正在从“大家都很担心”转向更具体的提议:披露什么、让谁审查、如果保障措施跟不上要不要一起慢下来。本周这一转向更明显,因为一些行业领袖开始支持 Anthropic CEO Dario Amodei 的部分呼吁——给前沿 AI 发展“定个节奏”。

DeepMind 研究所能不能让这场辩论更有用,还得看它接下来能放进来多少真正不同的声音。至少现在,它先把分歧摆上了桌面。
用户评论