Original English article
The original post, wording, author attribution, article card, and cover are rendered directly from X rather than copied into this repository.
正在从本站缓存加载原始 X 内容…
原帖缓存暂时不可用,请使用下方原文链接。
Open the original article on X
中文导读
Demis Hassabis 在文章中提出由美国发起 Frontier AI 标准机构。文章开头关于 AGI 时间和影响规模的内容属于作者预测,不应被当作已经发生的事实;更具体的部分是其治理制度提案。
框架希望按照动态能力阈值,而不是按照公司名称或模型是否开源,识别 Frontier-class 模型。建议测试范围包括网络安全、生物风险、欺骗、绕过安全护栏等高风险能力,并通过定期更新基准、隐藏评测与第三方审计降低模型针对固定测试刷分的可能。
作者提出初期可以让实验室在发布前自愿提交模型,待评估机制成熟后,再考虑把通过评估作为部署条件。行业出资能够提供专家和算力,但同时也引出监管俘获、利益冲突和监督者问责的问题。
用反馈图理解监管
监管本身也由多个循环组成:实验室内部测试、标准机构独立评估、第三方审计、发布后事故反馈、基准更新,以及政府与公众的慢速治理。任何一个环节如果只依赖被监管者提供的数据,都可能失去现实锚点。
值得继续追问的问题包括:
- 谁来监督标准机构本身?
- 隐藏测试怎样保持独立且可审计?
- 行业出资如何避免改变规则制定?
- 开源、海外和工具增强模型如何纳入能力阈值?
- “暂停或减缓开发”的触发条件由谁定义?
英文原文和封面版权归原作者及 X 页面所标示的权利方所有。本站通过服务器代理缓存公开的 X 数据和封面,再以同源卡片呈现原帖摘要;下方仅提供独立中文导读。封面副本仅用于本站展示,并保留原始来源说明。
如果这篇文章对你有帮助,欢迎分享给更多人!
部分信息可能已经过时



