给最强模型找个”上市前审查员”
前沿 AI 模型发布前,到底谁来把关?Google DeepMind 的 CEO 戴密斯·哈萨比斯这周在 X 上发了一篇长文,抛出了一个相当具体的答案:参照金融业的 FINRA,成立一个独立的”标准机构”,在最强模型向公众开放之前,先替大家把危险试出来。
哈萨比斯把这篇框架文章命名为《前沿 AI 的框架,与一个新时代的开端》。他的设想是:最初,做前沿模型的实验室可以自愿在发布前最多 30 天,把模型交给这个标准机构做评测;一旦评估流程被证明靠谱,就会顺势变成强制要求——通不过,就不能在美国市场部署。发布之后要是冒出严重漏洞,实验室也得配合机构一起修。

“这个办法的好处是,它技术上聚焦,同时又不压制创新,还能奖励负责任的做法。”哈萨比斯坦言,机构要跟得上领域加速,并能在风险变大时加码。
绕开”AI 版 FDA”的政治死结
AI 监管在美国至今是个烫手山芋。白宫 AI 顾问、a16z 合伙人 Sriram Krishnan 前不久就把话挑明了:行政体系里”不会有 AI 的 FDA”。把标准机构设计成 FINRA 那样的自监管组织,恰恰是给这个分歧留了条缝——它既有约束力,又不用新设一个联邦部门。
按哈萨比斯的构想,这个机构由开源代表和业内技术专家组成,资金来自各家 AI 实验室,还可以把某些评测外包给专门盯特定风险的 AI 安全小组。测试重点也很明确:网络攻击、生物威胁,以及模型试图绕开自身护栏的”欺骗”行为。
到底是真能管住最强模型,还是最后变成大玩家们学会”应付考试”的又一处场子,现在谁也给不了答案。但至少在”模型上线前该有人先看一眼”这件事上,行业里最有分量的那几位,似乎正在慢慢达成共识。
发表回复