要在中文语境里讲清Achiam的分量,得回到2022年那篇名为《Training language models to follow instructions with human feedback》的论文。正是这篇后来被称为InstructGPT的工作,把”人类反馈强化学习”(RLHF)这套方法立成了ChatGPT的底座。Achiam是那篇论文的共同作者之一,也是OpenAI最早一批研究科学家里的关键人物。
他还有另一件被整个AI圈记住的事:主导打造了开源项目”Spinning Up in Deep RL”。这是OpenAI当年推出的一套深度强化学习入门教材,把原本高门槛的RL知识摊开给普通人,培养了不少后来入行的人。一个既写得出奠基性论文、又愿意把知识免费撒出去的研究者,在一家以技术信仰立身的公司里,分量可想而知。
那么是什么触发了禁令?据报道有两件事。第一:Anthropic通过有限合作伙伴计划,向一家韩国电信公司开放了Mythos访问权限,美国官员在确认该公司与中国有关联的嫌疑后感到警觉(该公司被广泛报道为SK Telecom,已否认任何中国关联)。第二:Amazon CEO Andy Jassy据报告知政府,Amazon的研究人员找到了绕过Fable 5安全保护措施的方法。Anthropic对”越狱”这个说法有异议,称那是一个狭窄的、已经修补的问题,而非模型安全措施的全面失败。
“Think of it like a driving instructor with dual controls. The instructor trusts the student but stays ready to take the wheel or hit the brakes if a mistake occurs.”
—— Google DeepMind博客
OpenAI最近两天的动作,像是一场精心编排的IPO前戏。先是从Google挖来了Noam Shazeer——这个人可不是普通工程师,他是2017年那篇《Attention Is All You Need》的作者之一,也就是Transformer架构的奠基人。要知道,现在所有大模型公司都在用的Transformer,源头就是这篇论文。