一家公司主动把自己最新模型的强化学习训练停了两周,这比它宣布的任何新功能都值得看一眼。
OpenAI 说,暂停的是准备用于部署的最新模型的 RL 训练,这两周用来加固和红队测试自己的研究环境。措施包括更强的工作负载与网络隔离、持续的安全测试,以及针对高风险训练、评估和会调用工具的推理,扩展多阶段监控。
这些都是官方自述,有效性没有第三方验证。
值得注意的是对象变了。过去谈安全多在管模型输出,这次管的是内部训练和推理环境本身,尤其点名了会调用工具的推理。
对普通用户,短期几乎感觉不到变化。该看一眼的是在做 Agent 的团队:连模型作者都要给工具调用加隔离和监控,直接把读写权限交出去的做法值得再审一遍。
#人工智能就业 #AI新手村 #大模型 #OpenAI #程序员必备
