OpenAI 暂停前沿模型 RL 训练以强化安全
OpenAI 因模型能力增强带来的内部开发与测试风险上升,暂停了最新部署模型的强化学习(RL)训练两周,以加固研究环境、扩大红队测试与监控覆盖。其最大规模的前沿 RL 训练仍处于暂停状态,需通过小规模训练和评估验证安全措施并积累对齐证据。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsyzrlqd04xhro20xbr0dgud
来源:AI Hot News · RSS
还没有引用,欢迎补充背景或结论。