DC娱乐网

Sam Altman在帖中宣布OpenAI暂停部分前沿强化学习(RL)训练2周,

Sam Altman在帖中宣布OpenAI暂停部分前沿强化学习(RL)训练2周,以确保满足新能力水平下的对齐、安全和监控标准,强调模型进步极快时会优先采取行动。此举与OpenAI此前对Astra模型的“关键”网络安全评估相关,已暂停两周以强化研究环境、红队测试和监控,反映能力增长正推动内部风险管理升级。