Meta AI Research · Muse·· 2 天前AI 评分38
Meta 更新超级智能扩展框架,将安全要求延伸至训练与评估阶段
Developing Capable Models Responsibly
AI 导读
Meta 发布 Superintelligence Scaling Framework 更新,把失控风险管控要求扩展至训练与评估阶段:高风险强化学习训练前须评估模型能否破坏环境,环境须置于经内部流程审核的沙箱中,模型输出(含完整轨迹与思维链)实时写入防篡改日志,自动化系统可监控并中止高风险运行。框架同时细化了开放权重模型发布的风险评估,并计划新设董事会 AI 委员会审查后续框架变更。
来源:Meta AI Research · Muse · research.meta.ai