OpenAI发布了一项新研究,通过模拟部署来预测模型在真实场景中的行为,并发现该方法能有效估算不良行为的出现频率。
网友们觉得这方法挺靠谱,毕竟能提前看到模型在实际使用中会出啥幺蛾子,比光靠测试和红队演练更贴近真实情况,不过也有人担心数据隐私和模拟的准确性。
请 登录 后评论。没有帐号? 注册 一个。
小陈