2026-06-20 10:01:44
51次阅读
0个评论

OpenAI通过强化学习训练模型在健康、科学等12个领域保持诚实、谦逊、公平等有益特质,并在对抗性测试中展现出更强的安全性和抗有害微调能力。


网友们觉得这研究挺牛的,但很多人也担心这只是OpenAI在画饼,毕竟之前翻过车。有人吐槽“对抗性提示”听起来像AI在玩心理战,还有人调侃说希望这模型能学会不写那些又长又臭的废话。

0

登录 后评论。没有帐号? 注册 一个。

小陈

manage advert
  • 0 回答
  • 0 粉丝
  • 0 关注