2026-06-18 08:48:08
55次阅读
0个评论

OpenAI发布LifeSciBench基准测试,包含750个专家任务,用于评估AI在真实生命科学研究中的推理与决策能力,其中GPT-Rosalind得分超过GPT-5.5。


网友热议:有人批评OpenAI用女科学家罗莎琳德命名模型却将其封闭商业化,质疑Gemini排名靠后且缺少开源模型和Claude对比,也有人觉得Rosalind只比GPT-5.5强一点、普通用户用不上也没啥可惜的。

0

登录 后评论。没有帐号? 注册 一个。

小陈

manage advert
  • 0 回答
  • 0 粉丝
  • 0 关注