OpenAI发布LifeSciBench基准测试,包含750个专家任务,用于评估AI在真实生命科学研究中的推理与决策能力,其中GPT-Rosalind得分超过GPT-5.5。
网友热议:有人批评OpenAI用女科学家罗莎琳德命名模型却将其封闭商业化,质疑Gemini排名靠后且缺少开源模型和Claude对比,也有人觉得Rosalind只比GPT-5.5强一点、普通用户用不上也没啥可惜的。
请 登录 后评论。没有帐号? 注册 一个。
小陈