OpenAI Announces Benchmarks for AI Life Sciences Research. Its Best Model Failed 63.9% of the Test
OpenAI 发布生命科学研究 AI 基准测试:其最佳模型在测试中失败了 63.9%
from the failing-the-science dept.
来自"科学翻车"栏目。
June 22, 2026 at 05:39 AM GMT+8
发布时间:June 22, 2026 05:39 AM GMT+8
This week OpenAI announced a 750-task test to measure whether AI systems can support realistic life science research tasks, not just answer biology questions.
⋯ 继续阅读请登录会员 ⋯