动态

推出GeneBench-Pro测试模型处理复杂生物分析能力

推出GeneBench-Pro测试模型处理复杂生物分析能力
Greg Brockman
介绍GeneBench-Pro——测试模型是否能处理真实计算生物学所需的高判断力分析。问题大约需要人类专家20-40小时完成。GPT-5.6 Sol是向前迈出的一大步。
OpenAI
我们推出GeneBench-Pro,一个研究级基准测试,用于衡量一种更难的人工智能进展:智能体在混乱的生物数据中导航、选择正确分析路径并做出真实计算研究所需的判断的能力。
动态Greg Brockman2026-07-01原文

相关内容