OpenAI模型推理和上下文超Claude 3.7,通过强化学习提升性能
> 无论是推理能力还是上下文长度都超过了公开的 Claude 3.7 Sonnet 模型,同时他们还基于 o3 针对 Deep Research 做了大量的强化学习训练,让模型在执行任务和生成内容都可以取得很好的效果,模型能力就是 OpenAI 的护城河。
google deep research 大家基本不用再测试了。
之前的基座模型 1.5 pro 多少还是个满血版,现在赶鸭子上架,换成了 2.0 flash 蒸馏版模型(估计是因为长时间不更新,就变成了“起个大早赶了个晚集”)。
我测试让它针对一本书出一份不少于 2 万字的导读报告,确实参考文献列出了 200