抱怨廉价准确的长上下文未解决,Anthropic表现好
有一件让我有点烦的事情,希望很快能解决的是便宜且准确的长上下文。
在最近几周测试了GPT-5.6 Sol和Terra后,很明显Anthropic在长上下文连贯性方面击败了所有人,可能成本上也更优(?)。
OpenAI在我看来对超过350K上下文收费两倍,但无论如何没必要去那里,那些模型在那点上完全失败。我经常在800K+上下文使用Opus和Fable,感觉它们和25K上下文时一样连贯和高质。
我没有彻底测试很多其他模型在这种长度下的表现,但感觉除了Claude之外,在这个领域我们离很好地或廉价地处理这个问题还有很长的路要走。
Magic.dev的1亿token上下文怎么了?难道这一切都没成功?
在最近几周测试了GPT-5.6 Sol和Terra后,很明显Anthropic在长上下文连贯性方面击败了所有人,可能成本上也更优(?)。
OpenAI在我看来对超过350K上下文收费两倍,但无论如何没必要去那里,那些模型在那点上完全失败。我经常在800K+上下文使用Opus和Fable,感觉它们和25K上下文时一样连贯和高质。
我没有彻底测试很多其他模型在这种长度下的表现,但感觉除了Claude之外,在这个领域我们离很好地或廉价地处理这个问题还有很长的路要走。
Magic.dev的1亿token上下文怎么了?难道这一切都没成功?