前沿实验室提供长上下文,2026年将揭秘实现。
既然所有前沿实验室现在都提供“长上下文”,2026年将是每个人发现“长上下文”实际上是如何在底层实现的一年 :)
这太疯狂了。我注意到在 Opus 4.6 上消耗超过20% token 时性能显著下降。它下降得非常可怕,好像100万上下文无关紧要。模型开始变得妄想且不可用。0-15% 是一个非常舒适的区间,模型一致且高效 https://t.co/KtOP1T39X8
这太疯狂了。我注意到在 Opus 4.6 上消耗超过20% token 时性能显著下降。它下降得非常可怕,好像100万上下文无关紧要。模型开始变得妄想且不可用。0-15% 是一个非常舒适的区间,模型一致且高效 https://t.co/KtOP1T39X8