动态

Grok4、GPT-5、Gemini2.5 Pro准确率高,但Claude幻觉率更低

Grok4、GPT-5、Gemini2.5 Pro准确率高,但Claude幻觉率更低
Artificial Analysis
Grok 4(@xai)、GPT-5(@OpenAI)和 Gemini 2.5 Pro(@GoogleDeepMind)在 AA-Omniscience 中实现了最高准确率。它们未能获得最高 Omniscience Index 的原因在于 @AnthropicAI 的 Claude 模型具有较低幻觉率。
动态Artificial Analysis2025-11-17原文

相关内容