前沿模型GOAT之争
身价之外,模型实力谁最强?编程看Claude、综合竞技场看Gemini 3、多面手看GPT-5。
前三
- 编程之王:Claude称霸SWE-bench: Anthropic的Claude在SWE-bench Verified编程评测中长期领先,被大量开发者奉为‘写代码最强’。
- 竞技场冠军:Gemini 3登顶: 谷歌Gemini 3在2025年底登顶LMArena(大模型竞技场)综合排行,人气与实力兼具。
- GPT-5 vs Gemini 3 vs Claude: OpenAI的GPT-5、谷歌Gemini 3、Anthropic的Claude Opus形成三足鼎立,在推理、编程、多模态上互有胜负。
来源
打开完整版