AI大模型评测:顶尖模型竞争激烈

LLM排行榜显示,Claude Mythos 5和GPT-5.6 Sol在GPQA和SWE-Bench等基准测试中表现突出,Claude Opus 4.6-thinking也位居Arena排行榜前列,竞争异常激烈。

来源

打开完整版