Code Arena 开始衡量全栈能力:Kimi K3 登顶,GPT 5.6 第二,Claude Fable 5 第三
资讯来源: x作者: arena热度: 877发布于 2026年7月29日
Code Arena基准测试新增全栈开发能力评测,包含多步推理、工具使用和端到端应用生成。最新排名中,Kimi K3 (Max) 居首,GPT 5.6 Sol 第二,Claude Fable 5 第三。
- benchmark
- AI Models
- Code Arena
- fullstack
评论
登录后即可评论
还没有评论,来发第一条吧。