DeepsecBench 最新结果:GPT-5.6 得分最高,Kimi K3 以五分之一成本获其一半分数
资讯来源: x作者: vercel热度: 171发布于 2026年7月28日
网络安全漏洞检测基准 DeepsecBench 评估了多个模型,GPT-5.6 Sol 得分最高,Kimi K3 得分为其一半但成本仅五分之一,Grok 4.5 在前十中性价比最佳。
- benchmark
- cybersecurity
- GPT-5.6
- Kimi K3
- Grok 4.5
- vulnerability detection
- DeepsecBench
评论
登录后即可评论
还没有评论,来发第一条吧。