@lchkid 在 Grok 4.6 将于8月7日前后发布,这将是1.5T模型,SFT和RL将显著改进。 中发帖
在我们最新的 http://deepsec.sh 基准测试中,Grok 4.5 已脱颖而出,成为性价比最佳的网络安全 AI 模型。
它比 Sol 便宜 10 倍,比 Opus 5 便宜 5.7 倍,比 Kimi K3 便宜 2.2 倍,但性能却达到了 Kimi 级别。
Sol 仍是前沿模型,领先于 Opus 5。
DeepsecBench 评估模型在发现网络安全漏洞时的准确性、成本和速度。
最新结果:
GPT-5.6 Sol 得分最高
Kimi K3 以 1/5 的成本获得一半的最高分
Grok 4.5 在前 10 名中获得最佳得分/成本比率
[image]