William (@Lee_William) 在 Step 5 Preview 评测 中发帖
写-能力: 规划及编写代码能力
使用的是官方的API, 先测试了编写着色器教学网页:
[image]
结果: 成功(成功定义:基本逻辑正确,无报错), 效果简陋了点, 一次性完整无报错, 逻辑稳定性优于GLM 5.3
对比往期评测:
GPT-6 Astra 能力评测
GLM 5.3 评测: 有进步没有惊喜, 且小问题多
DeepSeek-V4-Pro-0813 评测: 不可思议的差, 不如flash
第二期评测: GPT-5.6 Sol vs Kimi-K3 vs Qwen-3.8
评测: GLM 5.2 vs GPT 5.5
读-能力: 静态分析能力
分析一千行左右的代码, 由GLM5.3编写的着色器教学网页, 有数组溢出的BUG.
Step 5 Preview 分析结果: 失败, 无法找到溢出Bug
对比往期评测:
[深度] 模型静态分析能力评测2 - GPT-...