后训练之神 国产大模型GLM-5.3实测:性价比20倍于美国顶级AI Fable5

青青百科 百科资讯 1

8月15日消息,日前智谱正式发布了GLM-5.3大模型,相比5.2版没有升级基座模型,还是7440亿参数量,但性能大幅提升,直追Fable 5。

对于GLM-5.3的表现,国内外的AI用户都很惊讶,甚至有人怀疑是智谱过拟合目前的评测项目了,但这几天网友实测表现也否定了这种跑分作弊的可能。

GLM-5.3用美国大模型1/10到1/5的参数量就做到了这么强的性能,靠的就是他们的RL后训练,这方面GLM-5.3堪称后训练之神了,而且智谱表示还有潜力可挖,估计后续的GLM-5.5还能更强。

GLM-5.3这次不仅是性能直追Fable级别,而且保持了价格优势,相比GLM-5.2没涨价,再加上使用中减少了Token用量,整体成本还是下降的。

Command Code用FlappyBench测试项目对比了GLM-5.3、Fable 5 和 GPT-5.6 Sol三个模型的性能与花费,根据功能、UX/UI和成本评分如下:

Fable 5 → 9.5/10 · $0.420

GLM 5.3 → 9/10 · $0.018

GPT-5.6 Sol → 9/10 · $0.150

结果就很明显了,Fable 5在质量上获胜,但成本是GLM 5.3的23倍,换句话说GLM-5.3的性价比高出20倍左右。

GLM 5.3的输出优于GPT 5.6 Sol,成本仅为其1/8,同样大幅领先。

虽然他们建议用户如果更看重质量,那就选择Fable 5,但这实际上是给Fable 5挽尊,GLM-5.3跟其质量差距谈不上多明显,但20倍的性价比是无法忽视的,不论是程序员个人还是公司,长期使用的成本就不一样了,选择谁是一目了然的。