01
太热闹了。昨儿DeepSeek V4 Pro正式版+Harness、Grok 4.6“你方唱罢”,今儿GLM-5.3闪亮一记“我登场”——
一出手便杀回开源一哥、国模一哥,甚至在Coding方面更加接近Claude Fable 5!
也就是说,唐杰给马斯克“画的饼”(说国产模型超越Fable 5不会太久),往前拱了一大截,也就花了2个月整。
在多项主流基准测试中,GLM-5.3是当前排名最高的开源模型,编程与智能体能力接近Claude Fable 5,编程体感超过其他国产模型。
更值得注意的是不同推理强度下的表现。随着Token预算增加,GLM-5.3的Coding准确率继续往上走;在High档位下,已经能以明显更低的Token消耗,做到超过Claude Opus 4.8最高档位的准确率。
0
评论 (0)