智谱GLM5.2的编程能力已经接近甚至达到SOTA级水平,虽然对比A记还有差距,但是已经展现出非常强悍的性能。唐杰老师也在X上放话,今年之内就能追平A记头牌。。。
这就说明编程能力这个赛道的所谓秘密,比如后训练阶段的防作弊奖励沙箱环境还是Whatever,已经被中国大模型头部公司原创性破解了,剩下的追平就是个时间问题。中国大语言模型公司的创新能力确实是世界顶级,谁也不比谁聪明多少,谁也不比谁笨多少,你想得出来,别人一样想得出来。
美国大语言模型公司的问题是成本太高,回报太慢,前沿探索的商业化往往被开源世界提前去杠杆,而在前沿探索这一块,百家争鸣百放齐放,ScalingLaw依然生效;中国大语言模型公司的问题是用于训练的算力基础设施受限太多,不影响追赶,但是很影响前沿突破,SOTA级的超大参数规模稠密模型的训练与美国差距明显,但是算法创新、架构优化和性价比都没有啥问题。
各有各的烦恼,这一波中国大语言模型能够再次追上世界前沿,H股和A股市场还是发挥了很大的正面作用,必须表扬!!!
发布于 广东
