载我以坤舆
26-05-15 11:13 微博认证:投资内容创作者 微博原创视频博主

AI应用
在cod i ng时代,由于训练的门槛难度相比大语言模型时代是降低的,模型之间能力的差异一定会被缩小。无论是小米还是deepseek都在进一步的证明这一点。
这种模型能力的缩小会带来什么变化呢?我认为这就是Deepseek新模型被低估的第二个影响。这种模型能力的缩小,会颠覆掉AI的竞争格局,无论是硬件还是软件。此前,Deepseek放出了五一限定优惠,虽然说是五一限定优惠,但根据公司之前的披露,在下半年昇腾950批量部署后,这就会是常规价格,甚至更低。

deepseek的价格是之前国内头部模型价格的10%(我也不知道为什么有人要去抱团炒作港股的国内二线模型公司.·)对比海外的模型,价格更是便宜得离谱,大概只有海外3-5%的价格。

价格不是最重要的,最重要的是下半年要在昇腾950批量部署,之前传出过很多次在做适配,目前来看暂时还没完成,但也就是一步之遥了。推理这件事我们和美国的差距远小于训练!其他厂商和英伟达的差距更是远小于训练。如果国内的百万长上下文模型推理可以全面用国内的GPU服务器,这意味着中国制造业将会像移动互联网,新能源一样,为全球的应用铺开落地做出重要贡献。过去AI推理的降本难度很大,最重要的原因就在于AI硬件企业几乎都是海外企业,光伏在没有中国企业进入之前成本是现在的十倍;锂电在没有中国企业进
入之前成本是现在十倍;中国企业把所有百万豪车的汽车零部件配置卷到了30万级别。

中国企业的降本能力,不需要质疑。而现在,很可能顶尖模型将会拥有能持续降本的中国制造硬件进行推理。
伴随模型能力的进步,下半年某一个时间我们很可能将会看到能力差距不大的中国模型只有美国模型5%的推理成本。我想再过3-6个月应该就有答案了。下半年再来看看呢?

发布于 吉林