#行业首个认知模型#
好家伙,卡帕西又说对了!
几个月前,这位OpenAI创始成员在访谈中抛出了一个判断:“推理模型要变天了!”
仅需10亿参数,就能构建起非常优秀的「认知核心」——一个剥离了海量事实记忆、只保留思考算法的智能单元。
结果万万没想到,如今有这样一支中国团队已经率先实践。
小冰之父李笛集结微软小冰原班人马,带着仅成立半年的AI初创公司Nextie(明日新程),刚刚推出了行业首个认知模型「新程Alpha」。
何为首个?事实上,明日新程对认知模型的押注和卡帕西几乎是同一时期给出。
在去年12月的奇绩创坛Demo Day上,明日新程首度公开亮相就明确提出:
AI进化终点不是更大的单体大模型,认知模型才是下一周期行业趋势。
凭借敏锐的行业嗅觉,他们愣是提前卡位、极限抢跑,于是有了今天的新程Alpha。
特别的是,这个模型只有区区4B参数,在动辄千亿万亿、模型参数卷到飞起的大模型里,可谓一股清流。
但就是这么个轻量级选手,却把很多推理大模型做不到的事情做成了:以下克上,不仅搞定了模型算力的痛,最终效果还能比肩第一梯队的GPT-5.4。
这下再也不用月底为Token账单发愁了。(doge)
算力成本立省100%,从烧显卡变成了交电费,而且直接端侧能跑。
那么问题来了,为啥这个认知模型可以以小搏大?和主流的知识型推理模型又有什么本质不同?量子位深入挖了挖。
http://t.cn/AXXBX3QJ
