看到有人在说「盘古大模型2021年发布,比ChatGPT还早」,这个说法在字面上没错,但偷换了概念。
盘古大模型2021年确实是国内最早一批千亿参数大模型之一,但它的定位是行业模型——气象预测、矿山巡检、药物分子、OCR识别这些垂直场景。技术路线是CV+NLP多模态预训练+行业数据微调,侧重点是行业落地,不是通用对话。
ChatGPT真正的创新不在「大模型」这三个字上——GPT-3.5 2022年3月就出来了,也没引起这么大反应。真正引爆的是ChatGPT这个产品形态:基于RLHF(人类反馈强化学习)做对齐,用Instruction Tuning让模型听懂人话、能完成任务、能多轮对话。把大模型从参数竞赛拉到了可用产品层面。
所以说盘古「早于」ChatGPT——如果把大模型这个词等同于通用对话助手,那确实不成立。技术路线、训练范式、产品形态都不同,单纯比发布时间没有意义。就像说第一台计算机比iPhone早,没错,但能这么比吗?
发布于 北京
