麻省理工科技评论
26-09-16 18:13 微博认证:《麻省理工科技评论》杂志官方微博

【AI不一定要“聊天”,OpenAI前研究员研发只做决策的模型,绕开文本生成,响应速度快200倍】

大模型一定要一个 #token# 接一个 token 地生成文字吗?

9 月 15 日,前 #OpenAI# 研究员 Diogo Almeida 在社交媒体上公布了自己过去两年一直秘密推进的项目——一种名为 Jev 的全新 AI 模型。和 ChatGPT、Claude 等主流 LLM 不同,Jev 不再生成自然语言,而是直接输出结构化判断、概率和置信度。

这也是 Almeida 创办的 AI 初创公司 TypeSafe AI 推出的首款模型。2024 年离开 OpenAI 后,Almeida 与几位联合创始人组建 TypeSafe,此后一直保持隐身。直到这次发帖,公司才正式亮相,并同期披露完成 4,000 万美元种子轮融资,由 DCVC 领投,本轮估值约为 2 亿美元。

TypeSafe 将 Jev 归入一类名为 System One 的新模型,并给出了看起来相当不错的性能数据。其宣称,在特定结构化工作流中,Jev 最高可比前沿 LLM 快近 200 倍、便宜 400 多倍,甚至能把“幻觉”和类型错误率做到 0%。

而 Almeida 的背景让这条路线显得尤其有意思。在 OpenAI 期间,他参与了 2022 年 InstructGPT 的研究。这项工作将监督微调、人类偏好数据和 RLHF 结合起来,让 GPT-3 更能按照人的意图回答问题,后来 ChatGPT 也沿用了相近的 RLHF 路线。OpenAI 在 GPT-4 的贡献者名单中,也将 Almeida 列入“Foundational RLHF and InstructGPT work”一栏。

戳链接查看详情:http://t.cn/AXOx6aGi