在CKDD上做了一个报告,分享了我们最近的CogVideoX技术和一些思考,希望对大家有用。ppt放在我的主页上了。http://t.cn/zYpBqTT
下面用清言自动生成了一个摘要,感觉还很靠谱:)
这份文档概述了清华大学 KEG 实验室在大模型领域的研究进展,主要涵盖以下几个方面:
1. GLM 模型系列:
GLM 模型是 KEG 实验室自研的通用语言模型,能够在自然语言理解、有条件生成和无条件生成任务上取得优异性能。
GLM-130B 模型在多个评测中表现出色,尤其在鲁棒性和校准误差方面表现最佳。
GLM-4 模型在通用能力、指令追随、中文对齐、代码、数学、安全等方面与 GPT-4 Turbo 性能相当。
2. Cog 系列模型:
CogView 是 KEG 实验室提出的文本到图像生成模型,在多个评测中取得了优异的性能。
CogVideo 是 CogView 的扩展,能够生成视频内容。
CogVideoX 是最新的文生视频模型,采用 Diffusion+Transformer 架构,能够生成更加逼真和细节丰富的视频。
3. 大模型与 AGI:
文档探讨了 GLM 模型在能力涌现、与环境交互和工具使用等方面的潜力,并展望了未来通用人工智能 (AGI) 的发展方向。
GLM 模型被认为是迈向 AGI 的重要一步,未来将通过重构应用、操作系统和计算方式等方式,推动 AGI 的发展。
4. AGI 应用栈:
文档提出了 AGI 应用栈的概念,包括重构应用、操作系统和计算方式等层次,以实现 AGI 的广泛应用。
5. 未来展望:
文档认为,2024 年可能是 AGI 元年,大模型将在通用问题上超越人类水平,并最终实现超级智能。
发布于 北京
