唐杰THU
24-08-30 11:34 微博认证:清华大学教授,AMiner创始人 唐杰

昨天,团队在KDD的AIGC day给了一个talk,顺便发布了GLM-4-plus,
文本方面:在语言理解、指令遵循、长文本处理等方面性能得到全面提升,保持了国际领先水平。
文生图:具备与当前最优的 MJ-V6 和 FLUX 等模型接近的性能。
图像/视频理解:具备卓越的图像理解能力,并具备基于时间感知的视频理解能力。该模型将上线开放平台(http://t.cn/A6RMpSFw),并成为国内首个通用视频理解模型 API。
视频生成基座模型 CogVideoX:在发布并开源 2B 版本后,5B 版本也正式开源,其性能进一步增强,是当前开源视频生成模型中的最佳选择。

此外「清言 APP」上线视频通话:国内首个面向C端用户开放的视频通话服务,「清言 APP」的视频通话功能跨越了文本、音频和视频模态,并具备实时推理能力。

最后,还有GLM-4-Flash API:推理服务完全免费,并提供微调服务。

发布于 北京