
科技观察窗
AI视频3年巨变:从诡异崩坏到以假乱真
2023年的AI视频因技术极不成熟,在物理规律、人脸细节和时空逻辑上频繁出现明显崩坏,被当时的观众形容为“技术性恐怖谷”,而短短三年后AI视频生成能力已实现飞跃,这种反差让许多人感到既震撼又后怕。
一、物理规律彻底崩坏
物体运动无视重力与惯性,人物动作出现非人扭曲。
标志性案例:2023年AI生成的威尔·史密斯吃面视频中,面条像活体触手一般在嘴里乱窜,完全不符合物理常识。
手指数量随机变化,六根、四根甚至七根手指交替出现,成为当时AI视频的典型“穿帮”特征。

二、人脸与肢体细节失控
人脸五官发生不自然的变形和移位,瞳孔、眉毛等细节频繁“跑偏”。
肢体动作僵硬或异常抖动,人物行走时仿佛“飘移”,缺乏正常生物力学特征。
面部表情难以准确呈现,常常出现“微笑的恐怖”或“静止的诡异”效果。

三、时空逻辑与场景衔接割裂
同一场景中,背景物品的材质、颜色、位置随机变化,难以保持一致性。
角色在镜头切换后突然消失或改变服装,场景过渡毫无逻辑。
镜头运动不连贯,画面出现莫名闪烁、像素破碎或“融化”效果。
四、独特的“诡异感”集中爆发
网友形容当时观看AI视频时会触发强烈的“恐怖谷效应” ,感觉“像在看伪人” 。
画面看起来“很真实”,但处处透露着不合理,让人产生心理上的不安与排斥。
许多视频因技术缺陷反而产生了某种超现实的荒诞幽默感,成为当时互联网上的“另类表情包”素材。
五、与三年后(2026年)的鲜明对比
2026年AI视频已能产出几秒内高度逼真的镜头,人脸、动作和场景一致性大幅提升。
当前AI视频的主流方向是“去AI味”,创作者刻意避免让内容显得像机器生成。
回看三年前的作品,人们才真切感受到技术迭代的速度有多惊人——从“一眼假”到“难辨真伪”只用了短短三年。