【2025年AI范式转变:瓶颈不再是规模,而是验证】
2025年,AI领域正在发生一场大多数人未曾察觉的范式转变。
这个转变的核心洞察是:AI进步的瓶颈已经不再是规模,而是验证。
从数学、形式化方法到推理密集型领域,今年变得越来越清晰的一点是:智能只有在输出可以被检查、纠正和复用时才能实现复利式增长。证明、程序、推理步骤——只有当它们存在于可验证的系统中,才能形成紧密的反馈闭环。其他一切最终都会遭遇瓶颈。
这解释了为什么AI在数学、代码和形式推理领域进步最快。也解释了为什么那些连接非形式推理与形式验证的突破,其重要性远超表面所见。
陶哲轩最近将这种转变描述为"大规模生产的专业化与手工打造的工作相辅相成"。这个框架精准地捕捉了这一转变的本质:我们不是在取代人类推理,而是在工业化确定性。
---
关于各领域的实际进展,作者给出了坦诚的评估:
量化分析与市场领域:当前AI仍然非常薄弱。它并不真正理解统计结构、市场状态转换或因果关系。任何声称AI能可靠分析股票或"理解"市场的说法都是夸大其词。
代码生成领域:情况更为复杂。模型仍会犯错,但在正确的结构、约束和人类指导下,它们已经达到了可以有意义地替代或增强初级软件工程师或研究生助理完成许多任务的水平。Claude Code配合Opus模型正在彻底改变软件开发方式,其处理任务的能力已经超过许多初级开发者,而成本却呈指数级降低。
定理证明领域:一个开源模型加上商业API,在作者的指导和纠正下,仅用一个下午的工作时间就帮助他将等周不等式的部分内容在Lean4中形式化。这项工作如果纯靠人工,至少需要一个月。
---
对于普通人如何判断AI的真实进步,作者给出了一个关键标准:不要看演示,不要看分数或基准测试,而要看系统的输出是否可以被检查。如果一个系统产生的结果可以被形式化验证、纠正和复用,那么进步就会复利累积。如果不能,改进往往会遭遇瓶颈。
这也是为什么在高风险领域——如航空飞行员、核电站安全、首席编辑、CEO或外科医生——自动化最为困难。不是因为AI无法执行这些任务,而是因为机器人和AI无法为后果严重的失败承担责任。在这些场景中,责任无法外包。
但变化在于:单个人类现在可以监督、验证和纠正比以前多得多的机器生成工作。这使得以监督、认证和最终判断为核心的角色变得更有价值,而非更少。
---
这是一把双刃剑。虽然能力和技能仍然重要,但未来就业市场的很大一部分将取决于一个人在价值链中的网络和关系。许多人将失去工作。而当一个经济体中有一半甚至大部分人口不再产生经济价值时,如何维持运转?全民基本收入将成为国家经济可持续和政治稳定的生存条件。
技术可以改变,但历史总会押韵。阶级斗争从未消失。
---
关于AI生成内容的信任问题,作者强调:如果你有办法有意义且高效地检查AI产出的内容,你就可以足够信任它来帮助你做关键决策。在编程领域,AI已经很有意义,因为你有办法在开发环境中测试和迭代。
但在投资等领域,真正的危险不是AI引用了错误的来源——那种错误你可以立即丢弃。真正的危险是当它听起来合理、引用真实数据,却推理错误。这些失败更难被发现,也正是未经验证的AI变得危险的地方。
---
展望2026年,验证、形式化数学和可扩展的正确性将成为科学加速和AI进步的基础。如果你关心AGI、研究自动化,或者真正的智能增益从何而来,这一层已经变得不可回避。
reddit.com/r/singularity/comments/1q1oufe/the_ai_paradigm_shift_most_people_missed_in_2025
