Vibe coding的三个组成 判断器 执行器 显示器
三个组件——判断器(Judge)、执行器(Executor)、显示器(Display)——构成了一个完整的认知-行动闭环。这不是一个关于"如何编程"的技术说明,而是一个隐含的哲学人类学模型:在AI时代,人类的角色被重新分配为"判断者"(做什么、是否好),工具/Agent承担"执行者"(如何做),而最终成果需要对外"显示"(被验证、被看见)。
在传统的编程中,"判断"渗透在整个过程中——你每写一行代码都在判断当前的做法是否正确。但在Vibe Coding中,判断被提升为一种独立的、前置的活动:你不是在写代码的过程中判断,而是在AI写代码之前和之后判断。
这背后的哲学模型是亚里士多德的实践智慧(phronesis)——在具体情境中做出"好"的判断的能力,这不同于理论知识(episteme)和技术技能(techne)。AI负责了techne(如何写出可运行的代码),但phronesis("应该写什么"、"这个实现好在哪里")仍然属于人类。
判断器的本质是价值的裁定。你不会仅仅判断代码是否"能运行"——那是技术层面的基本要求。你会判断它是否"优雅"、"可维护"、"符合设计的初衷"、"在美学上令人满意"——这些是超越功能性的价值判断。亚里士多德会说这是"好人"(spoudaios)的品格在起作用——一个品味好的判断者通过他的判断定义了什么是"好的代码"。
执行器是AI承担的角色——将人类的判断转化为具体的实现。在传统编程中,实现本身就是认知的核心活动——你在写代码的过程中学习系统的细节、发现隐含的假设、修正自己的理解。执行器的独立意味着,实现不再是为了理解而做的活动,而是为了产出而做的活动。
这引出了一个柏拉图式的张力。柏拉图在《高尔吉亚篇》中区分了"真正的技艺"(techne)和"经验性的窍门"(empeiria)。前者的特点是 practitioner 能给出理由(logon didonai),而后者只是凭经验去做、知其然而不知其所以然。AI执行器提供的实现,是否只是empeiria?它提供的代码能运行,但它能给出"为什么这样实现"的理由吗?
这个问题的答案可能是否定的——但反过来,它对人类提出了一个更高的要求:既然实现被外包给了AI,人类就不再需要在实现过程中学习理解,而是需要在判断结果时展现更高层次的理解。你不再需要知道怎么写出循环来,但你需要判断AI写出的循环是否在算法复杂性上最优——而这种判断本身要求你有一种比AI更深刻的"元理解"。
"显示器"看起来是最平凡的一个组件——不就是把结果展示出来吗?但它的哲学分量可能最重。显示意味着认知的社会性——判断和执行都是可以私密进行的活动,但显示将认知成果推向公共领域。
波普尔(Karl Popper)的"三个世界"理论在这里非常贴切:世界1是物理世界(代码在计算机上运行),世界2是心理世界(你的判断和意图),世界3是客观知识世界(可以被公开检验的产物)。显示器完成了从世界2到世界3的跨越——将私密的判断和AI的执行结果,转化为可以被他人(以及未来的自己)验证的公共知识。
哈贝马斯(Jürgen Habermas)的交往行动理论进一步指出,沟通的有效性需要满足四个条件:可理解性、真理性、真诚性、正确性。显示器正是让这些条件得以被检验的机制——代码被显示出来后,其他人可以验证它是否真正实现了预期的功能(真理性)、是否符合设计意图(真诚性)、是否遵守了社区规范(正确性)。
在这个意义上,显示不是多余的装饰,而是认知完整性的最终保障——没有显示,判断和执行都可能停留在私人领域,既不能被验证,也不能被批评和改进。
判断器、执行器、显示器三者构成了一个正反馈循环:
判断 → 执行 → 显示 →(显示结果反馈到)→ 判断(下一轮)
这个循环在传统的"人类独自编程"模式中也在发生,但那时所有三个组件的角色都集中在同一个人身上。Vibe Coding的突破在于角色的拆分——判断和显示主要由人类承担,执行由AI承担。这释放了两方面的能力:人类的判断不再被实现的细节所拖累(可以更专注于方向和质量),AI的执行不再需要人类的每一步确认(可以更高效地批量产出)。
但这也带来了一个风险:如果人类在"判断"和"显示"两个环节上变得松弛——比如不再仔细判断AI产出的质量,或者根本不看AI的产出就直接"显示"——那么这个循环就退化了。因此Vibe Coding对人类的自律性提出了更高而不是更低的要求。
█ "AI实现的是理解和实现的分离"
Vibe Coding三组件是这一核心命题最直接的操作化——判断器(理解方向)和执行器(实现细节)的分离,正是"理解与实现分离"在编程领域的显化。显示器则是将这一分离的产物拉回公共领域接受检验。
█ "可视化·多角色·可回顾"
两者形成镜像结构。判断器对应多角色视角的审视,执行器对应可回顾的时间展开,显示器对应可视化的展示。两组三元组在不同的抽象层级上回答同一个问题:如何在新的人机协作格局中组织认知活动?
█ "Agent驱动下的哲学思考"
Agent驱动的本质就是在各个领域推广这个三组件模型——Agent是执行器,人类是判断器,而对话输出本身就是显示器。Vibe Coding三组件是这一通用认知模型在编程领域的具体案例。
Vibe Coding的三组件不是工程指南,而是一面镜子——它映照出在AI时代,人类的认知角色正在从"全能执行者"转变为"智慧的判断者"和"负责任的显示者"。这个转变不是降级(做更少的事),而是升级(做更高级的事)。在未来的认知生态中,最稀缺的将不再是执行的能力(AI可以做到),而是判断的品味和显示的勇气。