别被表象骗了,GPT-4o 写 UI 没审美其实是由于系统指令的“枷锁”
但最近通过分析 Codex 的模型清单(manifest)文件,我发现了一个被大多数人忽略的细节:在 GPT-5.5 版本的内部配置中,竟然内置了极其详尽的前端指导指令。
这些指令并不是简单的“请让界面看起来现代化”这种模糊的描述,而是具体到了像素级的约束。比如,它明确规定了卡片圆角的半径范围、图标选择的优先级、Hero Section 的具体布局方式,甚至对颜色约束和按钮的交互行为都有强制性定义。更关键的是,指令里还列出了一张“黑名单”,明确规定要避开某些特定的 UI 模式。
这就揭示了一个真相:当你觉得 GPT 产出的 UI “没品味”时,可能根本不是模型本身的生成能力出了问题,而是它在接收你的 Prompt 之前,就已经被一套死板的全局系统指令给“框死”了。
我们经常在社交媒体上看到 Claude Code 和 Codex 的对比,但大多数人对比的其实是【模型外壳(Harness)】而非纯粹的模型能力。一个完整的 AI 交互体验是由系统提示词(System Prompt)、工具链、内存管理、项目指令以及产品默认设置共同组成的。
为了验证这个观点,业内有实测案例显示,如果将 GPT-5.6 Sol 放入一个类似 Claude Code 的轻量化环境(去掉那些沉重的默认 UI 约束)中运行,其产出的 UI 质量会远超预期。事实上,在 ReactBench 的基准测试中,GPT 系列在处理真实 React 任务时的得分其实非常高,这证明了它具备处理高审美 UI 的潜力,只是在实际产品化时被“阉割”了。
对于开发者来说,这里有一个非常关键的实操建议:请立即检查你的 CLAUDE.md 或 AGENTS.md 配置文件。
很多习惯于深度定制 AI 的开发者,会在这些配置文件中塞入大量的自定义指令。但请记住,这些指令是有时效性的。你半年前为了修正 GPT-4 的某个特定 Bug 而添加的死板规则,在面对新版本模型时,可能反而成了限制模型发挥的枷锁。
臃肿且过时的指令文件不仅会持续占用宝贵的上下文窗口,更会通过强行干预,误导模型产生不必要的冗余代码。如果你发现 AI 最近的输出开始变得古怪,或者审美水平突然下降,先不要急着认为模型在“退化”,建议先清理掉配置文件里的陈年旧账,给模型留出足够的自由度去生成。
