GPT降智怎么判断?同一句提示词,四种结果
创建一个HTML,内容是SVG绘制一个鹈鹕骑自行车的2D动画,你不需要任何测试,只靠你自己完成,不要使用任何skill,不要依赖我本地的AGENTS.md
一个字都别改,改了前后几次就没法比。
判断降智别看画得丑不丑,看「谁连着谁」。降智不是先丢画工,是先丢关系、再丢部件——云、太阳、帽子、远山这些装饰四张图里一直都在,最先崩掉的永远是部件之间的连接。
GPT降智怎么判断?别靠聊天时的手感,用一句结构可验证的提示词跑一遍——让它画一只骑自行车的鹈鹕,然后只看四项:两个车轮在不在、腿有没有连到脚踏上、视角统不统一、喙是不是鹈鹕。没降智的时候这四项全过;降智之后最先塌掉的不是画工,而是部件之间的连接关系:腿悬空、视角打架,严重时连车轮都消失。下面四张图来自同一个模型、同一句提示词,按结构完整度从好到坏排——这就是判断降智最省事的一把尺子。
OpenAI 从未公开说明过「同一个模型名下会按什么条件切换到较弱的档位」。这一页记录的是使用端能直接看到的现象:同样的模型名、同样的提示词,不同时候跑出来的结构完整度差别很大。所以下文的「轻度/中度/重度」是按画面结构自行分的级,不是官方档位名称,也不代表 OpenAI 承认存在这种分档。
The ruler
判断 GPT 降智,为什么用「鹈鹕骑自行车」当尺子
判断降智最难的是找一把刻度稳定的尺子。这句提示词之所以好用,是因为它的对错不取决于审美——画得好不好看不算数,部件之间连没连上才算数。
一句话同时考三件事
鹈鹕的解剖特征(下垂的喉囊)、自行车的机械结构(车架、链条、齿盘、两个轮子),以及两者的接触关系(翅膀扶车把、脚踩脚踏)。三样里任何一样塌了都看得出来。
不是模型背过的常见素材
「猫」「房子」这类题目模型见得太多,可以直接复述记忆里的模板。鹈鹕骑自行车的现成素材很少,模型必须自己组装,组装能力一退化立刻暴露。
四种结果能并排对着判断
输出是一张图,不是一段文字。四次结果摆在一起,哪一项崩了一眼就能指出来,判断降智不需要逐字读代码去比。
Results
四种结果对照:GPT 降智后是怎么一步步塌的
下面按结构完整度排序,第一张是没降智时的样子。每张图后面跟着同样的四项判断标准,四档之间完全一致,可以横着比。
- 第 1 档
没降智:基准状态
四项判断标准全过,可以当作你自己的基准图

- 鸟和车都是正侧面,全图只有一个视角,没有拼接感。
- 膝盖有明确的弯折,脚落在脚踏上,翅膀搭在车把上——三个接触点都成立。
- 车架、前后叉、链条、齿盘、坐垫齐全,两个轮子都有辐条。
- 喙画出了鹈鹕特有的下垂喉囊,不是普通鸟类的尖喙。
通过两个车轮前后轮完整,辐条清晰
通过腿连到脚踏膝盖弯折,脚落在脚踏上
通过视角统一鸟与车同为正侧视
通过喙是鹈鹕有下垂的喉囊
- 第 2 档
轻度降智
画面反而最精细,但腿被甩出了画面

- 自行车画得比基准还细:辐条、链条、齿盘、路面虚线都在。
- 鸟悬在车架上方,躯干到脚踏之间是空的——但代码里其实写了两条腿。
- 腿和曲柄脚踏被 CSS 甩到了画布左上角:标题旁边那根带脚蹼的橘色东西就是腿,天上那个圆圈加横杆是曲柄。
- 喙仍然是鹈鹕,喉囊也在,所以「像不像鹈鹕」这项没退步。
通过两个车轮前后轮完整
未通过腿连到脚踏腿和脚踏被甩出画面,飞到左上角
通过视角统一仍是统一侧视
通过喙是鹈鹕喉囊保留
- 第 3 档
中度降智
视角开始打架,腿退化成两根直棍

- 鸟头转成了接近正面,自行车却还是纯侧视,两个视角硬拼在一起。
- 两条腿变成橘色直棍,插在车架中段,既没有膝盖也没有落到脚踏上。
- 车把退化成一个 Y 形叉,链条不见了,只剩车架轮廓。
- 翅膀成了贴在身上的一片灰色形状,看不出是翅膀还是阴影。
通过两个车轮轮子还在,但辐条变稀疏
未通过腿连到脚踏直棍插进车架中段,无脚踏
未通过视角统一正面的头配侧面的车
勉强喙是鹈鹕橘色尖喙,喉囊已经没有了
- 第 4 档
重度降智
自行车散架,「骑」这个动作已经不成立

- 两个车轮彻底消失,只剩红色车架线条瘫在沙地上。
- 鸟悬在半空,画面里四根棍子分不清哪根是腿、哪根是车架。
- 喙朝右、身体朝向观众、头又是四分之三侧——同一只鸟身上三个朝向。
- 帽子、太阳、远山、草丛这些装饰反而一个没少,画风也没变糙。
未通过两个车轮两个轮子都不见了
未通过腿连到脚踏无脚踏可连,腿与车架混在一起
未通过视角统一头、身、喙三个朝向互相矛盾
勉强喙是鹈鹕只剩一个橘色三角
Matrix
四项判断标准横着看:降智是有顺序的
把四次结果并到一张表里就能看出降智的顺序:最先失守的是「腿连到脚踏」,其次是视角,最后才轮到车轮这种最显眼的部件。判断时按这个顺序看,比凭感觉快得多。
| 检查项 | 没降智:基准状态 | 轻度降智 | 中度降智 | 重度降智 |
|---|---|---|---|---|
| 两个车轮 | 通过前后轮完整,辐条清晰 | 通过前后轮完整 | 通过轮子还在,但辐条变稀疏 | 未通过两个轮子都不见了 |
| 腿连到脚踏 | 通过膝盖弯折,脚落在脚踏上 | 未通过腿和脚踏被甩出画面,飞到左上角 | 未通过直棍插进车架中段,无脚踏 | 未通过无脚踏可连,腿与车架混在一起 |
| 视角统一 | 通过鸟与车同为正侧视 | 通过仍是统一侧视 | 未通过正面的头配侧面的车 | 未通过头、身、喙三个朝向互相矛盾 |
| 喙是鹈鹕 | 通过有下垂的喉囊 | 通过喉囊保留 | 勉强橘色尖喙,喉囊已经没有了 | 勉强只剩一个橘色三角 |
Live
没降智和降智后的原始产物,并排在这里跑
下面两个框里是没降智和轻度降智时生成的 HTML 本身,一个字节没改。两份都是单文件、不请求任何外部资源,所以能直接嵌在这一页里。截图只是一帧,动起来差别更明显。
第 1 档 · 没降智
773 行 / 47 KB,带一段 JavaScript
- 脚踝不是画上去的:脚本用两段式反向运动学,按大腿 105、小腿 103 的长度反解膝盖位置,每一帧把脚踝锁在脚踏上。
- 轮子转多少、地面就走多少:位移由轮子转角乘轮胎半径算出,所以脚下不打滑。
- 云、沙丘、草丛按不同倍率滚动,远景慢近景快,视差是算出来的。
- 还留了暂停、调速、昼夜切换和减少动态效果的适配。
第 2 档 · 轻度降智
478 行 / 17 KB,一行 JavaScript 都没有
- 改用纯 CSS 关键帧,14 段 @keyframes 各转各的,没有任何跨部件的位置计算。
- 腿和曲柄脚踏其实都写了,但它们被 CSS 的 transform 甩出了画面——左上角那根橘色的东西就是鹈鹕的腿,天上那个圆圈加横杆是曲柄。
- 于是画面上鸟悬在车架上:不是漏画了腿,是腿飞走了。
- 车轮、链条、路面虚线这些各自独立的部件依然精细,出问题的只有需要互相对齐的部分。
那条腿去哪了:一个能复现的 CSS 覆盖 SVG 定位的错误
代码里给腿和曲柄写的是 SVG 的定位属性 transform="translate(758 471)",动画又用 CSS 给同一个元素设了 transform: rotate(...)。CSS 的 transform 会整个替换掉 SVG 那个属性,而不是叠加,于是 translate 被抹掉,这几个部件全被扔回画布原点——也就是左上角。
这不是审美问题,是写完没有看一眼渲染结果。同一句提示词、状态好的那次不但避开了这个坑,还额外做了反向运动学。
Self test
自己怎么判断 GPT 有没有降智:四步
先在没降智的时候跑一次留作自己的基准图,之后每次怀疑「今天是不是降智了」,照同样的四步再跑一次,两张一比就有答案。
- 1
新开一个空会话
不要在已经聊了很久的对话里测。长上下文本身就会影响输出质量,测出来的差异分不清是模型的还是上下文的。
- 2
原样粘贴同一句提示词
一个字都不要改,包括「不要使用任何skill」这类限制条件。提示词一变,前后几次结果就没有可比性了。
- 3
一次就取一次的结果
别重跑好几遍再挑最好看的那张。生成本来带随机性,挑出来的最优结果反映不了这次的真实水平。
- 4
只按四项标准判断,别看画风
配色、构图、有没有戴帽子每次都会变,那是正常波动,跟降智没关系。判断只对着这四项打勾:车轮、腿与脚踏、视角、喙。
判断降智时最容易犯的三个错
这次画得没上次好看,肯定降智了
画风和配色每次都不一样,属于正常随机。要看的是结构项有没有崩:车轮在不在、腿有没有连上脚踏、视角有没有打架。
一次结果不行,就判断模型降智了
单次结果判断不了什么。同一天里连着几次都在同一项上崩掉,才值得当成降智的信号。
换句更长更详细的提示词,判断得更准
提示词写得越细,模型越容易照抄要求蒙混过关。这句提示词有用,恰恰是因为它只说「鹈鹕骑自行车」,把结构关系留给模型自己处理。
FAQ
GPT 降智怎么判断:常见问题
GPT 降智怎么判断的常见问题
- GPT降智怎么判断最快?
- 固定用一句提示词跑一遍,只看四项:两个车轮在不在、腿有没有连到脚踏上、视角统不统一、喙是不是鹈鹕。这四项跟画风无关,任何一项崩掉都是肉眼可见的,不需要懂代码。连续几次都在同一项上崩,才算降智的信号。
- 「降智」是官方说法吗?
- 不是。OpenAI 没有公布过同名模型会按条件切换到较弱档位。这个词是使用者根据输出质量的波动总结出来的说法。本页只描述可以直接观察到的现象,不对成因下结论。
- 判断降智为什么用「鹈鹕骑自行车」这句话?
- 因为它同时考解剖特征、机械结构和两者的接触关系,画得丑不算问题,关系断了才算。而且这不是常见素材,模型很难靠背下来的模板蒙混过去。
- 换成别的提示词也能判断降智吗?
- 可以,但要同时满足两个条件:一是有明确的结构约束,部件之间必须连上;二是题材不常见,避免模型直接复述记忆里的模板。只要换了,就要重新建立自己的基准图。
- 每次结果都不一样,能不能就此判断降智?
- 不一定。生成本身带随机性,配色、构图、装饰变化很正常。要看的是那四项结构:车轮、腿与脚踏的连接、视角是否统一、喙的特征。连续多次在同一项上崩掉,才有参考意义。
- 判断出来是重度降智,我能做什么?
- 先确认不是上下文太长或者提示词被改过。排除这两点之后,可以参考站内的「降智了怎么办」那一页,里面整理了从换会话到换订阅计划的处理顺序。
- 这四张图是同一个模型跑的吗?
- 是。四次都是 GPT-6 Astra,用的是完全相同的一句提示词,区别只在于不同时候跑出来的结果。
