查看: 27|回复: 26

我发现 Codex 经常会写入幽灵规则

[复制链接]

6

主题

45

回帖

108

积分

注册会员

积分
108
发表于 2026-7-11 13:18:41 | 显示全部楼层 |阅读模式
当我纠正、取消或排除一个当前不会使用的行为时,我的想法是默认让该行为从文档中消失

但是 Codex 经常额外写入“明确不做”“暂不支持”“未来需要时再处理”等反向说明。

现在的处理:

不要做 X
→ 文档里写:X 被明确排除,未来需要时再……

实际的我想要的处理:

不要做 X
→ 删除 X ,不留下任何痕迹

就比如我在优化笔记顾流程时,它根据之前的规则加入了年度回顾的流程。

然后我纠正说:年度回顾用到的太少了,不需要这个流程,等年底我再单独设计这个流程。

结果它的实际行为是:

确实删了年度流程,但是却留下了一句:

年度回顾明确为“年底需要时再定义并确认独立流程”。

问题原因

我估计很多时候就是因为我多说了一句:等年底我再单独设计这个流程。结果他就真把这个话写到文档了。

感觉 AI 好像分不太清: 哪些是我单独给他解释的原因,哪些是需要沉淀到文档的规则。

而从我的对话习惯来说,我确实是把 AI 当成聊天对象了,所以有时候会解释下为什么我不做这个。但实际上它还是个只会干活的机器,所以没必要说太多给他,不然就会污染他的理解。

我的解决办法

虽然这不影响整个流程,但感觉还是有点奇怪,而且他在做 Skill 设计、项目文档的时候也会存在这个问题,我遇到很多次了

我想着如果我不改变我和 AI 的沟通方式的话,好像只能将它这种「幽灵判断」的行为加入了全局 AGENTS.md 来限制了。

不知道大伙有没有遇到这种情况,其他模型会不会有这个问题
回复

使用道具 举报

0

主题

8

回帖

16

积分

新手上路

积分
16
发表于 2026-7-11 13:29:21 | 显示全部楼层
这就是典型的 ai 不具备判断力,所以说当下的 ai 依然只能是辅助。
回复

使用道具 举报

0

主题

39

回帖

78

积分

注册会员

积分
78
发表于 2026-7-11 13:49:55 | 显示全部楼层
是的. 我叫它别干什么, 就顺便把这个别做什么写进去了. 有些理论上提供给第三方看的文档, 这种操作就画蛇添足了.
回复

使用道具 举报

0

主题

20

回帖

40

积分

新手上路

积分
40
发表于 2026-7-11 14:50:46 | 显示全部楼层
应该是 ai 遵循了最小修改原则, 能不删则不删, 除非你明确要求, 这个问题我也经常遇到, 你需要明确告诉他: "文档不再记录年度回顾相关内容, 删除年度回顾章节并对文档进行语义整理". 特别是你提到后续会用到 xx 内容时, 这时候 ai 是一定不会删你内容的.

从这个角度来看 AI 做的没毛病, 不然你提到后续会用它还给删了, 又有人会跳出来说 AI 会乱删内容
回复

使用道具 举报

0

主题

28

回帖

56

积分

注册会员

积分
56
发表于 2026-7-11 14:58:50 | 显示全部楼层
codex 和 cc 还得用 cli ,可控性强。然后指定不同的 profile 目录(不同的全局指令)来做不同的任务,不同的全局指令(+不同的项目指令),基本上幽灵判断可以在可控的心智成本下得到有效缓解。
回复

使用道具 举报

6

主题

45

回帖

108

积分

注册会员

积分
108
 楼主| 发表于 2026-7-11 15:06:27 | 显示全部楼层
@ndxxx 这是个好办法,确实 APP 只有一个全局 AGENTS.md ,我混杂了代码、笔记、文档相关的规则。目前大概有 60 多行 限制规则。倒也还在可控行数内,等后续再加的话,就考虑用 profile 单独给这几个分类创建了。
回复

使用道具 举报

0

主题

4

回帖

8

积分

新手上路

积分
8
发表于 2026-7-11 15:06:44 | 显示全部楼层
因为你的上下文是终身的, AI 的上下文 session 内都没法保证, 所以 AI 一定倾向于记下每一个决策的原因. 想解决就加 agents.md 规范好开发中间阶段的计划变更等等记录在哪里, 代码里面的注释写什么,不写什么.
回复

使用道具 举报

0

主题

2

回帖

4

积分

新手上路

积分
4
发表于 2026-7-11 15:24:50 | 显示全部楼层
确实,这点特别烦人
回复

使用道具 举报

0

主题

2

回帖

4

积分

新手上路

积分
4
发表于 2026-7-11 16:48:11 | 显示全部楼层
我觉得是 GPT 参数量相对来说太小的缘故。不知为何,GPT 总是会很刻板地去理解 prompt 。缺乏一些发散思维和创造力,无法理解自然语言的「弦外之音」和我没有要求的事情。GPT 做前端时总是会在界面上加上大量大量的描述和我提供的提示词的片段,看起来像是过分追求指令遵循导致的。

而 Claude 在这方面就会好得多,比如我可以跟 Claude 说「像做梦一样整理你的 Claude.md 」,但是对于 GPT 我就需要把提示词写的直接一些...Claude 给我的感觉更像是一个人,一个朋友,而 GPT 更像是擅长干活的工具...

当然可能下一代 GPT-6 就会解决这个问题了,据说 OpenAI 打算训练一个参数量大得多的底座去对抗 Claude fable 5.1 。
回复

使用道具 举报

2

主题

45

回帖

96

积分

注册会员

积分
96
发表于 2026-7-11 16:54:36 | 显示全部楼层
你要不要看看自己说的什么:

> 我多说了一句:等年底我再单独设计这个流程。结果他就真把这个话写到文档了。

你当 AI 是你肚子里的蛔虫吗,能听得出你这句话是违心的?它是 AI ,只会按字面意思理解你的话,而不是你的贴心男友,知道你哪句话是闹脾气不能当真。
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Powered by Discuz! X5.0 © 2001-2026 Discuz! Team.

在本版发帖
返回顶部