查看: 16|回复: 16

让同一个模型写 plan,再用它自己 review,这种有意义吗? 还是用不同的模型来 review 好?

[复制链接]

19

主题

11

回帖

79

积分

注册会员

积分
79
发表于 前天 10:42 | 显示全部楼层 |阅读模式
为啥用 fable5 (中间有 2 次自动降到 opus4.8 了,又给我强制回到 fable5)写的 plan ,给 sol ultra 去 review ,结果发现一大堆问题。然后把这个 review 结果又给 fable5 去看,它说 review 结果和建议都是对的!
回复

使用道具 举报

0

主题

29

回帖

58

积分

注册会员

积分
58
发表于 前天 10:44 | 显示全部楼层
有不同的模型对抗更好,但不意味着同一个模型就没有意义。模型切换视角也可以得出不同的结论。
回复

使用道具 举报

1

主题

1

回帖

5

积分

新手上路

积分
5
发表于 前天 10:45 | 显示全部楼层
肯定要要 cold agent review ,你自己写代码,自己 review 一样的道理会被惯性带着走
回复

使用道具 举报

0

主题

3

回帖

6

积分

新手上路

积分
6
发表于 前天 11:02 | 显示全部楼层
有意义,并不会更好
回复

使用道具 举报

1

主题

13

回帖

29

积分

新手上路

积分
29
发表于 前天 11:04 | 显示全部楼层
有意义,但是不如独立模型 review 好,很多文章跟实践经验都提过这一点,包括最近 A 社发布的 loop enginnering 例子
回复

使用道具 举报

0

主题

39

回帖

78

积分

注册会员

积分
78
发表于 前天 11:12 | 显示全部楼层
有意义。他自己能审查出缺陷,但是最好还是切换模型
回复

使用道具 举报

0

主题

3

回帖

6

积分

新手上路

积分
6
发表于 前天 12:16 | 显示全部楼层
哈哈,我这么玩过 2 周,你自己试试就知道了,你这么操作会无限制循环下去,gpt5.6 会一直发现问题,即使你使用/goal ,然后让它自己再 review 也会出问题,这个原因是因为它们在 review plan 的时候会丢失一些信息,所以总会发现问题,而且到最后会越改越乱。
回复

使用道具 举报

19

主题

11

回帖

79

积分

注册会员

积分
79
 楼主| 发表于 前天 12:19 | 显示全部楼层
@hanssx 那你的实践是,不要互相 review ?
回复

使用道具 举报

0

主题

1

回帖

2

积分

新手上路

积分
2
发表于 前天 12:25 | 显示全部楼层
@hanssx 同感,不知道是否有好的规避方案
回复

使用道具 举报

0

主题

1

回帖

2

积分

新手上路

积分
2
发表于 前天 12:34 | 显示全部楼层
同一个模型 reviews 同样的代码,都会出来不同的结果,这是 llm 底层决定的,换模型会“换一个方式出错”,而不是“不出错”
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Powered by Discuz! X5.0 © 2001-2026 Discuz! Team.

在本版发帖
返回顶部