andforce
V2EX  ›  OpenAI

完全不熟悉的领域,让 GPT5.6 进行 review,一个周了还是有 P1 问题咋整?

  •  
  •   andforce · 14h 10m ago via iPhone · 2700 views
    让 gpt5.6 写了一个网络调试软件,

    写完了之后,我会新开一个窗口,清空上下文,让 gpt5.6 进行 review 。

    然后把 review 后的结果,发给开发的那个窗口,继续改,改了再 review ,就这么陆陆续续搞了快一周了,还是有问题


    review 出来的那些问题,处于我的知识盲区,也不知道是不是真的有问题,崩溃
    26 replies    2026-07-25 00:48:52 +08:00
    scarlex
        1
    scarlex  
       14h 3m ago
    那你应该利用 AI 去补一下该领域的知识吧
    yefuchao
        2
    yefuchao  
       14h 3m ago
    换一下其他家模型试试
    avenger
        3
    avenger  
       13h 43m ago
    换模型 review 加一句:独立思考,联网搜索最佳实践
    一般会好一点
    lscho
        4
    lscho  
       13h 35m ago via Android
    让模型 review 我就没见过不出问题的。。。
    snxq1995
        5
    snxq1995  
       13h 23m ago
    说明实现细节模糊,且可供选择的方向很多。AI 本质上还是一个带权重的随机数。解决方案就是你去了解下,然后提供一个你想要达成目标效果的思路。
    night98
        6
    night98  
       13h 19m ago
    没啥用,自己实测比较合适,有生产问题再丢给它改,不然你换个模型扫依旧能扫出一堆问题。
    afxcn
        7
    afxcn  
       13h 17m ago
    你用 5.6 Sol Ultra 试试,一次就给干好了。

    我让它解决错误处理和闪退问题,它给写了 4 万行代码,删了 2 千多年代码,还不停。
    nuk
        8
    nuk  
       13h 15m ago
    TDD ,让他自己写用例,如果测试不了,就重构到能测试
    afxcn
        9
    afxcn  
       13h 15m ago
    现在它是跟 0-RTT 问题干上了。
    doraemonki
        10
    doraemonki  
       13h 14m ago
    每次 review 出来把某个结果丢给一个新对话,跟他说这是 claude 说的,合理吗?是小概率场景吗?有必要改吗?
    Meteora626
        11
    Meteora626  
       13h 13m ago
    只要评审 永远停不下,我用的 5.6 sol 极致。 我已经放弃了, 先实现再说
    lins05
        12
    lins05  
       13h 5m ago
    > 新开一个窗口,清空上下文,让 gpt5.6 进行 review 。
    > 然后把 review 后的结果,发给开发的那个窗口,继续改,改了再 review ,就这么陆陆续续

    让 codex 先给你写个 skill 吧,这个 skill 的内容就是: 启动一个干净上下文的 sub agent 在 subagent 里 review, 然后 main agent 根据 review 的输出再初步判断,值得修复的再修复

    这样至少不用几个窗口来回复制粘贴折腾了
    HENQIGUAI
        13
    HENQIGUAI  
       11h 25m ago
    直接开/goal, 不改好不罢休
    chengYT
        14
    chengYT  
       11h 18m ago
    开 goal 模式,review 完修修完 review ,直到没有问题
    hope7777777
        15
    hope7777777  
       11h 17m ago
    大概率底层设计就有问题,推倒重来,反复 p1 说明一直在兜底
    lujiaosama
        16
    lujiaosama  
       11h 15m ago
    交叉审查,不要只用 GPT.其次是不要小修小补,按照近乎重构的方式.最后是你自己需要懂一些, 让 AI 给方案再进行抉择.
    odirus
        17
    odirus  
       11h 14m ago
    @nuk 效果不会好的,AI 会为了通过测试用例而故意修改测试用例,或者乱造一些测试用例。

    所以要想驾驭 AI ,还是得有专业领域知识才行,不然会来来回回很浪费时间。
    rubyacgn
        18
    rubyacgn  
       10h 43m ago
    和你差不多的情况, 我是让 SOL 审 PRD, 总能找出新问题
    后来我放弃了, 重开项目用 ULTRA 产出 PRD, SUBAGENT 几轮审查后认为没问题就过了, 躺平
    nuk
        19
    nuk  
       10h 30m ago
    @odirus 我之前用 gemini 它就经常偷懒,但是把模块拆小后,限制它只能在当前模块测试和 fix 就也能一个一个做完,直接丢一整个大工程给它就容易瞎搞,改的乱七八糟的。
    ntdll
        20
    ntdll  
       10h 16m ago
    本质上就是变成了萝卜开会。

    两个模型出于自己的立场,会强调自己没问题。这个时候只能靠人工来判断了。
    ttt1088
        21
    ttt1088  
       9h 46m ago
    需要换个模型审查吧
    LittleControl
        22
    LittleControl  
       9h 42m ago
    我 gpt-5.6-sol high 一般 review 出来的问题 修复最多两轮后面就没有了,当然也可能跟项目复杂度有关
    hustfox
        23
    hustfox  
       9h 32m ago
    @afxcn 是真的细,一个需求 5.5 extra high 可能一两个小时搞完了,5.6 extra high+fast 能干个一两天。。。
    fovecifer
        24
    fovecifer  
       5h 32m ago
    需要制定一个标准,如果标准过于严苛,可能永远改不完
    就算是双模型互审,我也遇到过三四天不能收敛的情况,最后改出来一坨屎,只能回退
    afxcn
        25
    afxcn  
       3h 11m ago
    你要求它每个小任务都提交一次就好了。 @fovecifer
    nsjs
        26
    nsjs  
       1h 48m ago via iPhone
    ai 不像人的,没有原则和偏好。如果设计本身就有问题,或者存在争议,那反复横跳是必然的事情。
    另外,世界上本身就不存在完美的程序,要让 ai 找茬是能够无限找下去的😂
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   1060 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 57ms · UTC 18:37 · PVG 02:37 · LAX 11:37 · JFK 14:37
    ♥ Do have faith in what you're doing.