• 请不要在回答技术问题时复制粘贴 AI 生成的内容
sampeng
V2EX  ›  程序员

有一事不解,是绝大多数都是许愿 AI?

  •  
  •   sampeng · 1 day ago via iPhone · 1608 views
    v2 好像还好,隔壁 linux.do 的帖子 80%都是在测试模型有没降智

    我用了一年除了 sonnet3.x-4.x 突然开始我说 a ,他做 b 以外这种明显的。其他基本没有感觉到啊…忘记做漏做都是自己没说清楚的。给我的感觉就是我要没提他做了是惊喜,没做是我没说清楚。只要把我说了的都稳定快速做完就是好模型。

    或许这种所为的脑子不好使就是模型幻觉在 coding 里面的表现?

    然后我就想到会不会是都在许愿编程?用的人自己并不清楚正确的是什么结果,或者就是一句话帮我做个登录,帮我搞一下支付,帮我做 xx 功能这样?
    11 replies    2026-09-14 14:10:42 +08:00
    jackzhou968
        1
    jackzhou968  
       1 day ago
    有更好的模型, 觉得以前的模型不好用了
    nsjs
        2
    nsjs  
       1 day ago via iPhone
    开发三步骤嘛,提需求,实现,判定正确性。 判定很难的,没这能力就只好依赖 ai 了…… 而且现在很多人用来做整个产品,或多或少都有这方面问题的
    sampeng
        3
    sampeng  
    OP
       1 day ago via iPhone
    @nsjs 我个人非常不看好一个/glob 就不管了…我拿一个帐号来试过,他是会自己验证。写出来的东西都是啥啊…我再拿个 ai 来接着写都看不懂怎么修 bug 。
    Antihank
        4
    Antihank  
       1 day ago
    我没看到使用 Anthropic 模型的人有提出,基本上都是使用 Openai 模型的人在抱怨这个现象。
    nsjs
        5
    nsjs  
       1 day ago via iPhone
    @sampeng 做自己懂的东西是的,毕竟自己知道应该做成什么样。 现在有了 agent 之后,可以用来做更大的,超出自己知识和精力范围之外的东西了。 超出知识范围还好,可以学,超出精力范围就实在没有办法了,只能靠 agent 了。 所以模型智力很重要嘛,但这么多的人测智力的大多都是跟风图一乐而已,自己的那半亩地都种不好的
    jonty
        6
    jonty  
       1 day ago
    @Antihank #4 opus4.7 出来那时候不少人抱怨吧。
    idealhs
        7
    idealhs  
       23h 29m ago
    你自己测一下醍醐不就知道了
    前两天 Astra 高负载的时候,多少人用 Astra 被路由到 5.5 mini 了
    你感受不到 != 不存在
    FTJ
        8
    FTJ  
       23h 28m ago
    倒不完全是许愿。我的体验是,从 Opus 4.7 之后各家模型都有个毛病:回复越来越“工程师黑话化”。给个需求,开发完甩回来一堆编程术语,还混着它自己起的各种函数名、模块名,想看懂它改了哪里、怎么改的,成本非常高。功能是做了,但人和 AI 之间反而更难沟通了。
    lel020
        9
    lel020  
       2h 39m ago
    对我来说 AI 智商最重要的体现在于听懂我的要求,遵守 skill 约束,
    差不多的指令和 skill 环境,某天开始纠正 AI 的理解和实现次数明显变多,尤其是我都不用明说什么问题,说 AI 有问题 AI 就知道是什么问题但下次还犯,这种情况越来越多,那就是降智了,
    代码质量之类的反而很难体现智商,
    sampeng
        10
    sampeng  
    OP
       1h 11m ago
    @lel020 嗯。这点我同意,我其实不关心他画图降不降智,遵守 skill 约束,听懂我在说什么。我引导一下说一些关键点就知道是什么意思开始往下走,这样就足够了。说实话,这两周我也是从 cc 切换到 gpt 的,也还行啊。我不是很理解大家说的降智是怎样的表现,即不会中途乱写也不会理解错意图。唯一区别就是有时候会变慢。整体上我是能接受的。但是一句话许愿编程除外,就比较靠抽卡得体验
    lel020
        11
    lel020  
       47 mins ago
    @sampeng #10 画图这点感觉其实和把脉类似,没人知道为什么模型画出来的图是这样的,但也不用知道,
    只要知道模型正常的时候画的更好,现在画不好了,那指定有点什么毛病,
    尤其是脉象和某病人一样的话那多半是一样的病了,虽然直接下定论也不是很科学,但没有透视只能看到这么多了,
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   5641 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 58ms · UTC 06:58 · PVG 14:58 · LAX 23:58 · JFK 02:58
    ♥ Do have faith in what you're doing.