• 请不要在回答技术问题时复制粘贴 AI 生成的内容
senyuLight
V2EX  ›  程序员

看了一位 v 站博主的 OpenAI 模型降智测试,于是也测测自己用的客户端模型是否被降智

  •  
  •   senyuLight · 2h 44m ago · 1364 views

    原贴:一些关于 openai 订阅降智,账号风控的独立测试

    通过模型指纹识别:https://xqy2006.github.io/ModelTrace

    识别结果如下,看到是 gpt6 就放心了,真害怕是 gpt6 收费,使用的是 5.6

    23 replies    2026-09-14 11:14:11 +08:00
    Cabana
        1
    Cabana  
       2h 36m ago

    你这一点也不准啊,我用 gemini3.8flsh 测的
    senyuLight
        2
    senyuLight  
    OP
       2h 31m ago
    @Cabana 我勒个豆,那这不炸了,我还沾沾自喜,以为用的是真正的模型
    msg7086
        3
    msg7086  
       2h 30m ago
    > 真害怕是 gpt6 收费,使用的是 5.6

    5.6 ?没那么高,给你个 4 级别的就差不多了。
    senyuLight
        4
    senyuLight  
    OP
       2h 24m ago
    Tink
        5
    Tink  
       2h 24m ago
    我刚试了一下 grok4.6,搞笑,试出来是 opus4.6



    senyuLight
        6
    senyuLight  
    OP
       2h 21m ago
    @Tink 我又看了一下网站说明,这个网站只收录了,cluade 和 OpenAI 的模型,其他模型测,算出来的因子,去和收录的对比,毕竟没有收录其他模型,也就是说只能测 cluade 和 OpenAI 的模型。
    zwyhzxy
        7
    zwyhzxy  
       2h 12m ago
    astra high ,测出来是 luna ,日乐天了这
    senyuLight
        8
    senyuLight  
    OP
       2h 8m ago
    @zwyhzxy 那你测要么是被降智了,要么就像我同事一样,使用的是中转站,以为用的是 gpt6 ,结果是路由到 5.6 luna 。
    zhaotian5868
        9
    zhaotian5868  
       2h 7m ago
    5.6 sol high , 测出来确实是 sol
    loopq
        10
    loopq  
       2h 2m ago
    gpt 拼车 两次测试 [5.6 sol 和 6 astra] xhigh 都直接落到了 5.6 luna ,悲催了

    我自己的 codex plus 和 claude 都分别识别正确,6 astra - opus5 ,感觉这种 风控更多还是针对 sub2api 用户
    StudyFung
        11
    StudyFung  
       2h 0m ago
    中转站的 gpt6 ,测出来是 5.5 ,避雷
    kapr1k0rn
        12
    kapr1k0rn  
       1h 58m ago
    这种测试的意义是什么?难道因为是个 5.6 就默认回答得不对,是 6 就是对的?AI 版的因人废言?
    BenCoper
        13
    BenCoper  
       1h 56m ago
    测指纹这个意义不大,糖果题一直都是最容易发现降智的
    senyuLight
        14
    senyuLight  
    OP
       1h 55m ago
    @loopq 是的大佬,你自己的是官方客户端没问题的😀。这波是那些使用中转站和非官方的难受了
    senyuLight
        15
    senyuLight  
    OP
       1h 53m ago
    @kapr1k0rn 意义在于你使用的是不是真实你想用的模型。并不是对不对的问题,而是模型一致问题。
    senyuLight
        16
    senyuLight  
    OP
       1h 52m ago
    @BenCoper 糖果题是指什么呢,大佬科普一下呢
    lscho
        17
    lscho  
       1h 50m ago
    取糖果和鹈鹕是目前最快能测出来智商的
    senyuLight
        18
    senyuLight  
    OP
       1h 50m ago
    @StudyFung 我身边同事,使用中转站,选择的是 gpt6 ,实际上测出来是 5.6 luna ,从评论区大佬们反馈来看,中转站和反代的,基本都被降智了。
    senyuLight
        19
    senyuLight  
    OP
       1h 49m ago
    @lscho 好的,谢谢科普~
    layxy
        20
    layxy  
       1h 45m ago   ❤️ 1
    你看下那个帖子下我的回复,我昨天使用 300 多次,有一半被路由到 gpt5.6,也就是我的任何一次交互都有一半可能降智,鬼知道哪一次对话哪一次处理是 gpt5.6 还是 gpt5.6 ,下面的数据是在 https://chatgpt.com/codex/cloud/settings/analytics#usage 的轮次监控数据中可以看到,另外说明下我是 gptpro20x,一直官方 codex 使用,没有使用反代
    gpt-6-astra 154 次
    gpt-5.6-luna 151 次
    gpt-5.6-terra 8 次
    senyuLight
        21
    senyuLight  
    OP
       1h 32m ago
    @layxy 看了大佬你的回复了,我觉得这个是正常的。我用 gpt6 模型,或者 5.6 sol 模型的时候,做复杂任务,当前对话窗口回去开子 agent 执行任务,主 agent 管理,子 agent 就会根据任务派发到 gpt 其他模型。你在对话窗口是能够看到那些子 agent 执行的。
    plants
        22
    plants  
       1h 10m ago
    @senyuLight 因为 openai 在重点打击非法中转站,中转站降智是重灾区
    layxy
        23
    layxy  
       1h 8m ago
    @senyuLight 我是用的 gpt6-astra medium,没有要求其开子任务,之前蹬过 gpt5.6 sol ultra ,子 agent 执行我知道右上角会有子任务列表图标,但是用了 gpt6 后我觉得挺快的,完全不需要子 agent,也没在右上角看到过子 agent 的图标,说白了就是后端直接给路由到 luna 了
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   3754 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 54ms · UTC 04:22 · PVG 12:22 · LAX 21:22 · JFK 00:22
    ♥ Do have faith in what you're doing.