1
Cabana 2h 36m ago
|
2
senyuLight OP @Cabana 我勒个豆,那这不炸了,我还沾沾自喜,以为用的是真正的模型
![]() |
3
msg7086 2h 30m ago
> 真害怕是 gpt6 收费,使用的是 5.6
5.6 ?没那么高,给你个 4 级别的就差不多了。 |
4
senyuLight OP |
5
Tink 2h 24m ago
|
6
senyuLight OP @Tink 我又看了一下网站说明,这个网站只收录了,cluade 和 OpenAI 的模型,其他模型测,算出来的因子,去和收录的对比,毕竟没有收录其他模型,也就是说只能测 cluade 和 OpenAI 的模型。
![]() |
7
zwyhzxy 2h 12m ago
astra high ,测出来是 luna ,日乐天了这
|
8
senyuLight OP @zwyhzxy 那你测要么是被降智了,要么就像我同事一样,使用的是中转站,以为用的是 gpt6 ,结果是路由到 5.6 luna 。
|
9
zhaotian5868 2h 7m ago
5.6 sol high , 测出来确实是 sol
|
10
loopq 2h 2m ago
gpt 拼车 两次测试 [5.6 sol 和 6 astra] xhigh 都直接落到了 5.6 luna ,悲催了
我自己的 codex plus 和 claude 都分别识别正确,6 astra - opus5 ,感觉这种 风控更多还是针对 sub2api 用户 |
11
StudyFung 2h 0m ago
中转站的 gpt6 ,测出来是 5.5 ,避雷
|
12
kapr1k0rn 1h 58m ago
这种测试的意义是什么?难道因为是个 5.6 就默认回答得不对,是 6 就是对的?AI 版的因人废言?
|
13
BenCoper 1h 56m ago
测指纹这个意义不大,糖果题一直都是最容易发现降智的
|
14
senyuLight OP @loopq 是的大佬,你自己的是官方客户端没问题的😀。这波是那些使用中转站和非官方的难受了
|
15
senyuLight OP @kapr1k0rn 意义在于你使用的是不是真实你想用的模型。并不是对不对的问题,而是模型一致问题。
|
16
senyuLight OP @BenCoper 糖果题是指什么呢,大佬科普一下呢
|
17
lscho 1h 50m ago
取糖果和鹈鹕是目前最快能测出来智商的
|
18
senyuLight OP @StudyFung 我身边同事,使用中转站,选择的是 gpt6 ,实际上测出来是 5.6 luna ,从评论区大佬们反馈来看,中转站和反代的,基本都被降智了。
|
19
senyuLight OP @lscho 好的,谢谢科普~
|
20
layxy 1h 45m ago 你看下那个帖子下我的回复,我昨天使用 300 多次,有一半被路由到 gpt5.6,也就是我的任何一次交互都有一半可能降智,鬼知道哪一次对话哪一次处理是 gpt5.6 还是 gpt5.6 ,下面的数据是在 https://chatgpt.com/codex/cloud/settings/analytics#usage 的轮次监控数据中可以看到,另外说明下我是 gptpro20x,一直官方 codex 使用,没有使用反代
gpt-6-astra 154 次 gpt-5.6-luna 151 次 gpt-5.6-terra 8 次 |
21
senyuLight OP @layxy 看了大佬你的回复了,我觉得这个是正常的。我用 gpt6 模型,或者 5.6 sol 模型的时候,做复杂任务,当前对话窗口回去开子 agent 执行任务,主 agent 管理,子 agent 就会根据任务派发到 gpt 其他模型。你在对话窗口是能够看到那些子 agent 执行的。
|
22
plants 1h 10m ago
@senyuLight 因为 openai 在重点打击非法中转站,中转站降智是重灾区
|
23
layxy 1h 8m ago
@senyuLight 我是用的 gpt6-astra medium,没有要求其开子任务,之前蹬过 gpt5.6 sol ultra ,子 agent 执行我知道右上角会有子任务列表图标,但是用了 gpt6 后我觉得挺快的,完全不需要子 agent,也没在右上角看到过子 agent 的图标,说白了就是后端直接给路由到 luna 了
|