1
Cabana 19h 44m ago
|
2
senyuLight OP @Cabana 我勒个豆,那这不炸了,我还沾沾自喜,以为用的是真正的模型
![]() |
3
msg7086 19h 39m ago
> 真害怕是 gpt6 收费,使用的是 5.6
5.6 ?没那么高,给你个 4 级别的就差不多了。 |
4
senyuLight OP |
5
Tink 19h 33m ago
|
6
senyuLight OP @Tink 我又看了一下网站说明,这个网站只收录了,cluade 和 OpenAI 的模型,其他模型测,算出来的因子,去和收录的对比,毕竟没有收录其他模型,也就是说只能测 cluade 和 OpenAI 的模型。
![]() |
7
zwyhzxy 19h 20m ago
astra high ,测出来是 luna ,日乐天了这
|
8
senyuLight OP @zwyhzxy 那你测要么是被降智了,要么就像我同事一样,使用的是中转站,以为用的是 gpt6 ,结果是路由到 5.6 luna 。
|
9
zhaotian5868 19h 15m ago
5.6 sol high , 测出来确实是 sol
|
10
loopq 19h 10m ago
gpt 拼车 两次测试 [5.6 sol 和 6 astra] xhigh 都直接落到了 5.6 luna ,悲催了
我自己的 codex plus 和 claude 都分别识别正确,6 astra - opus5 ,感觉这种 风控更多还是针对 sub2api 用户 |
11
StudyFung 19h 9m ago
中转站的 gpt6 ,测出来是 5.5 ,避雷
|
12
kapr1k0rn 19h 7m ago
这种测试的意义是什么?难道因为是个 5.6 就默认回答得不对,是 6 就是对的?AI 版的因人废言?
|
13
BenCoper 19h 5m ago
测指纹这个意义不大,糖果题一直都是最容易发现降智的
|
14
senyuLight OP @loopq 是的大佬,你自己的是官方客户端没问题的😀。这波是那些使用中转站和非官方的难受了
|
15
senyuLight OP @kapr1k0rn 意义在于你使用的是不是真实你想用的模型。并不是对不对的问题,而是模型一致问题。
|
16
senyuLight OP @BenCoper 糖果题是指什么呢,大佬科普一下呢
|
17
lscho 18h 59m ago
取糖果和鹈鹕是目前最快能测出来智商的
|
18
senyuLight OP @StudyFung 我身边同事,使用中转站,选择的是 gpt6 ,实际上测出来是 5.6 luna ,从评论区大佬们反馈来看,中转站和反代的,基本都被降智了。
|
19
senyuLight OP @lscho 好的,谢谢科普~
|
20
layxy 18h 53m ago 你看下那个帖子下我的回复,我昨天使用 300 多次,有一半被路由到 gpt5.6,也就是我的任何一次交互都有一半可能降智,鬼知道哪一次对话哪一次处理是 gpt5.6 还是 gpt5.6 ,下面的数据是在 https://chatgpt.com/codex/cloud/settings/analytics#usage 的轮次监控数据中可以看到,另外说明下我是 gptpro20x,一直官方 codex 使用,没有使用反代
gpt-6-astra 154 次 gpt-5.6-luna 151 次 gpt-5.6-terra 8 次 |
21
senyuLight OP @layxy 看了大佬你的回复了,我觉得这个是正常的。我用 gpt6 模型,或者 5.6 sol 模型的时候,做复杂任务,当前对话窗口回去开子 agent 执行任务,主 agent 管理,子 agent 就会根据任务派发到 gpt 其他模型。你在对话窗口是能够看到那些子 agent 执行的。
|
22
plants 18h 19m ago
@senyuLight 因为 openai 在重点打击非法中转站,中转站降智是重灾区
|
23
layxy 18h 16m ago
@senyuLight 我是用的 gpt6-astra medium,没有要求其开子任务,之前蹬过 gpt5.6 sol ultra ,子 agent 执行我知道右上角会有子任务列表图标,但是用了 gpt6 后我觉得挺快的,完全不需要子 agent,也没在右上角看到过子 agent 的图标,说白了就是后端直接给路由到 luna 了
|
24
yiranw09 16h 9m ago
|
25
senyuLight OP @yiranw09 可以的,那我更加放心了👍
|
26
pwinner 15h 46m ago
其实最简单的是鹈鹕测试,大部分人日常使用可能注意不到被降智而已...
|
28
kianwww 15h 36m ago
有些客户端在触发风控或者高负载时也会静默降级
|
29
None123 15h 34m ago
astra max ,测出来是 gpt-5.6-luna
|
30
tim9527 15h 26m ago
|
31
FakerLeung 15h 20m ago
|
32
senyuLight OP @FakerLeung 中转站必炸,官方重点关注的,以后中转,反代,肯定是能不用就不用了
|
33
tim9527 14h 31m ago
|
34
yinmin 14h 26m ago via iPhone
openrouter 选 sol ,测出来 100% sol
|
35
jko123 14h 12m ago
|
36
senyuLight OP 是的,中转以后肯定不能用了,一方面是对话数据可能会被卖,最新网上一个博主花 5 位数卖 6tb 的中转数据,大量的 ssh 等 key ,另一方面中转可能会注水,最重要官方会限制,可能会对自己的项目有影响。
|
37
Cruzz 13h 42m ago
|
38
andie 13h 23m ago
很准
|
42
jwk345 12h 29m ago
|
44
senyuLight OP @jwk345 #43 还能说啥?只能说明,deepseek 蒸馏了 gpt 。这个网站只能测 gpt 和 cluade code ,其他模型,测出来的结果,只能去和这两家模型里面匹配。
![]() |
45
Kokomashiro 12h 9m ago
Composer 2.5 测出来是 3 个 9 的 gpt 5.4 ,你别说还真差不多。
|
46
0xcode 12h 8m ago
|
47
senyuLight OP @0xcode 根据前面数据来看,deepseek 应该是蒸馏了,gpt 和 cluade code 。
![]() |
48
jsq2627 11h 12m ago
测试了 Azure OpenAI 上的 gpt-6-astra, gpt-5.6-sol, gpt-5.6-luna ,结果非常准确。
|
50
menghuitangchao 9h 5m ago
我试了官方订阅的 5.4 、luna 、terra 、sol 、6 ,都测出来了,这个算法还是有东西的
|
51
jiayouzl 9h 1m ago
|
52
dongzhimin 8h 34m ago
@jsq2627 卖给第三方的特别是微软的不敢狸猫换太子
|
53
crystal1992 6h 36m ago
不止中转,第三方用指纹浏览器批量创建的号也被标记了,我们客户端直登的 90%降智
|