• 请不要在回答技术问题时复制粘贴 AI 生成的内容
senyuLight
V2EX  ›  程序员

看了一位 v 站博主的 OpenAI 模型降智测试,于是也测测自己用的客户端模型是否被降智

  •  
  •   senyuLight · 19h 53m ago · 4137 views

    原贴:一些关于 openai 订阅降智,账号风控的独立测试

    通过模型指纹识别:https://xqy2006.github.io/ModelTrace

    识别结果如下,看到是 gpt6 就放心了,真害怕是 gpt6 收费,使用的是 5.6

    53 replies    2026-09-14 22:54:28 +08:00
    Cabana
        1
    Cabana  
       19h 44m ago

    你这一点也不准啊,我用 gemini3.8flsh 测的
    senyuLight
        2
    senyuLight  
    OP
       19h 40m ago
    @Cabana 我勒个豆,那这不炸了,我还沾沾自喜,以为用的是真正的模型
    msg7086
        3
    msg7086  
       19h 39m ago
    > 真害怕是 gpt6 收费,使用的是 5.6

    5.6 ?没那么高,给你个 4 级别的就差不多了。
    senyuLight
        4
    senyuLight  
    OP
       19h 33m ago
    Tink
        5
    Tink  
       19h 33m ago
    我刚试了一下 grok4.6,搞笑,试出来是 opus4.6



    senyuLight
        6
    senyuLight  
    OP
       19h 30m ago
    @Tink 我又看了一下网站说明,这个网站只收录了,cluade 和 OpenAI 的模型,其他模型测,算出来的因子,去和收录的对比,毕竟没有收录其他模型,也就是说只能测 cluade 和 OpenAI 的模型。
    zwyhzxy
        7
    zwyhzxy  
       19h 20m ago
    astra high ,测出来是 luna ,日乐天了这
    senyuLight
        8
    senyuLight  
    OP
       19h 17m ago
    @zwyhzxy 那你测要么是被降智了,要么就像我同事一样,使用的是中转站,以为用的是 gpt6 ,结果是路由到 5.6 luna 。
    zhaotian5868
        9
    zhaotian5868  
       19h 15m ago
    5.6 sol high , 测出来确实是 sol
    loopq
        10
    loopq  
       19h 10m ago
    gpt 拼车 两次测试 [5.6 sol 和 6 astra] xhigh 都直接落到了 5.6 luna ,悲催了

    我自己的 codex plus 和 claude 都分别识别正确,6 astra - opus5 ,感觉这种 风控更多还是针对 sub2api 用户
    StudyFung
        11
    StudyFung  
       19h 9m ago
    中转站的 gpt6 ,测出来是 5.5 ,避雷
    kapr1k0rn
        12
    kapr1k0rn  
       19h 7m ago
    这种测试的意义是什么?难道因为是个 5.6 就默认回答得不对,是 6 就是对的?AI 版的因人废言?
    BenCoper
        13
    BenCoper  
       19h 5m ago
    测指纹这个意义不大,糖果题一直都是最容易发现降智的
    senyuLight
        14
    senyuLight  
    OP
       19h 4m ago
    @loopq 是的大佬,你自己的是官方客户端没问题的😀。这波是那些使用中转站和非官方的难受了
    senyuLight
        15
    senyuLight  
    OP
       19h 2m ago
    @kapr1k0rn 意义在于你使用的是不是真实你想用的模型。并不是对不对的问题,而是模型一致问题。
    senyuLight
        16
    senyuLight  
    OP
       19h 1m ago
    @BenCoper 糖果题是指什么呢,大佬科普一下呢
    lscho
        17
    lscho  
       18h 59m ago
    取糖果和鹈鹕是目前最快能测出来智商的
    senyuLight
        18
    senyuLight  
    OP
       18h 59m ago
    @StudyFung 我身边同事,使用中转站,选择的是 gpt6 ,实际上测出来是 5.6 luna ,从评论区大佬们反馈来看,中转站和反代的,基本都被降智了。
    senyuLight
        19
    senyuLight  
    OP
       18h 58m ago
    @lscho 好的,谢谢科普~
    layxy
        20
    layxy  
       18h 53m ago   ❤️ 1
    你看下那个帖子下我的回复,我昨天使用 300 多次,有一半被路由到 gpt5.6,也就是我的任何一次交互都有一半可能降智,鬼知道哪一次对话哪一次处理是 gpt5.6 还是 gpt5.6 ,下面的数据是在 https://chatgpt.com/codex/cloud/settings/analytics#usage 的轮次监控数据中可以看到,另外说明下我是 gptpro20x,一直官方 codex 使用,没有使用反代
    gpt-6-astra 154 次
    gpt-5.6-luna 151 次
    gpt-5.6-terra 8 次
    senyuLight
        21
    senyuLight  
    OP
       18h 41m ago
    @layxy 看了大佬你的回复了,我觉得这个是正常的。我用 gpt6 模型,或者 5.6 sol 模型的时候,做复杂任务,当前对话窗口回去开子 agent 执行任务,主 agent 管理,子 agent 就会根据任务派发到 gpt 其他模型。你在对话窗口是能够看到那些子 agent 执行的。
    plants
        22
    plants  
       18h 19m ago
    @senyuLight 因为 openai 在重点打击非法中转站,中转站降智是重灾区
    layxy
        23
    layxy  
       18h 16m ago
    @senyuLight 我是用的 gpt6-astra medium,没有要求其开子任务,之前蹬过 gpt5.6 sol ultra ,子 agent 执行我知道右上角会有子任务列表图标,但是用了 gpt6 后我觉得挺快的,完全不需要子 agent,也没在右上角看到过子 agent 的图标,说白了就是后端直接给路由到 luna 了
    yiranw09
        24
    yiranw09  
       16h 9m ago
    测了一下中转站的几个渠道
    1. 研究院渠道 GPT6

    2. Pro 号池

    3. Plus 号池

    测试方法应该是蛮准的,并且消耗比醍醐糖果小多了,开一个 chat 就能进行测试
    senyuLight
        25
    senyuLight  
    OP
       15h 54m ago
    @yiranw09 可以的,那我更加放心了👍
    pwinner
        26
    pwinner  
       15h 46m ago
    其实最简单的是鹈鹕测试,大部分人日常使用可能注意不到被降智而已...
    zjttfs
        27
    zjttfs  
       15h 40m ago
    @pwinner
    降智体感很明显..
    特别是 astra 降智.降智后明显弱智,做事做不全等
    kianwww
        28
    kianwww  
       15h 36m ago
    有些客户端在触发风控或者高负载时也会静默降级
    None123
        29
    None123  
       15h 34m ago
    astra max ,测出来是 gpt-5.6-luna
    tim9527
        30
    tim9527  
       15h 26m ago
    还可以,看来家宽挺准的,我鹈鹕测试也过了
    FakerLeung
        31
    FakerLeung  
       15h 20m ago
    丸辣,中转站 gpt-5.6-sol ,测出来是 gpt-5.6-luna
    senyuLight
        32
    senyuLight  
    OP
       15h 8m ago
    @FakerLeung 中转站必炸,官方重点关注的,以后中转,反代,肯定是能不用就不用了
    tim9527
        33
    tim9527  
       14h 31m ago
    用 Astra 又测试了一次 稳
    yinmin
        34
    yinmin  
       14h 26m ago via iPhone
    openrouter 选 sol ,测出来 100% sol
    jko123
        35
    jko123  
       14h 12m ago
    自用订阅测的


    中转站测的


    中转站果然不能用啊
    senyuLight
        36
    senyuLight  
    OP
       14h 2m ago
    是的,中转以后肯定不能用了,一方面是对话数据可能会被卖,最新网上一个博主花 5 位数卖 6tb 的中转数据,大量的 ssh 等 key ,另一方面中转可能会注水,最重要官方会限制,可能会对自己的项目有影响。
    Cruzz
        37
    Cruzz  
       13h 42m ago

    我这的肯定没降智,因为让他给我测试下 hive 认证跑了我百分之 40 的额度。根本用不起,我也不开。5.6sol 够够的。
    andie
        38
    andie  
       13h 23m ago
    很准
    sampeng
        39
    sampeng  
       13h 5m ago
    @layxy 应该不是你要求,而是 codex 的背后会有模型任务,compact ,explore ,都可能是 lua 。。
    layxy
        40
    layxy  
       13h 3m ago
    @sampeng 如果没降智,咋会这么拉啊,感觉现在使用没有刚出那两天好使了,有时候还不如 gpt5.6 sol
    sampeng
        41
    sampeng  
       13h 1m ago
    @layxy 换 pi/opencode 试试。。那个 codex 太臃肿了。
    jwk345
        42
    jwk345  
       12h 29m ago

    可以可以,我用 DeepSeek 官方 flash 带思考模式,给我测出 gpt-6-astra
    jwk345
        43
    jwk345  
       12h 22m ago
    @jwk345 还能说啥?😑
    senyuLight
        44
    senyuLight  
    OP
       12h 9m ago
    @jwk345 #43 还能说啥?只能说明,deepseek 蒸馏了 gpt 。这个网站只能测 gpt 和 cluade code ,其他模型,测出来的结果,只能去和这两家模型里面匹配。
    Kokomashiro
        45
    Kokomashiro  
       12h 9m ago
    Composer 2.5 测出来是 3 个 9 的 gpt 5.4 ,你别说还真差不多。
    0xcode
        46
    0xcode  
       12h 8m ago
    deepDeepSeek4.1
    senyuLight
        47
    senyuLight  
    OP
       11h 56m ago
    @0xcode 根据前面数据来看,deepseek 应该是蒸馏了,gpt 和 cluade code 。
    jsq2627
        48
    jsq2627  
       11h 12m ago
    测试了 Azure OpenAI 上的 gpt-6-astra, gpt-5.6-sol, gpt-5.6-luna ,结果非常准确。
    jiayouzl
        49
    jiayouzl  
       9h 7m ago
    @StudyFung 一份价格一分货,中转站这种玩意想想也知道有猫腻的。
    menghuitangchao
        50
    menghuitangchao  
       9h 5m ago
    我试了官方订阅的 5.4 、luna 、terra 、sol 、6 ,都测出来了,这个算法还是有东西的
    jiayouzl
        51
    jiayouzl  
       9h 1m ago
    codex+open ai 官方 api 接口(非中转站)
    dongzhimin
        52
    dongzhimin  
       8h 34m ago
    @jsq2627 卖给第三方的特别是微软的不敢狸猫换太子
    crystal1992
        53
    crystal1992  
       6h 36m ago
    不止中转,第三方用指纹浏览器批量创建的号也被标记了,我们客户端直登的 90%降智
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   936 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 129ms · UTC 21:30 · PVG 05:30 · LAX 14:30 · JFK 17:30
    ♥ Do have faith in what you're doing.