0x01. 起点
两个月前,开始玩菲律宾20x codex。在5.6时代爽的不行。不过一切的转折在9月初,closedai发布了他们的新一代模型gpt-6,虽然说没有瘫坐,但是却再面临一些其他问题:
Selected model is at capacity. Please try a different model.
对于被gpt、gemini弄坏了脑子的我看到这段话根本无法接受,真的就如同看到了核弹爆炸一样。

从字面意思来看,那就是GPT服务器土豆炸了,真的如此吗?未必。
0x02. 土豆?降智!
目前这个“at capacity”问题并不仅仅是模型拒绝回答,如果你的账号还符合以下特征,恭喜你,你的账号可能被flag了!
- 经常“Selected model is at capacity. Please try a different model.”
- 回复特别慢。而且伴随“at capacity”
- 输出质量下降(见0x03)
- 额度总量减少
对于这些情况,实际上的对应是:
- “at capacity”、回复首字慢 -> 被降低权重,导致拒绝服务。
- 输出质量下降 -> 被路由到5.6luna甚至4o(我这未复现)
如果出现了这种情况,基本确认你的账号已经被标记了,可以放弃换IP这类治疗方式了,下附我这里的网络出口:

我甚至都可以列出来你换ip之后的过程:
首先你会发现不会再at capacity了,模型输出速度也有一定程度的提升,但是!
等一天,一切恢复原样!
0x03. 测试
喜闻乐见的鹈鹕测试
Prompt:
创建一个HTML,内容是SVG绘制一个鹈鹕骑自行车的2D动画.
选择gpt6-astra,如果账号干净,中间不会capacity,仔细观察鹈鹕的动作。

顺便来点反面教材。

大豆包(3.1Pro+思考):

糖果测试
Prompt:
在一个黑色的袋子里放有三种口味的糖果,每种糖果有两种不同的形状(圆形和五角星形,不同的形
状靠手感可以分辨)。现已知不同口味的糖和不同形状的数量统计如下表。参赛者需要在活动前决定
摸出的糖果数目,那么,最少取出多少个糖果才能保证手中同时拥有不同形状的苹果味和桃子味的
糖?(同时手中有圆形苹果味匹配五角星桃子味糖果,或者有圆形桃子味匹配五角星苹果味糖果都满
足要求)不调用任何工具、也不调用联网
第 1 列 第 2 列 第 3 列 第 4 列
苹果味 桃子味 西瓜味
圆形 7 9 8
五角星形 7 6 4
正确答案(或者说,是5.6Sol/Gpt-6的标准输出):21

大豆包(3.8Flash,开思考)输出:

模型指纹测试法
众所周知大模型无法输出真正的随机数,从数学角度来说大模型输出的随机数是能够判断模型到底是什么的。
根据网页提示,和你的gpt聊天,主要观察输出结果是否和你所选择的模型一致。

传说中的turn-state检测法
https://github.com/gylive/ccodex-sleep-state

如果你的号通过了前面的测试,其实没多大必要专门做这个turn-state,这个项目的本质大概是这样的(我没review代码,讲错了别骂我):
- 和gpt对话的时候,对方的服务器基于各种风控模型,生成出一个加签的state给你。
- 你后续对话带着这个state继续和gpt对话。
- gpt的路由根据签名和state状态决定你是不是降智商。
既然如此,那么撞出一个好的turn-state之后一直用就能暂时性的解决问题。不过缺点也是有的:
- 加签就意味着过期,o/的清北哥肯定想得到要弄个过期时间,时间一到就重新撞吧(
- 你的号如果被flag了,那么撞这个过程也是痛苦的。
- 虽然比较阴暗,但是没准是钓鱼的
订阅区域
本文章测试用的账号:
- 你看到的正面例子:5x 美区(100USD),通过留学生朋友人肉支付。号的话gpt3.5的时代就注册过了,但一直没充钱,到手直接冲100刀。
- 你看到的反面例子:20x 菲律宾区,怎么支付的我就不知道了。8~9月用量每周剩70~80%
本次测试的网络环境:美国加州尔湾 ATT 住宅静态ip (我一人使用)
从B站和身边的使用体验看,5x的体验相对正常,20x控的狠。 另外低价区疑似也是打击重灾区,但是目前o/的风控模型仍然是黑箱,只能从结果倒推原因,并不绝对。
0x04. 结语
从本质上来说,o/还是给用户分了等级的,用api的b端大哥>普通用户>>>被标记的用户。
问题是,如果确实根据低价区来风控,截止目前菲律宾的20x大概是1100左右,米国的按汇率走1400左右,中间也就差了300,但是使用体验来看天差地别。
我可以直接下结论,如果被flag了,菲律宾的20x体验可能确实不如5x,频繁的“at capacity”根本无法让你用完多出来的600元的token。众所周知用不完也不给退款,现在1100里面感觉一个月只能正常用掉10%的用量,gpt-5.6甚至5.5都处于不可用的状态。
最后用和我一起用账号的朋友的一句话来结束文章。
我让他试着跑一下模型指纹的时候,他说:没试过,对我来说其实挺够用(
我说其实他没用过正经的GPT-6-Astra。
最黑色幽默的就在这里了,在o/开始吹GPT-6-Astra达到AGI之前,还是先看看,大家真的用上GPT-6-Astra了吗?
Comments NOTHING