全球AI大宕机,你的中转站却还能用?就说牛不牛

全美顶级闭源大模型全部停摆,好巧,然后自己的中转站却稳定返回数据,哎呀,直接扯下了部分中转站的遮羞布。

在主流AI服务集体瘫痪的3小时40分钟里,一个耐人寻味的现象出现在技术社区的讨论中:有开发者发现,自己使用的中转站仍然能正常响应请求。

这引发了大量追问:“如果大家都不可以用,就你的中转站可以,那这个中转站卖的是真货吗?”“是不是中转回源到GLM了?”“会不会中转站代理的并不是GPT?”

简单来说,答案是:能用,但原因值得警惕

原理:为什么官方崩了,中转站还能用?

中转站的本质是一个“中间层”——它接收用户的API请求,再转发到真实的模型服务商(如OpenAI、Anthropic)。当官方服务大规模瘫痪时,中转站仍可用的可能性有三个:

  1. 缓存响应:中转站可能缓存了之前相同或相似请求的回复,直接返回缓存内容,绕过了已经宕机的上游推理服务。
  2. 本地/备选模型替代:更隐蔽的情况是,中转站在用户不知情的情况下,将原本请求的高端模型(如Claude Opus)路由到了另一个可用的替代模型(如更便宜的GLM、Qwen,甚至是本地部署的开源模型),并返回了替代模型的输出。
  3. 不同上游节点:部分中转站可能使用了与官方主站不同的API节点或CDN边缘节点,在主干故障时仍保持了一部分可用性。

背后的灰色操作:模型替换与路由劫持

技术社区的讨论中多次出现了同一个质疑:“中转站暗自替换了模型返回”。

这并非空穴来风。事实上,这类“偷换模型”的操作在中转站生态中早已不是秘密。

根据多个第三方检测工具的披露,部分AI中转站存在以下灰色操作:

操作方式 说明
模型替换 用户为Claude Opus付费,中转站后台却偷偷换成Claude Sonnet甚至Haiku来响应请求,赚取差价。用户看到的仍是“Opus”的返回标识,但实际内容来自廉价模型。
隐藏Prompt注入 中转站在用户请求中偷偷插入额外的系统提示词,虚增Token消耗,从而多收费用。
路由规则劫持 通过配置路由规则,将特定模型的请求永久重写到另一个模型。例如,Vercel AI Gateway官方文档中就明确提供了rewrite功能,可将claude-opus请求重写为claude-haiku来“将昂贵模型路由到更便宜的模型”。阿里云的AI网关也提供“智能路由”功能,可在不修改应用代码的前提下“按成本、质量或响应速度选择候选模型”。

如何识别自己的中转站是否“掺水”?

现在社区已经开发出多种检测手段来应对这个问题:

  • 行为指纹检测:这是最新且成本极低的方法。研究发现,不同模型对“随机数”有独特的偏好——GPT-4o明显偏爱42和37,Claude Sonnet 5对47有强迫症般的执着,而Qwen3-Max则30次全部吐出42。只需约120次请求,就能以约10%的错误率识别模型真身,“让套壳无处遁形”。
  • 多维度基线对比:工具如RelayRadar和API纯净度检测器,从SSE事件链结构、模型自我声明、知识截止日期、推理能力基线、代码生成质量等多个维度与官方API基线进行1:1比对,判断是否存在模型替换。

小结:宕机是把照妖镜

回到最初的问题:9月3日全球AI大宕机期间中转站还能不能用?

能用,但能用的中转站反而更可疑。 当所有官方源都哑火时,一个仍能正常工作的中转站大概率在做“替代品生意”——用本地缓存或更便宜的替代模型糊弄用户,却照收高端模型的钱。

有开发者评论说:“北美糖宝跌出御三家实锤了,谷歌跟中转站坐一桌。” 另一边的社区则更直接:“如果现在还能用这些的中转站,你懂的……”

技术社区的共识是:中转站能用≠问题不大,恰恰相反,它暴露了API中转生态中“偷梁换柱”的行业灰产。宕机事件不仅暴露了AI产业对少数云基础设施的依赖,也顺手扯下了部分中转站的遮羞布。

评论

发表评论

登录后可发表评论并对评论点赞。

去登录
暂无评论,快来发表第一条评论吧!