cocodot

AI 中转降智检测

测测你正在用的中转 API 会不会在简单题上明显答错 —— 被降配、砍上下文或换成很差的模型,通常会在这里露馅。填你自己的中转信息,依次跑 6 道答案固定的题。

🔒 你的 key 我们不存、不记日志、用完即弃 —— 只用于这一次检测。检测逻辑 开源可自查(题目与判分规则就是仓库里的 probe_spec.json),不放心也可以下 CLI 在自己电脑上跑。

它是怎么测的

6 道答案事先已知的题 —— 指令遵循、Base64 解码、约 3.5k 字的大海捞针、推理陷阱、算术、代码理解 —— 程序直接比对答案,不用裁判模型。能力正常的模型通常全过;被严重降配或砍了上下文的,往往会错几道。它分辨不出实际是哪个模型在回答:便宜的小模型也可能全过。结果是 0-100 分 + 逐项明细,每道题最长等 60 秒。

常见问题

什么叫"降智"?

有些中转会把你的请求偷偷路由到更便宜的小模型 —— 你付旗舰的钱、拿到低配的输出;还有的会砍上下文长度或阉割能力。这个工具能暴露其中让简单题明显答错的情况,但分辨不出具体是哪个模型在回答。

检测原理是什么?

依次跑 6 道答案事先已知的题(指令遵循、Base64 解码、约 3.5k 字的大海捞针、推理陷阱、算术、代码理解),程序直接比对答案,不用裁判模型。能力正常的模型通常全过;被严重降配或砍了上下文的,往往会错几道。便宜的小模型也可能全过,所以通过不等于证明了是哪个模型。最后给 0-100 分和逐项明细;有题目请求失败时判为「检测未完成」。

我的 API key 安全吗?

key 只用于这一次检测,不存储、不记日志、不复用。题目与判分规则开源(仓库里的 probe_spec.json),也可以下载 CLI 在自己电脑上跑同样的检测。

能测别家的中转吗?

能,这正是它的用途。支持任意 OpenAI 兼容端点:测你现在在用的、也测我们、然后对比。我们公开自己的分数,而不是让你「相信我们」。

AI 中转降智检测 · 测你的 API 有没有掺水 | cocodot · cocodot