大模型降智检测用来评测 GPT、Claude、DeepSeek、Kimi、通义千问、豆包、Gemini 和 Grok。同一套题目发给你自己的接口,看模型在能力、迷惑题和绘图上有没有变差。
站点包含降智检测、基础能力测试、糖果迷惑题、鹈鹕骑车绘图,以及 API 中转站掺水检测。分数只来自已经完成的真实回答。没有配置接口、也没有完成记录时,不会显示降智结论。
能力测试看阅读、推理、代码和知识问答。糖果测试用改过数字的熟题识别幻觉。鹈鹕骑车让模型写出一只骑自行车的鹈鹕。中转站检测则看有没有偷换模型、吞掉系统提示或假流式。
接口密钥只保存在当前浏览器。本站没有后台存放密钥。保存前会用本机 AES-GCM 加密,解开用的钥匙也不离开这台浏览器。导出的报告不含密钥。
首页的官方模型实况读取 OpenAI、Claude、Gemini、DeepSeek、Kimi 和 Grok 各自公开的状态页。点开一家可以看到组件和近期事件。OpenAI 这类页面按官方状态页的分组、可用率和每日色条展示。