kimik3.io/状态
Kimi K3 状态
Kimi K3 现在正常吗?另附 60 秒自查,判断是不是你这条链路的问题。
当前状态:检测中…——由你的浏览器于 页面加载时 拉取,每 60 秒刷新。
kimi-k3(每个点为 5 分钟窗口)采集序列,采集脚本在站点仓库。
实时数据拉取失败(被浏览器拦截或已离线)——下方的 60 秒自查仍然可用。
60 秒自查
一条请求,不用 SDK。这就是我们 2026-07-18 实际执行的命令(响应在下方):
curl https://direct.evolink.ai/v1/chat/completions \
-H "Authorization: Bearer $EVOLINK_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"kimi-k3","messages":[{"role":"user","content":"Reply with the single word: up"}]}'
{
"model": "kimi-k3",
"choices": [{
"message": { "content": "up" },
"finish_reason": "stop"
}],
"usage": { "prompt_tokens": 92, "completion_tokens": 48 }
}
读懂你的结果
| 你拿到的 | 它意味着 | 该做的 |
|---|---|---|
200 + 有内容 | 没挂。你的生产问题在别处 | 检查你客户端里的超时和重试 |
401 | 是你的 key,不是模型 | key 错了/过期了,或环境变量不对——真实 401 响应体 |
404 | 模型名写错了 | ID 就是 kimi-k3,一个字符不差——真实 404 响应体 |
429 | 被限流了,不是挂了 | 退避后重试;检查你的余额 |
5xx / 超时 | 可能是真事故 | 重试一次,换备用 base URL,再去看服务方的通告渠道 |
200 + 空内容 | 不是故障——是 max_completion_tokens 陷阱,照单全额扣费 | 把它测透的六组实测 |
| 200 但非常慢 | 是波动,不是挂了——极简提示词我们也实测到过 36s | 默认用流式输出;客户端超时按分钟设——耗时数据 |
三种看着像故障、其实不是的情况
- 静默的等待。K3 每个请求都会先推理再作答。非流式时,线上就是几秒到几分钟的一片空白——一个看着像卡死、其实在干活的调用。流式输出约 3s 内就能看到推理 token,同一个调用立刻有了生气。
- 空响应。压低了
max_completion_tokens,返回的是 HTTP 200、一个空字符串和一张全额账单。只看状态码的监控都会说它「在线」;每个用户都会说它「坏了」。都不对——那是一个设置。 - SDK 超时。长上下文调用正常就要跑 52+ 秒;客户端默认超时把它们掐死并上报失败。不是模型挂了——是你的 HTTP 客户端先放弃了。长上下文下超时要按分钟设。
状态常见问题
Kimi K3 现在挂了吗?
页面顶部的曲线直接回答这个问题:数据每 60 秒自动刷新。对你自己的环境,上面的 60 秒自查是最终答案。
Kimi K3 为什么这么慢?
通常不是挂了——是在思考。K3 每个请求都会先推理再输出答案;非流式时看上去就像卡住,而且我们实测到了真实的波动(同一条极简提示词在不同运行里墙钟 3.6s 和 36.1s)。默认用流式输出,首个推理 token 约 3s 就到。
为什么我的调用返回 HTTP 200 但内容是空的?
那是 max_completion_tokens 陷阱,不是故障:预算压到约 1,024 及以下时,我们六组实测全部返回空字符串、finish_reason: "length",并全额扣费。让这个参数保持 131,072 的默认值。
这个页面多久更新一次?
实时块由你的浏览器每 60 秒自动刷新,不需要我们做任何事。检查脚本在站点仓库里,所以你也可以跑和我们完全一样的东西。
用你自己的 key 跑一遍自查
EvoLink 在 OpenAI 兼容接口上承载 kimi-k3——一把 key 即可调用 GPT、Claude、Gemini 等全球主流模型。注册即送 10 个免费额度。