快速调通 Kimi K3 API
模型 ID kimi-k3,输入 $3.00、输出 $15.00(每百万 token),上下文窗口 1,048,576。能跑通的代码就在下面——复制、改一行 base_url、填上 key,第一次调用就能成功。
{
"model": "kimi-k3",
"choices": [{
"message": {
"content": "OK",
"reasoning_content": "We need answer to user…"
},
"finish_reason": "stop"
}],
"usage": {
"prompt_tokens": 116,
"completion_tokens": 53,
"completion_tokens_details":
{ "reasoning_tokens": 37 }, // 按输出价计费
"prompt_tokens_details":
{ "cached_tokens": 116 } // 价格仅 1/10
}
}
Kimi K3 是月之暗面(Moonshot AI)的旗舰模型,于 2026 年 7 月发布。API 已经上线:模型 ID kimi-k3,上下文窗口 1,048,576 token,输入 $3.00 / 百万 token(缓存命中 $0.30),输出 $15.00 / 百万 token。它兼容 OpenAI 格式,EvoLink 以同样的费率承载,不加价,只需改一行 base_url。
再看内部:总参数 2.8 万亿,混合专家(MoE)架构(每个 token 激活 896 个专家中的 16 个),基于 Kimi Delta Attention,原生支持视觉理解。开放权重官方定于 2026 年 7 月 27 日前发布——我们在跟踪进展。
价格引自官方定价页,读取于 2026-07-20;架构引自官方快速开始,读取于 2026-07-18。所有标注「实测」的数字都是我们自己跑出来的——测量方法。
坑,我们都替你踩过了
kimi-k3 上线后的第一个小时我们就开始跑它,把所有硌脚的地方标了出来。三个设置调对,你的接入第一次就能跑通,账单也和预期一致。
改一行,就能跑
K3 兼容 OpenAI 格式。把 base_url 指向一个承载它的网关、写上模型名,就完成了。
from openai import OpenAI
client = OpenAI(
api_key="YOUR_EVOLINK_API_KEY",
base_url="https://direct.evolink.ai/v1", # <-- 你唯一需要改的一行
)
response = client.chat.completions.create(
model="kimi-k3",
messages=[{"role": "user", "content": "Explain prompt caching in two sentences."}],
)
print(response.choices[0].message.content)
除非你已经读过为什么压低它会适得其反,否则让 max_completion_tokens 保持 131,072 的默认值。完整接入流程、鉴权与流式输出见 API 指南。
继续深入
一个问题一页。页面上的每个数字,要么注明日期引自官方文档,要么由我们实测得出。
免费试用 Kimi K3
聊天路线,和注册即送 10 个免费额度的 API 路线——外加怎么让额度更耐用。
免费开始 动手Kimi K3 API 指南
鉴权、一段能跑通的请求、流式输出、真实响应体长什么样,以及如何区分成功和静默失败。
开始调用 选路EvoLink vs OpenRouter
两家同价承载 K3。同一天、同一套测试跑遍两边:字段名、缓存、可靠性、延迟。
看实测对比 查一下Kimi K3 状态
成功率与时延,按时间画成实时曲线。
看曲线 预算定价
带日期戳的官方费率,以及让输出价成为关键变量的推理 token 开销。
看真实成本 交互工具成本计算器
按你的请求量、提示词结构和缓存命中率,用官方费率在浏览器里算出月账单。
算你的账 跟进开放权重:7 月 27 日
官方已承诺,尚未交付。状态跟踪、2.8T 硬件账,以及一份开源前准备清单。
跟踪进展 规模100 万 token 上下文窗口
单次调用塞进 50 万 token,实测——缓存预热之后,重复跑的成本只有 1/10。窗口用对了,是真省。
看实测数字 评估延迟
极简提示词首 token 约 3 秒(07-16 实测 2.8s,07-18 复测 3.35s);真实提示词:首个正文 token 中位 21.4s——外加把这段等待整个藏起来的流式输出方案。
看耗时数据 排障错误与失败模式
故意把调用写错之后拿到的真实响应体——包括两个不报错、直接返回 HTTP 200 的坏参数。
去修Kimi K3 常见问题
短答案——每一条背后,都有带日期的官方来源或我们自己的实测。
Kimi K3 是什么?
Kimi K3 是月之暗面(Moonshot AI)的旗舰大语言模型,2026 年 7 月发布:总参数 2.8 万亿,混合专家(MoE)架构(每个 token 激活 896 个专家中的 16 个),基于 Kimi Delta Attention,原生支持视觉理解,上下文窗口 1,048,576 token。引自官方快速开始,读取于 2026-07-18。
Kimi K3 开源吗?
还没有。权重官方承诺 2026 年 7 月 27 日前发布,但截至 2026-07-18 尚未公开,许可证也未公布。我们在跟踪发布,权重落地后几小时内更新。
Kimi K3 API 多少钱?
输入 $3.00 / 百万 token(缓存命中 $0.30),输出 $15.00 / 百万 token——而且推理 token 按输出价计费,在我们的实测里占输出的 43–77%。官方定价页,读取于 2026-07-20。看完整计费拆解。
如何访问 Kimi K3?
三条路:在 kimi.com 直接聊天;用月之暗面平台的官方 API;或者走 EvoLink 这样的 OpenAI 兼容网关——费率与官方一致——已有的 OpenAI 格式代码只需改一行 base_url。照页面代码发出第一次调用。
Kimi K3 的上下文窗口有多大?
1,048,576 token——整整一个二进制百万。max_completion_tokens 默认 131,072;把它压得太低,就会遇到空响应照常扣费。把窗口用满实际要花多少钱。
Kimi K3 能处理图片吗?
官方快速开始列明原生支持视觉理解(读取于 2026-07-18)。视觉工作负载我们还没实测——所有已经实测过的内容都记录在测量方法里。
拿到 key,发出第一次调用
EvoLink 在 OpenAI 兼容接口上承载 kimi-k3——一把 key 即可调用 GPT、Claude、Gemini 等全球主流模型。注册即送 10 个免费额度。