API 已上线 · 数字带日期戳 · 权重 2026-07-27 前开源

快速调通 Kimi K3 API

模型 ID kimi-k3,输入 $3.00、输出 $15.00(每百万 token),上下文窗口 1,048,576。能跑通的代码就在下面——复制、改一行 base_url、填上 key,第一次调用就能成功。

kimi-k3 · 真实响应 · 重复调用(整段缓存命中)
{
  "model": "kimi-k3",
  "choices": [{
    "message": {
      "content": "OK",
      "reasoning_content": "We need answer to user…"
    },
    "finish_reason": "stop"
  }],
  "usage": {
    "prompt_tokens": 116,
    "completion_tokens": 53,
    "completion_tokens_details":
      { "reasoning_tokens": 37 },  // 按输出价计费
    "prompt_tokens_details":
      { "cached_tokens": 116 }      // 价格仅 1/10
  }
}
模型 ID
kimi-k3
输入
$3.00 /1M
缓存命中
$0.30 /1M
输出
$15.00 /1M
上下文
1,048,576
架构
2.8T · KDA 混合线性注意力 · 激活 896 个专家中的 16 个 · 官方快速开始,读取于 2026-07-20
开放权重
2026-07-27 前 · 官方快速开始,读取于 2026-07-20
成功率 · 24 小时
实时 →

Kimi K3 是月之暗面(Moonshot AI)的旗舰模型,于 2026 年 7 月发布。API 已经上线:模型 ID kimi-k3,上下文窗口 1,048,576 token,输入 $3.00 / 百万 token(缓存命中 $0.30),输出 $15.00 / 百万 token。它兼容 OpenAI 格式,EvoLink 以同样的费率承载,不加价,只需改一行 base_url

再看内部:总参数 2.8 万亿,混合专家(MoE)架构(每个 token 激活 896 个专家中的 16 个),基于 Kimi Delta Attention,原生支持视觉理解。开放权重官方定于 2026 年 7 月 27 日前发布——我们在跟踪进展

价格引自官方定价页,读取于 2026-07-20;架构引自官方快速开始,读取于 2026-07-18。所有标注「实测」的数字都是我们自己跑出来的——测量方法

改一行,就能跑

K3 兼容 OpenAI 格式。把 base_url 指向一个承载它的网关、写上模型名,就完成了。

python · openai sdk
from openai import OpenAI

client = OpenAI(
    api_key="YOUR_EVOLINK_API_KEY",
    base_url="https://direct.evolink.ai/v1",   # <-- 你唯一需要改的一行
)

response = client.chat.completions.create(
    model="kimi-k3",
    messages=[{"role": "user", "content": "Explain prompt caching in two sentences."}],
)

print(response.choices[0].message.content)

除非你已经读过为什么压低它会适得其反,否则让 max_completion_tokens 保持 131,072 的默认值。完整接入流程、鉴权与流式输出见 API 指南

继续深入

一个问题一页。页面上的每个数字,要么注明日期引自官方文档,要么由我们实测得出。

免费开始

免费试用 Kimi K3

聊天路线,和注册即送 10 个免费额度的 API 路线——外加怎么让额度更耐用。

免费开始
动手

Kimi K3 API 指南

鉴权、一段能跑通的请求、流式输出、真实响应体长什么样,以及如何区分成功和静默失败。

开始调用
选路

EvoLink vs OpenRouter

两家同价承载 K3。同一天、同一套测试跑遍两边:字段名、缓存、可靠性、延迟。

看实测对比
查一下

Kimi K3 状态

成功率与时延,按时间画成实时曲线。

看曲线
预算

定价

带日期戳的官方费率,以及让输出价成为关键变量的推理 token 开销。

看真实成本
交互工具

成本计算器

按你的请求量、提示词结构和缓存命中率,用官方费率在浏览器里算出月账单。

算你的账
跟进

开放权重:7 月 27 日

官方已承诺,尚未交付。状态跟踪、2.8T 硬件账,以及一份开源前准备清单。

跟踪进展
规模

100 万 token 上下文窗口

单次调用塞进 50 万 token,实测——缓存预热之后,重复跑的成本只有 1/10。窗口用对了,是真省。

看实测数字
评估

延迟

极简提示词首 token 约 3 秒(07-16 实测 2.8s,07-18 复测 3.35s);真实提示词:首个正文 token 中位 21.4s——外加把这段等待整个藏起来的流式输出方案。

看耗时数据
排障

错误与失败模式

故意把调用写错之后拿到的真实响应体——包括两个不报错、直接返回 HTTP 200 的坏参数。

去修

Kimi K3 常见问题

短答案——每一条背后,都有带日期的官方来源或我们自己的实测。

Kimi K3 是什么?

Kimi K3 是月之暗面(Moonshot AI)的旗舰大语言模型,2026 年 7 月发布:总参数 2.8 万亿,混合专家(MoE)架构(每个 token 激活 896 个专家中的 16 个),基于 Kimi Delta Attention,原生支持视觉理解,上下文窗口 1,048,576 token。引自官方快速开始,读取于 2026-07-18。

Kimi K3 开源吗?

还没有。权重官方承诺 2026 年 7 月 27 日前发布,但截至 2026-07-18 尚未公开,许可证也未公布。我们在跟踪发布,权重落地后几小时内更新。

Kimi K3 API 多少钱?

输入 $3.00 / 百万 token(缓存命中 $0.30),输出 $15.00 / 百万 token——而且推理 token 按输出价计费,在我们的实测里占输出的 43–77%。官方定价页,读取于 2026-07-20。看完整计费拆解

如何访问 Kimi K3?

三条路:在 kimi.com 直接聊天;用月之暗面平台的官方 API;或者走 EvoLink 这样的 OpenAI 兼容网关——费率与官方一致——已有的 OpenAI 格式代码只需改一行 base_url照页面代码发出第一次调用

Kimi K3 的上下文窗口有多大?

1,048,576 token——整整一个二进制百万。max_completion_tokens 默认 131,072;把它压得太低,就会遇到空响应照常扣费把窗口用满实际要花多少钱

Kimi K3 能处理图片吗?

官方快速开始列明原生支持视觉理解(读取于 2026-07-18)。视觉工作负载我们还没实测——所有已经实测过的内容都记录在测量方法里。

拿到 key,发出第一次调用

EvoLink 在 OpenAI 兼容接口上承载 kimi-k3——一把 key 即可调用 GPT、Claude、Gemini 等全球主流模型。注册即送 10 个免费额度。

获取 EvoLink API key