Kimi(Moonshot)API 的 OpenAI 兼容接入 —— 以及它默认开思考

Kimi 以超长上下文著称。通过 DaoXE 就是一次 OpenAI 兼容调用 —— 但 K2「思考」默认开启推理,若要普通、更省的输出通常需要关掉它。

更新于 2026-07-20

Kimi 的长上下文适合大文件和仓库级 prompt,通过 DaoXE 它和 GPT、Claude、DeepSeek 共用一个 key —— 无需单独注册 Moonshot。用 Kimi ID 调 /v1/chat/completions。成本分流见最便宜 API 教程

通过 DaoXE 调用 Kimi (Moonshot)#

/v1/chat/completions,模型填准确的 Kimi ID。K2 思考默认开启;需要普通输出时在请求体里发送 thinking disabled。

bash
# Kimi K2 "thinking" builds default reasoning ON. Send thinking disabled
# when you want plain output; omit it to keep reasoning on.
curl --fail-with-body --show-error --silent \
  https://daoxe.com/v1/chat/completions \
  -H "Authorization: Bearer ${DAOXE_API_KEY}" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "YOUR_EXACT_MODEL_ID",
    "max_tokens": 64,
    "messages": [{"role": "user", "content": "Reply with OK."}],
    "thinking": {"type": "disabled"}
  }'

Kimi (Moonshot) 特有的注意点#

  • 思考默认开启(K2)。 要普通、更省的输出就发 thinking disabled;不发则保持推理开启。
  • reasoning_content 字段。 开思考时推理在 reasoning_content 里 —— 多轮工具调用要像 DeepSeek 那样回传它。
  • 长上下文=真实成本。 大窗口很强,但 token 会累积 —— prompt 保持精简。
  • 只用准确 ID。GET /v1/models 读取 Kimi ID。

支付与真实成本#

支付宝 / 微信 / USDT —— 统一 1 元 = $1

所有支付方式统一按 1 元 = $1 额度充值,模型按各自的美元官方价扣费。按真实汇率约 7,西方旗舰(GPT / Claude / Gemini / Grok)实付约为官方美元价的 1/7(省约 85%)——USDT 同样按此充值,海外持美元者也享此价。诚实提醒:国产廉价模型(DeepSeek / Qwen / GLM)也比官方直连便宜,只是幅度小些,并「所有模型都 1/7」。汇率会变,实时价以定价页为准,充一小笔即可自证。

验证你拿到的是真模型#

先证明端点可用,再怀疑客户端 —— 这一步失败,改任何设置都没用:

bash
export DAOXE_API_KEY="your_api_key"

# List the exact model IDs your account can call
curl --fail-with-body --show-error --silent \
  https://daoxe.com/v1/models \
  -H "Authorization: Bearer ${DAOXE_API_KEY}"

先确认连通,再在 temperature 0 下把长上下文 prompt 与官方 Moonshot API 对比,检查召回:

别信我们 —— 自己验证

开源 benchmark 对准 DaoXE 和官方 API,在 temperature 0 下对比。再学会如何鉴别掉包,让便宜端点无法悄悄把你换成更小的模型。

常见问题#

我没要求,为什么 Kimi 在「思考」?

K2 思考默认开启。要普通输出就在请求体里发送 thinking disabled。

Kimi 也有 reasoning_content 回传吗?

开思考时有 —— 多轮工具调用要像 DeepSeek 一样回传 reasoning_content

需要 Moonshot 账号吗?

不需要 —— 通过 DaoXE,Kimi 在你的单一 key 后面,免去海外注册摩擦。

这里 Kimi 多少钱?

按模型、按账号 —— 见实时定价。相对官方优势:多数主流模型经低价分组约低 30%–80%

试用 DaoXE —— 并亲自 benchmark 它

一个 key 调 GPT、Claude、Gemini、DeepSeek 等。用开源 benchmark 对准我们做对比 —— 别只听我们说。