Kimi 的长上下文适合大文件和仓库级 prompt,通过 DaoXE 它和 GPT、Claude、DeepSeek 共用一个 key —— 无需单独注册 Moonshot。用 Kimi ID 调 /v1/chat/completions。成本分流见最便宜 API 教程。
通过 DaoXE 调用 Kimi (Moonshot)#
用 /v1/chat/completions,模型填准确的 Kimi ID。K2 思考默认开启;需要普通输出时在请求体里发送 thinking disabled。
# Kimi K2 "thinking" builds default reasoning ON. Send thinking disabled
# when you want plain output; omit it to keep reasoning on.
curl --fail-with-body --show-error --silent \
https://daoxe.com/v1/chat/completions \
-H "Authorization: Bearer ${DAOXE_API_KEY}" \
-H "Content-Type: application/json" \
-d '{
"model": "YOUR_EXACT_MODEL_ID",
"max_tokens": 64,
"messages": [{"role": "user", "content": "Reply with OK."}],
"thinking": {"type": "disabled"}
}'Kimi (Moonshot) 特有的注意点#
- 思考默认开启(K2)。 要普通、更省的输出就发 thinking disabled;不发则保持推理开启。
- reasoning_content 字段。 开思考时推理在
reasoning_content里 —— 多轮工具调用要像 DeepSeek 那样回传它。 - 长上下文=真实成本。 大窗口很强,但 token 会累积 —— prompt 保持精简。
- 只用准确 ID。 从
GET /v1/models读取 Kimi ID。
支付与真实成本#
支付宝 / 微信 / USDT —— 统一 1 元 = $1
所有支付方式统一按 1 元 = $1 额度充值,模型按各自的美元官方价扣费。按真实汇率约 7,西方旗舰(GPT / Claude / Gemini / Grok)实付约为官方美元价的 1/7(省约 85%)——USDT 同样按此充值,海外持美元者也享此价。诚实提醒:国产廉价模型(DeepSeek / Qwen / GLM)也比官方直连便宜,只是幅度小些,并非「所有模型都 1/7」。汇率会变,实时价以定价页为准,充一小笔即可自证。
验证你拿到的是真模型#
先证明端点可用,再怀疑客户端 —— 这一步失败,改任何设置都没用:
export DAOXE_API_KEY="your_api_key"
# List the exact model IDs your account can call
curl --fail-with-body --show-error --silent \
https://daoxe.com/v1/models \
-H "Authorization: Bearer ${DAOXE_API_KEY}"先确认连通,再在 temperature 0 下把长上下文 prompt 与官方 Moonshot API 对比,检查召回:
别信我们 —— 自己验证
把 开源 benchmark 对准 DaoXE 和官方 API,在 temperature 0 下对比。再学会如何鉴别掉包,让便宜端点无法悄悄把你换成更小的模型。
常见问题#
我没要求,为什么 Kimi 在「思考」?
K2 思考默认开启。要普通输出就在请求体里发送 thinking disabled。
Kimi 也有 reasoning_content 回传吗?
开思考时有 —— 多轮工具调用要像 DeepSeek 一样回传 reasoning_content。
需要 Moonshot 账号吗?
不需要 —— 通过 DaoXE,Kimi 在你的单一 key 后面,免去海外注册摩擦。
这里 Kimi 多少钱?
按模型、按账号 —— 见实时定价。相对官方优势:多数主流模型经低价分组约低 30%–80%。
试用 DaoXE —— 并亲自 benchmark 它
一个 key 调 GPT、Claude、Gemini、DeepSeek 等。用开源 benchmark 对准我们做对比 —— 别只听我们说。