Kimi K3 API
moonshotai/kimi-k3Kimi K3 根据对话消息与长文本上下文生成回答、计划、代码和文档分析。1,048,576-token 上下文适合通过 Chat Completions 处理仓库级审查、长文档集合和持续智能体工作流。
Kimi K3
Moonshot AI · chat-completions
同步 LLM API
快速开始
向 /v1/chat/completions 发送一次 POST 请求。非流式调用会直接返回模型结果和用量,不需要创建任务或查询状态。
- Endpoint
- POST /v1/chat/completions
- Model ID
- kimi-k3
- Protocol
- Chat Completions
请求字段
| 字段 | 要求 | 说明 |
|---|---|---|
| model | 必填 | kimi-k3 |
| messages | 必填 | 非空对话消息数组。 |
| max_tokens | 可选 | 限制本次响应的输出 token 数。 |
| stream | 可选 | 设为 true 时返回 SSE 事件流。 |
返回与用量
成功响应包含生成内容和 usage。系统按实际输入、输出与缓存 token 结算。
流式响应
设置 stream: true 可读取 SSE;流结束后再从最终用量事件完成统计。
curl --request POST \
+ --url https://api.vidgo.ai/v1/chat/completions \
+ --header 'Authorization: Bearer $VIDGO_API_KEY' \
+ --header 'Content-Type: application/json' \
+ --data '{
"model": "kimi-k3",
"messages": [
{
"role": "user",
"content": "Explain why deterministic retries matter in distributed systems."
}
],
"max_tokens": 1024,
"stream": false
}'服务端保存 API Key。不要把密钥放入浏览器代码或公开仓库。
继续体验
相关模型
Kimi K3 文本生成 API — 常见问题
Kimi K3 文本生成 API 是什么?
Kimi K3 由 Moonshot AI 开发,接收有序对话消息,并通过 Vidgo AI 返回生成文本与 usage。
如何调用 Kimi K3 文本生成 API?
使用 Bearer 认证向 /v1/chat/completions 发送 POST 请求,model 传入 kimi-k3,并提供非空 messages 数组。stream 为 false 时返回 JSON,为 true 时返回 SSE。
Kimi K3 文本生成如何计费?
每 1M tokens 的输入、输出、缓存读取和缓存写入费率分别为 456、2280、456 和 456 积分。成功请求的最低正向扣费为 0.001 积分。
Kimi K3 文本生成接受哪些输入?
Vidgo Chat Completions 接口接收包含 role 与文本 content 的非空 messages 数组,还支持该协议文档中的 max_tokens 和 stream。
Kimi K3 的上下文窗口有多大?
Kimi K3 的上下文窗口为 1,048,576 tokens。请求覆盖大型代码仓库或文档集合时,应为文件、文档和章节添加清晰标记。