DeepSeek V4 Pro Chat Completions API
deepseek/deepseek-v4-proDeepSeek V4 Pro Chat Completions 根据对话消息与长文本生成代码和推理回答,百万 Token 上下文可关联跨文档细节。标注来源和任务约束,可引导模型组织复杂分析与后续回答。
DeepSeek V4 Pro
DeepSeek · chat-completions
快速开始
向 /v1/chat/completions 发送一次 POST 请求。非流式调用会直接返回模型结果和用量,不需要创建任务或查询状态。
- Endpoint
- POST /v1/chat/completions
- Model ID
- deepseek/deepseek-v4-pro
- Protocol
- Chat Completions
请求字段
| 字段 | 要求 | 说明 |
|---|---|---|
| model | 必填 | deepseek/deepseek-v4-pro |
| messages | 必填 | 非空对话消息数组。 |
| max_tokens | 可选 | 正整数,设置响应的输出上限;体验区范围为 256–8,192。 |
| temperature | 可选 | 采样温度,范围为 0–2。 |
| top_p | 可选 | 核采样概率须大于 0 且不超过 1;体验区滑块为 0.1–1。 |
| stream | 可选 | 设为 true 时返回 SSE 事件流。 |
返回与用量
成功响应包含生成内容和 usage。系统按实际输入、输出与缓存 token 结算。
流式响应
设置 stream: true 可读取 SSE;流结束后再从最终用量事件完成统计。
curl --request POST \
--url https://api.vidgo.ai/v1/chat/completions \
--header "Authorization: Bearer $VIDGO_API_KEY" \
--header 'Content-Type: application/json' \
--data '{
"model": "deepseek/deepseek-v4-pro",
"messages": [
{
"role": "user",
"content": "Explain why deterministic retries matter in distributed systems."
}
],
"max_tokens": 1024,
"temperature": 1,
"top_p": 1,
"stream": false
}'服务端保存 API Key。不要把密钥放入浏览器代码或公开仓库。
继续体验
相关模型
DeepSeek V4 Pro Chat Completions API 常见问题
DeepSeek V4 Pro Chat Completions API 是什么?
DeepSeek V4 Pro Chat Completions 是 DeepSeek 根据有序对话消息与长文本生成代码、分析和推理回答的模型。百万 Token 上下文有助于关联大型文档与仓库片段中的细节。明确的指令和来源标记可引导模型处理任务。你可以通过 API 进行程序化调用,也可以在上方体验区直接在线试用。
DeepSeek V4 Pro 如何使用百万 Token 上下文?
在有序消息中放入相关文档、代码片段与先前对话。为资料标注章节,再提出指明比较对象的具体问题。
DeepSeek V4 Pro 如何辅助仓库分析?
提供相关文件、实际表现和预期修改。模型可关联实现细节、解释可能原因,并起草便于审查的修改计划。
DeepSeek V4 Pro 怎样处理复杂推理任务?
写明输入、约束与期望结果。检查计算或决策时,可以要求列出中间步骤,再对照提供的证据核查结论。
DeepSeek V4 Pro 怎样综合分析长文档?
为每份文档设置标题和稳定的章节标记,再提出明确的比较主题,便于按原始段落核查回答。
DeepSeek V4 Pro 怎样延续多轮对话?
在 messages 中按顺序加入先前的 user 和 assistant 消息,最后放入新问题,模型会结合这些消息继续回答。
DeepSeek V4 Pro 的回答长度怎样设置?
将 max_tokens 设为正整数,指定本次回答的生成上限。页面体验区提供 256 至 8,192 Token 的可选范围。
DeepSeek V4 Pro 在 Vidgo 如何计费?
输入每百万 Token 为 68.4 积分($0.342),输出每百万 Token 为 136.8 积分($0.684)。每次响应都会报告 Token 用量。