DeepSeek V4 Flash Chat Completions API
deepseek/deepseek-v4-flashDeepSeek V4 Flash Chat Completions 处理对话消息与长文本,生成回答、代码解释和文档分析。百万 token 上下文便于关联资料细节,适合高频问答与编程辅助。
DeepSeek V4 Flash
DeepSeek · chat-completions
快速开始
向 /v1/chat/completions 发送一次 POST 请求。非流式调用会直接返回模型结果和用量,不需要创建任务或查询状态。
- Endpoint
- POST /v1/chat/completions
- Model ID
- deepseek/deepseek-v4-flash
- Protocol
- Chat Completions
请求字段
| 字段 | 要求 | 说明 |
|---|---|---|
| model | 必填 | deepseek/deepseek-v4-flash |
| messages | 必填 | 非空对话消息数组。 |
| max_tokens | 可选 | 限制本次响应的输出 token 数。 |
| temperature | 可选 | 采样温度,体验区可设置 0–2。 |
| top_p | 可选 | 核采样概率,体验区可设置 0–1。 |
| stream | 可选 | 设为 true 时返回 SSE 事件流。 |
返回与用量
成功响应包含生成内容和 usage。系统按实际输入、输出与缓存 token 结算。
流式响应
设置 stream: true 可读取 SSE;流结束后再从最终用量事件完成统计。
curl --request POST \
--url https://api.vidgo.ai/v1/chat/completions \
--header "Authorization: Bearer $VIDGO_API_KEY" \
--header 'Content-Type: application/json' \
--data '{
"model": "deepseek/deepseek-v4-flash",
"messages": [
{
"role": "user",
"content": "Explain why deterministic retries matter in distributed systems."
}
],
"max_tokens": 1024,
"temperature": 1,
"top_p": 1,
"stream": false
}'服务端保存 API Key。不要把密钥放入浏览器代码或公开仓库。
继续体验
相关模型
DeepSeek V4 Flash Chat Completions API 常见问题
DeepSeek V4 Flash Chat Completions API 是什么?
DeepSeek V4 Flash Chat Completions 是 DeepSeek 用于根据对话消息和长文本生成回答、代码解释与文档分析的模型。百万 token 上下文便于关联大量输入中的资料;284B 总参数、每 token 激活 13B 的 Flash 架构适合高效处理这些任务。通过来源标记和明确指令可以引导回答。你可以通过 API 进行程序化调用,也可以在上方体验区直接在线试用。
DeepSeek V4 Flash 的上下文窗口有多大?
DeepSeek V4 Flash 具有百万 token 上下文窗口。需要综合多份文档、代码片段或先前对话时,可将相关内容一起放入请求。
用 DeepSeek V4 Flash 分析长文档时怎样整理材料?
为每份文档设置标题和稳定的章节标记,再提出指向具体证据的短问题,便于按原文检查回答。
DeepSeek V4 Flash 如何辅助代码分析?
提供相关代码、实际表现和期望结果,模型可解释函数、提出排查步骤,并整理初步修改计划。
DeepSeek V4 Flash 怎样延续多轮对话?
在 messages 中按顺序放入先前的 user 与 assistant 消息,最后加入新问题,模型会结合这些对话内容继续回答。
怎样控制 DeepSeek V4 Flash 的回答长度?
将 max_tokens 设为正整数,指定本次回答的输出上限。页面体验区提供 256 至 8,192 tokens 的可选范围。
DeepSeek V4 Flash 如何帮助规划智能体任务?
在消息中写清目标、可执行动作、约束和完成标准,模型可以整理一份供审查的初步步骤。