Gemini 3 Flash Preview Chat API
google/gemini-3-flash-previewGemini 3 Flash Preview Chat 将文本和多模态素材转化为回答、代码与分析,支持 100 万 token 上下文和可调推理深度。提供任务目标与资料,即可围绕问题整理并生成结果。
Gemini 3 Flash Preview
Google · chat-completions
快速开始
向 /v1/chat/completions 发送 POST 请求,使用 google/gemini-3-flash-preview 获取生成结果与用量;stream 可选择 JSON 或 SSE。
- Endpoint
- POST /v1/chat/completions
- Model ID
- google/gemini-3-flash-preview
- Protocol
- Chat Completions
请求字段
| 字段 | 要求 | 说明 |
|---|---|---|
| model | 必填 | google/gemini-3-flash-preview |
| messages | 必填 | 非空对话消息数组。 |
| max_tokens | 可选 | 限制本次响应的输出 token 数。 |
| temperature | 可选 | 采样温度,体验区可设置 0–2。 |
| top_p | 可选 | 核采样概率,体验区可设置 0–1。 |
| stream | 可选 | 设为 true 时返回 SSE 事件流。 |
返回与用量
成功响应包含生成内容和 usage。系统按实际输入、输出与缓存 token 结算。
流式响应
设置 stream: true 可读取 SSE;流结束后再从最终用量事件完成统计。
curl --request POST \
--url https://api.vidgo.ai/v1/chat/completions \
--header "Authorization: Bearer $VIDGO_API_KEY" \
--header 'Content-Type: application/json' \
--data '{
"model": "google/gemini-3-flash-preview",
"messages": [
{
"role": "user",
"content": "Explain why deterministic retries matter in distributed systems."
}
],
"max_tokens": 1024,
"temperature": 1,
"top_p": 1,
"stream": false
}'服务端保存 API Key。不要把密钥放入浏览器代码或公开仓库。
继续体验
相关模型
Gemini 3 Flash Preview Chat API 常见问题
Gemini 3 Flash Preview Chat API 是什么?
Gemini 3 Flash Preview 是 Google Gemini 3 系列中用于对话、编程和多模态理解的模型。它把文本与媒体上下文转化为回答、分析和代码,具备 100 万 token 上下文窗口及可调节推理深度。可通过 Chat Completions、Gemini Native 或本页体验区调用。
Gemini 3 Flash Preview 如何处理长文档?
它的上下文窗口为 100 万 tokens。将相关文档和明确的问题放在同一次请求中,可以要求模型归纳、对照或指出资料中的具体依据。
如何向 Gemini 3 Flash Preview 提交图像?
在 Gemini Native 的 contents 中加入文本片段与 inlineData 片段;后者提供 mimeType 和 Base64 data,并在文本中说明要检查的图像细节。
如何获取 Gemini 3 Flash Preview 的流式响应?
Chat Completions 将 stream 设为 true;Gemini Native 调用 streamGenerateContent?alt=sse。按顺序读取 SSE 事件,并查看 usageMetadata 中的 token 用量。
Gemini 3 Flash Preview 在 Vidgo AI 的价格是多少?
每 100 万输入 tokens 收取 80 credits($0.40),每 100 万输出 tokens 收取 480 credits($2.40)。可根据响应中的 token 用量和上方价格表核对费用。