Gemini 3.1 Pro Preview Chat API
google/gemini-3.1-pro-previewGemini 3.1 Pro Preview Chat 将文本和多模态素材转化为分析、代码与回答,支持 100 万 token 上下文和可调推理深度。提供目标、源资料与验收标准,即可围绕证据组织结果。
Gemini 3.1 Pro Preview
Google · chat-completions
快速开始
向 /v1/chat/completions 发送 POST 请求,使用 google/gemini-3.1-pro-preview 获取生成结果与用量;stream 可选择 JSON 或 SSE。
- Endpoint
- POST /v1/chat/completions
- Model ID
- google/gemini-3.1-pro-preview
- Protocol
- Chat Completions
请求字段
| 字段 | 要求 | 说明 |
|---|---|---|
| model | 必填 | google/gemini-3.1-pro-preview |
| messages | 必填 | 非空对话消息数组。 |
| max_tokens | 可选 | 限制本次响应的输出 token 数。 |
| temperature | 可选 | 采样温度,体验区可设置 0–2。 |
| top_p | 可选 | 核采样概率,体验区可设置 0–1。 |
| stream | 可选 | 设为 true 时返回 SSE 事件流。 |
返回与用量
成功响应包含生成内容和 usage。系统按实际输入、输出与缓存 token 结算。
流式响应
设置 stream: true 可读取 SSE;流结束后再从最终用量事件完成统计。
curl --request POST \
--url https://api.vidgo.ai/v1/chat/completions \
--header "Authorization: Bearer $VIDGO_API_KEY" \
--header 'Content-Type: application/json' \
--data '{
"model": "google/gemini-3.1-pro-preview",
"messages": [
{
"role": "user",
"content": "Explain why deterministic retries matter in distributed systems."
}
],
"max_tokens": 1024,
"temperature": 1,
"top_p": 1,
"stream": false
}'服务端保存 API Key。不要把密钥放入浏览器代码或公开仓库。
继续体验
相关模型
Gemini 3.1 Pro Preview Chat API 常见问题
Gemini 3.1 Pro Preview Chat API 是什么?
Gemini 3.1 Pro Preview 是 Google Gemini 3 系列中用于复杂推理、编程及多模态分析的模型。它将文本和媒体上下文转化为详细回答、代码与结构化结论,具备 100 万 token 上下文窗口。可按任务设置推理深度,并通过 Chat Completions、Gemini Native 或本页体验区调用。
Gemini 3.1 Pro Preview 如何辅助编程?
提供目标、相关源文件、约束和测试结果,并要求模型结合证据规划修改步骤、检查输出与需求是否一致。
Gemini 3.1 Pro Preview 能分析多少上下文?
它的上下文窗口为 100 万 tokens。将回答具体问题所需的文档、代码和对话记录组织在请求中。
如何向 Gemini 3.1 Pro Preview 提交多模态内容?
在 Gemini Native 的 contents 中同时使用文本与 inlineData 片段;媒体片段提供 mimeType 和 Base64 data,并用文本说明分析目标。
如何获取 Gemini 3.1 Pro Preview 的流式响应?
Chat Completions 将 stream 设为 true;Gemini Native 调用 streamGenerateContent?alt=sse。按顺序读取 SSE 事件,并查看 usageMetadata 中的 token 用量。
Gemini 3.1 Pro Preview 在 Vidgo AI 的价格是多少?
每 100 万输入 tokens 收取 160 credits($0.80),每 100 万输出 tokens 收取 960 credits($4.80)。可根据响应中的 token 用量和上方价格表核对费用。