Gemini 3.7 Flash API
google/gemini-3.7-flashGemini 3.7 Flash 将文本、图像、音频、视频和文档转化为代码与分析结果,适合开发与知识任务。百万 token 上下文可关联大量资料,系统指令和生成参数可控制回答。
Gemini 3.7 Flash
Google · chat-completions
快速开始
向 /v1/chat/completions 发送 POST 请求,使用 google/gemini-3.7-flash 获取生成结果与用量;stream 可选择 JSON 或 SSE。
- Endpoint
- POST /v1/chat/completions
- Model ID
- google/gemini-3.7-flash
- Protocol
- Chat Completions
请求字段
| 字段 | 要求 | 说明 |
|---|---|---|
| model | 必填 | google/gemini-3.7-flash |
| messages | 必填 | 非空对话消息数组。 |
| max_tokens | 可选 | 限制本次响应的输出 token 数。 |
| temperature | 可选 | 采样温度,体验区可设置 0–2。 |
| top_p | 可选 | 核采样概率,体验区可设置 0–1。 |
| stream | 可选 | 设为 true 时返回 SSE 事件流。 |
返回与用量
成功响应包含生成内容和 usage。系统按实际输入、输出与缓存 token 结算。
流式响应
设置 stream: true 可读取 SSE;流结束后再从最终用量事件完成统计。
curl --request POST \
--url https://api.vidgo.ai/v1/chat/completions \
--header "Authorization: Bearer $VIDGO_API_KEY" \
--header 'Content-Type: application/json' \
--data '{
"model": "google/gemini-3.7-flash",
"messages": [
{
"role": "system",
"content": "You are a helpful assistant."
},
{
"role": "user",
"content": "Explain why deterministic retries matter in distributed systems."
}
],
"max_tokens": 4096,
"temperature": 1,
"top_p": 1,
"stream": false
}'服务端保存 API Key。不要把密钥放入浏览器代码或公开仓库。
继续体验
相关模型
Gemini 3.7 Flash API 常见问题
Gemini 3.7 Flash API 是什么?
Gemini 3.7 Flash 是 Google 面向编程、多模态分析与长上下文知识任务的模型,可将文本、图像、音频、视频和文档转化为代码、分析结果与具体回答。1,048,576-token 上下文窗口可关联大量来源资料,生成参数帮助控制回答。你可以通过 Chat Completions 或 Gemini Native 调用,也可以在上方 Playground 进行文本对话。
Gemini 3.7 Flash 的上下文窗口有多大?
Gemini 3.7 Flash 最多接收 1,048,576 输入 tokens,最大输出为 65,536 tokens。需要关联多个来源时,可在同一任务中提供相关文档、代码和指令。
Gemini 3.7 Flash 可以分析哪些输入?
Gemini 3.7 Flash 可分析文本、图像、音频、视频及 PDF。在 API 请求中结合明确问题、提取目标或开发任务提供资料。
Gemini 3.7 Flash 如何辅助编程与网页开发?
提供需求、代码库上下文、设计参考和验收标准后,模型可规划改动、生成代码、解释错误并审查界面实现。
Gemini 3.7 Flash 可以使用哪两种 API 格式?
向 /v1/chat/completions 发送 model 和 messages,或向 /v1beta/models/google/gemini-3.7-flash:generateContent 发送 contents。流式响应使用对应的 SSE 调用方式。
Gemini 3.7 Flash 的缓存输入如何计费?
响应报告缓存读取时,缓存输入费率为每 1M tokens $0.060 或 12 积分。标准输入为 $0.600 或 120 积分;包含思考 token 的输出为 $3.00 或 600 积分。
Gemini 3.7 Flash 有哪些 thinking levels?
Gemini 3.7 Flash 提供 low、medium 和 high 三种 thinking levels。可在 API 请求中根据任务的响应速度、token 用量和推理深度选择。
Gemini 3.7 Flash 体验区可设置多少输出 tokens?
Max Tokens 默认值为 4,096,可输入 1–65,536 的整数。Chat Completions 使用 max_tokens;Gemini Native 使用 generationConfig.maxOutputTokens。