Gemini 3.5 Flash API
google/gemini-3.5-flashGemini 3.5 Flash 将文本、图像、音频、视频和文档转化为代码、分析与回答,适合编程和复杂资料处理。百万 token 上下文可关联大量来源内容,系统指令与生成参数帮助控制回答重点和篇幅。
Gemini 3.5 Flash
Google · chat-completions
快速开始
向 /v1beta/models/google/gemini-3.5-flash:generateContent 发送 POST 请求。流式调用使用 /v1beta/models/google/gemini-3.5-flash:streamGenerateContent?alt=sse,响应包含生成内容与 usageMetadata。
- Endpoint
- POST /v1beta/models/google/gemini-3.5-flash:generateContent
- Model ID
- google/gemini-3.5-flash
- Protocol
- Gemini Native
请求字段
| 字段 | 要求 | 说明 |
|---|---|---|
| model | 路径必填 | google/gemini-3.5-flash |
| contents | 必填 | 非空对话内容数组;每项包含 role 与 parts。 |
| contents[].parts[].text | 文本输入 | 对话中的文本内容。 |
| contents[].parts[].inlineData | 多模态输入 | 包含 mimeType 与 Base64 data 的内联媒体。 |
| systemInstruction | 可选 | 本次对话的系统指令。 |
| generationConfig.temperature | 可选 | 采样温度。 |
| generationConfig.maxOutputTokens | 可选 | 本次响应的输出 token 控制值。 |
| generationConfig.topP | 可选 | 核采样概率。 |
| generationConfig.topK | 可选 | Top K 采样设置。 |
| generationConfig.stopSequences | 可选 | 停止生成的字符串数组。 |
| safetySettings | 可选 | 安全设置数组。 |
返回与用量
响应的 candidates 包含生成内容,usageMetadata 给出输入与输出 token 用量。
流式响应
向 /v1beta/models/google/gemini-3.5-flash:streamGenerateContent?alt=sse 发送 POST 请求并读取 SSE;用量从 usageMetadata 获取。
curl --request POST \
--url https://api.vidgo.ai/v1beta/models/google/gemini-3.5-flash:generateContent \
--header "Authorization: Bearer $VIDGO_API_KEY" \
--header 'Content-Type: application/json' \
--data '{
"contents": [
{
"role": "user",
"parts": [
{
"text": "Summarize the key risks in this design."
}
]
}
],
"generationConfig": {
"temperature": 1,
"topP": 1,
"maxOutputTokens": 1024
}
}'服务端保存 API Key。不要把密钥放入浏览器代码或公开仓库。
继续体验
相关模型
Gemini 3.5 Flash API 常见问题
Gemini 3.5 Flash API 是什么?
Gemini 3.5 Flash 是 Google 的模型,可将文本和多模态资料转化为分析结果、代码与具体回答。1,048,576-token 上下文窗口适合关联大量来源内容。系统指令和生成参数可控制回答重点与形式。你可以通过 Chat Completions 或 Gemini Native 调用,也可以在上方 Playground 进行文本对话。
Gemini 3.5 Flash 的上下文窗口有多大?
Gemini 3.5 Flash 的上下文窗口为 1,048,576 tokens。可在一个任务中关联长文档、代码文件和对话记录。
Gemini 3.5 Flash 最多输出多少 tokens?
模型 API 最大输出为 65,536 tokens。Chat Completions 使用 max_tokens,Gemini Native 使用 generationConfig.maxOutputTokens;本页 Playground 控件范围为 256–8,192 tokens。
Gemini 3.5 Flash 可以分析哪些输入?
Gemini 3.5 Flash 可分析文本、图像、音频、视频与文档。在 API 请求中结合具体问题或提取目标提供资料。
Gemini 3.5 Flash 如何辅助编程?
提供需求、相关源文件与测试预期后,模型可梳理代码关系、提出改动方案、解释错误并审查实现。
如何通过 Gemini Native 调用 Gemini 3.5 Flash?
向 /v1beta/models/google/gemini-3.5-flash:generateContent 发送包含 contents 的 POST 请求。可按任务加入 systemInstruction 或 generationConfig。流式调用使用 streamGenerateContent 并设置 alt=sse。
Gemini 3.5 Flash 在 Vidgo 如何计费?
输入费率为每 1M tokens $0.900 或 180 积分;输出费率为每 1M tokens $5.40 或 1080 积分。响应中的用量字段提供每次请求的 token 统计。