Gemini 3.5 Flash API

google/gemini-3.5-flash
1,048,576 tokens · 180 输入积分 / 1M tokens

Gemini 3.5 Flash 将文本、图像、音频、视频和文档转化为代码、分析与回答,适合编程和复杂资料处理。百万 token 上下文可关联大量来源内容,系统指令与生成参数帮助控制回答重点和篇幅。

Gemini 3.5 Flash

Google · chat-completions

与 Gemini 3.5 Flash 开始对话

每个模型都有独立对话。切换模型不会发送其他模型的聊天记录,切回后可继续原对话。请求按实际 Token 用量计费。

Ctrl / ⌘ + Enter 发送0 / 32,000

继续体验

Gemini 3.5 Flash

Gemini 3.5 Flash 适合编程、长上下文分析,以及结合文本、图像、音频、视频和文档的多模态理解。Chat Completions 接收消息;Gemini Native 使用 contents 和 generationConfig。两种格式返回完整或流式结果,提供 token 用量。Playground 提供文本对话;API 请求可提供多模态资料。

为什么选择 Gemini 3.5 Flash?

  • 关联大量资料在 1,048,576-token 上下文窗口中分析相关源文件、文档和对话记录。

  • 编程与迭代开发结合需求和代码库上下文,生成代码、排查思路与跨步骤审查意见。

  • 多模态理解将文字指令与图像、音频、视频或文档结合,围绕原始资料回答具体问题。

  • 两种接口格式Chat Completions 使用有序消息;Gemini Native 使用 contents、systemInstruction 和 generationConfig。

输入参数

参数要求说明
modelChat Completions 必填

填写 google/gemini-3.5-flash。

messagesChat Completions 必填

由 role 和 content 组成的非空有序消息数组。

max_tokensChat Completions 可选

设置本次响应的输出上限;模型 API 最大输出为 65,536 tokens。

contentsGemini Native 必填

由 role 和 parts 组成的非空对话数组。

systemInstructionGemini Native 可选

通过 parts 提供系统指令。

generationConfig.temperatureGemini Native 可选

控制采样温度。

generationConfig.topPGemini Native 可选

控制核采样概率。

generationConfig.topKGemini Native 可选

设置 top-k 采样的候选 token 数。

generationConfig.stopSequencesGemini Native 可选

遇到指定序列时停止生成。

generationConfig.maxOutputTokensGemini Native 可选

设置输出上限,最高 65,536 tokens。

safetySettingsGemini Native 可选

按类别配置安全阈值。

streamChat Completions 可选

设为 true 返回 SSE;Gemini Native 使用 streamGenerateContent 方法。

默认值falsetrue

使用方法

  1. 描述任务提供问题、来源资料及预期输出格式。

  2. 选择接口格式向 Chat Completions 发送 messages,或向 Gemini Native 发送 contents。

  3. 设置生成参数按需要设置输出上限、系统指令与采样参数。

  4. 读取结果查看生成内容与 token 用量,并在后续对话中补充相关上下文。

价格

输入与输出 token 分别计量。以下费率均按每 1M tokens 计算,并以积分结算。

用量费率说明
Input$0.900 · 180 积分 / 1M tokens请求中计入输入的 token。
Output$5.40 · 1080 积分 / 1M tokens响应中生成的 token,包含思考 token。

适用场景

  • 代码库分析结合相关文件与需求,在实现或排查改动前梳理关系。

  • 长文档整理关联报告、政策和研究资料中的细节,形成结构化结论。

  • 多模态审查针对截图、录音、视频或文档内容提出明确问题。

使用建议

  • 在同一请求中说明目标、相关资料和验收标准。
  • 使用 Gemini Native 的 systemInstruction 固定输出格式和任务范围。
  • 根据接口格式设置 max_tokens 或 generationConfig.maxOutputTokens。

使用说明

  • 上下文窗口为 1,048,576 tokens,模型 API 最大输出为 65,536 tokens。
  • 本页文本聊天 Playground 可在 Chat Completions 与 Gemini Native 之间切换;输出控件范围为 256–8,192 tokens。
  • Chat Completions 的 model 及 Gemini Native 路径均使用完整 ID google/gemini-3.5-flash。

相关模型

Gemini 3.5 Flash API 常见问题

Gemini 3.5 Flash API 是什么?

Gemini 3.5 Flash 是 Google 的模型,可将文本和多模态资料转化为分析结果、代码与具体回答。1,048,576-token 上下文窗口适合关联大量来源内容。系统指令和生成参数可控制回答重点与形式。你可以通过 Chat Completions 或 Gemini Native 调用,也可以在上方 Playground 进行文本对话。

Gemini 3.5 Flash 的上下文窗口有多大?

Gemini 3.5 Flash 的上下文窗口为 1,048,576 tokens。可在一个任务中关联长文档、代码文件和对话记录。

Gemini 3.5 Flash 最多输出多少 tokens?

模型 API 最大输出为 65,536 tokens。Chat Completions 使用 max_tokens,Gemini Native 使用 generationConfig.maxOutputTokens;本页 Playground 控件范围为 256–8,192 tokens。

Gemini 3.5 Flash 可以分析哪些输入?

Gemini 3.5 Flash 可分析文本、图像、音频、视频与文档。在 API 请求中结合具体问题或提取目标提供资料。

Gemini 3.5 Flash 如何辅助编程?

提供需求、相关源文件与测试预期后,模型可梳理代码关系、提出改动方案、解释错误并审查实现。

如何通过 Gemini Native 调用 Gemini 3.5 Flash?

向 /v1beta/models/google/gemini-3.5-flash:generateContent 发送包含 contents 的 POST 请求。可按任务加入 systemInstruction 或 generationConfig。流式调用使用 streamGenerateContent 并设置 alt=sse。

Gemini 3.5 Flash 在 Vidgo 如何计费?

输入费率为每 1M tokens $0.900 或 180 积分;输出费率为每 1M tokens $5.40 或 1080 积分。响应中的用量字段提供每次请求的 token 统计。