Gemini 3 Flash Preview Chat API

google/gemini-3-flash-preview
1M tokens · 输入 80 / 输出 480 积分 / 1M tokens

Gemini 3 Flash Preview Chat 将文本和多模态素材转化为回答、代码与分析,支持 100 万 token 上下文和可调推理深度。提供任务目标与资料,即可围绕问题整理并生成结果。

Gemini 3 Flash Preview

Google · chat-completions

与 Gemini 3 Flash Preview 开始对话

每个模型都有独立对话。切换模型不会发送其他模型的聊天记录,切回后可继续原对话。请求按实际 Token 用量计费。

Ctrl / ⌘ + Enter 发送0 / 32,000

继续体验

Gemini 3 Flash Preview Chat

Gemini 3 Flash Preview 是 Google Gemini 3 系列中面向对话、编程及多模态理解的模型。100 万 token 上下文窗口可容纳相关文件、文档与对话记录,推理深度配置可按任务复杂度调整。Vidgo 提供 Chat Completions 与 Gemini Native 两种调用格式,返回完整 JSON 或 SSE 事件流。

为什么选择 Gemini 3 Flash Preview?

  • 快速处理编程任务结合需求和源代码生成草稿、审查意见与针对性解释。

  • 长上下文整理在 100 万 token 上下文中对照关联文件和文档。

  • 推理深度可调根据问题复杂度和响应时间需求设置思考深度。

  • 多模态理解通过 Gemini Native 的 contents 将文本与媒体素材一起提交分析。

参数

参数要求说明
modelChat Completions 必填

使用 google/gemini-3-flash-preview。

messagesChat Completions 必填

非空对话消息数组。

contentsGemini Native 必填

包含 role 与 parts 的非空对话数组;模型 ID 写在 URL 中。

contents[].parts[].inlineDataGemini Native 可选

与文本片段一起提交的媒体数据,包含 mimeType 和 Base64 data。

generationConfigGemini Native 可选

设置 temperature、topP、topK、maxOutputTokens 或 stopSequences。

safetySettingsGemini Native 可选

本次请求的安全设置。

streamChat Completions 可选

设为 true 时接收 SSE 响应。

默认falsetrue

如何使用

  1. 说明任务提供目标、相关上下文及希望得到的回答形式。

  2. 选择请求格式Chat Completions 提交 messages;Gemini Native 提交 contents。

  3. 设置生成参数在体验区表单或 JSON 模式中设置 Temperature、Max Tokens 和 Top P。

  4. 检查响应阅读结果与 token 用量,再按需提交下一轮问题。

价格

输入与输出 token 分开计费;下列费率均按每 100 万 tokens 计算。

用量费率说明
输入$0.40 · 80 credits / 1M tokens请求中的输入 tokens。
输出$2.40 · 480 credits / 1M tokens响应中的生成 tokens,包括用量记录中的推理 tokens。

适用场景

  • 编程助手根据源代码与需求解释行为并起草修改。

  • 文档分析围绕具体问题归纳和比较长文档。

  • 图像问答结合图像与文字指令提取相关细节。

使用建议

  • 将目标和检查标准放在相关资料附近,便于模型建立联系。
  • 使用 Gemini Native contents 时,尽量先放文本指令,再放内联媒体片段。
  • 依据响应中的用量字段核对输入和输出 token 数。

使用说明

  • 上下文窗口为 100 万 tokens。
  • 本页体验区的输出控制范围为 256–8,192 tokens。
  • Chat Completions 的 model 字段及 Gemini Native 的模型 URL 均使用 google/gemini-3-flash-preview。

相关模型

Gemini 3 Flash Preview Chat API 常见问题

Gemini 3 Flash Preview Chat API 是什么?

Gemini 3 Flash Preview 是 Google Gemini 3 系列中用于对话、编程和多模态理解的模型。它把文本与媒体上下文转化为回答、分析和代码,具备 100 万 token 上下文窗口及可调节推理深度。可通过 Chat Completions、Gemini Native 或本页体验区调用。

Gemini 3 Flash Preview 如何处理长文档?

它的上下文窗口为 100 万 tokens。将相关文档和明确的问题放在同一次请求中,可以要求模型归纳、对照或指出资料中的具体依据。

如何向 Gemini 3 Flash Preview 提交图像?

在 Gemini Native 的 contents 中加入文本片段与 inlineData 片段;后者提供 mimeType 和 Base64 data,并在文本中说明要检查的图像细节。

如何获取 Gemini 3 Flash Preview 的流式响应?

Chat Completions 将 stream 设为 true;Gemini Native 调用 streamGenerateContent?alt=sse。按顺序读取 SSE 事件,并查看 usageMetadata 中的 token 用量。

Gemini 3 Flash Preview 在 Vidgo AI 的价格是多少?

每 100 万输入 tokens 收取 80 credits($0.40),每 100 万输出 tokens 收取 480 credits($2.40)。可根据响应中的 token 用量和上方价格表核对费用。