Gemini

gemini-3.7-flash

Google按量计费

Google 的 gemini-3.7-flash 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。

textimageaudiovideofilecachingcode_interpreterfunction_callingtoolsweb_searchstructured_outputjson_modereasoningvisioncontext:1048576
起始价格
输入 / 输出 · 1M
上下文
1M
最大输入窗口
最大输出
65.5K
单次响应最大 token 数
模态
→
发布于
Aug 2026

按供应商定价

Google AI Studio
省50%
谷歌官方接口
输入$0.75$0.375/ 1M
输出$3.75$1.875/ 1M
缓存读取$0.075$0.0375/ 1M
Google Vertex
省30%
谷歌官方接口
输入$0.75$0.525/ 1M
输出$3.75$2.625/ 1M
缓存读取$0.075$0.0525/ 1M
Gemini Cli
省90%
Gemini cli 号池,适合 vibe coding学习等场景
输入$0.75$0.075/ 1M
输出$3.75$0.375/ 1M
缓存读取$0.075$0.0075/ 1M

能力 / 支持的模态

提示词缓存代码解释器函数调用工具网络搜索结构化输出JSON 模式推理视觉
输入
输出

厂商与数据隐私

厂商
Google文档
分词器
SentencePiece (Gemini)
许可证
Proprietary (commercial)商业闭源
数据保留75 天默认不会用于上游训练

性能

接入 API

调用示例

请求POST/v1beta/models/gemini-3.7-flash:generateContent
请求示例
参数
参数类型默认值 / 范围说明信息
temperature
number
=10 ~ 2
采样温度;越低越稳定
top_p
number
=10 ~ 1
核采样累计概率
max_tokens
integer>= 1响应中最大 token 数
frequency_penalty
number
=0-2 ~ 2
惩罚高频 token 的重复出现
presence_penalty
number
=0-2 ~ 2
鼓励引入新话题
stop
array—最多 4 个停止生成的字符串
seed
integer—尽量保证可复现的采样种子
n
integer
=1>= 1
生成的候选条数
stream
boolean
=false
通过 SSE 流式返回 token
response_format
object—强制输出 JSON 对象或符合 Schema 的结果
tools
array—模型可调用的工具 / 函数声明
tool_choice
string
autononerequired
工具选择策略或具体工具名
logprobs
boolean
=false
返回每个 token 的对数概率
top_logprobs
integer0 ~ 20每个 token 返回的 top 概率数量
logit_bias
object—按 token 的 logit 偏置映射
user
string—用于风险审计的终端用户标识

替换 <YOUR_API_KEY> 替换为令牌设置中的 API Key。

身份验证

所有请求必须携带 Authorization: Bearer <TOKEN> 请求头。Anthropic 格式的端点也接受 x-api-key 请求头。

在「令牌」页面生成 API Key,可以按模型、分组、IP、速率等维度精细化授权。

支持的参数

Generation parameters
参数类型默认值 / 范围说明信息
temperature
number
=10 ~ 2
采样温度;越低越稳定
top_p
number
=10 ~ 1
核采样累计概率
max_tokens
integer>= 1响应中最大 token 数
frequency_penalty
number
=0-2 ~ 2
惩罚高频 token 的重复出现
presence_penalty
number
=0-2 ~ 2
鼓励引入新话题
stop
array—最多 4 个停止生成的字符串
seed
integer—尽量保证可复现的采样种子
n
integer
=1>= 1
生成的候选条数
stream
boolean
=false
通过 SSE 流式返回 token
response_format
object—强制输出 JSON 对象或符合 Schema 的结果
tools
array—模型可调用的工具 / 函数声明
tool_choice
string
autononerequired
工具选择策略或具体工具名
logprobs
boolean
=false
返回每个 token 的对数概率
top_logprobs
integer0 ~ 20每个 token 返回的 top 概率数量
logit_bias
object—按 token 的 logit 偏置映射
user
string—用于风险审计的终端用户标识

速率限制

供应商RPMTPMRPD
default580231K12K
Gemini Cli520208K10K
Google AI Studio930371K19K
Google Vertex450179K8.9K

RPM = 每分钟请求数,TPM = 每分钟 token 数,RPD = 每日请求数。限制按令牌分组生效。

API 接入常见问题

创建账户前需要了解的关键信息。

探索更多模型