Google

gemini-3.5-flash

模型 IDgemini-3.5-flash

接入文档Markdown

模型简介

Gemini 3.5 Flash 是 Google 的多模态模型,支持文本、图像、视频、音频和 PDF 输入,并生成文本输出。

模型能力

规格来自已列明的模型资料;目录标签用于快速判断接入能力,精确限制以来源文档为准。

OpenAI 兼容Responses APIAnthropic 兼容Gemini 兼容视觉提示词缓存推理音频

已核验规格

输入 / 输出
文本、图像、视频、音频、PDF / 文本
上下文窗口
1,048,576 tokens
最大输出
65,536 tokens
已验证能力
函数调用、结构化输出、代码执行、文件搜索

资料来源: Google Gemini 3.5 Flash 模型文档

独立能力评测

仅展示与精确模型 ID 和推理档位相符的公开测评,不用相近型号替代。

智能指数

50

同类排名 #20 / 186

输出速度

169.7 tok/s

同类排名 #25 / 186

首字延迟

20.22s

推理,高投入

在较高综合分数下保持很快的输出速度,适合智能与吞吐都重要的多模态工作。

测评档位: 推理,高投入. Artificial Analysis · 评测方法

模型价格和接入方式

价格直接读取 MoleAPI 控制台目录,并按当前计费分组与上下文档位展示。

实际结算价格以控制台中的账户分组为准。
实时价格来源

价格表

USD / 1M tokens
标准x1default输入 $1.5 · 输出 $9

输入

$1.5 / 1M tokens

输出

$9 / 1M tokens

缓存读取

$0.15 / 1M tokens

特价x0.8discount输入 $1.2 · 输出 $7.2

输入

$1.2 / 1M tokens

输出

$7.2 / 1M tokens

缓存读取

$0.12 / 1M tokens

接入协议

可用计费分组: 标准, 特价

openai
POST
/v1/chat/completions
openai-response
POST
/v1/responses
anthropic
POST
/v1/messages
gemini
POST
/v1beta/models/{model}:generateContent

gemini-3.5-flash 模型介绍

以下介绍经过重新组织与本地化表达,并与所列模型资料交叉核验。

Gemini 3.5 Flash 是 Google 的多模态模型,支持文本、图像、视频、音频和 PDF 输入,并生成文本输出。

核心优势

  • 原生覆盖文本、图像、视频、音频和 PDF 输入。
  • 独立测评显示高推理档位兼具较高综合分数与很快的输出速度。
  • 支持函数调用、结构化输出、代码执行、搜索和 1M 上下文。

使用限制

  • 高推理档位虽然解码快,但思考阶段会增加首个答案等待时间。
  • 输出价格高于较早的 Flash 系列,批量任务需要核算实际 token 用量。

选型与上线评估

选择 gemini-3.5-flash 时,先把官方定位映射到真实任务:需要在单个请求中处理长文档或多种媒体输入,并结合工具调用、代码执行或结构化输出的应用。 第一轮评测应同时覆盖它的主要优势“原生覆盖文本、图像、视频、音频和 PDF 输入。”和已知限制“高推理档位虽然解码快,但思考阶段会增加首个答案等待时间。”,而不是只比较一次通用问答的主观观感。

接入层面,MoleAPI 当前为这款 Google 模型列出 openai, openai-response, anthropic, gemini 协议和 标准, 特价 计费分组;默认价格摘要为 输入 $1.5 / 1M tokens · 输出 $9 / 1M tokens。价格、协议与可用分组来自实时目录,正式上线前仍应按自己的上下文长度、输出规模和缓存命中率计算代表性请求成本。

能力数据采用与精确模型 ID 匹配的“推理,高投入”公开测评。上线判断还应加入自己的正确率、结构化输出合格率、工具调用成功率和超时率,并固定模型 ID、提示词和样本集,避免版本或推理档位变化掩盖真实回归。

本页模型资料最近核验于 2026-07-23。当上游模型卡、上下文限制或工具支持发生变化时,应先更新来源与双语事实,再调整推荐结论;MoleAPI 的实时价格变化则由目录自动同步,不与静态能力描述混在一起。

代码示例

示例使用 MoleAPI 的 Responses API 地址;替换 API Key 后即可运行。

curl https://api.moleapi.com/v1/responses \
  -H "Authorization: Bearer $MOLEAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3.5-flash",
    "input": "Explain this problem step by step."
  }'

常见问题

gemini-3.5-flash 怎么计费?

本页价格从 MoleAPI 控制台接口动态读取,并随模型价格、上下文档位和账户分组更新。

gemini-3.5-flash 支持哪些接入方式?

本页协议和接口来自 MoleAPI 模型目录的 supported_endpoint_types 字段。

如何在现有项目中切换到 gemini-3.5-flash?

保留 MoleAPI 的 API 地址和密钥,把请求中的 model 参数替换为本页模型 ID;再按照对应协议检查参数差异。

gemini-3.5-flash 的模型资料来自哪里?

模型能力与限制已根据 Google 等页面核验;价格和可用协议只采用 MoleAPI 控制台数据。