# Google: gemini-3.5-flash

- 模型 ID: `gemini-3.5-flash`
- 供应商: Google
- 网页版本: https://www.moleapi.com/zh-CN/models/google/gemini-3.5-flash
- 内容状态: verified

## 模型简介

Gemini 3.5 Flash 是 Google 的多模态模型，支持文本、图像、视频、音频和 PDF 输入，并生成文本输出。

## 模型能力

- OpenAI 兼容
- Responses API
- Anthropic 兼容
- Gemini 兼容
- 视觉
- 提示词缓存
- 推理

### 已核验规格

- 输入 / 输出: 文本、图像、视频、音频、PDF / 文本
- 上下文窗口: 1,048,576 tokens
- 最大输出: 65,536 tokens
- 已验证能力: 函数调用、结构化输出、代码执行、文件搜索

### 独立能力评测

- 推理，高投入
- Intelligence: 50 (#20/186)
- Output speed: 169.7 tok/s (#25/186)
- Time to first token: 20.22s
- Source: https://artificialanalysis.ai/models/gemini-3-5-flash/

在较高综合分数下保持很快的输出速度，适合智能与吞吐都重要的多模态工作。

## 模型价格和接入方式

价格由 MoleAPI 控制台接口动态提供。

### 标准 (default, x1)

- 输入: $1.5 / 1M tokens
- 输出: $9 / 1M tokens
- 缓存读取: $0.15 / 1M tokens

### 特价 (discount, x0.8)

- 输入: $1.2 / 1M tokens
- 输出: $7.2 / 1M tokens
- 缓存读取: $0.12 / 1M tokens

### 接入协议

| Protocol | Method | Endpoint |
| --- | --- | --- |
| openai | POST | /v1/chat/completions |
| openai-response | POST | /v1/responses |
| anthropic | POST | /v1/messages |
| gemini | POST | /v1beta/models/{model}:generateContent |

- 实时价格来源: https://home.moleapi.com/api/pricing

## gemini-3.5-flash 模型介绍

Gemini 3.5 Flash 是 Google 的多模态模型，支持文本、图像、视频、音频和 PDF 输入，并生成文本输出。

### 适合场景

需要在单个请求中处理长文档或多种媒体输入，并结合工具调用、代码执行或结构化输出的应用。

### 核心优势

- 原生覆盖文本、图像、视频、音频和 PDF 输入。
- 独立测评显示高推理档位兼具较高综合分数与很快的输出速度。
- 支持函数调用、结构化输出、代码执行、搜索和 1M 上下文。

### 使用限制

- 高推理档位虽然解码快，但思考阶段会增加首个答案等待时间。
- 输出价格高于较早的 Flash 系列，批量任务需要核算实际 token 用量。

### 选型与上线评估

选择 gemini-3.5-flash 时，先把官方定位映射到真实任务：需要在单个请求中处理长文档或多种媒体输入，并结合工具调用、代码执行或结构化输出的应用。 第一轮评测应同时覆盖它的主要优势“原生覆盖文本、图像、视频、音频和 PDF 输入。”和已知限制“高推理档位虽然解码快，但思考阶段会增加首个答案等待时间。”，而不是只比较一次通用问答的主观观感。

接入层面，MoleAPI 当前为这款 Google 模型列出 openai, openai-response, anthropic, gemini 协议和 标准, 特价 计费分组；默认价格摘要为 输入 $1.5 / 1M tokens · 输出 $9 / 1M tokens。价格、协议与可用分组来自实时目录，正式上线前仍应按自己的上下文长度、输出规模和缓存命中率计算代表性请求成本。

能力数据采用与精确模型 ID 匹配的“推理，高投入”公开测评。上线判断还应加入自己的正确率、结构化输出合格率、工具调用成功率和超时率，并固定模型 ID、提示词和样本集，避免版本或推理档位变化掩盖真实回归。

本页模型资料最近核验于 2026-07-23。当上游模型卡、上下文限制或工具支持发生变化时，应先更新来源与双语事实，再调整推荐结论；MoleAPI 的实时价格变化则由目录自动同步，不与静态能力描述混在一起。

### 资料来源

- [Google Gemini 3.5 Flash 模型文档](https://ai.google.dev/gemini-api/docs/models/gemini-3.5-flash) — Google
- 最近核验: 2026-07-23

## 代码示例

### cURL

```bash
curl https://api.moleapi.com/v1/responses \
  -H "Authorization: Bearer $MOLEAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"gemini-3.5-flash","input":"Explain this problem step by step."}'
```

### Python

```python
from openai import OpenAI

client = OpenAI(base_url="https://api.moleapi.com/v1", api_key="YOUR_MOLEAPI_API_KEY")
response = client.responses.create(model="gemini-3.5-flash", input="Explain this problem step by step.")
print(response.output_text)
```

### TypeScript

```typescript
import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.moleapi.com/v1", apiKey: process.env.MOLEAPI_API_KEY });
const response = await client.responses.create({ model: "gemini-3.5-flash", input: "Explain this problem step by step." });
console.log(response.output_text);
```

## 更多相关模型

- [gemini-3.1-pro](https://www.moleapi.com/zh-CN/models/google/gemini-3.1-pro) — Google
- [gemini-3-flash](https://www.moleapi.com/zh-CN/models/google/gemini-3-flash) — Google
- [gemini-3.7-flash](https://www.moleapi.com/zh-CN/models/google/gemini-3.7-flash) — Google

## 常见问题

### gemini-3.5-flash 怎么计费？

本页价格从 MoleAPI 控制台接口动态读取，并随模型价格、上下文档位和账户分组更新。

### gemini-3.5-flash 支持哪些接入方式？

当前目录列出的协议是 openai、openai-response、anthropic、gemini。

### 如何在现有项目中切换到 gemini-3.5-flash？

保留 MoleAPI 的 API 地址和密钥，替换 model 参数，再检查所用协议的参数差异。

### gemini-3.5-flash 的资料来自哪里？

模型能力与限制根据 Google 等列明页面核验；价格与协议来自 MoleAPI 控制台。
