# Google: gemini-3-flash-preview

- 模型 ID: `gemini-3-flash-preview`
- 供应商: Google
- 网页版本: https://www.moleapi.com/zh-CN/models/google/gemini-3-flash
- 内容状态: alias

## 模型简介

Gemini 3 Flash 是 Gemini 3 系列面向低延迟、高吞吐和成本效率的多模态模型。

## 模型能力

- OpenAI 兼容
- Gemini 兼容
- 视觉
- 提示词缓存
- 推理

### 已核验规格

- 官方定位: 快速、高效的 Gemini 3 模型
- 上下文窗口: 最高 1,000,000 tokens
- 输入 / 输出: 文本、图像、音频、视频、PDF / 文本
- 适用模式: 低延迟、高吞吐、多模态

## 模型价格和接入方式

价格由 MoleAPI 控制台接口动态提供。

### 标准 (default, x1)

- 输入: $0.5 / 1M tokens
- 输出: $3 / 1M tokens
- 缓存读取: $0.05 / 1M tokens

### 特价 (discount, x0.8)

- 输入: $0.4 / 1M tokens
- 输出: $2.4 / 1M tokens
- 缓存读取: $0.04 / 1M tokens

### 接入协议

| Protocol | Method | Endpoint |
| --- | --- | --- |
| openai | POST | /v1/chat/completions |
| gemini | POST | /v1beta/models/{model}:generateContent |

- 实时价格来源: https://home.moleapi.com/api/pricing

## gemini-3-flash-preview 模型介绍

Gemini 3 Flash 是 Gemini 3 系列面向低延迟、高吞吐和成本效率的多模态模型。

### 适合场景

实时聊天、内容审核、批量提取、移动应用和高并发多模态处理。

### 核心优势

- 响应快，适合用户直接交互和高并发服务。
- 原生覆盖文本、图像、音频、视频和 PDF 输入。
- 长上下文与较低成本适合批量文档和媒体任务。

### 使用限制

- 极难专业推理和质量优先任务应使用 Pro。
- 高推理投入会削弱 Flash 的延迟优势。

### 选型与上线评估

选择 gemini-3-flash-preview 时，先把官方定位映射到真实任务：实时聊天、内容审核、批量提取、移动应用和高并发多模态处理。 第一轮评测应同时覆盖它的主要优势“响应快，适合用户直接交互和高并发服务。”和已知限制“极难专业推理和质量优先任务应使用 Pro。”，而不是只比较一次通用问答的主观观感。

接入层面，MoleAPI 当前为这款 Google 模型列出 openai, gemini 协议和 标准, 特价 计费分组；默认价格摘要为 输入 $0.5 / 1M tokens · 输出 $3 / 1M tokens。价格、协议与可用分组来自实时目录，正式上线前仍应按自己的上下文长度、输出规模和缓存命中率计算代表性请求成本。

目前没有展示与该精确模型 ID 和推理档位完全匹配的独立排名，因此不使用相近型号推断分数。上线前应固定模型 ID、提示词和样本集，记录正确率、结构化输出合格率、工具调用成功率与超时率，再与候选模型做同条件比较。

本页模型资料最近核验于 2026-07-24。当上游模型卡、上下文限制或工具支持发生变化时，应先更新来源与双语事实，再调整推荐结论；MoleAPI 的实时价格变化则由目录自动同步，不与静态能力描述混在一起。

### 资料来源

- [B.AI Gemini 3 Flash 模型指南](https://docs.b.ai/llmservice/models/gemini-3-flash/) — B.AI
- [Google Gemini 模型文档](https://ai.google.dev/gemini-api/docs/models) — Google
- 最近核验: 2026-07-24

## 代码示例

### cURL

```bash
curl https://api.moleapi.com/v1/chat/completions \
  -H "Authorization: Bearer $MOLEAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"gemini-3-flash-preview","messages":[{"role":"user","content":"Hello"}]}'
```

## 更多相关模型

- [gemini-3.5-flash](https://www.moleapi.com/zh-CN/models/google/gemini-3.5-flash) — Google
- [gemini-3.1-pro](https://www.moleapi.com/zh-CN/models/google/gemini-3.1-pro) — Google
- [gemini-3-flash](https://www.moleapi.com/zh-CN/models/google/gemini-3-flash) — Google

## 常见问题

### gemini-3-flash-preview 怎么计费？

本页价格从 MoleAPI 控制台接口动态读取，并随模型价格、上下文档位和账户分组更新。

### gemini-3-flash-preview 支持哪些接入方式？

当前目录列出的协议是 openai、gemini。

### 如何在现有项目中切换到 gemini-3-flash-preview？

保留 MoleAPI 的 API 地址和密钥，替换 model 参数，再检查所用协议的参数差异。

### gemini-3-flash-preview 的资料来自哪里？

模型能力与限制根据 B.AI 等列明页面核验；价格与协议来自 MoleAPI 控制台。
