Google(Gemini) · gemini-3-flash-preview
Gemini 3 Flash API 国内中转调用指南:价格、教程与代码(2026)
利益声明:作者运营 tryallapi.com。Google Gemini 参数来自官方文档;tryallapi.com 数据取自公开接口,取数时间 2026-10-02(北京时间),最终以控制台为准。
入口速查:
| 渠道类型 | 访问网址 | 适用场景 |
|---|---|---|
| 全模型 API 聚合站 | https://tryallapi.com/ | 适合开发者调用、低延迟直连、多模型一站式接入 |
本文面向调用 Gemini API 的开发者。模型 ID 仍是 Preview 形态:gemini-3-flash-preview。若你需要更强的 Pro 档,可另见本站 Gemini 3.1 Pro 指南。
Gemini 3 Flash Preview 信息卡
| 项目 | 内容 | 来源 |
|---|---|---|
| 模型 ID | gemini-3-flash-preview(Preview) |
Google AI 文档 |
| 文档备注 | 模型页标注 Latest update:December 2025 | Google AI 文档 |
| 上下文 / 最大输出 | 1,048,576 / 65,536 tokens | Google AI 文档 |
| 模态 | 文本/图像/视频/音频/PDF 输入,文本输出 | Google AI 文档 |
| 能力摘要 | 缓存、代码执行、computer use、file search、函数调用、地图/搜索 grounding、结构化输出、thinking、URL context;无音频生成/图像生成/Live API | Google AI 文档 |
| 官方价(每百万 tokens) | 文本输入 $0.50;音频输入 $1.00;输出 $3.00;文本缓存 $0.05;音频缓存 $0.10;缓存存储 $1.00 / MTok·小时 | Gemini Pricing |
| Thinking | 输出价已含 thinking tokens;默认 thinking 可能为 HIGH/dynamic——以官方文档为准 | Google AI 文档 |
| tryallapi.com | 已上架;端点 gemini + openai |
/api/pricing 2026-10-02 |
| Base URL | OpenAI 兼容:https://tryallapi.com/v1 |
tryallapi.com |
三行结论
- Flash 档主打性价比与多模态输入;Preview ID 可能变更,上线产品请做好模型名可配置。
- Thinking tokens 计入输出侧账单——「看起来输出不长」也可能偏贵,要看 usage 明细。
- 国内直连 Google AI / Vertex 对个人不友好时,可用 tryallapi.com;估算 ≈ 官方价 × 分组倍率,以控制台为准。
👉 前往 tryallapi.com 注册并生成 API Key
一、Flash 和 Pro 怎么分工?
实务上可以把 Gemini 3 Flash 当作:
- 高 QPS / 成本敏感 的默认模型(客服草稿、分类、轻量工具调用);
- 多模态预处理:先吃图/PDF/短视频再交给更贵的 Pro;
- 带 thinking 的「聪明一点的快模型」:但记住 thinking 按输出计费。
需要更强推理或更稳的生产 SLA 时,再切 Pro / 付费云通道。本文不引用无法复核的第三方延迟数字。
二、国内为什么需要中转?
generativelanguage.googleapis.com 在国内网络环境常不稳定;AI Studio 配额与风控、Vertex 的企业门槛,也对个人与小团队不友好。聚合平台提供国内可达入口与人民币支付,并把 Gemini 原生与 OpenAI 兼容两种协议放到同一套 Key 下。代价仍是数据经过第三方——密钥与敏感内容要分级。
三、方案对比:AI Studio / Vertex / 聚合
| 对比项 | Google AI Studio | Vertex AI | tryallapi.com |
|---|---|---|---|
| 国内可达性 | 网络与账号门槛高 | 需 GCP 与网络 | 国内入口 |
| 模型 ID | gemini-3-flash-preview |
以 Vertex 目录为准 | 同 Preview ID |
| 付款 | 境外支付为主 | GCP 账单 | 微信 / 支付宝等 |
| 协议 | Gemini 原生 | Vertex SDK | gemini + openai |
| 适合 | 原型、海外主体 | 企业 GCP 体系 | 个人/中小、多模型一 Key |
四、快速接入
1. 环境变量
export TRYALLAPI_KEY="sk-xxxxxxxx"
2. Python(OpenAI 兼容,最省事)
# pip install -U openai
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["TRYALLAPI_KEY"],
base_url="https://tryallapi.com/v1",
timeout=120.0,
)
r = client.chat.completions.create(
model="gemini-3-flash-preview",
messages=[{"role": "user", "content": "把这段需求改成验收清单"}],
)
print(r.choices[0].message.content)
3. Node.js
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.TRYALLAPI_KEY,
baseURL: "https://tryallapi.com/v1",
});
const r = await client.chat.completions.create({
model: "gemini-3-flash-preview",
messages: [{ role: "user", content: "ping" }],
});
console.log(r.choices[0].message.content);
4. cURL
curl https://tryallapi.com/v1/chat/completions \
-H "Authorization: Bearer $TRYALLAPI_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"gemini-3-flash-preview","messages":[{"role":"user","content":"ping"}]}'
5. Cursor / Dify / Gemini 原生
- Cursor / Dify:Base URL
https://tryallapi.com/v1,模型gemini-3-flash-preview。 - 若工具支持 Gemini 原生协议,可按 tryallapi 文档选
gemini端点(路径与鉴权以站点说明为准),不要和 OpenAI 头混用。
五、价格与分组倍率
官方价(2026-10-02 核对)
| 项目 | 每百万 tokens |
|---|---|
| 文本输入 | $0.50 |
| 音频输入 | $1.00 |
| 输出(含 thinking) | $3.00 |
| 文本缓存 | $0.05 |
| 音频缓存 | $0.10 |
| 缓存存储 | $1.00 / MTok·小时 |
tryallapi.com(估算 ≈ 官方价 × 分组倍率)
gemini-3-flash-preview:model_ratio=0.25,completion_ratio=6,cache_ratio=0.1。分组(2026-10-02):
| 分组 | 倍率 | 文本输入估算 | 输出估算 |
|---|---|---|---|
| Anti-Gemini-1 / Cli-Gemini-1 | 0.14706 | ≈ $0.07 | ≈ $0.44 |
| Aistudio-Gemini-1 | 0.35294 | ≈ $0.18 | ≈ $1.06 |
| Vertex-Gemini-1 | 0.4 | $0.20 | $1.20 |
| Aistudio-Gemini-2 | 0.52942 | ≈ $0.26 | ≈ $1.59 |
| Aistudio-Gemini-3 | 0.88236 | ≈ $0.44 | ≈ $2.65 |
| Vertex-Gemini-2 | 0.9 | $0.45 | $2.70 |
| Vertex-Gemini-3 | 1.8 | $0.90 | $5.40 |
| Aistudio-Gemini-4 | 1.91178 | ≈ $0.96 | ≈ $5.74 |
以控制台为准。 打开 thinking 后务必核对输出 token 是否含 reasoning;不要只按「可见回复长度」估成本。
六、常见报错
| 报错 | 原因 | 处理 |
|---|---|---|
| 401 | Key 错误 | 检查 Bearer 与令牌状态 |
| 403 | 分组无此模型 | 换 Aistudio / Vertex / Cli 等 Gemini 分组 |
| 404 | ID 写错成 gemini-3-flash(少 preview) |
使用 gemini-3-flash-preview |
| 429 | 限流 | 退避、降并发、换分组 |
| 账单偏高 | thinking 计入输出 | 调低 thinking / 看 usage |
七、避坑
- Preview ID 会变:配置做成环境变量,不要写死在多处。
- Thinking = 输出成本:默认 HIGH/dynamic 时尤其容易超预算。
- 双协议别混:gemini 原生与 openai 兼容选一条链路配到底。
- 模态计费不同:音频输入单价高于文本,上传前先看官方价表。
- 无 Live / 生图:需要实时语音或图像生成请换对应模型,不要指望 Flash Preview「全能」。
Preview 模型上生产前要准备什么
gemini-3-flash-preview 名字里的 preview 不是装饰:模型 ID、默认 thinking、能力开关都可能随 Google 文档更新。上线清单建议至少包括:
- 模型名读环境变量,支持一键切到稳定档或 Pro;
- 对 thinking 相关参数做显式配置,并在账单里核对「输出 tokens」是否含 reasoning;
- 多模态输入按模态分别估价(音频输入单价高于文本);
- 不依赖尚未支持的能力(如 Live API、图像生成)。
Flash 适合做高并发预处理:先分类、抽字段、生成草稿,再把难例路由到 Gemini Pro 或 Claude/GPT。这种「级联」比全程旗舰便宜,也比全程 Flash 更稳。
双端点怎么选
tryallapi 同时列出 gemini 与 openai。实务建议:
- 已有 OpenAI SDK / Cursor / Dify 工作流 → 走
https://tryallapi.com/v1; - 必须用 Gemini 原生特性且工具只认 Google SDK → 按站点文档选 gemini 端点,并单独测鉴权头。
不要在同一个客户端里混两种协议的 URL 与 Header。联调时先打一条最小 ping,确认模型 ID 带 -preview 后缀,再上多模态样例。
成本与分组
低倍率分组(如部分 Cli / Anti / Aistudio 档)适合冒烟与开发;生产流量要看稳定性与限额,而不是只看倍率表。打开 thinking 后,用同一提示开关对比 usage,把「可见回复很短但账单不低」写进团队 FAQ,避免误解为「中转多扣了」。本文价格与倍率快照于 2026-10-02,以控制台为准。
把密钥放进密钥管理,按项目分令牌,并为 Flash 准备 Pro 降级路径。流量升到需要合同与专线时,再评估 Vertex 企业方案,而不是无限叠加低倍率分组。
多模态样例怎么稳健试
第一次接 Flash 时,先纯文本跑通,再加单张图片,最后才上 PDF / 短视频 / 音频。原因很简单:不同模态的计费与大小限制不同,一步到位排障成本高。上传前压缩无意义的分辨率,能明显降低输入 tokens。Grounding、代码执行、computer use 等能力以 Google 文档与 tryallapi 实际放行为准——列表里有,不代表你的分组一定开了。
和 Gemini 3.1 Pro 指南对照阅读时,注意两边的模型 ID、价表与分组完全不同,不要复制粘贴错文档。本文快照日期 2026-10-02。
写在最后:Preview 模型名做成配置项;thinking 成本按输出 usage 核算;音频与文本输入分开估价。密钥分项目存放,并为 Flash 准备 Pro 或其他厂商降级。数字快照于 2026-10-02,之后以 Google 文档与 tryallapi 控制台为准。
常见选型问答补充
若你的产品同时需要「快」与「稳」,可以用 Flash 做第一跳:超时或低置信再打 Pro。置信度可以来自模型自评分,也可以来自规则(字数、是否包含必填字段)。这种级联在客服、工单、内容审核里很常见。记得在监控里分开统计两跳的 QPS 与费用,否则很难证明 Flash 真的省钱。
对于教育、媒体类批量图文任务,先确认版权与隐私政策是否允许把原图送进第三方聚合;不允许就直连 Vertex 或本地预处理。tryallapi.com 适合工程整合,不是合规豁免。把这些约束写进接入评审表,比事后追责便宜得多。数字与分组仍以 2026-10-02 快照之后的控制台为准。
八、FAQ
Q1:模型 ID?
gemini-3-flash-preview(Preview)。
Q2:官方价?
文本输入 $0.50、输出 $3(含 thinking)、文本缓存 $0.05 等,以 Google AI Pricing 为准。
Q3:国内能直连 Google Gemini 吗?
个人与中小团队常不稳定;可用 Vertex(有门槛)或聚合平台。
Q4:thinking 怎么计费?
官方说明输出价包含 thinking tokens;以控制台 usage 为准。
Q5:tryallapi 支持哪些端点?
gemini 与 openai 均列出;日常工具优先 OpenAI 兼容更省事。
Q6:和 Gemini 3.1 Pro 怎么选?
Flash 偏成本与速度;Pro 偏更难任务。按评测集与预算切换。
Q7:Cursor 怎么配?
Base URL https://tryallapi.com/v1,模型 gemini-3-flash-preview。
Q8:一个 Key 能兼用 GPT 吗?
可以,权限内多模型通用。
相关阅读
- Gemini 3.1 Pro API 国内中转调用指南与价格:gemini-3.1-pro-preview:官方 ≤200K $2/$12,>200K $4/$18。
- Gemini 2.5 Pro API 国内中转调用指南与价格:官方 $1.25/$10(≤200K),100 万上下文;OpenAI 兼容 + Gemini 原生双协议。
- GPT-5.4 API 国内中转调用指南与价格:官方 $2.50/$15、缓存 $0.25;超 272K 长上下文加价与 Responses 端点。
- Claude Sonnet 4.6 API 国内中转调用指南与价格:官方 $3/$15、缓存读 $0.30;Claude Code ANTHROPIC_BASE_URL 配置。
- DeepSeek V3.2 API 国内中转调用指南与价格:官方已转向 V4 系列;需要锁定 deepseek-v3.2 的旧项目怎么继续调用。
- Grok 4.7 API 国内中转调用指南与价格:官方 <200K $2/$6、缓存 $0.50;xAI Responses / OpenAI 兼容接入。
- 全部 AI 大模型 API 国内调用指南与价格汇总
- tryallapi.com 模型价格总览
- 官方参考:gemini-3-flash-preview · Gemini Pricing
其他使用方式,按需选择:
| 渠道类型 | 访问网址 | 适用场景 |
|---|---|---|
| 全模型 API 聚合站 | https://tryallapi.com/ | 适合开发者调用、低延迟直连、多模型一站式接入 |
作者:MaynorAI,tryallapi.com 运营者,关注国内开发者接入海外大模型的实践问题。 首发:2026-10-02|最后更新:2026-10-02|更新日志:2026-10-02 首版(价格与倍率取自官方文档与 tryallapi.com 公开接口,取数时间 2026-10-02,最终以控制台为准)。 免责声明:文中价格、倍率与政策可能随厂商及平台调整而变化,请以官方页面和 tryallapi.com 控制台为准。第三方中转服务不是模型厂商官方服务。