tryallapi.com API 调用指南

Google(Gemini) · gemini-3-flash-preview

Gemini 3 Flash API 国内中转调用指南:价格、教程与代码(2026)

作者 MaynorAI · 首发 · 更新

利益声明:作者运营 tryallapi.com。Google Gemini 参数来自官方文档;tryallapi.com 数据取自公开接口,取数时间 2026-10-02(北京时间),最终以控制台为准。

入口速查:

渠道类型 访问网址 适用场景
全模型 API 聚合站 https://tryallapi.com/ 适合开发者调用、低延迟直连、多模型一站式接入

本文面向调用 Gemini API 的开发者。模型 ID 仍是 Preview 形态:gemini-3-flash-preview。若你需要更强的 Pro 档,可另见本站 Gemini 3.1 Pro 指南。


Gemini 3 Flash Preview 信息卡

项目 内容 来源
模型 ID gemini-3-flash-preview(Preview) Google AI 文档
文档备注 模型页标注 Latest update:December 2025 Google AI 文档
上下文 / 最大输出 1,048,576 / 65,536 tokens Google AI 文档
模态 文本/图像/视频/音频/PDF 输入,文本输出 Google AI 文档
能力摘要 缓存、代码执行、computer use、file search、函数调用、地图/搜索 grounding、结构化输出、thinking、URL context;无音频生成/图像生成/Live API Google AI 文档
官方价(每百万 tokens) 文本输入 $0.50;音频输入 $1.00;输出 $3.00;文本缓存 $0.05;音频缓存 $0.10;缓存存储 $1.00 / MTok·小时 Gemini Pricing
Thinking 输出价已含 thinking tokens;默认 thinking 可能为 HIGH/dynamic——以官方文档为准 Google AI 文档
tryallapi.com 已上架;端点 gemini + openai /api/pricing 2026-10-02
Base URL OpenAI 兼容:https://tryallapi.com/v1 tryallapi.com

三行结论

  1. Flash 档主打性价比与多模态输入;Preview ID 可能变更,上线产品请做好模型名可配置。
  2. Thinking tokens 计入输出侧账单——「看起来输出不长」也可能偏贵,要看 usage 明细。
  3. 国内直连 Google AI / Vertex 对个人不友好时,可用 tryallapi.com;估算 ≈ 官方价 × 分组倍率,以控制台为准。

👉 前往 tryallapi.com 注册并生成 API Key


一、Flash 和 Pro 怎么分工?

实务上可以把 Gemini 3 Flash 当作:

需要更强推理或更稳的生产 SLA 时,再切 Pro / 付费云通道。本文不引用无法复核的第三方延迟数字。


二、国内为什么需要中转?

generativelanguage.googleapis.com 在国内网络环境常不稳定;AI Studio 配额与风控、Vertex 的企业门槛,也对个人与小团队不友好。聚合平台提供国内可达入口与人民币支付,并把 Gemini 原生与 OpenAI 兼容两种协议放到同一套 Key 下。代价仍是数据经过第三方——密钥与敏感内容要分级。


三、方案对比:AI Studio / Vertex / 聚合

对比项 Google AI Studio Vertex AI tryallapi.com
国内可达性 网络与账号门槛高 需 GCP 与网络 国内入口
模型 ID gemini-3-flash-preview 以 Vertex 目录为准 同 Preview ID
付款 境外支付为主 GCP 账单 微信 / 支付宝等
协议 Gemini 原生 Vertex SDK gemini + openai
适合 原型、海外主体 企业 GCP 体系 个人/中小、多模型一 Key

四、快速接入

1. 环境变量

export TRYALLAPI_KEY="sk-xxxxxxxx"

2. Python(OpenAI 兼容,最省事)

# pip install -U openai
import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["TRYALLAPI_KEY"],
    base_url="https://tryallapi.com/v1",
    timeout=120.0,
)
r = client.chat.completions.create(
    model="gemini-3-flash-preview",
    messages=[{"role": "user", "content": "把这段需求改成验收清单"}],
)
print(r.choices[0].message.content)

3. Node.js

import OpenAI from "openai";
const client = new OpenAI({
  apiKey: process.env.TRYALLAPI_KEY,
  baseURL: "https://tryallapi.com/v1",
});
const r = await client.chat.completions.create({
  model: "gemini-3-flash-preview",
  messages: [{ role: "user", content: "ping" }],
});
console.log(r.choices[0].message.content);

4. cURL

curl https://tryallapi.com/v1/chat/completions \
  -H "Authorization: Bearer $TRYALLAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"gemini-3-flash-preview","messages":[{"role":"user","content":"ping"}]}'

5. Cursor / Dify / Gemini 原生


五、价格与分组倍率

官方价(2026-10-02 核对)

项目 每百万 tokens
文本输入 $0.50
音频输入 $1.00
输出(含 thinking) $3.00
文本缓存 $0.05
音频缓存 $0.10
缓存存储 $1.00 / MTok·小时

tryallapi.com(估算 ≈ 官方价 × 分组倍率)

gemini-3-flash-preview:model_ratio=0.25,completion_ratio=6,cache_ratio=0.1。分组(2026-10-02):

分组 倍率 文本输入估算 输出估算
Anti-Gemini-1 / Cli-Gemini-1 0.14706 ≈ $0.07 ≈ $0.44
Aistudio-Gemini-1 0.35294 ≈ $0.18 ≈ $1.06
Vertex-Gemini-1 0.4 $0.20 $1.20
Aistudio-Gemini-2 0.52942 ≈ $0.26 ≈ $1.59
Aistudio-Gemini-3 0.88236 ≈ $0.44 ≈ $2.65
Vertex-Gemini-2 0.9 $0.45 $2.70
Vertex-Gemini-3 1.8 $0.90 $5.40
Aistudio-Gemini-4 1.91178 ≈ $0.96 ≈ $5.74

以控制台为准。 打开 thinking 后务必核对输出 token 是否含 reasoning;不要只按「可见回复长度」估成本。


六、常见报错

报错 原因 处理
401 Key 错误 检查 Bearer 与令牌状态
403 分组无此模型 换 Aistudio / Vertex / Cli 等 Gemini 分组
404 ID 写错成 gemini-3-flash(少 preview) 使用 gemini-3-flash-preview
429 限流 退避、降并发、换分组
账单偏高 thinking 计入输出 调低 thinking / 看 usage

七、避坑

  1. Preview ID 会变:配置做成环境变量,不要写死在多处。
  2. Thinking = 输出成本:默认 HIGH/dynamic 时尤其容易超预算。
  3. 双协议别混:gemini 原生与 openai 兼容选一条链路配到底。
  4. 模态计费不同:音频输入单价高于文本,上传前先看官方价表。
  5. 无 Live / 生图:需要实时语音或图像生成请换对应模型,不要指望 Flash Preview「全能」。


Preview 模型上生产前要准备什么

gemini-3-flash-preview 名字里的 preview 不是装饰:模型 ID、默认 thinking、能力开关都可能随 Google 文档更新。上线清单建议至少包括:

  1. 模型名读环境变量,支持一键切到稳定档或 Pro;
  2. 对 thinking 相关参数做显式配置,并在账单里核对「输出 tokens」是否含 reasoning;
  3. 多模态输入按模态分别估价(音频输入单价高于文本);
  4. 不依赖尚未支持的能力(如 Live API、图像生成)。

Flash 适合做高并发预处理:先分类、抽字段、生成草稿,再把难例路由到 Gemini Pro 或 Claude/GPT。这种「级联」比全程旗舰便宜,也比全程 Flash 更稳。


双端点怎么选

tryallapi 同时列出 gemini 与 openai。实务建议:

不要在同一个客户端里混两种协议的 URL 与 Header。联调时先打一条最小 ping,确认模型 ID 带 -preview 后缀,再上多模态样例。


成本与分组

低倍率分组(如部分 Cli / Anti / Aistudio 档)适合冒烟与开发;生产流量要看稳定性与限额,而不是只看倍率表。打开 thinking 后,用同一提示开关对比 usage,把「可见回复很短但账单不低」写进团队 FAQ,避免误解为「中转多扣了」。本文价格与倍率快照于 2026-10-02,以控制台为准。

把密钥放进密钥管理,按项目分令牌,并为 Flash 准备 Pro 降级路径。流量升到需要合同与专线时,再评估 Vertex 企业方案,而不是无限叠加低倍率分组。


多模态样例怎么稳健试

第一次接 Flash 时,先纯文本跑通,再加单张图片,最后才上 PDF / 短视频 / 音频。原因很简单:不同模态的计费与大小限制不同,一步到位排障成本高。上传前压缩无意义的分辨率,能明显降低输入 tokens。Grounding、代码执行、computer use 等能力以 Google 文档与 tryallapi 实际放行为准——列表里有,不代表你的分组一定开了。

和 Gemini 3.1 Pro 指南对照阅读时,注意两边的模型 ID、价表与分组完全不同,不要复制粘贴错文档。本文快照日期 2026-10-02。

写在最后:Preview 模型名做成配置项;thinking 成本按输出 usage 核算;音频与文本输入分开估价。密钥分项目存放,并为 Flash 准备 Pro 或其他厂商降级。数字快照于 2026-10-02,之后以 Google 文档与 tryallapi 控制台为准。


常见选型问答补充

若你的产品同时需要「快」与「稳」,可以用 Flash 做第一跳:超时或低置信再打 Pro。置信度可以来自模型自评分,也可以来自规则(字数、是否包含必填字段)。这种级联在客服、工单、内容审核里很常见。记得在监控里分开统计两跳的 QPS 与费用,否则很难证明 Flash 真的省钱。

对于教育、媒体类批量图文任务,先确认版权与隐私政策是否允许把原图送进第三方聚合;不允许就直连 Vertex 或本地预处理。tryallapi.com 适合工程整合,不是合规豁免。把这些约束写进接入评审表,比事后追责便宜得多。数字与分组仍以 2026-10-02 快照之后的控制台为准。

八、FAQ

Q1:模型 ID?
gemini-3-flash-preview(Preview)。

Q2:官方价?
文本输入 $0.50、输出 $3(含 thinking)、文本缓存 $0.05 等,以 Google AI Pricing 为准。

Q3:国内能直连 Google Gemini 吗?
个人与中小团队常不稳定;可用 Vertex(有门槛)或聚合平台。

Q4:thinking 怎么计费?
官方说明输出价包含 thinking tokens;以控制台 usage 为准。

Q5:tryallapi 支持哪些端点?
gemini 与 openai 均列出;日常工具优先 OpenAI 兼容更省事。

Q6:和 Gemini 3.1 Pro 怎么选?
Flash 偏成本与速度;Pro 偏更难任务。按评测集与预算切换。

Q7:Cursor 怎么配?
Base URL https://tryallapi.com/v1,模型 gemini-3-flash-preview。

Q8:一个 Key 能兼用 GPT 吗?
可以,权限内多模型通用。


相关阅读


其他使用方式,按需选择:

渠道类型 访问网址 适用场景
全模型 API 聚合站 https://tryallapi.com/ 适合开发者调用、低延迟直连、多模型一站式接入

作者:MaynorAI,tryallapi.com 运营者,关注国内开发者接入海外大模型的实践问题。 首发:2026-10-02|最后更新:2026-10-02|更新日志:2026-10-02 首版(价格与倍率取自官方文档与 tryallapi.com 公开接口,取数时间 2026-10-02,最终以控制台为准)。 免责声明:文中价格、倍率与政策可能随厂商及平台调整而变化,请以官方页面和 tryallapi.com 控制台为准。第三方中转服务不是模型厂商官方服务。