xAI(Grok) · grok-4.7
Grok 4.7 API 国内中转调用指南:价格、教程与代码(2026)
利益声明:作者运营 tryallapi.com。xAI 参数来自 docs.x.ai;tryallapi.com 取数 2026-10-01,最终以控制台为准。
入口速查:
| 渠道类型 | 访问网址 | 适用场景 |
|---|---|---|
| 全模型 API 聚合站 | https://tryallapi.com/ | 适合开发者调用、低延迟直连、多模型一站式接入 |
面向想把 Grok 4.7 接进 Agent / 编程工作流,却不便直连 api.x.ai 的国内开发者。
Grok 4.7 信息卡
| 项目 | 内容 | 来源 |
|---|---|---|
| 模型 ID | grok-4.7 |
xAI Models |
| 定位 | 文本与代码主推型号(文档称 Code/Chat 优先选 4.7) | xAI Docs |
| 上下文 | 500K tokens | xAI Docs |
| 知识截止 | 2026-05(文档 NOTE) | xAI Docs |
| 官方价(提示 <200K) | 输入 $2.00;缓存输入 $0.50;输出 $6.00 | xAI Docs 2026-10-01 |
| 官方价(提示 ≥200K) | 输入 $4.00;缓存输入 $1.00;输出 $12.00(整次请求按高档) | 同上 |
| 推理 | 文档提及 reasoning;Responses 上可能返回加密 reasoning 内容 | xAI Docs |
| tryallapi.com | 已上架;端点 openai + anthropic |
/api/pricing |
| Base URL | https://tryallapi.com/v1 |
tryallapi.com |
三行结论
- 官方标准档在短提示下是 $2 / $6,一旦提示达到 200K,整单升到 $4 / $12,做长仓分析前先截断或摘要。
- xAI 原生 base 是
https://api.x.ai/v1;国内网络与支付往往不便,可用 tryallapi.com 兼容层。 - 创建令牌时选 Cli-Grok / Xai-Grok 分组,扣费 ≈ 官方价 × 分组倍率,以控制台为准。
一、Grok 4.7 在工程里的位置
xAI 文档把 Grok 4.7 当作通用文本与代码默认项,并提供 Responses API 示例。和「只做聊天」不同,编程 Agent 更关心:函数调用是否稳、长仓库上下文是否触发 200K 加倍、reasoning 字段是否被客户端正确忽略或展示。
与同系列 4.6 / 4.5 相比,公开价目表上 4.7 与 4.6 短上下文价一致($2/$0.5/$6),长上下文规则同样是 ≥200K 加倍。选型时更应看代码质量与工具调用,而不是差几美分的标价。
二、为什么走中转?
- 网络:
api.x.ai在部分国内网络下不稳定。 - 支付:xAI 账单与境外卡门槛。
- 多模型:同一项目可能还要调 GPT、Claude;聚合平台一个 Key 切换
model字段即可。
中转多一跳,延迟与可用性取决于分组上游;用小流量探针,不要一上来就灌生产全量。
三、官方 xAI / 聚合对比
| 对比项 | 官方 xAI API | tryallapi.com |
|---|---|---|
| Base URL | https://api.x.ai/v1 |
https://tryallapi.com/v1 |
| 模型名 | grok-4.7 |
同左 |
| 国内访问 | 视网络而定 | 面向国内入口 |
| 支付 | xAI 账户 | 微信 / 支付宝等 |
| 协议 | OpenAI 风格 Responses / Chat | OpenAI + Anthropic 兼容端点 |
| 适合 | 海外主体、要官方特性第一时间 | 国内团队、多模型统一账单 |
四、接入代码
export TRYALLAPI_KEY="sk-xxxxxxxx"
Python(Chat Completions)
# pip install -U openai
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["TRYALLAPI_KEY"],
base_url="https://tryallapi.com/v1",
timeout=180,
)
stream = client.chat.completions.create(
model="grok-4.7",
messages=[{"role": "user", "content": "修复并解释:function median(a){a.sort();return a[a.length/2]}"}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Python(Responses,若网关已映射)
resp = client.responses.create(
model="grok-4.7",
input="给这个 Flask 路由补上幂等键设计",
)
print(getattr(resp, "output_text", resp))
若 Responses 返回 404,退回 Chat Completions;以 tryallapi 文档支持的端点为准。
Node.js
import OpenAI from "openai";
const client = new OpenAI({ apiKey: process.env.TRYALLAPI_KEY, baseURL: "https://tryallapi.com/v1" });
const r = await client.chat.completions.create({
model: "grok-4.7",
messages: [{ role: "user", content: "把这段 TypeScript 的 any 收紧成真实类型" }],
});
console.log(r.choices[0].message.content);
cURL
curl https://tryallapi.com/v1/chat/completions \
-H "Authorization: Bearer $TRYALLAPI_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"grok-4.7","messages":[{"role":"user","content":"ping"}]}'
Cursor:Settings → Models → OpenAI API Key + Override Base URL https://tryallapi.com/v1 → 自定义 grok-4.7。
Claude Code:若走 Anthropic 兼容端点,按站点说明配置 ANTHROPIC_BASE_URL;模型名仍写 grok-4.7(需网关支持协议转换)。
Dify:OpenAI-API-compatible,endpoint https://tryallapi.com/v1。
五、价格与分组
官方(每百万 tokens)
| 提示 <200K | 提示 ≥200K(整次请求) | |
|---|---|---|
| 输入 | $2.00 | $4.00 |
| 缓存输入 | $0.50 | $1.00 |
| 输出 | $6.00 | $12.00 |
来源:xAI Models 文档,2026-10-01 核对。
tryallapi.com(≈ 官方 × 分组倍率)
grok-4.7:model_ratio=1,completion_ratio=3,cache_ratio=0.25。
| 分组 | 倍率 | <200K 输入估算 | <200K 输出估算 |
|---|---|---|---|
| Cli-Grok-1 | 0.14706 | ≈ $0.29 | ≈ $0.88 |
| Cli-Grok-2 | 0.2059 | ≈ $0.41 | ≈ $1.24 |
| Xai-Grok-1 | 0.88236 | ≈ $1.76 | ≈ $5.29 |
以控制台为准。 长提示先按官方加倍规则估算,再乘倍率。
示例:日 300 次 × 入 4k / 出 1.5k → 月入 3,600 万、出 1,350 万;官方短档约 36×$2 + 13.5×$6 = $153;倍率 r 时约 $153×r。若单次提示经常 ≥200K,用加倍后的官方价替换后再乘 r。
六、长上下文策略(比「找更低倍率」更重要)
- 仓库级任务先检索再喂文件,避免把整个 monorepo 塞进一条 prompt。
- 稳定前缀尽量命中缓存(官方缓存输入 $0.50 档)。
- 监控每条请求的 prompt tokens;接近 200K 时告警。
- 对比「摘要后短提示 + 工具读文件」与「一次塞满」的总费用,而不是只看单次输出质量。
七、自测方法
- 短题 100 次:成功与截断;
- 构造 ~210K 提示(合成重复文本即可)验证是否按加倍计费;
- 核对
usage与控制台; - 不在文章里填写未测量的延迟。
八、报错与避坑
| 报错 | 处理 |
|---|---|
| 401 | 检查 Bearer / 令牌 |
| 403 | 换 Cli-Grok / Xai-Grok 分组 |
| 404 | 确认模型名 grok-4.7;base_url 含 /v1 |
| 429 | 退避、换分组 |
| 超时 | 提高 timeout,开流式 |
避坑:① 警惕 200K 加倍;② 低倍率分组先测质量;③ 加密 reasoning 字段不要当用户可见文本乱展示;④ 小额充值;⑤ 敏感代码审第三方条款。
编程 Agent 场景的实践笔记
把 Grok 4.7 接到 Cursor、Cline 或自建 Agent 时,优先保证三件事:流式输出完整、工具调用参数可解析、长文件采用「检索 + 分段」而不是一次性塞满 200K。官方在 ≥200K 时整单加倍,意味着「多塞一点上下文」可能让费用跳档,而不是线性变贵。试运行阶段用 tryallapi.com 的低倍率 Grok 分组观察行为,确认质量可接受后再视稳定性需求调整分组。若 Responses API 在中转层尚未完全映射,先用 Chat Completions 跑通业务,把协议升级当成独立里程碑。和 GPT、Claude 混用时,用统一的评测集打分,避免仅凭主观「更敢改代码」选型。账单侧按模型维度拆开令牌,才能知道 Grok 是否真的比别的旗舰更省。
与 xAI 原生 SDK 的差异心态
官方示例里 base_url="https://api.x.ai/v1",换成 tryallapi 后,行为上应尽量贴近 OpenAI 兼容子集。遇到官方新字段(例如强制附带的加密 reasoning)时,客户端要能容忍未知字段,不要因为多一个 JSON key 就整段解析失败。地区路由、优先处理等官方加价项,中转是否透传以控制台说明为准;没有写清楚的,就当作「未承诺」,不要在对外 SLA 里写死。保持这种「兼容优先、特性渐进」的心态,中转链路会好维护得多。
九、FAQ
Q1:模型 ID?
grok-4.7。
Q2:官方价?
<200K:$2 入 / $0.5 缓存 / $6 出;≥200K:整单 $4 / $1 / $12。以 docs.x.ai 为准。
Q3:国内直连 xAI?
视网络与支付而定,多数团队用聚合更省事。
Q4:tryallapi 怎么接?
base_url=https://tryallapi.com/v1,环境变量 TRYALLAPI_KEY,model=grok-4.7。
Q5:分组倍率?
2026-10-01:约 0.15~0.88,见上表,以控制台为准。
Q6:上下文多长?
文档写 500K;价梯在 200K prompt 处加倍。
Q7:和 Grok 4.6?
公开短档价相同量级;按质量与可用性选择。
Q8:一 Key 多模型?
可以;建议分项目限额。
写在接入之后
完成第一次成功响应只是起点。建议你继续做两件事:把 TRYALLAPI_KEY 放进密钥管理(不要写进仓库);为关键路径准备第二个模型作降级。中转站解决的是网络与支付,解决不了提示词质量、评测缺失与密钥泄露。定期打开 tryallapi.com 控制台核对分组倍率是否变动,并回到厂商官方价格页复核——本文数字快照于 2026-10-01,之后一切以页面为准。若你的流量上升到需要合同、发票抬头与专线,再评估直连官方云或企业方案,而不是无限叠加低倍率分组。
费用告警怎么设才有用
针对 Grok 4.7,建议至少三条告警:单请求 prompt tokens ≥ 180K(靠近加倍阈值);单日该模型消费超过预算的 N%;某分组错误率短时升高。告警不要只发到没人看的邮箱,最好进值班群并附带 request id。试制阶段可以用 Cli-Grok 低倍率分组,但要把「质量抽检通过」写成上线门禁,再视情况换更接近官方的 Xai-Grok 分组。混合使用 Anthropic 兼容端点时,确认客户端不会把 Grok 当 Claude 解析特有字段。把这些运维细节写进 runbook,中转方案才能从 Demo 变成可值夜班的生产依赖。
小结:什么时候该上 Grok 4.7
当你已经有 OpenAI 兼容工具链,希望多一个高质量代码模型做 A/B,或官方评测/内部手感显示 Grok 在某类重构上更敢改且可接受时,用 tryallapi.com 接入成本最低。若你的硬性要求是「必须官方 SLA + 数据驻留条款」,那就走 xAI 官方合同,而不是中转。两者可以并存:实验流量走聚合,合规流量走官方。
对于只想「先跑通」的读者:复制本文的 Python 片段,换成自己的 Key,先完成一次非流式 ping,再开流式,最后才接工具调用。顺序不要反。
相关阅读
- GPT-5.4 API 国内中转调用指南与价格:官方 $2.50/$15、缓存 $0.25;超 272K 长上下文加价与 Responses 端点。
- Claude Sonnet 4.6 API 国内中转调用指南与价格:官方 $3/$15、缓存读 $0.30;Claude Code ANTHROPIC_BASE_URL 配置。
- Gemini 3 Flash API 国内中转调用指南与价格:gemini-3-flash-preview:官方文本 $0.50/$3,thinking 计入输出。
- DeepSeek V3.2 API 国内中转调用指南与价格:官方已转向 V4 系列;需要锁定 deepseek-v3.2 的旧项目怎么继续调用。
- Qwen3.8 Max API 国内中转调用指南与价格:阿里云百炼华北2 ¥12/¥36;DashScope OpenAI 兼容与聚合接入对比。
- Kimi K3 API 国内中转调用指南与价格:官方全球价 $3/$15、缓存 $0.30;推理常开,100 万上下文。
- 全部 AI 大模型 API 国内调用指南与价格汇总
- tryallapi.com 模型价格总览
- 官方参考:xAI Docs · Models & Pricing
其他使用方式,按需选择:
| 渠道类型 | 访问网址 | 适用场景 |
|---|---|---|
| 全模型 API 聚合站 | https://tryallapi.com/ | 适合开发者调用、低延迟直连、多模型一站式接入 |
作者:MaynorAI,tryallapi.com 运营者,关注国内开发者接入海外大模型的实践问题。 首发:2026-10-01|最后更新:2026-10-01|更新日志:2026-10-01 首版(价格与倍率取自官方文档与 tryallapi.com 公开接口,取数时间 2026-10-01,最终以控制台为准)。 免责声明:文中价格、倍率与政策可能随厂商及平台调整而变化,请以官方页面和 tryallapi.com 控制台为准。第三方中转服务不是模型厂商官方服务。