跳到主要内容
Grok

Grok 4.7 API 价格与迁移指南:200K 阈值、Fast、Priority 和真实成本

截至 2026 年 9 月 27 日,本文核对 Grok 4.7 API 的短、长上下文价格、缓存与推理 Token、工具费、Priority、US endpoint、Fast 和 Batch 边界,并给出从 4.6 评估迁移、验账与失败排查步骤。

本文目录 正在整理章节

先说结论:截至 2026 年 9 月 27 日,Grok 4.7 已可通过 xAI API 使用,标准短上下文价格为每 100 万 Token 输入 2 美元、缓存输入 0.50 美元、输出 6 美元。它与 Grok 4.6 的公开标准单价和 500K 上下文窗口相同,但提示词达到 200K Token 后,整次请求的输入、缓存输入和输出都会进入更高费率,不是只给超出的部分加价。

因此,从 Grok 4.6 迁移到 4.7 不应被写成“必须升级”或“零成本升级”。xAI 没有公布 Grok 4.6 的退役日期,4.6 仍在官方价格表中。更稳妥的做法是固定两个模型 ID,用真实业务样本比较合格结果率、延迟、推理 Token、工具调用和每个成功任务的总成本,再做小流量切换。

本文只讨论开发者使用的 xAI API。grok.com / SuperGrok、X Premium、消费者 Extra Usage Credits、xAI API credits 和直接 X API 是不同产品与账本;消费者订阅不能抵扣本文的 API 调用费用。

Grok 4.7 适合直接迁移吗

判断项 Grok 4.7 当前事实 迁移建议
模型 ID grok-4.7 在测试和生产中显式固定,不用未核验的别名代替
上下文窗口 500,000 Token 重点监控 200K 提示词计费阈值,而不是只看最大窗口
输入与输出 文本、图片输入;文本输出 图像输入也会产生相应 Token,不能只按文字长度估算
推理强度 low、medium、high、xhigh;默认 high 对比测试必须固定相同 effort,否则价格和延迟不可比
与 4.6 的标准价格 当前公开基础费率相同 不代表真实任务成本必然相同;推理量、重试和工具调用仍会变化
4.6 生命周期 仍在价格表中,官方未公布退役日 保留回滚路径,不制造“强制迁移”期限

xAI 在 2026 年 9 月 21 日公告中将 Grok 4.7 定位为面向编码、代理任务和知识工作的模型。公告中的性能和安全数据主要来自 xAI 自身评测,不能直接替代你的业务验收;迁移决策仍应以同一输入、同一工具和同一验收标准下的实际结果为准。

Grok 4.7 API 当前价格

xAI API Pricing 明确说明公开 API 价格使用 USD。Grok 4.7 的标准费率如下:

提示词规模 输入 / 100 万 Token 缓存输入 / 100 万 Token 输出 / 100 万 Token
低于 200K Token 2.00 USD 0.50 USD 6.00 USD
达到或超过 200K Token 4.00 USD 1.00 USD 12.00 USD

这里的“提示词”包含本轮请求发送的对话历史和缓存输入。达到长上下文阈值后,整次请求中的所有输入、缓存输入和输出都使用长上下文费率。不要把它实现成“前 199,999 个 Token 用低价、之后才用高价”的阶梯计费。官方不同页面同时出现“≥ 200K / reaches the threshold”和“above / exceeds 200K”两类措辞;本文按主价格表的“达到或超过 200K”保守预算,正好 200K 时仍应以实际 usage、cost_in_usd_ticks 和账单为准。

200K 阈值为什么会让成本跳变

假设两次请求都没有命中缓存,并各生成 10K 输出 Token:

请求 输入费 输出费 合计
199K 输入 + 10K 输出 0.199 × 2 = 0.398 USD 0.010 × 6 = 0.060 USD 0.458 USD
201K 输入 + 10K 输出 0.201 × 4 = 0.804 USD 0.010 × 12 = 0.120 USD 0.924 USD

示例只演示 Token 费,不含服务器端工具、Priority、US regional endpoint、税费或第三方平台加价。真实请求还可能因为推理 Token、图像输入和代理多轮调用而更高。

缓存命中后的成本示例

一笔低于 200K 的请求包含 20K 未缓存输入、60K 缓存输入和 10K 输出时:

未缓存输入:0.020 × 2.00 = 0.040 USD
缓存输入:  0.060 × 0.50 = 0.030 USD
输出:      0.010 × 6.00 = 0.060 USD
合计:                         0.130 USD

如果同一请求的提示词达到长上下文阈值,就要把三个单价分别换成 4、1 和 12 美元重新计算。

cached、reasoning 和 output Token 怎样计费

缓存不是自动保证

xAI 的 Grok 4.7 指南建议在 Responses API 设置稳定的 prompt_cache_key,在 Chat Completions 使用 x-grok-conv-id,让同一会话更可能路由到可复用缓存的服务器。即使内容看起来相同,如果前缀被改写、消息顺序变化或没有稳定路由键,也可能出现 cached_tokens=0。

缓存 Token 仍计入总提示词规模,也仍计入 TPM 限额;它只是使用较低的缓存输入单价。检查 usage.input_tokens_details.cached_tokens 或对应 Chat Completions 字段,不能仅凭客户端感觉判断缓存是否命中。

reasoning Token 按完整输出价格收费

官方用量与价格说明把 reasoning token 列为完整 completion token 价格。也就是说,xhigh 不是一个固定附加费,但更深推理可能产生更多 reasoning token、增加延迟和总成本。

例如响应的 output_tokens=20,000,其中 reasoning_tokens=8,000,短上下文时仍应按 20K × 6 USD / 1M 计算输出费,而不是只给最终可见文字计费。

Responses API 的 encrypted reasoning 要原样传回

Grok 4.7 的 Responses API 会返回 reasoning.encrypted_content,即使请求没有在 include 中显式列出它。管理多轮上下文时,应把相关 reasoning item 原样放回下一次请求;不要解析、删改或只保留其中一部分。Chat Completions 的响应结构不受这一规则影响。

工具费、Priority、US endpoint、Fast 和 Batch 的边界

选项 当前公开计费或可用性 最容易混淆的点
服务器端工具 Token 费之外,按工具当前规则另计 一次代理任务可能自主调用多次工具
Priority Processing 实际以 service_tier=priority 服务时,所有 Token 类型按标准费率 2 倍 它是公共 API 调度层,不等于 Grok 4.7 Fast
US regional endpoint Token 费为全球端点的 1.1 倍 只改变符合文档范围的区域处理与 Token 费,不代表所有工具和存储自动获得同一保证
Grok 4.7 Fast 仅 Cursor 与 Grok Build;公共 xAI API 不提供 不能向 api.x.ai 猜一个 Fast 模型 ID
Batch API Grok 4.7 模型详情明确标为不支持 通用 Batch 文档存在,不代表每个模型都可用或有折扣

常见服务器端工具费用

  • Web Search:5 USD / 1,000 次调用。
  • X Search:5 USD / 1,000 条抓取帖子、10 USD / 1,000 份抓取用户资料。
  • Code Execution:5 USD / 1,000 次调用。
  • File Attachments:10 USD / 1,000 次调用。
  • Collections Search:2.50 USD / 1,000 次调用。

工具可能还产生模型输入、推理、输出或媒体理解 Token。X Search 已改成按资源计费,详细字段和核账方法可看站内的 xAI X Search 价格与成本指南。

Priority 与 Fast 不是同一个产品

Priority 是公共 Chat Completions / Responses API 的请求级调度选项,只有响应确认实际使用 priority 时才收 2 倍 Token 费。缓存折扣会先应用,再乘 Priority 倍数;官方只明确了按 Token 计价部分,没有说明固定的服务器端工具调用费也乘 2,因此不能把整张账单机械翻倍。Grok 4.7 Fast 则是 Cursor 和 Grok Build 中的独立快速供应路径,不在公共 xAI API,也不包含在 Grok Build 免费层。

当前官方 Fast 价格表列出:

Fast 提示词规模 输入 / 100 万 缓存输入 / 100 万 输出 / 100 万
低于 200K 4.00 USD 1.00 USD 12.00 USD
超过 200K 6.00 USD 1.50 USD 18.00 USD

发布公告和模型指南用“twice the standard token rates”概括 Fast,但当前价格表的长上下文行是 6 / 1.50 / 18 USD,相对公共 API 长上下文的 4 / 1 / 12 USD 只有 1.5 倍。这是当前官方页面之间可见的口径冲突,不能替官方“修正”成 8 / 2 / 24。做预算时应并列记录概述与具体表格,最终以使用当日的 Fast 表和 Cursor 实际账单为准。

US regional endpoint 的可复算价格

Grok 4.7 当前全球端点是 https://api.x.ai/v1,US regional endpoint 是 https://us.api.x.ai/v1。官方表列出的 1.1 倍 Token 价格为:

  • 低于 200K:输入 2.20、缓存输入 0.55、输出 6.60 USD / 100 万 Token。
  • 达到或超过 200K:输入 4.40、缓存输入 1.10、输出 13.20 USD / 100 万 Token。

这不是“美国用户价格”,而是选择指定区域端点的 API 处理价格。账号可用性、税费和最终发票仍以目标 team 的 Console 为准。

怎样接入 Grok 4.7 官方 API

步骤一:确认 team、余额和模型权限

  1. 登录 xAI Console,确认当前选中的 team;API key、余额、用量和发票都按 team 管理。
  2. 在 Models 页面确认该 team 实际显示 grok-4.7,不要用消费者 Grok App 的模型入口推断 API 权限。
  3. 先设置低风险预算、告警和自动充值上限,再创建或复用 API key。
  4. 把密钥放入服务端环境变量 XAI_API_KEY,不要写进浏览器、移动端包、仓库或截图。

步骤二:先发一笔不带工具的最小请求

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["XAI_API_KEY"],
    base_url="https://api.x.ai/v1",
)

response = client.responses.create(
    model="grok-4.7",
    input="检查这个 Python 函数的边界条件,并给出最小修复方案。",
    reasoning={"effort": "high"},
    prompt_cache_key="migration-canary-v1",
)

print(response.output_text)

payload = response.model_dump()
usage = payload.get("usage", {})
cost_ticks = usage.get("cost_in_usd_ticks")
if cost_ticks is not None:
    print("request_cost_usd=", cost_ticks / 10_000_000_000)

示例使用 OpenAI 兼容客户端,但请求发往 xAI 官方端点。不同 SDK 版本可能尚未为 cost_in_usd_ticks 建立类型定义,因此示例先转成原始字典读取;若字段仍缺失,应检查原始 HTTP JSON,而不是把缺失误写成零费用。

步骤三:再逐项加入图片、工具和区域要求

先得到纯模型请求的质量、延迟和成本基线,再一次只增加一个变量:图片输入、Web Search、X Search、代码执行、Priority 或 US endpoint。这样费用上升时才能定位来源。不要在第一笔测试里同时打开多个自动工具。

从 Grok 4.6 评估迁移到 4.7

第一步:冻结可比较的样本与参数

从真实业务中选择 30 至 100 个代表性任务,至少包含常规请求、长对话、图片输入、工具调用、失败重试和接近 200K 的长上下文。固定系统提示、工具、超时、temperature、reasoning effort 和验收规则。

第二步:显式调用两个版本

分别使用 grok-4.6 与 grok-4.7,不要让路由器自动选择版本。对第三方模型网关,还要单独记录网关价格、缓存实现、路由和退款主体;第三方价不能冒充 xAI 官方 API 价。

第三步:比较每个成功任务,而不是只看 Token 单价

  • 任务一次通过率和人工验收分。
  • 输入、缓存输入、reasoning、最终输出 Token。
  • 工具调用次数、抓取资源数和重试次数。
  • 中位延迟、P90 延迟和超时率。
  • cost_in_usd_ticks 换算后的每请求成本。
  • 每个合格结果成本,而不是只比较每 100 万 Token 的标价。

第四步:检查兼容性和阻断项

  • Responses API 多轮客户端能否保留并传回 encrypted reasoning item。
  • 应用是否错误使用 Grok 4.7 不支持的 Batch API。
  • 是否依赖不受支持的 presencePenalty、frequencyPenalty 或 stop 等推理模型参数。
  • 提示词是否经常越过 200K,导致整单费率翻档。
  • 缓存路由键和不变前缀是否稳定,缓存命中是否真实出现。

第五步:小流量上线并保留回滚

先把 5% 至 10% 可回滚流量切到 4.7,设置每日费用、单请求费用、错误率和延迟告警。达到预设质量与成本门槛后再逐步扩大;未达到时回到显式固定的 4.6。官方没有给出 4.6 退役期限,因此没有必要用未经验证的全量切换制造风险。

用 cost_in_usd_ticks 核对真实费用

xAI Cost Tracking 说明,每个推理响应的 usage.cost_in_usd_ticks 是该请求实际计入的 API 费用,已经包含适用的 Token、缓存折扣和服务器端工具费用。换算规则是:

1 USD = 10,000,000,000 ticks
cost_usd = cost_in_usd_ticks / 10_000_000_000

该字段是单请求 API 用量费,不是含税信用卡入账金额,也不会替你累计整个工作流。应用应保存匿名请求 ID、模型、service tier、区域端点、Token 明细、工具明细、ticks、成功状态和业务标签,再按任务求和。

建议设置的四类告警

  1. 200K 阈值告警:提示词超过 180K 时预警,达到 200K 时记录整单费率切换。
  2. 单请求成本告警:按任务类型设置不同阈值,避免长代理任务吞掉整日预算。
  3. 缓存异常告警:同一稳定会话连续多轮 cached_tokens=0 时检查路由键和前缀变化。
  4. 工具循环告警:工具次数、重试或抓取资源数异常上升时中止任务并人工检查。

五类产品、credits 和退款必须分开

产品或余额 入口与渠道 能支付什么 关键退款与价格边界
SuperGrok 消费者订阅 grok.com、Grok iOS / Android 消费者 Grok 功能与套餐额度 Web 与 Google Play 的退款按当前 Grok FAQ 由 xAI 审核;Apple 订单由 Apple 处理。结账币种、税费和 SKU 以原渠道为准
消费者 Extra Usage Credits 当前通过 Grok Web 的 Settings → Usage 购买 消费者周额度用完后的继续使用 不是 API credits;公开 FAQ 以美元符号描述最低购买额,但具体币种、税费和动作单价以账号实显为准
X Premium x.com、X iOS / Android X 会员及对应 Grok 权益 Premium+ 当前帮助页列出 SuperGrok 和 Grok Bot,但不等于 xAI API 余额,也不能证明某账号已获得 Grok 4.7 API;退款按 X 或原应用商店规则
xAI API prepaid / monthly billing xAI Console,按 team 管理 Grok 4.7、工具及其他 xAI API 用量 官方 API 价为 USD;prepaid credits 原则上不可退款,法律要求地区除外;税务信息和最终税额以发票为准
直接 X API X Developer Console 直接读取或写入 X 数据端点 独立余额、限额、计费和支持主体;不能与 xAI API 的 X Search 或 credits 混用

当前 xAI 消费者定价页仍在 SuperGrok 权益中写 Grok 4.6,并没有公开确认每个 SuperGrok 或 X Premium 档位都已获得 4.7。消费者账号是否出现 4.7、具体地区和渠道价格均以模型选择器与结账页为准,不能从 API 上线反推。

如果你关注消费者套餐,查看站内的 SuperGrok 套餐价格指南;开通、账号关联、付款后不到账和退款入口可看 Grok 与 X Premium+ 订阅排查指南。文本 Token 可用站内 Token 计算器做初步估算,但工具无法预测 reasoning token、工具循环或最终账单。

xAI API 充值、月结和发票边界

xAI Billing 文档在 2026 年 9 月 22 日更新后列出两种主要方式:

  • Prepaid credits:先购买后使用,消耗归属所选 team。银行转账可能需要 2 至 3 个工作日到账;印度支付卡当前需使用 Guest Checkout。
  • Monthly invoiced billing:默认关闭,需要获得资格并设置大于 0 的 invoiced spending limit。系统先扣 prepaid credits,余额用尽后的合格用量再进入月末账单。
  • Auto top-up:可以设置余额阈值、充值额和月度充值上限,当前最低自动充值金额为 5 USD。使用达到自设月度上限的 80% 时,API spend management 卡片会显示警告;月度充值上限控制自动购买,不等于 API 用量硬上限。
  • 余额耗尽:若 invoiced spending limit 为 0,prepaid credits 用尽后请求会被拒绝;达到已设置的月结限额后也会停止响应。
  • 发票:账单地址和税务信息会显示在发票上,官方称目前不能追溯重开发票,应在购买前核对。

API Billing FAQ规定 prepaid API credits 原则上不可退款,适用法律要求的地区除外。不要把这条规则套给 SuperGrok、Apple、Google Play、X Premium、直接 X API 或第三方网关,它们有各自的订单与处理主体。

常见失败与费用异常怎么排查

401:API key 无效或用错环境

确认密钥来自目标 xAI team,服务端实际读取了预期环境变量,并且没有把测试 key、已撤销 key 或带空格的值部署到生产。不要在日志中输出完整密钥。

403 或 model not found:看不到 Grok 4.7

先在 xAI Console 的目标 team 查看 Models 页面和区域可用性。消费者 Grok App 能用某模型,不代表 API team 自动有权限;第三方网关有模型,也不代表官方端点使用相同模型 ID。Grok 4.7 Fast 在公共 xAI API 上不可用,不能靠猜测 slug 解决。

429:超过速率限制

使用指数退避与随机抖动,限制并发和重试总次数,并记录是否因代理循环重复提交。缓存输入仍计入 TPM;不能因为价格较低就认为它不占速率额度。

费用突然翻倍

  1. 查看提示词是否从低于 200K 变成达到或超过 200K。
  2. 检查 reasoning effort、输出长度和重试次数是否改变。
  3. 检查是否启用了 Priority 或切换到 US regional endpoint。
  4. 检查缓存是否失效、cached_tokens 是否归零。
  5. 检查 Web Search、X Search、代码执行、文件和媒体工具的用量。
  6. 以 cost_in_usd_ticks 核对请求级 API 费用,再与发票中的税费和付款手续费分开比较。

余额还有钱,请求却停止

确认余额属于当前 team,而不是另一个 Personal Team 或组织;再检查 prepaid balance、invoiced spending limit、模型权限和团队状态。删除 team 会移除其 prepaid credits,不要把 team 删除当作普通退出操作。

缓存始终不命中

保持系统提示和历史消息前缀完全稳定,为会话设置一致的 prompt_cache_key 或 x-grok-conv-id,并直接观察 usage 中的 cached tokens。把时间戳、随机 ID 或每轮变化的内容放在前缀开头,会破坏缓存复用。

Batch 请求失败

Grok 4.7 当前模型详情明确写着 Batch API 不支持。应改为常规 Responses / Chat Completions 请求,或在重新核验官方支持表后选择适合 Batch 的模型;不要假设“没有折扣”就等于“可以按原价批处理”。

事实核验范围与仍未知的信息

  • 事实、价格、渠道与条款核验日期:2026 年 9 月 27 日。
  • Grok 4.7 于 9 月 21 日上线 xAI API;模型指南与价格页的最后更新日均为 9 月 21 日。
  • 官方未公布 Grok 4.6 的退役日,也没有把 4.7 迁移描述成强制升级。
  • API 公开费率是 USD;目标账户的税费、非美元付款、汇率、发卡行手续费和最终可用性以 Console 与发票为准。
  • 消费者定价页仍写 Grok 4.6,因此 SuperGrok、X Premium 各档是否向某个地区和账号开放 4.7,公开资料不足,必须标为未知。
  • 第三方网关、Cursor 和 Grok Build 有自己的套餐、加价、缓存、路由与退款规则,本文不能替代其结账页。
  • 官方 Fast 页的长上下文表与“2 倍标准价”的概括不能完全机械互算,预算应以使用当日的具体价格表和账单为准。

常见问题

Grok 4.7 API 多少钱?

提示词低于 200K 时,每 100 万 Token 输入 2 USD、缓存输入 0.50 USD、输出 6 USD;达到或超过 200K 时,整次请求分别按 4、1、12 USD 计费。工具、Priority、US endpoint 和税费可能另外增加成本。

正好 200K Token 用哪一档?

官方主价格表将长上下文标为“≥ 200K”,因此预算和告警应把正好 200K 视为长上下文档。生产中应以响应 usage 和当日官方价格页复核。

Grok 4.7 比 4.6 贵吗?

当前 xAI 官方标准 API 价格表中,两者的输入、缓存输入、输出和 200K 长上下文费率相同。但 4.7 的推理量、工具使用、延迟、重试和完成合格任务的次数可能不同,所以真实任务成本未必相同。

必须马上从 Grok 4.6 迁移吗?

不必。4.6 仍在官方价格表中,xAI 没有公布退役日。先做并行评测和小流量切换,保留显式 4.6 回滚路径。

reasoning token 免费吗?

不免费。官方把 reasoning token 按完整 completion token 价格计费;提高 reasoning effort 可能增加推理 Token、延迟和总成本。

SuperGrok 或 X Premium+ 包含 Grok 4.7 API credits 吗?

不能这样推断。SuperGrok 和 X Premium+ 属于消费者订阅或 X 会员,xAI API credits 由 Console team 单独充值和计费,二者不能互相抵扣。如果你要开通消费者版、关联 X 账号,或排查付款后仍显示 Free,可参阅站内的 Grok 与 X Premium+ 订阅、激活和不到账排查指南。该指南包含已披露的第三方推广链接;第三方不是 xAI 或 X 官方渠道,商品、价格、到账与退款应以实际订单页和条款为准。

Grok 4.7 Fast 可以通过公共 xAI API 调用吗?

当前不可以。官方只列 Cursor 和 Grok Build,且 Grok Build 免费层不包含 Fast。公共 API 的 Priority Processing 是另一个请求级调度产品。

Grok 4.7 支持 Batch API 吗?

当前模型详情明确标为不支持。通用 Batch API 文档不等于所有模型都可批处理。

怎样知道一笔请求最终花了多少钱?

读取响应中的 usage.cost_in_usd_ticks,除以 10,000,000,000 得到该请求的 USD API 用量费;多轮任务要逐请求累加。税费、换汇和付款手续费仍以发票与银行记录为准。

xAI API prepaid credits 能退款吗?

当前 API Billing FAQ 的规则是原则上不退款,适用法律要求的地区除外。该规则只针对 xAI API prepaid credits;消费者订阅、Apple、Google Play、X Premium、直接 X API 和第三方平台要按各自订单处理。

迁移时最值得监控哪个指标?

优先看“每个合格结果成本”:把任务成功率、人工验收、总 ticks、延迟、重试和工具用量放在一起。单看每 100 万 Token 的标价无法判断哪一版在你的业务里更划算。

Continue reading

相关推荐

查看全部文章
01 xAI X Search 计费变化:按帖子收费、成本计算与迁移清单 2026-09-13 02 Grok 怎么开通?X Premium+ 与 SuperGrok 订阅、激活和不到账排查 2026-09-13 03 SuperGrok 套餐价格:Grok Bot、Lite、Plus、Heavy 与 X Premium+ 怎么选 2026-08-22 04 程序员开发的 AI 会取代程序员的话,为什么他们还要那么做呢? 2026-05-28