本文目录 正在整理章节
先说结论:截至 2026 年 9 月 27 日,Grok 4.7 已可通过 xAI API 使用,标准短上下文价格为每 100 万 Token 输入 2 美元、缓存输入 0.50 美元、输出 6 美元。它与 Grok 4.6 的公开标准单价和 500K 上下文窗口相同,但提示词达到 200K Token 后,整次请求的输入、缓存输入和输出都会进入更高费率,不是只给超出的部分加价。
因此,从 Grok 4.6 迁移到 4.7 不应被写成“必须升级”或“零成本升级”。xAI 没有公布 Grok 4.6 的退役日期,4.6 仍在官方价格表中。更稳妥的做法是固定两个模型 ID,用真实业务样本比较合格结果率、延迟、推理 Token、工具调用和每个成功任务的总成本,再做小流量切换。
本文只讨论开发者使用的 xAI API。grok.com / SuperGrok、X Premium、消费者 Extra Usage Credits、xAI API credits 和直接 X API 是不同产品与账本;消费者订阅不能抵扣本文的 API 调用费用。
Grok 4.7 适合直接迁移吗
| 判断项 | Grok 4.7 当前事实 | 迁移建议 |
|---|---|---|
| 模型 ID | grok-4.7 |
在测试和生产中显式固定,不用未核验的别名代替 |
| 上下文窗口 | 500,000 Token | 重点监控 200K 提示词计费阈值,而不是只看最大窗口 |
| 输入与输出 | 文本、图片输入;文本输出 | 图像输入也会产生相应 Token,不能只按文字长度估算 |
| 推理强度 | low、medium、high、xhigh;默认 high |
对比测试必须固定相同 effort,否则价格和延迟不可比 |
| 与 4.6 的标准价格 | 当前公开基础费率相同 | 不代表真实任务成本必然相同;推理量、重试和工具调用仍会变化 |
| 4.6 生命周期 | 仍在价格表中,官方未公布退役日 | 保留回滚路径,不制造“强制迁移”期限 |
xAI 在 2026 年 9 月 21 日公告中将 Grok 4.7 定位为面向编码、代理任务和知识工作的模型。公告中的性能和安全数据主要来自 xAI 自身评测,不能直接替代你的业务验收;迁移决策仍应以同一输入、同一工具和同一验收标准下的实际结果为准。
Grok 4.7 API 当前价格
xAI API Pricing 明确说明公开 API 价格使用 USD。Grok 4.7 的标准费率如下:
| 提示词规模 | 输入 / 100 万 Token | 缓存输入 / 100 万 Token | 输出 / 100 万 Token |
|---|---|---|---|
| 低于 200K Token | 2.00 USD | 0.50 USD | 6.00 USD |
| 达到或超过 200K Token | 4.00 USD | 1.00 USD | 12.00 USD |
这里的“提示词”包含本轮请求发送的对话历史和缓存输入。达到长上下文阈值后,整次请求中的所有输入、缓存输入和输出都使用长上下文费率。不要把它实现成“前 199,999 个 Token 用低价、之后才用高价”的阶梯计费。官方不同页面同时出现“≥ 200K / reaches the threshold”和“above / exceeds 200K”两类措辞;本文按主价格表的“达到或超过 200K”保守预算,正好 200K 时仍应以实际 usage、cost_in_usd_ticks 和账单为准。
200K 阈值为什么会让成本跳变
假设两次请求都没有命中缓存,并各生成 10K 输出 Token:
| 请求 | 输入费 | 输出费 | 合计 |
|---|---|---|---|
| 199K 输入 + 10K 输出 | 0.199 × 2 = 0.398 USD | 0.010 × 6 = 0.060 USD | 0.458 USD |
| 201K 输入 + 10K 输出 | 0.201 × 4 = 0.804 USD | 0.010 × 12 = 0.120 USD | 0.924 USD |
示例只演示 Token 费,不含服务器端工具、Priority、US regional endpoint、税费或第三方平台加价。真实请求还可能因为推理 Token、图像输入和代理多轮调用而更高。
缓存命中后的成本示例
一笔低于 200K 的请求包含 20K 未缓存输入、60K 缓存输入和 10K 输出时:
未缓存输入:0.020 × 2.00 = 0.040 USD
缓存输入: 0.060 × 0.50 = 0.030 USD
输出: 0.010 × 6.00 = 0.060 USD
合计: 0.130 USD
如果同一请求的提示词达到长上下文阈值,就要把三个单价分别换成 4、1 和 12 美元重新计算。
cached、reasoning 和 output Token 怎样计费
缓存不是自动保证
xAI 的 Grok 4.7 指南建议在 Responses API 设置稳定的 prompt_cache_key,在 Chat Completions 使用 x-grok-conv-id,让同一会话更可能路由到可复用缓存的服务器。即使内容看起来相同,如果前缀被改写、消息顺序变化或没有稳定路由键,也可能出现 cached_tokens=0。
缓存 Token 仍计入总提示词规模,也仍计入 TPM 限额;它只是使用较低的缓存输入单价。检查 usage.input_tokens_details.cached_tokens 或对应 Chat Completions 字段,不能仅凭客户端感觉判断缓存是否命中。
reasoning Token 按完整输出价格收费
官方用量与价格说明把 reasoning token 列为完整 completion token 价格。也就是说,xhigh 不是一个固定附加费,但更深推理可能产生更多 reasoning token、增加延迟和总成本。
例如响应的 output_tokens=20,000,其中 reasoning_tokens=8,000,短上下文时仍应按 20K × 6 USD / 1M 计算输出费,而不是只给最终可见文字计费。
Responses API 的 encrypted reasoning 要原样传回
Grok 4.7 的 Responses API 会返回 reasoning.encrypted_content,即使请求没有在 include 中显式列出它。管理多轮上下文时,应把相关 reasoning item 原样放回下一次请求;不要解析、删改或只保留其中一部分。Chat Completions 的响应结构不受这一规则影响。
工具费、Priority、US endpoint、Fast 和 Batch 的边界
| 选项 | 当前公开计费或可用性 | 最容易混淆的点 |
|---|---|---|
| 服务器端工具 | Token 费之外,按工具当前规则另计 | 一次代理任务可能自主调用多次工具 |
| Priority Processing | 实际以 service_tier=priority 服务时,所有 Token 类型按标准费率 2 倍 |
它是公共 API 调度层,不等于 Grok 4.7 Fast |
| US regional endpoint | Token 费为全球端点的 1.1 倍 | 只改变符合文档范围的区域处理与 Token 费,不代表所有工具和存储自动获得同一保证 |
| Grok 4.7 Fast | 仅 Cursor 与 Grok Build;公共 xAI API 不提供 | 不能向 api.x.ai 猜一个 Fast 模型 ID |
| Batch API | Grok 4.7 模型详情明确标为不支持 | 通用 Batch 文档存在,不代表每个模型都可用或有折扣 |
常见服务器端工具费用
- Web Search:5 USD / 1,000 次调用。
- X Search:5 USD / 1,000 条抓取帖子、10 USD / 1,000 份抓取用户资料。
- Code Execution:5 USD / 1,000 次调用。
- File Attachments:10 USD / 1,000 次调用。
- Collections Search:2.50 USD / 1,000 次调用。
工具可能还产生模型输入、推理、输出或媒体理解 Token。X Search 已改成按资源计费,详细字段和核账方法可看站内的 xAI X Search 价格与成本指南。
Priority 与 Fast 不是同一个产品
Priority 是公共 Chat Completions / Responses API 的请求级调度选项,只有响应确认实际使用 priority 时才收 2 倍 Token 费。缓存折扣会先应用,再乘 Priority 倍数;官方只明确了按 Token 计价部分,没有说明固定的服务器端工具调用费也乘 2,因此不能把整张账单机械翻倍。Grok 4.7 Fast 则是 Cursor 和 Grok Build 中的独立快速供应路径,不在公共 xAI API,也不包含在 Grok Build 免费层。
当前官方 Fast 价格表列出:
| Fast 提示词规模 | 输入 / 100 万 | 缓存输入 / 100 万 | 输出 / 100 万 |
|---|---|---|---|
| 低于 200K | 4.00 USD | 1.00 USD | 12.00 USD |
| 超过 200K | 6.00 USD | 1.50 USD | 18.00 USD |
发布公告和模型指南用“twice the standard token rates”概括 Fast,但当前价格表的长上下文行是 6 / 1.50 / 18 USD,相对公共 API 长上下文的 4 / 1 / 12 USD 只有 1.5 倍。这是当前官方页面之间可见的口径冲突,不能替官方“修正”成 8 / 2 / 24。做预算时应并列记录概述与具体表格,最终以使用当日的 Fast 表和 Cursor 实际账单为准。
US regional endpoint 的可复算价格
Grok 4.7 当前全球端点是 https://api.x.ai/v1,US regional endpoint 是 https://us.api.x.ai/v1。官方表列出的 1.1 倍 Token 价格为:
- 低于 200K:输入 2.20、缓存输入 0.55、输出 6.60 USD / 100 万 Token。
- 达到或超过 200K:输入 4.40、缓存输入 1.10、输出 13.20 USD / 100 万 Token。
这不是“美国用户价格”,而是选择指定区域端点的 API 处理价格。账号可用性、税费和最终发票仍以目标 team 的 Console 为准。
怎样接入 Grok 4.7 官方 API
步骤一:确认 team、余额和模型权限
- 登录 xAI Console,确认当前选中的 team;API key、余额、用量和发票都按 team 管理。
- 在 Models 页面确认该 team 实际显示
grok-4.7,不要用消费者 Grok App 的模型入口推断 API 权限。 - 先设置低风险预算、告警和自动充值上限,再创建或复用 API key。
- 把密钥放入服务端环境变量
XAI_API_KEY,不要写进浏览器、移动端包、仓库或截图。
步骤二:先发一笔不带工具的最小请求
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["XAI_API_KEY"],
base_url="https://api.x.ai/v1",
)
response = client.responses.create(
model="grok-4.7",
input="检查这个 Python 函数的边界条件,并给出最小修复方案。",
reasoning={"effort": "high"},
prompt_cache_key="migration-canary-v1",
)
print(response.output_text)
payload = response.model_dump()
usage = payload.get("usage", {})
cost_ticks = usage.get("cost_in_usd_ticks")
if cost_ticks is not None:
print("request_cost_usd=", cost_ticks / 10_000_000_000)
示例使用 OpenAI 兼容客户端,但请求发往 xAI 官方端点。不同 SDK 版本可能尚未为 cost_in_usd_ticks 建立类型定义,因此示例先转成原始字典读取;若字段仍缺失,应检查原始 HTTP JSON,而不是把缺失误写成零费用。
步骤三:再逐项加入图片、工具和区域要求
先得到纯模型请求的质量、延迟和成本基线,再一次只增加一个变量:图片输入、Web Search、X Search、代码执行、Priority 或 US endpoint。这样费用上升时才能定位来源。不要在第一笔测试里同时打开多个自动工具。
从 Grok 4.6 评估迁移到 4.7
第一步:冻结可比较的样本与参数
从真实业务中选择 30 至 100 个代表性任务,至少包含常规请求、长对话、图片输入、工具调用、失败重试和接近 200K 的长上下文。固定系统提示、工具、超时、temperature、reasoning effort 和验收规则。
第二步:显式调用两个版本
分别使用 grok-4.6 与 grok-4.7,不要让路由器自动选择版本。对第三方模型网关,还要单独记录网关价格、缓存实现、路由和退款主体;第三方价不能冒充 xAI 官方 API 价。
第三步:比较每个成功任务,而不是只看 Token 单价
- 任务一次通过率和人工验收分。
- 输入、缓存输入、reasoning、最终输出 Token。
- 工具调用次数、抓取资源数和重试次数。
- 中位延迟、P90 延迟和超时率。
cost_in_usd_ticks换算后的每请求成本。- 每个合格结果成本,而不是只比较每 100 万 Token 的标价。
第四步:检查兼容性和阻断项
- Responses API 多轮客户端能否保留并传回 encrypted reasoning item。
- 应用是否错误使用 Grok 4.7 不支持的 Batch API。
- 是否依赖不受支持的
presencePenalty、frequencyPenalty或stop等推理模型参数。 - 提示词是否经常越过 200K,导致整单费率翻档。
- 缓存路由键和不变前缀是否稳定,缓存命中是否真实出现。
第五步:小流量上线并保留回滚
先把 5% 至 10% 可回滚流量切到 4.7,设置每日费用、单请求费用、错误率和延迟告警。达到预设质量与成本门槛后再逐步扩大;未达到时回到显式固定的 4.6。官方没有给出 4.6 退役期限,因此没有必要用未经验证的全量切换制造风险。
用 cost_in_usd_ticks 核对真实费用
xAI Cost Tracking 说明,每个推理响应的 usage.cost_in_usd_ticks 是该请求实际计入的 API 费用,已经包含适用的 Token、缓存折扣和服务器端工具费用。换算规则是:
1 USD = 10,000,000,000 ticks
cost_usd = cost_in_usd_ticks / 10_000_000_000
该字段是单请求 API 用量费,不是含税信用卡入账金额,也不会替你累计整个工作流。应用应保存匿名请求 ID、模型、service tier、区域端点、Token 明细、工具明细、ticks、成功状态和业务标签,再按任务求和。
建议设置的四类告警
- 200K 阈值告警:提示词超过 180K 时预警,达到 200K 时记录整单费率切换。
- 单请求成本告警:按任务类型设置不同阈值,避免长代理任务吞掉整日预算。
- 缓存异常告警:同一稳定会话连续多轮
cached_tokens=0时检查路由键和前缀变化。 - 工具循环告警:工具次数、重试或抓取资源数异常上升时中止任务并人工检查。
五类产品、credits 和退款必须分开
| 产品或余额 | 入口与渠道 | 能支付什么 | 关键退款与价格边界 |
|---|---|---|---|
| SuperGrok 消费者订阅 | grok.com、Grok iOS / Android | 消费者 Grok 功能与套餐额度 | Web 与 Google Play 的退款按当前 Grok FAQ 由 xAI 审核;Apple 订单由 Apple 处理。结账币种、税费和 SKU 以原渠道为准 |
| 消费者 Extra Usage Credits | 当前通过 Grok Web 的 Settings → Usage 购买 | 消费者周额度用完后的继续使用 | 不是 API credits;公开 FAQ 以美元符号描述最低购买额,但具体币种、税费和动作单价以账号实显为准 |
| X Premium | x.com、X iOS / Android | X 会员及对应 Grok 权益 | Premium+ 当前帮助页列出 SuperGrok 和 Grok Bot,但不等于 xAI API 余额,也不能证明某账号已获得 Grok 4.7 API;退款按 X 或原应用商店规则 |
| xAI API prepaid / monthly billing | xAI Console,按 team 管理 | Grok 4.7、工具及其他 xAI API 用量 | 官方 API 价为 USD;prepaid credits 原则上不可退款,法律要求地区除外;税务信息和最终税额以发票为准 |
| 直接 X API | X Developer Console | 直接读取或写入 X 数据端点 | 独立余额、限额、计费和支持主体;不能与 xAI API 的 X Search 或 credits 混用 |
当前 xAI 消费者定价页仍在 SuperGrok 权益中写 Grok 4.6,并没有公开确认每个 SuperGrok 或 X Premium 档位都已获得 4.7。消费者账号是否出现 4.7、具体地区和渠道价格均以模型选择器与结账页为准,不能从 API 上线反推。
如果你关注消费者套餐,查看站内的 SuperGrok 套餐价格指南;开通、账号关联、付款后不到账和退款入口可看 Grok 与 X Premium+ 订阅排查指南。文本 Token 可用站内 Token 计算器做初步估算,但工具无法预测 reasoning token、工具循环或最终账单。
xAI API 充值、月结和发票边界
xAI Billing 文档在 2026 年 9 月 22 日更新后列出两种主要方式:
- Prepaid credits:先购买后使用,消耗归属所选 team。银行转账可能需要 2 至 3 个工作日到账;印度支付卡当前需使用 Guest Checkout。
- Monthly invoiced billing:默认关闭,需要获得资格并设置大于 0 的 invoiced spending limit。系统先扣 prepaid credits,余额用尽后的合格用量再进入月末账单。
- Auto top-up:可以设置余额阈值、充值额和月度充值上限,当前最低自动充值金额为 5 USD。使用达到自设月度上限的 80% 时,API spend management 卡片会显示警告;月度充值上限控制自动购买,不等于 API 用量硬上限。
- 余额耗尽:若 invoiced spending limit 为 0,prepaid credits 用尽后请求会被拒绝;达到已设置的月结限额后也会停止响应。
- 发票:账单地址和税务信息会显示在发票上,官方称目前不能追溯重开发票,应在购买前核对。
API Billing FAQ规定 prepaid API credits 原则上不可退款,适用法律要求的地区除外。不要把这条规则套给 SuperGrok、Apple、Google Play、X Premium、直接 X API 或第三方网关,它们有各自的订单与处理主体。
常见失败与费用异常怎么排查
401:API key 无效或用错环境
确认密钥来自目标 xAI team,服务端实际读取了预期环境变量,并且没有把测试 key、已撤销 key 或带空格的值部署到生产。不要在日志中输出完整密钥。
403 或 model not found:看不到 Grok 4.7
先在 xAI Console 的目标 team 查看 Models 页面和区域可用性。消费者 Grok App 能用某模型,不代表 API team 自动有权限;第三方网关有模型,也不代表官方端点使用相同模型 ID。Grok 4.7 Fast 在公共 xAI API 上不可用,不能靠猜测 slug 解决。
429:超过速率限制
使用指数退避与随机抖动,限制并发和重试总次数,并记录是否因代理循环重复提交。缓存输入仍计入 TPM;不能因为价格较低就认为它不占速率额度。
费用突然翻倍
- 查看提示词是否从低于 200K 变成达到或超过 200K。
- 检查 reasoning effort、输出长度和重试次数是否改变。
- 检查是否启用了 Priority 或切换到 US regional endpoint。
- 检查缓存是否失效、
cached_tokens是否归零。 - 检查 Web Search、X Search、代码执行、文件和媒体工具的用量。
- 以
cost_in_usd_ticks核对请求级 API 费用,再与发票中的税费和付款手续费分开比较。
余额还有钱,请求却停止
确认余额属于当前 team,而不是另一个 Personal Team 或组织;再检查 prepaid balance、invoiced spending limit、模型权限和团队状态。删除 team 会移除其 prepaid credits,不要把 team 删除当作普通退出操作。
缓存始终不命中
保持系统提示和历史消息前缀完全稳定,为会话设置一致的 prompt_cache_key 或 x-grok-conv-id,并直接观察 usage 中的 cached tokens。把时间戳、随机 ID 或每轮变化的内容放在前缀开头,会破坏缓存复用。
Batch 请求失败
Grok 4.7 当前模型详情明确写着 Batch API 不支持。应改为常规 Responses / Chat Completions 请求,或在重新核验官方支持表后选择适合 Batch 的模型;不要假设“没有折扣”就等于“可以按原价批处理”。
事实核验范围与仍未知的信息
- 事实、价格、渠道与条款核验日期:2026 年 9 月 27 日。
- Grok 4.7 于 9 月 21 日上线 xAI API;模型指南与价格页的最后更新日均为 9 月 21 日。
- 官方未公布 Grok 4.6 的退役日,也没有把 4.7 迁移描述成强制升级。
- API 公开费率是 USD;目标账户的税费、非美元付款、汇率、发卡行手续费和最终可用性以 Console 与发票为准。
- 消费者定价页仍写 Grok 4.6,因此 SuperGrok、X Premium 各档是否向某个地区和账号开放 4.7,公开资料不足,必须标为未知。
- 第三方网关、Cursor 和 Grok Build 有自己的套餐、加价、缓存、路由与退款规则,本文不能替代其结账页。
- 官方 Fast 页的长上下文表与“2 倍标准价”的概括不能完全机械互算,预算应以使用当日的具体价格表和账单为准。
常见问题
Grok 4.7 API 多少钱?
提示词低于 200K 时,每 100 万 Token 输入 2 USD、缓存输入 0.50 USD、输出 6 USD;达到或超过 200K 时,整次请求分别按 4、1、12 USD 计费。工具、Priority、US endpoint 和税费可能另外增加成本。
正好 200K Token 用哪一档?
官方主价格表将长上下文标为“≥ 200K”,因此预算和告警应把正好 200K 视为长上下文档。生产中应以响应 usage 和当日官方价格页复核。
Grok 4.7 比 4.6 贵吗?
当前 xAI 官方标准 API 价格表中,两者的输入、缓存输入、输出和 200K 长上下文费率相同。但 4.7 的推理量、工具使用、延迟、重试和完成合格任务的次数可能不同,所以真实任务成本未必相同。
必须马上从 Grok 4.6 迁移吗?
不必。4.6 仍在官方价格表中,xAI 没有公布退役日。先做并行评测和小流量切换,保留显式 4.6 回滚路径。
reasoning token 免费吗?
不免费。官方把 reasoning token 按完整 completion token 价格计费;提高 reasoning effort 可能增加推理 Token、延迟和总成本。
SuperGrok 或 X Premium+ 包含 Grok 4.7 API credits 吗?
不能这样推断。SuperGrok 和 X Premium+ 属于消费者订阅或 X 会员,xAI API credits 由 Console team 单独充值和计费,二者不能互相抵扣。如果你要开通消费者版、关联 X 账号,或排查付款后仍显示 Free,可参阅站内的 Grok 与 X Premium+ 订阅、激活和不到账排查指南。该指南包含已披露的第三方推广链接;第三方不是 xAI 或 X 官方渠道,商品、价格、到账与退款应以实际订单页和条款为准。
Grok 4.7 Fast 可以通过公共 xAI API 调用吗?
当前不可以。官方只列 Cursor 和 Grok Build,且 Grok Build 免费层不包含 Fast。公共 API 的 Priority Processing 是另一个请求级调度产品。
Grok 4.7 支持 Batch API 吗?
当前模型详情明确标为不支持。通用 Batch API 文档不等于所有模型都可批处理。
怎样知道一笔请求最终花了多少钱?
读取响应中的 usage.cost_in_usd_ticks,除以 10,000,000,000 得到该请求的 USD API 用量费;多轮任务要逐请求累加。税费、换汇和付款手续费仍以发票与银行记录为准。
xAI API prepaid credits 能退款吗?
当前 API Billing FAQ 的规则是原则上不退款,适用法律要求的地区除外。该规则只针对 xAI API prepaid credits;消费者订阅、Apple、Google Play、X Premium、直接 X API 和第三方平台要按各自订单处理。
迁移时最值得监控哪个指标?
优先看“每个合格结果成本”:把任务成功率、人工验收、总 ticks、延迟、重试和工具用量放在一起。单看每 100 万 Token 的标价无法判断哪一版在你的业务里更划算。