跳转到内容

关键信息

定价

所有价格均为美元。有关每个模型的详细信息,请参阅模型页面

文本 API 定价

ModelContextInput / 1M tokensCached input / 1M tokensOutput / 1M tokens
grok-4.5 (< 200k prompt tokens)500k$2.00$0.30$6.00
grok-4.5 (≥ 200k prompt tokens)500k$4.00$0.60$12.00
grok-4.3 (< 200k prompt tokens)1M$1.25$0.20$2.50
grok-4.3 (≥ 200k prompt tokens)1M$2.50$0.40$5.00
grok-4.20-0309-reasoning (< 200k prompt tokens)1M$1.25$0.20$2.50
grok-4.20-0309-reasoning (≥ 200k prompt tokens)1M$2.50$0.40$5.00
grok-4.20-0309-non-reasoning (< 200k prompt tokens)1M$1.25$0.20$2.50
grok-4.20-0309-non-reasoning (≥ 200k prompt tokens)1M$2.50$0.40$5.00
grok-build-0.1 (< 200k prompt tokens)256k$1.00$0.20$2.00
grok-build-0.1 (≥ 200k prompt tokens)256k$2.00$0.40$4.00
grok-4.20-multi-agent-0309 (< 200k prompt tokens)1M$1.25$0.20$2.50
grok-4.20-multi-agent-0309 (≥ 200k prompt tokens)1M$2.50$0.40$5.00

显示的价格为每百万个令牌。列有两行的模型使用长上下文定价:提示达到指定令牌阈值的请求将按较高费率计费该请求中的所有令牌。

图像生成定价

ModelCost
grok-imagine-image$0.02 / image
grok-imagine-image-quality$0.05 / image
grok-imagine-video-1.5$0.080 / sec
grok-imagine-video$0.050 / sec

语音定价

ModeCost
Speech to Speech (grok-voice-think-fast-1.0)$0.05 / min ($3.00 / hr) audio
$0.004 / text input
Speech to Speech (grok-voice-think-fast-2.0)$0.08 / min ($4.80 / hr) audio
$0.004 / text input
Speech to Text$0.10 / hr (REST), $0.20 / hr (Streaming)
Text to Speech$15.00 / 1M chars

工具定价

使用 xAI 提供的服务器端工具的请求根据两个组件定价:令牌使用服务器端工具调用。由于代理自主决定调用多少工具,成本会随查询复杂度而增加。

令牌成本

所有标准令牌类型都会根据请求中使用的模型计费:

  • 输入令牌:您的查询和对话历史
  • 推理令牌:代理的内部思考和规划
  • 完成令牌:最终响应
  • 图像令牌:视觉内容分析(如适用)
  • 缓存提示令牌:从缓存提供而非重新计算的提示令牌

工具调用成本

ToolTool NameDescriptionCost / 1k Calls
Web Searchweb_search搜索互联网和浏览网页$5
X Searchx_search搜索 X 帖子、用户资料和线程$5
Code Executioncode_execution, code_interpreter在沙盒环境中运行 Python 代码$5
File Attachmentsattachment_search搜索附加到消息中的文件$10
Collections Searchcollections_search, file_search查询您上传的文档集合(RAG)$2.50
Image Understandingview_image分析在网页搜索和 X 搜索中找到的图像*基于令牌
X Video Understandingview_x_video分析在 X 搜索中找到的视频*基于令牌
Remote MCP Tools由 MCP 服务器设置连接和使用自定义 MCP 工具服务器基于令牌
† 所有工具名称在 Responses API 中均有效。在 gRPC API (Python xAI SDK) 中,不支持 code_interpreterfile_search
* 仅适用于搜索工具找到的图像和视频—不适用于直接在消息中传递的图像。

对于查看图像和查看 X 视频工具,您不会为工具调用本身付费,但会为用于处理图像或视频的图像令牌付费。

图像搜索是网页搜索的一部分,按标准网页搜索费率计费。

对于远程 MCP 工具,您不会为工具调用付费,但会为使用的任何令牌付费。

有关使用工具的更多信息,请访问我们的工具指南

批量 API 定价

批量 API 允许您以低于标准定价的折扣异步处理大量请求。折扣大小因模型而异。批量请求被排队并在后台处理,大多数在 24 小时内完成。

Real-time APIBatch API
Token pricingStandard ratesDiscounted rates (varies by model)
Response timeImmediate (seconds)Typically within 24 hours
Rate limitsPer-minute limits applyRequests don't count towards rate limits

批量折扣适用于所有令牌类型—输入令牌、输出令牌、缓存令牌和推理令牌。按模型的批量折扣:

标准费率 20% 折扣

  • grok-4.3
  • grok-4.20-0309-reasoning
  • grok-4.20-0309-non-reasoning
  • grok-4.20-multi-agent-0309

未在上列出的模型没有批量折扣。

要查看模型的批量价格,在其详情页面上切换 "显示批量 API 定价"

NOTE

批量折扣仅适用于文本和语言模型。图像和视频生成在批量 API 中受支持,但按标准费率计费。有关完整详细信息,请参阅批量 API 文档

优先处理定价

优先处理为文本请求提供更高的调度优先级,以降低延迟。优先请求按标准费率的 2x 溢价计费。

StandardPriority
Token pricingStandard rates2x standard rates
Response timeStandard scheduling priorityHigher scheduling priority

2x 乘数适用于所有令牌类型—输入、输出、缓存和推理。提示缓存折扣在应用乘数之前适用。

只有当响应确认 "service_tier": "priority" 时,您才会按优先费率计费。如果请求在默认层级上提供服务,则适用标准费率。

NOTE

优先处理仅适用于聊天完成和响应端点。不支持图像生成、视频生成或批量 API请求。有关完整详细信息,请参阅优先处理文档

文件和集合定价

存储在 xAI 平台上的文件和集合根据使用的存储量计费。

ResourceRate
File storage$0.025 / GiB / day
Collection storage$0.10  / GiB / day

下载成本

从文件和集合下载数据按数据传输量的固定费率计费:

ResourceRate
File downloads$0.20 / GiB downloaded
Collection downloads$0.20 / GiB downloaded

您可以通过 xAI 控制台或xAI API查看和管理您的文件集合

使用指南违规费

当您的请求被我们的系统判定为违反使用指南时,我们仍会为请求的生成收费。

对于在 Responses API 中生成前被捕获的违规行为,我们将对每个请求收取 $0.05 的使用指南违规费。

计费和可用性

您的模型访问权限可能因地理位置、账户限制等各种因素而异。

有关账单如何收取的信息,请访问管理计费了解更多详情。

有关团队模型可用性的最新信息,请访问 xAI 控制台上的模型页面

本文档为 docs.x.ai 全站中文翻译,由 AI 自动翻译生成。代码示例请以原文为准。