xAI Grok 4.5 资料整理

模型与厂商 · AI 总索引 · organize 总索引

主题定位

汇总 Grok 4.5(xAI / 部分报道称 SpaceXAI 体系)在 2026 年 7 月公开的规格、价格、能力与选型位置。面向个人开发者(尤其编码 / agent 场景),不替代你已定的国产打底策略,只回答:「Grok 4.5 值不值得作为海外增强通道之一?」

不做什么:不写完整 xAI 全系历史;不承诺大陆支付/网络可直连;不把未独立复现的榜单当硬真理。

背景与现状

6 条 TL;DR

  1. 发布时间:约 2026-07-08 官宣 / 随后公开(TechCrunch 等同日报道);定位为编码、agent、知识工作「主力役马」,非只刷分。
  2. 官方 API 价(已核验)6(输入/输出,每百万 token);缓存输入 $0.50;上下文 500K。见 docs 模型页pricing
  3. 模型 IDgrok-4.5(别名 grok-4.5-latestgrok-build-latest)。多模态:text+image → text;function calling / structured outputs / reasoning 支持。
  4. 相对 Claude Opus 4.8:单价更低(约 6 vs Opus 约 25);官方叙事强调 token 效率与速度;SWE-Bench Pro 自报约 64.7%(Opus 4.8 max 约 69.2%)——差距不大,但 harness 不同会翻盘。
  5. 产品侧:宣传与 Cursor 共训/深度集成;适合「Cursor 工作流 + API 编码 agent」;大陆直连与支付仍是硬门槛。
  6. 对你(大陆个人开发者)的位置:可作为 L2 海外增强的备选/分流(尤其 Cursor 用户、要压 token 成本时),不能替代 L0 本地与 L1 国产确定性底座。

官方规格速查(优先采信)

可信度
模型 IDgrok-4.5;别名 grok-4.5-latestgrok-build-latestdocs.x.ai 模型页
上下文500,000 tokens✅ 同上 / models 总表
模态text, image → text
能力开关function calling、structured outputs、reasoning
输入价$2.00 / 百万 token✅ 模型页 + pricing
缓存输入$0.50 / 百万 token✅ 模型页
输出价$6.00 / 百万 token
限流示例150 rps;50M tokens/min(以控制台为准)✅ 模型页
区域us-east-1、us-west-2
知识截止2026-02-01(无搜索工具则无实时)✅ models 总表摘要
Batch 折扣pricing 页:4.5 不在 batch 折扣列表(4.3/4.20 系有 20% off)pricing
Priority全 token 类型 标准价✅ pricing
服务端工具附加费Web/X Search、Code Execution 等约 $5 / 1k 次调用 量级✅ pricing

部分二手文称「超过 200K 上下文单价翻倍」——本会话官方 pricing/模型页抓取未写明该规则,标为 ⚠️ 待控制台或更新文档复核,不作硬结论。

同厂相关模型(便于别买错)

模型上下文输入/输出 $/M备注
grok-4.5500k2.00 / 6.00旗舰智能 / 编码主推
grok-4.31M1.25 / 2.50更长上下文、更便宜
grok-4.20-*-0309 系1M1.25 / 2.50reasoning / non-reasoning / multi-agent
grok-build-0.1(Code API)256k1.00 / 2.00编码 API 线,非 4.5 本体
(历史)Grok 4.1库内旧文 0.50已非当前旗舰,见旧选型文

来源:docs.x.ai/developers/modelspricing

能力与基准(交叉信息,需标注)

官方叙事(公告 / 报道)

  • 定位:coding、agentic、office/知识工作「workhorse」;强调 token 效率约 2×、服务速度约 80 TPS 量级(公告侧数字)。
  • Musk / 报道表述:Opus-class,但更快、更省 token、更便宜(TechCrunch 2026-07-08)。
  • Cursor 联合/共训的公开叙事较常见(公告页;本会话 WebFetch 公告页 403,依赖搜索摘要 + 第三方复述 → 🟡)。

编码相关基准(多源复述官方表,非本机复现)

基准Grok 4.5对照可信度
SWE-Bench Pro64.7%Opus 4.8 max 69.2%;Opus 4.7 max 64.3%;GPT-5.5 xhigh ~58.6%🟡 多源引 x.ai/news/grok-4-5,未在本环境打开原文 HTML
输出 token 效率(SWE Pro 任务均输出)~15.9k tokens/任务Opus 4.8 max ~67k(约 4.2× 更省)🟡 同上
DeepSWE / Terminal / Marathon 等互有胜负(视 harness)与 Opus 4.8 拉锯🟡 二手对比文

读法(第一性)

  • 绝对智能:顶尖梯队,略逊或贴近 Claude 旗舰(看题集与 effort)。
  • 真正卖点往往是 $/任务 与 时延,不是单点榜一。
  • 与你文档中 MiniMax M3(SWE Pro ~59%)比:Grok 4.5 更高一档,但带来 海外支付 + 网络 成本。

价格对照(元/百万 Token,汇率 1 USD≈7.2)

模型输入输出相对 Grok 4.5 输出
DeepSeek V4-flash≈1.0 元≈2.0 元远低于 Grok
MiniMax M3 促销 API≈2.2 元≈8.6 元同量级或更低
Grok 4.5≈14.4 元≈43.2 元基准
Claude Sonnet 5 促销≈14 元≈72 元Grok 输出更便宜
Claude Opus 4.8≈36 元≈180 元Grok 输出约 1/4 价

编码 agent 若真如官方所说「输出 token 少 4×」,有效任务成本还可能再拉开——但这是官方任务集统计,实战以你自己的仓库为准。

方案概览:放进你的三层架构

flowchart TD
    A["编码 / 知识任务"] --> B{{"约束优先?"}}
    B -->|"隐私/离线/撞墙"| L0["L0 本地 Ollama"]
    B -->|"日常高频/人民币"| L1["L1 MiniMax + DeepSeek"]
    B -->|"海外增强"| L2{{"选哪条海外?"}}
    L2 -->|"Cursor 深度集成 / 要压 token"| G["Grok 4.5 API"]
    L2 -->|"长链稳妥 / 已有 Claude 习惯"| C["Claude Sonnet/Opus 小额"]
    L0 --> Out["统一外壳:Claude Code / Cursor"]
    L1 --> Out
    G --> Out
    C --> Out
角色是否推荐 Grok 4.5说明
L0 本地无本地开源 Grok 4.5 权重可对等
L1 日常国产支付/网络/封号结构不占优
L2 海外攻坚可选与 Claude 二选一或分流;Cursor 用户优先评估
独立产品嵌 API⚠️可用但单价高于 DeepSeek;注意条款与数据出境

接入要点

API

  • 控制台:console.x.ai(以官方为准)
  • 文档:Models · Grok 4.5 · Pricing · API 入口
  • 兼容面:OpenAI 兼容端点 / 官方 SDK;支持 tools、structured output、reasoning 档位(low/medium/high,文档与公告侧描述)
  • 多轮 agent:务必开 prompt cache(缓存输入 $0.50)

产品形态(非 API)

  • Grok 聊天 / X 订阅体系:与 API 计费分离(额度规则常变,本文不展开)
  • Cursor:多计划可调用 Grok 系(以 Cursor 模型列表为准)
  • 第三方:OpenRouter 等常有转售(加价与稳定性另计)

大陆使用注意

风险说明
网络官方 API 区域在美西/美东,需稳定出境
支付外币卡 / 企业账单;个人侧痛点与 Claude 类似
合规代码/数据出境;敏感项目仍走国产/本地
中转第三方 Key 有泄露与假模型风险,见 Claude 接入方案 同类原则

风险与限制

  1. 公告页本环境 403:SWE 等细表依赖搜索摘要与二手复述,已标 🟡;落地前建议浏览器打开 x.ai/news/grok-4-5 复核。
  2. 厂商品牌名表述不一:报道出现 SpaceXAI / xAI 混用,以 docs.x.aix.ai 域名为准。
  3. Batch 对 4.5 无折扣(pricing 页现状)——大批量离线任务可能不如 4.3/4.20 系划算。
  4. 上下文 500K < 部分 Claude 1M 配置——超大库一次性塞满仍可能吃亏。
  5. 服务端搜索/代码执行按次加价——agent 乱搜会把账单打穿。
  6. 库内 Grok 4.1 价格不可再当决策依据

诚实声明

级别内容
✅ 已在官方文档确认模型 ID、500K、模态、能力开关、6/$0.50 缓存、区域、限流示例、同厂价表、工具附加费、Batch/Priority 规则
🟡 多源交叉 / 二手发布日叙事、Cursor 共训、SWE Pro 64.7%、token 效率 4.2×、80 TPS、TechCrunch 报道要点
⚠️ 未确认长上下文(>200K)是否官方双倍计价;EU 可用性时间表是否已变;你账号实际限流
❌ 未做本机对 Grok 4.5 的真实编码压测;大陆支付开通实测

对你的选型建议(收敛)

  1. 主链不变:L0 本地 + L1 MiniMax/DeepSeek + L2 海外小额。
  2. L2 若已用 Claude 顺手:不必强行换 Grok;可小额试 1~2 个硬任务比「$/成功任务」。
  3. 重度 Cursor 用户:优先在 Cursor 内直接试 Grok 4.5,再决定是否开 xAI API。
  4. 要极致输出省 token 的 agent 流水线:Grok 4.5 的官方效率叙事值得小流量 A/B。
  5. 要最长上下文 / 最稳长链:仍可偏向 Claude 旗舰。

关联主题

主要来源

工作流元信息

字段
整理日期2026-07-14(Asia/Shanghai)
方法官方 docs WebFetch + 多源搜索交叉 + 与库内选型文档对照
语言中文

此文件夹下有0条笔记。