xAI Grok 4.5 资料整理
模型与厂商 · AI 总索引 · organize 总索引
主题定位
汇总 Grok 4.5(xAI / 部分报道称 SpaceXAI 体系)在 2026 年 7 月公开的规格、价格、能力与选型位置。面向个人开发者(尤其编码 / agent 场景),不替代你已定的国产打底策略,只回答:「Grok 4.5 值不值得作为海外增强通道之一?」
不做什么:不写完整 xAI 全系历史;不承诺大陆支付/网络可直连;不把未独立复现的榜单当硬真理。
背景与现状
6 条 TL;DR
- 发布时间:约 2026-07-08 官宣 / 随后公开(TechCrunch 等同日报道);定位为编码、agent、知识工作「主力役马」,非只刷分。
- 官方 API 价(已核验):2/6(输入/输出,每百万 token);缓存输入 $0.50;上下文 500K。见 docs 模型页、pricing。
- 模型 ID:
grok-4.5(别名 grok-4.5-latest、grok-build-latest)。多模态:text+image → text;function calling / structured outputs / reasoning 支持。
- 相对 Claude Opus 4.8:单价更低(约 2/6 vs Opus 约 5/25);官方叙事强调 token 效率与速度;SWE-Bench Pro 自报约 64.7%(Opus 4.8 max 约 69.2%)——差距不大,但 harness 不同会翻盘。
- 产品侧:宣传与 Cursor 共训/深度集成;适合「Cursor 工作流 + API 编码 agent」;大陆直连与支付仍是硬门槛。
- 对你(大陆个人开发者)的位置:可作为 L2 海外增强的备选/分流(尤其 Cursor 用户、要压 token 成本时),不能替代 L0 本地与 L1 国产确定性底座。
官方规格速查(优先采信)
| 项 | 值 | 可信度 |
|---|
| 模型 ID | grok-4.5;别名 grok-4.5-latest、grok-build-latest | ✅ docs.x.ai 模型页 |
| 上下文 | 500,000 tokens | ✅ 同上 / models 总表 |
| 模态 | text, image → text | ✅ |
| 能力开关 | function calling、structured outputs、reasoning | ✅ |
| 输入价 | $2.00 / 百万 token | ✅ 模型页 + pricing |
| 缓存输入 | $0.50 / 百万 token | ✅ 模型页 |
| 输出价 | $6.00 / 百万 token | ✅ |
| 限流示例 | 150 rps;50M tokens/min(以控制台为准) | ✅ 模型页 |
| 区域 | us-east-1、us-west-2 | ✅ |
| 知识截止 | 2026-02-01(无搜索工具则无实时) | ✅ models 总表摘要 |
| Batch 折扣 | pricing 页:4.5 不在 batch 折扣列表(4.3/4.20 系有 20% off) | ✅ pricing |
| Priority | 全 token 类型 2× 标准价 | ✅ pricing |
| 服务端工具附加费 | Web/X Search、Code Execution 等约 $5 / 1k 次调用 量级 | ✅ pricing |
部分二手文称「超过 200K 上下文单价翻倍」——本会话官方 pricing/模型页抓取未写明该规则,标为 ⚠️ 待控制台或更新文档复核,不作硬结论。
同厂相关模型(便于别买错)
| 模型 | 上下文 | 输入/输出 $/M | 备注 |
|---|
| grok-4.5 | 500k | 2.00 / 6.00 | 旗舰智能 / 编码主推 |
| grok-4.3 | 1M | 1.25 / 2.50 | 更长上下文、更便宜 |
| grok-4.20-*-0309 系 | 1M | 1.25 / 2.50 | reasoning / non-reasoning / multi-agent |
| grok-build-0.1(Code API) | 256k | 1.00 / 2.00 | 编码 API 线,非 4.5 本体 |
| (历史)Grok 4.1 | — | 库内旧文 0.20/0.50 | 已非当前旗舰,见旧选型文 |
来源:docs.x.ai/developers/models、pricing。
能力与基准(交叉信息,需标注)
官方叙事(公告 / 报道)
- 定位:coding、agentic、office/知识工作「workhorse」;强调 token 效率约 2×、服务速度约 80 TPS 量级(公告侧数字)。
- Musk / 报道表述:Opus-class,但更快、更省 token、更便宜(TechCrunch 2026-07-08)。
- 与 Cursor 联合/共训的公开叙事较常见(公告页;本会话 WebFetch 公告页 403,依赖搜索摘要 + 第三方复述 → 🟡)。
编码相关基准(多源复述官方表,非本机复现)
| 基准 | Grok 4.5 | 对照 | 可信度 |
|---|
| SWE-Bench Pro | 64.7% | Opus 4.8 max 69.2%;Opus 4.7 max 64.3%;GPT-5.5 xhigh ~58.6% | 🟡 多源引 x.ai/news/grok-4-5,未在本环境打开原文 HTML |
| 输出 token 效率(SWE Pro 任务均输出) | ~15.9k tokens/任务 | Opus 4.8 max ~67k(约 4.2× 更省) | 🟡 同上 |
| DeepSWE / Terminal / Marathon 等 | 互有胜负(视 harness) | 与 Opus 4.8 拉锯 | 🟡 二手对比文 |
读法(第一性):
- 绝对智能:顶尖梯队,略逊或贴近 Claude 旗舰(看题集与 effort)。
- 真正卖点往往是 $/任务 与 时延,不是单点榜一。
- 与你文档中 MiniMax M3(SWE Pro ~59%)比:Grok 4.5 更高一档,但带来 海外支付 + 网络 成本。
价格对照(元/百万 Token,汇率 1 USD≈7.2)
| 模型 | 输入 | 输出 | 相对 Grok 4.5 输出 |
|---|
| DeepSeek V4-flash | ≈1.0 元 | ≈2.0 元 | 远低于 Grok |
| MiniMax M3 促销 API | ≈2.2 元 | ≈8.6 元 | 同量级或更低 |
| Grok 4.5 | ≈14.4 元 | ≈43.2 元 | 基准 |
| Claude Sonnet 5 促销 | ≈14 元 | ≈72 元 | Grok 输出更便宜 |
| Claude Opus 4.8 | ≈36 元 | ≈180 元 | Grok 输出约 1/4 价 |
编码 agent 若真如官方所说「输出 token 少 4×」,有效任务成本还可能再拉开——但这是官方任务集统计,实战以你自己的仓库为准。
方案概览:放进你的三层架构
flowchart TD
A["编码 / 知识任务"] --> B{{"约束优先?"}}
B -->|"隐私/离线/撞墙"| L0["L0 本地 Ollama"]
B -->|"日常高频/人民币"| L1["L1 MiniMax + DeepSeek"]
B -->|"海外增强"| L2{{"选哪条海外?"}}
L2 -->|"Cursor 深度集成 / 要压 token"| G["Grok 4.5 API"]
L2 -->|"长链稳妥 / 已有 Claude 习惯"| C["Claude Sonnet/Opus 小额"]
L0 --> Out["统一外壳:Claude Code / Cursor"]
L1 --> Out
G --> Out
C --> Out
| 角色 | 是否推荐 Grok 4.5 | 说明 |
|---|
| L0 本地 | ❌ | 无本地开源 Grok 4.5 权重可对等 |
| L1 日常国产 | ❌ | 支付/网络/封号结构不占优 |
| L2 海外攻坚 | 可选 | 与 Claude 二选一或分流;Cursor 用户优先评估 |
| 独立产品嵌 API | ⚠️ | 可用但单价高于 DeepSeek;注意条款与数据出境 |
接入要点
API
- 控制台:
console.x.ai(以官方为准)
- 文档:Models · Grok 4.5 · Pricing · API 入口
- 兼容面:OpenAI 兼容端点 / 官方 SDK;支持 tools、structured output、reasoning 档位(low/medium/high,文档与公告侧描述)
- 多轮 agent:务必开 prompt cache(缓存输入 $0.50)
产品形态(非 API)
- Grok 聊天 / X 订阅体系:与 API 计费分离(额度规则常变,本文不展开)
- Cursor:多计划可调用 Grok 系(以 Cursor 模型列表为准)
- 第三方:OpenRouter 等常有转售(加价与稳定性另计)
大陆使用注意
| 风险 | 说明 |
|---|
| 网络 | 官方 API 区域在美西/美东,需稳定出境 |
| 支付 | 外币卡 / 企业账单;个人侧痛点与 Claude 类似 |
| 合规 | 代码/数据出境;敏感项目仍走国产/本地 |
| 中转 | 第三方 Key 有泄露与假模型风险,见 Claude 接入方案 同类原则 |
风险与限制
- 公告页本环境 403:SWE 等细表依赖搜索摘要与二手复述,已标 🟡;落地前建议浏览器打开 x.ai/news/grok-4-5 复核。
- 厂商品牌名表述不一:报道出现 SpaceXAI / xAI 混用,以
docs.x.ai 与 x.ai 域名为准。
- Batch 对 4.5 无折扣(pricing 页现状)——大批量离线任务可能不如 4.3/4.20 系划算。
- 上下文 500K < 部分 Claude 1M 配置——超大库一次性塞满仍可能吃亏。
- 服务端搜索/代码执行按次加价——agent 乱搜会把账单打穿。
- 库内 Grok 4.1 价格不可再当决策依据。
诚实声明
| 级别 | 内容 |
|---|
| ✅ 已在官方文档确认 | 模型 ID、500K、模态、能力开关、2/6/$0.50 缓存、区域、限流示例、同厂价表、工具附加费、Batch/Priority 规则 |
| 🟡 多源交叉 / 二手 | 发布日叙事、Cursor 共训、SWE Pro 64.7%、token 效率 4.2×、80 TPS、TechCrunch 报道要点 |
| ⚠️ 未确认 | 长上下文(>200K)是否官方双倍计价;EU 可用性时间表是否已变;你账号实际限流 |
| ❌ 未做 | 本机对 Grok 4.5 的真实编码压测;大陆支付开通实测 |
对你的选型建议(收敛)
- 主链不变:L0 本地 + L1 MiniMax/DeepSeek + L2 海外小额。
- L2 若已用 Claude 顺手:不必强行换 Grok;可小额试 1~2 个硬任务比「$/成功任务」。
- 重度 Cursor 用户:优先在 Cursor 内直接试 Grok 4.5,再决定是否开 xAI API。
- 要极致输出省 token 的 agent 流水线:Grok 4.5 的官方效率叙事值得小流量 A/B。
- 要最长上下文 / 最稳长链:仍可偏向 Claude 旗舰。
关联主题
主要来源
工作流元信息
| 字段 | 值 |
|---|
| 整理日期 | 2026-07-14(Asia/Shanghai) |
| 方法 | 官方 docs WebFetch + 多源搜索交叉 + 与库内选型文档对照 |
| 语言 | 中文 |