这组型号覆盖自动路由、通用模型、低延迟 Fast、深度推理 Thinking、多工具 Agents 和专业 Expert 六类能力。本指南整理 auto 与 11 个 Grok 型号,给出一套面向生产环境的路由、评测和版本治理方法。
说明:部分 Grok 420、4.3、4.5 名称可能属于平台别名、内部型号或预览配置。本文只做工程定位,不推断未经确认的官方规格。
模型快速对照
| 模型 | 系列 | 类型 | 定位 | 优先场景 |
|---|---|---|---|---|
auto | Auto Router | router | 根据任务、负载和策略自动选择底层模型 | 多模型网关、默认聊天入口、成本与质量动态平衡以及故障自动降级 |
grok-3 | Grok | general | 成熟的通用问答、分析和代码辅助 | 日常对话、资料整理、常规开发、摘要和存量 Grok 工作流 |
grok-4 | Grok | general | 新一代通用推理与生产任务 | 复杂问答、代码分析、研究辅助、结构化内容和多步骤业务自动化 |
grok-420-fast | Grok 420 | fast | 低延迟、高吞吐和实时交互 | 搜索摘要、分类抽取、客服建议、代码补全和代理前置路由 |
grok-420-thinking | Grok 420 | thinking | 复杂推理、规划和需要更多计算的任务 | 架构推演、复杂缺陷定位、数学与逻辑分析、研究综合和方案比较 |
grok-420-agents | Grok 420 | agents | 工具调用、多步骤执行和代理工作流 | 检索分析、跨系统操作、代码代理、自动化排障和需要执行后验证的任务 |
grok-4.3 | Grok 4.3 | general | 通用质量、速度和兼容性的平衡版本 | 生产聊天、代码与文档助手、业务分析和从旧版本渐进迁移 |
grok-4.3-fast | Grok 4.3 | fast | 4.3 系列的实时低延迟层 | 高并发问答、信息抽取、意图路由、短文本改写和交互式应用 |
grok-4.3-expert | Grok 4.3 | expert | 专业分析、复杂审查和质量优先任务 | 技术评审、复杂代码审查、研究报告、风险分析和高价值客户交付 |
grok-4.5 | Grok 4.5 | general | 更新一代通用能力与生产平衡 | 综合问答、编码、文档、业务自动化和多场景统一入口 |
grok-4.5-fast | Grok 4.5 | fast | 4.5 系列的速度与吞吐优先层 | 实时助手、搜索结果整理、批量处理、简单代码生成和高并发 API |
grok-4.5-expert | Grok 4.5 | expert | 4.5 系列的专业质量与复杂任务层 | 高级工程、研究分析、合规辅助、系统设计和最终质量复核 |
推荐路由架构
- 规则和缓存先处理确定性请求;
- Fast 承接分类、抽取和实时任务;
- 通用 Grok 处理大多数对话、代码与文档;
- Thinking/Expert 只升级困难或高价值样本;
- Agents 使用独立工具白名单、审计和人工确认;
- Auto 必须输出并记录实际选中的底层模型。
Auto 的优点与风险
Auto 能根据负载和任务动态优化体验,也能在某个型号故障时降级;但底层模型变化会影响复现、成本和行为。审计、合规和严格回归场景应指定固定型号,普通入口可以使用 Auto,但要设置策略上限。
统一评测
所有型号使用同一真实任务集,统计成功率、延迟、单位成功成本和返工。Thinking/Expert 重点看困难样本质量,Fast 看吞吐和延迟,Agents 看工具正确率与越权风险,Auto 看路由命中和底层模型漂移。
结论
合理方案不是选择一个“最强模型”处理全部请求,而是让 Fast 承担规模、通用层承担日常、Thinking/Expert 保护难题、Agents 执行受控工具,并由 Auto 或显式路由器协调。


