Grok-1
Grok-1
Active

Grok-1

Grok-1 是 xAI 的 2024 Apache-2.0 开放权重 314B 专家混合基础模型,而不是当前的 Grok 助手。本指南解释了其架构、硬件负担、部署选择、替代方案和历史相关性。

74

Views

0

Likes

Jan 2026

Added

github.com

Website

Tags

open-source-llmfree

Editorial Review

About Grok-1

Grok-1 是 xAI 于 2024 年 3 月以开放权重和示例 JAX 代码发布的 3140 亿参数混合专家基础模型。它是研究人员和基础设施团队的历史模型版本,而不是当前的 Grok 消费者助理,也不是当前每个 xAI API 功能背后的模型。截至 2026 年 6 月,xAI 当前的 Grok 产品文档引入了 Grok 4.5,同时其产品还包括聊天、文件、语音、连接器、图像和视频创建以及 Grok-1 检查点中不存在的其他服务。

这种区别是页面上最重要的事实。下载 Grok-1 将为您提供一个原始的预训练检查点,xAI 表示该检查点未针对对话或其他特定应用程序进行微调。它不会重新创建 grok.com、实时 X 知识、当前代理工具、Grok Imagine、安全系统、托管或较新专有模型的行为。

Hand-drawn Grok-1 mixture-of-experts diagram showing eight experts with two active for each token
Grok-1 通过八个专家中的两个来路由每个令牌。完整的检查点包含 314B 个参数,而大约 25% 的权重对于令牌来说是活跃的。

Grok-1 技术规格

规格官方 Grok-1 版本实际意义
型号类型原始基础语言模型在面向用户的部署之前需要进行任务调整、提示、评估和安全工作
总参数314B检查点存储和内存要求远远超出典型工作站
建筑8位专家的混合路由器为每个令牌选择专家前馈路径的子集
每个代币使用的专家2、约25%的重量活跃主动计算低于密集的 314B 模型,但所有权重仍然需要适当的存储和服务策略
层数64具有大量分布式推理要求的深层变压器堆栈
注意48 个查询头,8 个键/值头分组的键/值头减少了部分注意力记忆成本
嵌入尺寸6,144大型隐藏表示有助于模型记忆和计算
分词器SentencePiece,131,072 个词汇表应用程序必须使用已发布的令牌生成器来兼容令牌 ID
最大序列长度8,192 个代币比许多较新的长上下文模型产品短得多
参考栈JAX 示例代码;激活分片和 8 位量化支持存储库展示了正确性,而不是优化的生产服务器
许可证用于存储库源和 Grok-1 权重的 Apache 许可证 2.0查看确切的许可范围以及所有第三方依赖项和下游使用义务

开放重量并不意味着准备好跑步

xAI 的存储库明确警告所包含的专家混合实现效率低下,并且被选择用于在没有自定义内核的情况下验证模型的正确性。参考路径要求机器具有足够的 GPU 内存用于 314B 检查点。即使使用 8 位权重,在运行时开销、缓存、框架缓冲区、复制和冗余之前,仅原始权重存储就达到数百 GB 的量级。较低位社区转换可以减少内存,但可能会改变准确性,并且与 xAI 的官方检查点不同。

认真的部署需要兼容的检查点格式、分片计划、优化的 MoE 内核、加速器拓扑、模型服务器、标记器服务、批处理策略、键/值缓存策略、监控和恢复。测量互连流量以及单个 GPU 利用率:跨设备的专家路由可能会将通信变成瓶颈。

Grok-1 与当前 Grok 产品

能力Grok-1 开放重量检查点当前 Grok 产品/API
目的使用 2023 时代的基本模型进行研究和自托管实验目前的助理和开发人员服务
对话行为在已发布的检查点中未对指令或对话进行微调针对产品的培训后、提示、工具和保障措施
当前信息没有内置实时检索或 X 访问可能包括当前搜索、X 上下文、连接器或代理工具,具体取决于表面
多模态作为文本基础模型发布当前产品文档文件、语音、图像、视频和 Grok Imagine 功能
运营您提供硬件、服务、扩展、安全和监控xAI 根据计划、限制、条款和可用性运营托管服务
模型生成Grok-1较新的车型系列;当前文档标识 Grok 4.5

当 Grok-1 仍然有意义时

  • 教育部研究: 检查大型发布的专家混合架构、路由行为、分片和推理优化。
  • 繁殖研究: 将官方检查点和参考实现与社区运行时或转换进行比较。
  • 历史评价: 研究一个著名的 2023 年预训练检查点在受控基准下相对于后来的开放模型的表现。
  • 基础设施实验: 当合适的硬件已经存在时,测试分布式加载、量化、专家放置和服务系统。

对于只需要功能强大的自托管助手的新应用程序来说,这通常是一个糟糕的默认设置。更新、更小的开放模型可以提供更强的指令遵循、更长的上下文、多模态、更容易的服务、更好的工具使用和更低的总成本。相关比较是接受的每单位硬件和工程工作的任务性能,而不是总参数计数。

部署决策清单

  1. 定义研究或产品原因。 解释为什么需要 Grok-1 而不是更新的密集模型或 MoE 模型。
  2. 估计完整的足迹。 包括下载的检查点、转换的副本、内存、键/值缓存、临时存储、副本和备份。
  3. 选择一个服务实现。 验证它是否支持确切的架构、分词器、量化、专家路由和目标硬件。
  4. 验证转换。 在信任转换后的检查点之前,将 logits 或固定评估套件与官方参考进行比较。
  5. 添加后训练或控制。 原始基础模型并不是安全的聊天助手;为预期用途定义提示、微调、调节和拒绝行为。
  6. 端到端基准测试。 记录加载时间、每秒令牌、第一个令牌的时间、批量吞吐量、内存、通信开销、功率、故障率和输出质量。
  7. 确保服务安全。 验证请求、隔离模型工作人员、限制输入长度和并发性、保护日志并阻止对管理端点的不受信任的访问。

可供比较的替代方案

替代路径为什么要比较决策标准
较新的开放权重密集模型更简单的服务和强大的指令调整变体相同硬件预算下的质量和吞吐量
较新的开放重量 MoE 模型通过更新的功能保留稀疏计算研究价值内核支持、活动参数、上下文、许可证和生态系统
xAI 主办 API无需操作 314B 检查点即可访问当前 Grok 模型任务成功、数据术语、区域可用性、延迟和成本
其他托管前沿 API更广泛的提供商和治理比较可接受的结果成本、工具、环境、安全、支持和转换风险
检索加较小模型基于已批准数据的较小模型可以在狭窄的工作中胜过大型基础模型证据准确性、延迟、可维护性和基础设施总成本

评估指标

  • 任务成功: 人工审核后接受的代表性任务的百分比。
  • 服务效率: 每个加速器每秒输出令牌数和有用批量大小的每瓦特输出令牌数。
  • 第一个令牌的时间: 排队后的交互延迟,包括路由和预填充。
  • 量化后的质量: 任务指标和失败模式相对于参考精度的变化。
  • 总成本: 硬件、电源、存储、网络、工程、停机时间以及根据已接受结果进行的审查。
  • 安全行为: 预期应用程序的有害完成、数据泄漏、提示注入和策略失败率。

如何验证转换或量化的检查点

大多数团队不会直接服务于原始的 JAX 检查点。转换可以重新排序张量、更改专家路由、更改分词器文件、选择不同的数值精度或引入特定于运行时的内核。不要通过阅读一项看似合理的完成来验证它。从文件清单和哈希开始,确认张量名称和形状,并将一组确定性的令牌 ID 和下一个令牌逻辑与选定层的官方参考或工具链允许的最终输出进行比较。

然后以预期的序列长度和批量大小运行固定的评估集。比较困惑或任务准确性、数值漂移、专家选择、重复、输出截断、语言行为和长提示下的失败。记录转换脚本提交、源检查点哈希、量化方法、校准数据、运行时版本、内核标志和硬件。将社区文件视为具有自己出处的单独构建工件,不能与 xAI 的版本互换。

许可和治理审查

Apache 2.0 是宽松的,但它并不能回答所有部署问题。保留所需的通知、文档修改,并根据实际分发模型审查专利和商标条款。存储库许可证适用于已发布的源代码和 Grok-1 权重;它不会自动许可应用程序数据、第三方库、社区转换、微调数据集、生成的品牌或下游系统检索的内容。

组织还应定义可接受的使用规则、评估所有权、事件响应、模型卡文档以及删除不安全或未经授权的微调数据的流程。如果模型暴露在外部,请发布与用户相关的限制:它是较旧的原始基础检查点,没有固有的当前数据访问权限,可能会生成不准确或有害的文本,并且依赖于应用程序级保护措施。

常见问题

Grok-1 是开源的吗?

xAI 在 Apache 2.0 下发布了 Grok-1 权重和存储库代码。 “开放权重”是更清晰的描述,因为该版本不包括完整的训练数据集或训练管道。查看存储库许可证的确切范围。

Grok-1 可以在普通电脑上运行吗?

不是通过官方参考路径。 314B 检查点需要非常大的内存,并且存储库警告其示例 MoE 实现效率不高。社区量化或卸载可能会降低要求,但会带来主要的性能和保真度权衡。

今天 grok.com 上使用的是 Grok-1 模型吗?

Grok-1 号是历史发布的检查点。当前的 xAI 文档标识了新一代 Grok 和更广泛的托管产品。

Grok-1 是否包含实时 X 数据?

不会。下载的检查点不会自动连接到 X、网络搜索或时事。检索和数据访问必须使用适当的权限单独构建。

Grok-1 指令是否已调整?

xAI 将发布描述为预训练后的原始基础模型,未针对对话或其他特定应用进行微调。

初创公司是否应该自行托管 Grok-1?

只有具有明确的研究或基础设施原因以及合适的硬件。大多数产品团队应该在接受 Grok-1 的运营负担之前对较新的较小开放模型进行基准测试并托管 API。

官方消息来源

上次审核日期为 2026 年 7 月 25 日。Grok-1 规范指的是 2024 年开放重量版本;当前的 Grok 型号、产品功能、计划和 API 可用性应单独验证。

Ready to try Grok-1?

Visit the official website to get started

Visit Grok-1

Quick Info

Added
1/21/2026
Published
1/21/2026
Updated
7/27/2026

Share This Tool

Have an AI tool to share?

Submit it to AI Dreamhub

Get your product in front of people actively exploring AI tools.

Submit Your Tool

Related Tools

DeepSeek-R1

DeepSeek-R1

DeepSeek's first-generation reasoning models. DeepSeek-R1-Zero, a model trained via large-scale reinforcement learning without supervised fine-tuning, demonstrated remarkable performance on reasoning. - 智能 AI 工具,助力您的工作效率。

open-source-llmfree
790
DeepSeek-V3

DeepSeek-V3

A strong Mixture-of-Experts (MoE) language model with 671B total parameters with 37B activated for each token. - 智能 AI 工具,助力您的工作效率。

open-source-llmfree
760
Qwen3

Qwen3

Qwen3 is the large language model series developed by Qwen team, Alibaba Cloud. - 智能 AI 工具,助力您的工作效率。

open-source-llmfree
770
Llama 3

Llama 3

Llama3 is a large language model developed by Meta AI. It is the successor to Meta's Llama2 language model. - 智能 AI 工具,助力您的工作效率。

open-source-llmfree
770