Grok-1
Grok-1
Active

Grok-1

Grok-1 est le modèle de base mélange d'experts Apache-2.0 314B à poids ouverts 2024 de xAI, et non l'assistant Grok actuel. Ce guide explique son architecture, la charge matérielle, les choix de déploiement, les alternatives et la pertinence historique.

48

Views

0

Likes

Jan 2026

Added

github.com

Website

Tags

open-source-llmfree

Editorial Review

About Grok-1

Grok-1 est le modèle de base de mélange d'experts de 314 milliards de paramètres que xAI a publié avec des pondérations ouvertes et un exemple de code JAX en mars 2024. Il s'agit d'une version de modèle historique pour les chercheurs et les équipes d'infrastructure, et non de l'assistant consommateur Grok actuel et non du modèle derrière chaque fonctionnalité xAI API actuelle. Depuis juin 2026, la documentation actuelle du produit Grok de xAI introduit Grok 4.5, tandis que son produit comprend également le chat, les fichiers, la voix, les connecteurs, la création d'images et de vidéos, ainsi que d'autres services qui n'existaient pas dans le point de contrôle Grok-1.

Cette distinction est le fait le plus important de la page. Le téléchargement de Grok-1 vous donne un point de contrôle brut de pré-entraînement qui, selon xAI, n'a pas été affiné pour le dialogue ou une autre application spécifique. Il ne recrée pas grok.com, les connaissances live X, les outils d'agent actuels, Grok Imagine, les systèmes de sécurité, l'hébergement ou le comportement des modèles propriétaires plus récents.

Hand-drawn Grok-1 mixture-of-experts diagram showing eight experts with two active for each token
Grok-1 achemine chaque jeton via deux des huit experts. Le point de contrôle complet contient 314 paramètres B, tandis qu'environ 25 % des poids sont actifs pour un jeton.

Grok-1 spécifications techniques

SpécificationVersion officielle Grok-1Signification pratique
Type de modèleModèle de langage de base brutNécessite une adaptation des tâches, des invites, une évaluation et un travail de sécurité avant le déploiement face à l'utilisateur
Paramètres totaux314BLes besoins en stockage et en mémoire des points de contrôle dépassent largement ceux d'un poste de travail classique
ArchitectureMélange de 8 expertsUn routeur sélectionne un sous-ensemble de chemins de transmission experts pour chaque jeton
Experts utilisés par jeton2, environ 25 % des poids actifsLe calcul actif est inférieur à celui d'un modèle 314B dense, mais tous les poids nécessitent toujours une stratégie de stockage et de service appropriée.
Calques64Pile de transformateurs profonde avec des exigences d'inférence distribuées substantielles
Attention48 têtes de requête, 8 têtes clé/valeurLes têtes clé/valeur regroupées réduisent une partie du coût de la mémoire d'attention
Taille d'intégration6,144Une grande représentation cachée contribue à la mémoire du modèle et au calcul
TokeniseurSentencePiece, vocabulaire de 131 072 jetonsLes applications doivent utiliser le tokenizer publié pour les ID de jeton compatibles
Longueur maximale de la séquence8 192 jetonsBeaucoup plus court que de nombreuses offres de modèles à contexte long plus récentes
Pile de référenceJAX exemple de code ; Sharding d'activation et prise en charge de la quantification 8 bitsLe référentiel démontre l'exactitude, pas un serveur de production optimisé
LicenceLicence Apache 2.0 pour la source du référentiel et les pondérations Grok-1Examinez la portée exacte de la licence ainsi que toutes les dépendances de tiers et les obligations d'utilisation en aval.

Les poids ouverts ne signifient pas prêts à fonctionner

Le référentiel de xAI avertit explicitement que l'implémentation mixte d'experts incluse est inefficace et a été choisie pour valider l'exactitude du modèle sans noyaux personnalisés. Le chemin de référence attend une machine avec suffisamment de mémoire GPU pour un point de contrôle 314B. Même avec des pondérations de 8 bits, le stockage de la pondération brute à lui seul est de l'ordre de centaines de gigaoctets avant la surcharge d'exécution, les caches, les tampons de structure, la réplication et la redondance. Les conversions de communauté de bits inférieurs peuvent réduire la mémoire mais peuvent modifier la précision et ne constituent pas le même artefact que le point de contrôle officiel de xAI.

Un déploiement sérieux nécessite un format de point de contrôle compatible, un plan de partitionnement, des noyaux MoE optimisés, une topologie d'accélérateur, un serveur de modèles, un service de tokenisation, une politique de traitement par lots, une stratégie de cache clé/valeur, une surveillance et une récupération. Mesurez le trafic d'interconnexion ainsi que l'utilisation individuelle des GPU : un routage expert entre les appareils peut transformer la communication en goulot d'étranglement.

Grok-1 par rapport au produit Grok actuel

CapacitéGrok-1 point de contrôle de poids ouvertProduit Grok actuel/API
ObjectifRecherche et expérimentation auto-hébergée avec un modèle de base de l'ère 2023Services actuels d'assistant et de développeur
Comportement de dialoguePas d'instructions ou de dialogues affinés dans le point de contrôle publiéPost-formation, invites, outils et garanties spécifiques au produit
Informations actuellesPas de récupération en direct intégrée ni d'accès XPeut inclure la recherche actuelle, le contexte X, les connecteurs ou les outils d'agent en fonction de la surface
MultimodalitéPublié en tant que modèle de base de texteFichiers de documents du produit actuel, voix, images, vidéo et fonctionnalités Grok Imagine
OpérationsVous fournissez le matériel, le service, la mise à l'échelle, la sécurité et la surveillancexAI exploite le service hébergé sous réserve des forfaits, des limites, des conditions et de la disponibilité.
Génération de modèleGrok-1Familles modèles plus récentes ; les documents actuels identifient Grok 4.5

Quand Grok-1 a encore du sens

  • Recherche du ministère de l'Éducation : inspectez une vaste architecture composée d'experts, le comportement de routage, le partitionnement et l'optimisation de l'inférence.
  • Etudes de reproduction : comparez le point de contrôle officiel et l'implémentation de référence avec les environnements d'exécution ou les conversions communautaires.
  • Évaluation historique : étudiez le comportement d'un point de contrôle pré-formation important de 2023 par rapport aux modèles ouverts ultérieurs dans le cadre d'un benchmark contrôlé.
  • Expériences d’infrastructure : tester les systèmes de chargement, de quantification, de placement d'experts et de service distribués lorsqu'un matériel approprié existe déjà.

Il s’agit généralement d’une mauvaise valeur par défaut pour une nouvelle application qui a simplement besoin d’un assistant auto-hébergé performant. Des modèles ouverts plus récents et plus petits peuvent offrir un meilleur suivi des instructions, un contexte plus long, une multimodalité, un service plus facile, une meilleure utilisation des outils et un coût total inférieur. La comparaison pertinente est la performance des tâches acceptée par unité de matériel et d'effort d'ingénierie, et non le nombre total de paramètres.

Liste de contrôle pour la décision de déploiement

  1. Définir la raison de la recherche ou du produit. Expliquez pourquoi Grok-1 est requis plutôt qu'un modèle dense ou MoE plus récent.
  2. Estimez l’empreinte totale. Incluez le point de contrôle téléchargé, les copies converties, la mémoire, le cache clé/valeur, le stockage temporaire, les répliques et la sauvegarde.
  3. Sélectionnez une implémentation de diffusion. Vérifiez qu'il prend en charge l'architecture exacte, le tokeniseur, la quantification, le routage expert et le matériel cible.
  4. Validez la conversion. Comparez les logits ou une suite d'évaluation fixe avec la référence officielle avant de faire confiance à un point de contrôle converti.
  5. Ajoutez une post-formation ou des contrôles. Un modèle de base brut n'est pas un assistant de discussion sécurisé ; définir les comportements d'incitation, de réglage, de modération et de refus pour l'utilisation prévue.
  6. Benchmark de bout en bout. Enregistrez le temps de chargement, les jetons par seconde, le temps jusqu'au premier jeton, le débit des lots, la mémoire, la surcharge de communication, la puissance, le taux de défaillance et la qualité de sortie.
  7. Sécurisez le service. Authentifiez les requêtes, isolez les travailleurs du modèle, limitez la longueur des entrées et la simultanéité, protégez les journaux et bloquez les accès non fiables aux points de terminaison de gestion.

Alternatives à comparer

Chemin alternatifPourquoi le comparerCritère de décision
Nouveau modèle dense à poids ouvertService plus simple et variantes adaptées aux instructionsQualité et débit avec le même budget matériel
Nouveau modèle MoE à poids ouvertConserve la valeur de la recherche par calcul clairsemé avec des fonctionnalités plus récentesPrise en charge du noyau, paramètres actifs, contexte, licence et écosystème
xAI hébergé APIAccès aux modèles Grok actuels sans utiliser de point de contrôle 314BSuccès des tâches, conditions des données, disponibilité régionale, latence et coût
Autre frontière hébergée APIComparaison plus large des fournisseurs et de la gouvernanceCoût du résultat accepté, outils, contexte, sécurité, support et risque de changement
Récupération et modèle plus petitUn modèle plus petit fondé sur des données approuvées peut surpasser un modèle de base de grande taille sur un travail restreint.Exactitude des preuves, latence, maintenabilité et coût total de l'infrastructure

Paramètres d'évaluation

  • Succès de la tâche : pourcentage de tâches représentatives acceptées après examen humain.
  • Efficacité du service : jetons de sortie par seconde par accélérateur et par watt à des tailles de lots utiles.
  • Temps jusqu'au premier jeton : délai interactif après la mise en file d'attente, y compris le routage et le pré-remplissage.
  • Qualité après quantification : changement dans les métriques de tâches et les modèles d’échec par rapport à la précision de référence.
  • Coût total : matériel, alimentation, stockage, mise en réseau, ingénierie, temps d'arrêt et examen par résultat accepté.
  • Comportement de sécurité : taux d'achèvement nuisibles, de fuite de données, d'injection rapide et d'échec des politiques pour l'application prévue.

Comment valider un point de contrôle converti ou quantifié

La plupart des équipes ne desserviront pas directement le point de contrôle d'origine JAX. Une conversion peut réorganiser les tenseurs, modifier le routage expert, modifier les fichiers de tokenizer, sélectionner une précision numérique différente ou introduire des noyaux spécifiques à l'exécution. Ne le validez pas en lisant un achèvement plausible. Commencez par les manifestes et les hachages de fichiers, confirmez les noms et les formes des tenseurs et comparez un ensemble déterministe d'ID de jeton et de logits de jeton suivant avec la référence officielle au niveau des couches sélectionnées ou de la sortie finale lorsque la chaîne d'outils le permet.

Exécutez ensuite un ensemble d’évaluation fixe aux longueurs de séquence et aux tailles de lots prévues. Comparez la perplexité ou la précision des tâches, la dérive numérique, la sélection d'experts, la répétition, la troncature des résultats, le comportement du langage et l'échec sous de longues invites. Enregistrez la validation du script de conversion, le hachage du point de contrôle source, la méthode de quantification, les données d'étalonnage, la version d'exécution, les indicateurs du noyau et le matériel. Traitez un fichier de communauté comme un artefact de construction distinct avec sa propre provenance, et non comme interchangeable avec la version de xAI.

Examen des licences et de la gouvernance

Apache 2.0 est permissif, mais il ne répond pas à toutes les questions de déploiement. Conservez les avis requis, documentez les modifications et examinez les clauses des brevets et des marques avec le modèle de distribution actuel. La licence du référentiel s'applique à la source publiée et aux poids Grok-1 ; il n'accorde pas automatiquement de licence aux données d'application, aux bibliothèques tierces, aux conversions de communauté, aux ensembles de données de réglage fin, à la marque générée ou au contenu récupéré par un système en aval.

Les organisations doivent également définir des règles d'utilisation acceptable, la propriété de l'évaluation, la réponse aux incidents, la documentation du modèle de carte et un processus de suppression des données de réglage fin dangereuses ou non autorisées. Si le modèle est exposé en externe, publiez les limitations pertinentes pour les utilisateurs : il s'agit d'un point de contrôle de base brut plus ancien, n'a pas d'accès inhérent aux données actuelles, peut générer du texte inexact ou nuisible et dépend des protections au niveau de l'application.

Questions fréquemment posées

Grok-1 est-il open source ?

xAI a publié les poids Grok-1 et le code du référentiel sous Apache 2.0. « Pondérations ouvertes » est la description la plus claire, car la version n'inclut pas l'ensemble de données d'entraînement complet ni le pipeline d'entraînement. Consultez la licence du référentiel pour connaître la portée exacte.

Grok-1 peut-il fonctionner sur un PC normal ?

Pas via le chemin de référence officiel. Le point de contrôle 314B nécessite une très grande mémoire et le référentiel prévient que son exemple d'implémentation MoE n'est pas efficace. La quantification ou le déchargement communautaire peuvent réduire les exigences mais introduisent des compromis majeurs en matière de performances et de fidélité.

Grok-1 est-il le modèle utilisé sur grok.com aujourd'hui ?

Non. Grok-1 est un point de contrôle publié historiquement. La documentation actuelle xAI identifie les nouvelles générations de Grok et un produit hébergé beaucoup plus large.

Grok-1 inclut-il des données X en temps réel ?

Non. Le point de contrôle téléchargé n'a pas de connexion automatique à X, à la recherche sur le Web ou aux événements actuels. La récupération et l'accès aux données doivent être construits séparément avec les autorisations appropriées.

L’instruction Grok-1 est-elle réglée ?

xAI décrit la version comme le modèle de base brut après la pré-formation, non affiné pour le dialogue ou une autre application spécifique.

Une startup devrait-elle héberger elle-même Grok-1 ?

Uniquement avec une raison claire de recherche ou d’infrastructure et un matériel approprié. La plupart des équipes produit devraient comparer les nouveaux modèles ouverts plus petits et les API hébergés avant d'accepter la charge opérationnelle de Grok-1.

Sources officielles

Dernière révision le 25 juillet 2026. Les spécifications Grok-1 font référence à la version à poids ouvert de 2024 ; Les modèles Grok actuels, les caractéristiques du produit, les plans et la disponibilité API doivent être vérifiés séparément.

Ready to try Grok-1?

Visit the official website to get started

Visit Grok-1

Quick Info

Added
1/21/2026
Published
1/21/2026
Updated
7/25/2026

Share This Tool

Have an AI tool to share?

Submit it to AI Dreamhub

Get your product in front of people actively exploring AI tools.

Submit Your Tool

Related Tools

DeepSeek-R1

DeepSeek-R1

DeepSeek's first-generation reasoning models. DeepSeek-R1-Zero, a model trained via large-scale reinforcement learning without supervised fine-tuning, demonstrated remarkable performance on reasoning. - Outil IA intelligent pour améliorer votre productivité.

open-source-llmfree
570
DeepSeek-V3

DeepSeek-V3

A strong Mixture-of-Experts (MoE) language model with 671B total parameters with 37B activated for each token. - Outil IA intelligent pour améliorer votre productivité.

open-source-llmfree
520
Qwen3

Qwen3

Qwen3 is the large language model series developed by Qwen team, Alibaba Cloud. - Outil IA intelligent pour améliorer votre productivité.

open-source-llmfree
580
Llama 3

Llama 3

Llama3 is a large language model developed by Meta AI. It is the successor to Meta's Llama2 language model. - Outil IA intelligent pour améliorer votre productivité.

open-source-llmfree
650