Grok-1 est le modèle de base de mélange d'experts de 314 milliards de paramètres que xAI a publié avec des pondérations ouvertes et un exemple de code JAX en mars 2024. Il s'agit d'une version de modèle historique pour les chercheurs et les équipes d'infrastructure, et non de l'assistant consommateur Grok actuel et non du modèle derrière chaque fonctionnalité xAI API actuelle. Depuis juin 2026, la documentation actuelle du produit Grok de xAI introduit Grok 4.5, tandis que son produit comprend également le chat, les fichiers, la voix, les connecteurs, la création d'images et de vidéos, ainsi que d'autres services qui n'existaient pas dans le point de contrôle Grok-1.
Cette distinction est le fait le plus important de la page. Le téléchargement de Grok-1 vous donne un point de contrôle brut de pré-entraînement qui, selon xAI, n'a pas été affiné pour le dialogue ou une autre application spécifique. Il ne recrée pas grok.com, les connaissances live X, les outils d'agent actuels, Grok Imagine, les systèmes de sécurité, l'hébergement ou le comportement des modèles propriétaires plus récents.
Grok-1 spécifications techniques
| Spécification | Version officielle Grok-1 | Signification pratique |
|---|---|---|
| Type de modèle | Modèle de langage de base brut | Nécessite une adaptation des tâches, des invites, une évaluation et un travail de sécurité avant le déploiement face à l'utilisateur |
| Paramètres totaux | 314B | Les besoins en stockage et en mémoire des points de contrôle dépassent largement ceux d'un poste de travail classique |
| Architecture | Mélange de 8 experts | Un routeur sélectionne un sous-ensemble de chemins de transmission experts pour chaque jeton |
| Experts utilisés par jeton | 2, environ 25 % des poids actifs | Le calcul actif est inférieur à celui d'un modèle 314B dense, mais tous les poids nécessitent toujours une stratégie de stockage et de service appropriée. |
| Calques | 64 | Pile de transformateurs profonde avec des exigences d'inférence distribuées substantielles |
| Attention | 48 têtes de requête, 8 têtes clé/valeur | Les têtes clé/valeur regroupées réduisent une partie du coût de la mémoire d'attention |
| Taille d'intégration | 6,144 | Une grande représentation cachée contribue à la mémoire du modèle et au calcul |
| Tokeniseur | SentencePiece, vocabulaire de 131 072 jetons | Les applications doivent utiliser le tokenizer publié pour les ID de jeton compatibles |
| Longueur maximale de la séquence | 8 192 jetons | Beaucoup plus court que de nombreuses offres de modèles à contexte long plus récentes |
| Pile de référence | JAX exemple de code ; Sharding d'activation et prise en charge de la quantification 8 bits | Le référentiel démontre l'exactitude, pas un serveur de production optimisé |
| Licence | Licence Apache 2.0 pour la source du référentiel et les pondérations Grok-1 | Examinez la portée exacte de la licence ainsi que toutes les dépendances de tiers et les obligations d'utilisation en aval. |
Les poids ouverts ne signifient pas prêts à fonctionner
Le référentiel de xAI avertit explicitement que l'implémentation mixte d'experts incluse est inefficace et a été choisie pour valider l'exactitude du modèle sans noyaux personnalisés. Le chemin de référence attend une machine avec suffisamment de mémoire GPU pour un point de contrôle 314B. Même avec des pondérations de 8 bits, le stockage de la pondération brute à lui seul est de l'ordre de centaines de gigaoctets avant la surcharge d'exécution, les caches, les tampons de structure, la réplication et la redondance. Les conversions de communauté de bits inférieurs peuvent réduire la mémoire mais peuvent modifier la précision et ne constituent pas le même artefact que le point de contrôle officiel de xAI.
Un déploiement sérieux nécessite un format de point de contrôle compatible, un plan de partitionnement, des noyaux MoE optimisés, une topologie d'accélérateur, un serveur de modèles, un service de tokenisation, une politique de traitement par lots, une stratégie de cache clé/valeur, une surveillance et une récupération. Mesurez le trafic d'interconnexion ainsi que l'utilisation individuelle des GPU : un routage expert entre les appareils peut transformer la communication en goulot d'étranglement.
Grok-1 par rapport au produit Grok actuel
| Capacité | Grok-1 point de contrôle de poids ouvert | Produit Grok actuel/API |
|---|---|---|
| Objectif | Recherche et expérimentation auto-hébergée avec un modèle de base de l'ère 2023 | Services actuels d'assistant et de développeur |
| Comportement de dialogue | Pas d'instructions ou de dialogues affinés dans le point de contrôle publié | Post-formation, invites, outils et garanties spécifiques au produit |
| Informations actuelles | Pas de récupération en direct intégrée ni d'accès X | Peut inclure la recherche actuelle, le contexte X, les connecteurs ou les outils d'agent en fonction de la surface |
| Multimodalité | Publié en tant que modèle de base de texte | Fichiers de documents du produit actuel, voix, images, vidéo et fonctionnalités Grok Imagine |
| Opérations | Vous fournissez le matériel, le service, la mise à l'échelle, la sécurité et la surveillance | xAI exploite le service hébergé sous réserve des forfaits, des limites, des conditions et de la disponibilité. |
| Génération de modèle | Grok-1 | Familles modèles plus récentes ; les documents actuels identifient Grok 4.5 |
Quand Grok-1 a encore du sens
- Recherche du ministère de l'Éducation : inspectez une vaste architecture composée d'experts, le comportement de routage, le partitionnement et l'optimisation de l'inférence.
- Etudes de reproduction : comparez le point de contrôle officiel et l'implémentation de référence avec les environnements d'exécution ou les conversions communautaires.
- Évaluation historique : étudiez le comportement d'un point de contrôle pré-formation important de 2023 par rapport aux modèles ouverts ultérieurs dans le cadre d'un benchmark contrôlé.
- Expériences d’infrastructure : tester les systèmes de chargement, de quantification, de placement d'experts et de service distribués lorsqu'un matériel approprié existe déjà.
Il s’agit généralement d’une mauvaise valeur par défaut pour une nouvelle application qui a simplement besoin d’un assistant auto-hébergé performant. Des modèles ouverts plus récents et plus petits peuvent offrir un meilleur suivi des instructions, un contexte plus long, une multimodalité, un service plus facile, une meilleure utilisation des outils et un coût total inférieur. La comparaison pertinente est la performance des tâches acceptée par unité de matériel et d'effort d'ingénierie, et non le nombre total de paramètres.
Liste de contrôle pour la décision de déploiement
- Définir la raison de la recherche ou du produit. Expliquez pourquoi Grok-1 est requis plutôt qu'un modèle dense ou MoE plus récent.
- Estimez l’empreinte totale. Incluez le point de contrôle téléchargé, les copies converties, la mémoire, le cache clé/valeur, le stockage temporaire, les répliques et la sauvegarde.
- Sélectionnez une implémentation de diffusion. Vérifiez qu'il prend en charge l'architecture exacte, le tokeniseur, la quantification, le routage expert et le matériel cible.
- Validez la conversion. Comparez les logits ou une suite d'évaluation fixe avec la référence officielle avant de faire confiance à un point de contrôle converti.
- Ajoutez une post-formation ou des contrôles. Un modèle de base brut n'est pas un assistant de discussion sécurisé ; définir les comportements d'incitation, de réglage, de modération et de refus pour l'utilisation prévue.
- Benchmark de bout en bout. Enregistrez le temps de chargement, les jetons par seconde, le temps jusqu'au premier jeton, le débit des lots, la mémoire, la surcharge de communication, la puissance, le taux de défaillance et la qualité de sortie.
- Sécurisez le service. Authentifiez les requêtes, isolez les travailleurs du modèle, limitez la longueur des entrées et la simultanéité, protégez les journaux et bloquez les accès non fiables aux points de terminaison de gestion.
Alternatives à comparer
| Chemin alternatif | Pourquoi le comparer | Critère de décision |
|---|---|---|
| Nouveau modèle dense à poids ouvert | Service plus simple et variantes adaptées aux instructions | Qualité et débit avec le même budget matériel |
| Nouveau modèle MoE à poids ouvert | Conserve la valeur de la recherche par calcul clairsemé avec des fonctionnalités plus récentes | Prise en charge du noyau, paramètres actifs, contexte, licence et écosystème |
| xAI hébergé API | Accès aux modèles Grok actuels sans utiliser de point de contrôle 314B | Succès des tâches, conditions des données, disponibilité régionale, latence et coût |
| Autre frontière hébergée API | Comparaison plus large des fournisseurs et de la gouvernance | Coût du résultat accepté, outils, contexte, sécurité, support et risque de changement |
| Récupération et modèle plus petit | Un modèle plus petit fondé sur des données approuvées peut surpasser un modèle de base de grande taille sur un travail restreint. | Exactitude des preuves, latence, maintenabilité et coût total de l'infrastructure |
Paramètres d'évaluation
- Succès de la tâche : pourcentage de tâches représentatives acceptées après examen humain.
- Efficacité du service : jetons de sortie par seconde par accélérateur et par watt à des tailles de lots utiles.
- Temps jusqu'au premier jeton : délai interactif après la mise en file d'attente, y compris le routage et le pré-remplissage.
- Qualité après quantification : changement dans les métriques de tâches et les modèles d’échec par rapport à la précision de référence.
- Coût total : matériel, alimentation, stockage, mise en réseau, ingénierie, temps d'arrêt et examen par résultat accepté.
- Comportement de sécurité : taux d'achèvement nuisibles, de fuite de données, d'injection rapide et d'échec des politiques pour l'application prévue.
Comment valider un point de contrôle converti ou quantifié
La plupart des équipes ne desserviront pas directement le point de contrôle d'origine JAX. Une conversion peut réorganiser les tenseurs, modifier le routage expert, modifier les fichiers de tokenizer, sélectionner une précision numérique différente ou introduire des noyaux spécifiques à l'exécution. Ne le validez pas en lisant un achèvement plausible. Commencez par les manifestes et les hachages de fichiers, confirmez les noms et les formes des tenseurs et comparez un ensemble déterministe d'ID de jeton et de logits de jeton suivant avec la référence officielle au niveau des couches sélectionnées ou de la sortie finale lorsque la chaîne d'outils le permet.
Exécutez ensuite un ensemble d’évaluation fixe aux longueurs de séquence et aux tailles de lots prévues. Comparez la perplexité ou la précision des tâches, la dérive numérique, la sélection d'experts, la répétition, la troncature des résultats, le comportement du langage et l'échec sous de longues invites. Enregistrez la validation du script de conversion, le hachage du point de contrôle source, la méthode de quantification, les données d'étalonnage, la version d'exécution, les indicateurs du noyau et le matériel. Traitez un fichier de communauté comme un artefact de construction distinct avec sa propre provenance, et non comme interchangeable avec la version de xAI.
Examen des licences et de la gouvernance
Apache 2.0 est permissif, mais il ne répond pas à toutes les questions de déploiement. Conservez les avis requis, documentez les modifications et examinez les clauses des brevets et des marques avec le modèle de distribution actuel. La licence du référentiel s'applique à la source publiée et aux poids Grok-1 ; il n'accorde pas automatiquement de licence aux données d'application, aux bibliothèques tierces, aux conversions de communauté, aux ensembles de données de réglage fin, à la marque générée ou au contenu récupéré par un système en aval.
Les organisations doivent également définir des règles d'utilisation acceptable, la propriété de l'évaluation, la réponse aux incidents, la documentation du modèle de carte et un processus de suppression des données de réglage fin dangereuses ou non autorisées. Si le modèle est exposé en externe, publiez les limitations pertinentes pour les utilisateurs : il s'agit d'un point de contrôle de base brut plus ancien, n'a pas d'accès inhérent aux données actuelles, peut générer du texte inexact ou nuisible et dépend des protections au niveau de l'application.
Questions fréquemment posées
Grok-1 est-il open source ?
xAI a publié les poids Grok-1 et le code du référentiel sous Apache 2.0. « Pondérations ouvertes » est la description la plus claire, car la version n'inclut pas l'ensemble de données d'entraînement complet ni le pipeline d'entraînement. Consultez la licence du référentiel pour connaître la portée exacte.
Grok-1 peut-il fonctionner sur un PC normal ?
Pas via le chemin de référence officiel. Le point de contrôle 314B nécessite une très grande mémoire et le référentiel prévient que son exemple d'implémentation MoE n'est pas efficace. La quantification ou le déchargement communautaire peuvent réduire les exigences mais introduisent des compromis majeurs en matière de performances et de fidélité.
Grok-1 est-il le modèle utilisé sur grok.com aujourd'hui ?
Non. Grok-1 est un point de contrôle publié historiquement. La documentation actuelle xAI identifie les nouvelles générations de Grok et un produit hébergé beaucoup plus large.
Grok-1 inclut-il des données X en temps réel ?
Non. Le point de contrôle téléchargé n'a pas de connexion automatique à X, à la recherche sur le Web ou aux événements actuels. La récupération et l'accès aux données doivent être construits séparément avec les autorisations appropriées.
L’instruction Grok-1 est-elle réglée ?
xAI décrit la version comme le modèle de base brut après la pré-formation, non affiné pour le dialogue ou une autre application spécifique.
Une startup devrait-elle héberger elle-même Grok-1 ?
Uniquement avec une raison claire de recherche ou d’infrastructure et un matériel approprié. La plupart des équipes produit devraient comparer les nouveaux modèles ouverts plus petits et les API hébergés avant d'accepter la charge opérationnelle de Grok-1.
Sources officielles
- xAI : version ouverte de Grok-1
- Dépôt officiel xai-org/grok-1 et spécifications du modèle
- Grok-1 Texte de la licence Apache 2.0
- Aperçu actuel des produits Grok
- Annonce originale de Grok et Grok-1
- Livre de recettes officiel xAI API
Dernière révision le 25 juillet 2026. Les spécifications Grok-1 font référence à la version à poids ouvert de 2024 ; Les modèles Grok actuels, les caractéristiques du produit, les plans et la disponibilité API doivent être vérifiés séparément.
