Poids de Mistral Large 4 et guide Hugging Face
Suivez la sortie des poids prévue, consultez la fiche modèle et estimez les besoins de téléchargement et de déploiement.
Sur cette page
Statut de publication
L'annonce officielle d'octobre 6 prévoit la mise à disposition des poids ouverts pour la fin octobre. Ce calendrier ne prouve pas que les fichiers sont déjà disponibles. Consultez l'annonce officielle et l'organisation Hugging Face de Mistral AI pour trouver le dépôt du modèle.
Identifier le bon dépôt
Vérifiez l'éditeur, l'identifiant exact du modèle et la révision. Un nom de dépôt seul ne garantit pas qu'il est officiel. Lisez la fiche du modèle, l'architecture prise en charge et la liste des fichiers. Épinglez un commit ou une révision plutôt que de déployer une branche mobile.
Avant de télécharger
Vérifiez la licence dans le dépôt publié ; ne supposez pas une licence d'un modèle antérieur. Inspectez les sommes de contrôle et les tailles attendues des fichiers. Calculez la capacité disque pour les poids originaux, les artefacts de conversion, le cache et la copie de restauration. N'exécutez jamais de scripts provenant d'un miroir non vérifié.
Estimation mémoire
Un modèle de 1.05T paramètres nécessite environ 2.1 To à deux octets par paramètre, 1.05 To à un octet ou 525 Go à un demi-octet. Il s'agit d'estimations arithmétiques portant uniquement sur les poids, et non de configurations GPU testées. Les métadonnées de quantification, le routage, le cache KV et la surcharge d'exécution augmentent le total. Les paramètres actifs ne réduisent pas le besoin de stocker l'ensemble des poids des experts.
Préparation du framework
Confirmez que votre environnement d'exécution prend en charge l'architecture et le format de quantification exacts. Testez la compatibilité du tokenizer, le placement des experts, le traitement d'images et la communication multi-appareils. Utilisez une invite courte et une image connue avant de tenter un long contexte.
Liste de contrôle du déploiement
- Notez la révision du dépôt et la licence.
- Vérifiez les fichiers téléchargés avant conversion.
- Mesurez la mémoire, la latence et le débit avec des entrées réalistes.
- Définissez des limites de requêtes et un comportement d'annulation.
- Gardez les identifiants hors du code public et ne journalisez que les diagnostics nécessaires.
Si les poids ne sont pas disponibles
Utilisez l'API officielle pour vos expériences si vous y avez accès. Cet espace de travail ne distribue pas de poids et n'a pas évalué de déploiement auto-hébergé de Large 4. Lisez notre guide de déploiement local avant de budgéter le matériel.
Essayez une tâche de votre propre travail.
Apportez le matériel source et vérifiez le résultat.
Ouvrir l'espace de travail