IAboutique

La série légère & efficace

Mistral en local.

Mistral 7B c'est l'assistant rapide. Mistral Small 24B, c'est du professionnel léger. Cette série française brille par son efficacité : peu de mémoire, beaucoup de qualité. Ce guide vous dit quelle machine, à quel débit, pour quel usage.

La gamme Mistral

De 7B à 24B : quelle est la différence ?

Mistral publie deux modèles vedettes : Mistral 7B et Mistral Small 24B.

Mistral 7B, c'est 7 milliards de paramètres — un poids léger. Mémoire requise : 4–6 Go. C'est l'assistant du quotidien : chat, rédaction, résumés, traduction, traitement de texte. Très rapide, peu gourmand. Parfait pour débuter ou pour un déploiement massif (un modèle par poste de travail).

Mistral Small 24B, c'est 24 milliards de paramètres — la couche au-dessus. Mémoire requise : 12–16 Go. La qualité monte d'un cran : meilleure compréhension des documents, plus fin, capable de gérer du RAG (brancher vos dossiers à l'IA) sans ralentissement.

Mistral propose aussi des variantes (Large, etc.), mais nos configurations couvrent les deux vedettes — assez pour 90 % des usages.

De la RAM au débit

Combien de mémoire ? Combien de vitesse ?

Mistral 7B quantifié (Q4) = 4–6 Go de mémoire. Mistral Small 24B quantifié = 12–16 Go. Ce sont les chiffres nus, pas la marge. Lors de l'inférence, le contexte, la génération et la marge de sécurité peuvent doubler ces chiffres.

Nos configurations intègrent cette marge : 16 Go pour du 7B (tranquille), 32–64 Go pour du 24B. Ça parait paradoxal, mais c'est l'assurance qualité — pas d'échanges disque, pas de gel, pas de surprise.

Le débit (tokens/sec) dépend de la bande passante mémoire. Une carte graphique dédiée sera plus rapide qu'un GPU intégré, mais la différence vraie, c'est la largeur mémoire. Chaque configuration reçoit un benchmark signé au banc de recette— le débit annoncé, c'est le vôtre, pas une promesse.

Les configurations qui tournent du Mistral

Trois chemins, du starter au professionnel.

STARTER 8B

Mistral 7B + Llama 8B

Station compacte avec RTX 5060 Ti 16 Go et 32 Go de RAM système. Parfait pour un premier assistant local, la rédaction, le chat. Tous les modèles petits (7B, 8B) y tournent confortablement. Le choix des indépendants et des PME qui commencent.

PRO 32B

Mistral Small 24B + Qwen 32B + RAG

Mini-PC professionnel : Ryzen AI Max+ 395, 64 Go mémoire unifiée. Mistral Small 24B brille ici — interrogez vos dossiers en langage naturel, le RAG vous répond sur VOS documents. C'est la machine des équipes support, juridique, RH.

CREATOR 14B

14B texte + images SDXL/Flux

Si vous préférez une GPU dédiée sur un châssis plus standard. RTX 5070 Ti 16 Go, 64 Go RAM. C'est rapide, et vous bénéficiez de la génération d'images locale (SDXL, Flux). Pour les créatifs qui veulent texte + image dans une même machine.

Comment vous l'utiliserez

Cas d'usage concrets : à quoi ressemble un jour normal.

Chat & rédaction (7B)

Vous ouvrez Open WebUI. Vous tapez « Rédige-moi un mail professionnel pour proposer un devis ». Mistral 7B répond en 3–4 secondes — avec une qualité qui plaît. Pas d'API, pas de token, pas d'abonnement.

RAG documentaire (24B)

Vous importez 50 pages de documentation interne. Vous posez « Quelle est la proc de congé parental ? ». Mistral Small 24B lit vos documents, extrait la réponse, cite la source — tout chez vous. C'est le RAG.

Aide au code (7B en rapide, 24B en nuancé)

Vous branchez VS Code sur votre machine locale (extension Continue). Mistral vous propose de compléter votre code. Le 7B sera rapide et bon pour 80 % des cas ; le 24B, plus nuancé, pour les architectures complexes.

Traduction & normalisation (7B)

Vos e-mails clients arrivent en 3 langues. Mistral 7B en local trie, traduit, formate — une mission répétitive, aucune confidentialité blessée, aucune facture.

Premiers pas

Installer Mistral en 3 étapes

Si vous avez une machine IAboutique, tout est déjà prêt à la livraison — passez l'étape installation. Si vous arrivez par vos propres ressources :

1. Installez Ollama (ollama.com). Téléchargez l'exécutable pour votre système (macOS, Windows, Linux), lancez-le. Ollama crée un petit daemon local qui gère l'accès aux modèles.

2. Lancez le pull : ollama pull mistral(ou ollama pull mistral-small si vous préférez le 24B). Ollama télécharge le modèle quantifié (~4 Go pour Mistral 7B, ~9 Go pour Small 24B) et le cache localement.

3. Ouvrez l'interface web : visitez localhost:11434 ou installez Open WebUI (openwebui.com) pour un UI plus riche. Commencez à discuter avec Mistral — pas d'API, pas de token, pas d'abonnement. Tout chez vous, tout gratuit.

Sur une machine IAboutique, ces trois étapes sont déjà complétées et testées à la livraison. Ollamа est en service, les modèles commandés sont téléchargés, et Open WebUI est configuré pour votre usage.

Les trois questions qui reviennent

Mini-FAQ

Mistral 7B ou Mistral Small 24B : comment choisir ?

Mistral 7B si vous cherchez la vitesse et la légèreté — chat, rédaction rapide, chat machine avec peu de VRAM. Mistral Small 24B si vous faites du RAG professionnel ou que vous interrogez de longs documents. La différence de coût machine (16 Go vs 64 Go) vaut bien la montée en qualité si vous en avez besoin.

Quelle est la latence d'une réponse avec Mistral local ?

Comptez 1–2 secondes pour le traitement initial (le modèle charge le contexte). Ensuite, la génération est très rapide — moins d'une seconde par phrase en général. Contrairement au cloud, vous n'êtes jamais bloqué par une file d'attente ou un quota.

Peut-on déployer Mistral sur plusieurs machines en même temps ?

Oui. Vous achetez 5 STARTER 8B, vous installez Mistral 7B sur chacune — plus de 50 utilisateurs servis en parallèle, sans partage de ressource. Chaque machine reste 100 % locale et indépendante. C'est le modèle des grandes équipes distribuées.

Déployer Mistral localement ?

Mistral, c'est l'efficacité made in France. Trouvez la configuration qui convient à votre débit et votre budget en 5 minutes.