Grout télécharge les modèles d'IA une fois, puis les exécute sur votre propre machine. Aucune requête ne quitte l'appareil, rien n'est facturé au prompt, et le studio continue de fonctionner quand le Wi-Fi de l'école s'arrête.
Six choses changent dès que le modèle quitte le serveur de quelqu'un d'autre pour arriver sur votre bureau.
Un Wi-Fi scolaire filtré, un trajet en train, une coupure de courant en pleine semaine d'examens : rien de tout cela n'arrête le studio une fois les modèles téléchargés.
Les prompts, les photos de devoirs, les brouillons et le code restent sur la machine. Aucun envoi à auditer, aucune durée de conservation à négocier, aucun entraînement sur le travail des élèves.
L'inférence locale se paie en électricité, pas en jetons. Une classe de trente peut itérer autant qu'elle veut sans limite de débit partagée ni facture qui grimpe avec la curiosité.
Un modèle local répond au rythme de votre machine, pas à celui d'un serveur partagé à 9 h du matin, quand tous les établissements du fuseau horaire démarrent en même temps.
Aucun compte élève à créer et aucun sous-traitant tiers dans la chaîne : l'analyse de protection des données d'un établissement en devient nettement plus courte.
Le studio et ses modèles voyagent avec le portable. Sortie de terrain, vol en avion, campus rural en 3G : les capacités ne changent pas.
Un outil d'IA dans le cloud est un client léger. Vous tapez, le texte part vers un centre de données, un très gros modèle calcule une réponse, et la réponse revient. Votre appareil ne fait presque rien : d'où le besoin d'un réseau, d'un compte et d'une relation de facturation.
L'IA locale déplace le modèle vers vous. Les poids — les nombres qui encodent ce que le modèle sait — sont téléchargés une fois sous forme de fichier, en général entre quelques centaines de mégaoctets et quelques gigaoctets selon la taille et la quantification. Ensuite, votre processeur, votre carte graphique ou le moteur neuronal Apple Silicon fait le calcul directement.
Les modèles locaux sont plus petits que les modèles de pointe du cloud : sur certains problèmes de raisonnement difficiles, le cloud garde l'avantage. Ce que vous obtenez en échange compte :
Les poids d'un modèle sont généralement stockés en précision réduite — 4 bits ou 8 bits au lieu de 16 — ce qui réduit la taille du fichier et la mémoire nécessaire, au prix d'une perte de qualité faible et le plus souvent imperceptible. C'est la technique qui, à elle seule, permet à un modèle capable de tenir sur un portable scolaire. Grout choisit la quantification adaptée à votre machine : vous n'avez rien de tout cela à apprendre pour l'utiliser.
Un ordre de grandeur. Grout détecte votre machine et vous propose ce qu'elle peut encaisser.
| Machine | Modèles de texte | Vision et images | Export vidéo |
|---|---|---|---|
| Portable scolaire, 8 Go de RAM | Petits modèles, rapides | OCR de vision, génération légère | 1080p, plus lent |
| Portable récent, 16 Go de RAM | Petits et moyens modèles | Vision complète, génération d'images | 1080p, confortable |
| Apple Silicon ou GPU dédié | Gros modèles | Génération et agrandissement rapides | 4K, accéléré par le matériel |
L'inférence locale sollicite la batterie bien plus qu'un onglet de navigateur. Branchez la machine pour les longues séries de génération.
L'IA hors ligne signifie que le modèle lui-même s'exécute sur votre propre ordinateur plutôt que sur un serveur distant. Vous téléchargez les poids du modèle une fois, et chaque prompt est ensuite calculé en local par votre processeur ou votre carte graphique. Aucune requête ne quitte la machine, donc l'outil continue de fonctionner sans connexion réseau.
Pour le travail que les élèves font réellement — résumer, expliquer, structurer un plan, extraire du texte d'une image, générer un schéma, écrire un petit programme — un bon modèle local est véritablement compétitif, et il répond instantanément, sans quota. Les plus gros modèles de pointe gardent l'avantage sur les longues chaînes de raisonnement difficiles. Grout traite cette répartition honnêtement : local par défaut, avec des modèles Premium dans le cloud via les Merits quand une tâche l'exige vraiment.
Un portable de milieu de gamme des dernières années suffit pour les petits et moyens modèles. Grout détecte la machine et recommande des tailles de modèles qui tourneront confortablement dessus : un portable scolaire obtient un studio utilisable plutôt qu'un message d'erreur. Plus de RAM et une carte graphique dédiée ou Apple Silicon débloquent les plus gros modèles et une génération d'images plus rapide.
Oui : un modèle doit être récupéré une fois, ce qui demande une connexion. Ensuite, c'est un fichier sur votre disque, utilisable indéfiniment hors ligne. Les établissements pré-téléchargent souvent les modèles dans l'image système des portables pour que les appareils arrivent prêts à l'emploi.
Structurellement, oui. Le principal risque de l'IA dans le cloud est que le travail d'un enfant soit transmis à un tiers et stocké par lui. L'inférence locale supprime entièrement ce transfert : c'est une position bien plus facile à défendre devant des parents comme devant un délégué à la protection des données.
Téléchargez une fois, puis travaillez hors ligne aussi longtemps que vous voulez. Sans compte, sans quota, sans envoi.
Télécharger Grout gratuitement