Technik
Welche Offline-KI-Modelle sich auf einem Schul-Laptop lohnen
Sie brauchen keine Workstation. Sie brauchen die richtige Modellgröße — und ein ehrliches Gespür dafür, worin lokale Modelle heute schon gut sind.
Anish Menon · CEO & Gründer, Grout
· 7 Min. Lesezeit
Die Annahme, KI lokal laufen zu lassen setze teure Hardware voraus, ist rund zwei Jahre veraltet. Quantisierung und kleinere, besser trainierte Modelle haben die Einstiegshürde so weit gesenkt, dass ein Schul-Notebook der Mittelklasse ein realistisches Ziel ist.
Was sich nicht geändert hat: Die Modellwahl zählt hier mehr als in der Cloud, weil Sie derjenige sind, der den Arbeitsspeicher bezahlt.
Die einzigen drei Zahlen, auf die es ankommt
Ein 4-Bit-Modell im Bereich von drei bis acht Milliarden Parametern ist der ideale Kompromiss für ein Notebook. Es passt bequem in den Speicher, antwortet schnell und bewältigt die Aufgaben, mit denen Lernende tatsächlich ankommen.
- Parameteranzahl — grob gesagt, wie viel das Modell weiß. Mehr ist besser und schwerer.
- Quantisierung — die Genauigkeit, mit der die Gewichte gespeichert sind. 4 Bit vierteln den Speicherbedarf gegenüber 16 Bit ungefähr, zu Qualitätseinbußen, die die meisten Lernenden bei Alltagsaufgaben nicht bemerken.
- Kontextlänge — wie viel Text das Modell gleichzeitig aufnehmen kann. Sie entscheidet darüber, ob Sie ein ganzes Kapitel einspeisen können oder nur ein paar Absätze.
Worin lokale Modelle heute schon gut sind
- Ein Kapitel oder ein Transkript zusammenfassen.
- Ein Konzept auf einem gewünschten Niveau erklären — wiederholt und geduldig.
- Text aus dem Foto einer Handschrift oder eines Arbeitsblatts auslesen.
- Übungsaufgaben aus mitgeliefertem Material erzeugen.
- Umformulieren für mehr Klarheit, einen anderen Ton oder ein anderes Leseniveau.
- Kleine, klar umrissene Programme schreiben und bestehenden Code erklären.
- Übersetzen und Korrigieren beim Sprachenlernen.
Wo die Cloud weiterhin vorn liegt
Das ist eine echte Lücke und kein Kleingedrucktes aus dem Marketing. Die praktikable Antwort lautet: lokal als Standard, mit einem bewussten Weg zur Eskalation — genau so ist Grout aufgebaut, mit Modellen auf dem Gerät als Voreinstellung und optionalen Premium-Cloud-Modellen, wenn eine Aufgabe es rechtfertigt.
- Lange, mehrstufige Schlussfolgerungen, bei denen sich ein kleiner Fehler aufschaukelt.
- Alles, was Wissen über aktuelle Ereignisse verlangt — jedes lokale Modell hat einen Wissensstichtag und keinen Browser.
- Sehr lange Dokumente, bei denen ein großes Kontextfenster alles entscheidet.
- Enge Spezialgebiete, die nur ein sehr großes Modell aufgenommen hat.
Was ein bestimmtes Gerät leisten kann
Der gemeinsame Speicher von Apple Silicon schlägt sich hier besser, als die Zahl vermuten lässt, weil die GPU den gesamten Pool ansprechen kann. Ein MacBook Air mit 16 GB ist ein erstaunlich starker Rechner für lokale KI.
- 8 GB RAM: kleine 4-Bit-Textmodelle, Vision-OCR, leichte Bildgenerierung. Brauchbar — und offline.
- 16 GB RAM: mittelgroße Modelle mit längerem Kontext, volle Vision-Funktionen und komfortable Bildgenerierung. Das ist der ideale Bereich.
- Apple Silicon oder eine dedizierte GPU: große Modelle, schnelle Generierung und hardwarebeschleunigter Videoexport.
Hinweise zur Einrichtung
- Laden Sie Modelle in einem schnellen Netz herunter, bevor Sie sie brauchen — das ist der einzige Schritt, der eine Verbindung erfordert.
- Schließen Sie das Netzteil an, wenn längere Generierungen anstehen; lokale Inferenz beansprucht den Akku stark.
- Halten Sie ein kleines, schnelles Modell für kurze Fragen bereit und ein größeres für echte Arbeit, statt alles durch das größte zu schicken, was gerade noch passt.
- Bitten Sie die IT bei Schulgeräten darum, die Modelle direkt in das Geräte-Image aufzunehmen, damit die Laptops einsatzbereit ankommen.
Häufig gestellte Fragen
Kann man KI-Modelle auf einem normalen Laptop betreiben?+
Ja. Ein 4-Bit-quantisiertes Modell im Bereich von drei bis acht Milliarden Parametern läuft bequem auf einem Laptop mit 8 bis 16 GB RAM und bewältigt Zusammenfassen, Erklären, OCR, das Erzeugen von Aufgaben und kleinere Programmieraufgaben offline.
Wie viel RAM braucht man für lokale KI?+
8 GB reichen für kleine Modelle und Vision-OCR. 16 GB sind das komfortable Ziel und ermöglichen längeren Kontext und Bildgenerierung. Apple Silicon holt aus derselben Zahl mehr heraus, weil sich GPU und Prozessor den Speicher teilen.
Brauchen Offline-KI-Modelle überhaupt Internet?+
Nur ein einziges Mal, um die Modelldatei herunterzuladen. Danach liegt das Modell auf der Festplatte und läuft beliebig lange ohne Netzwerkverbindung.