Terug naar het Helpcentrum

Gids voor vision-instellingen

Een vision-model kiezen, max tokens en temperatuur instellen, en schone tekst uit rommelig handschrift halen.

Laatst bijgewerkt25 augustus 2026

Een vision-model kiezen

Een vision-model leest beelden: een foto van handgeschreven aantekeningen, een gedrukte pagina, een schema, een grafiek.

Wat de vision-modellen hier doen

De vision-modellen van Grout zetten handgeschreven aantekeningen rechtstreeks op het canvas om in bewerkbare tekst, en dezelfde modellen beantwoorden vragen over wat een afbeelding toont. Onder de beschikbare modellen zitten er uit de QWEN- en Llama-families.

Lokaal of in de cloud

  • Lokale vision-modellen draaien volledig op je computer, dus er verlaat niets van de afbeelding het apparaat. Dit is de route voor leerlingwerk en antwoordbladen.
  • De optionele Nexus AI-module bereikt meer dan 300 modellen op de cloud-GPU's van Grout wanneer je er een wilt die je computer niet aankan. Die vraagt een account, een verbinding en Merits, en de afbeelding verlaat de machine.
  • Grotere vision-modellen lezen rommelig handschrift beter; kleinere antwoorden sneller. Probeer eerst het kleine en stap pas over als het echt faalt.
  • Vergelijk de modelgrootte met je vrije geheugen voordat je downloadt — de gids met systeemvereisten geeft de cijfers.

Max tokens en temperatuur

Twee instellingen doen het meeste werk. Beide zijn zo verkeerd te zetten dat het op een modelprobleem lijkt.

Max tokens

Max tokens begrenst hoe lang het antwoord van het model mag worden. Dat maakt een antwoord niet beter, alleen langer — en een langer antwoord kost evenredig meer tijd.

  • Standaard: 500.
  • Bereik: 100 tot 1000.
  • 100–200 wanneer je een kort label, één getal of een antwoord van één regel wilt.
  • 500 voor een gewone uitleg, en daarom is het de standaard.
  • 800–1000 alleen wanneer je echt een lange, volledig uitgewerkte uitleg wilt.

Temperatuur

Temperatuur bepaalt hoeveel het model zijn formulering laat variëren. Laag is herhaalbaar en letterlijk; hoog is inventief, en dat is het laatste wat je wilt bij het overtypen van andermans handschrift.

  • Standaard: 0,7.
  • Bereik: 0,0 tot 1,0.
  • 0,0–0,3 voor tekst van een pagina lezen, getallen eruit halen of nakijken tegen een sleutel.
  • 0,3–0,5 voor feitelijke uitleg waar de formulering wat mag ademen.
  • 0,7–0,9 voor brainstormen, alternatieve formuleringen en creatief schrijven.

Als de uitvoer van de pagina afdwaalt

Een transcriptie die vloeiend leest maar niet bij de pagina past, komt bijna altijd door een te hoge temperatuur. Draai die richting nul voordat je het model of de foto de schuld geeft.

Bereid de afbeelding voor je iets vraagt

De meeste vision-missers zijn fotografie, geen configuratie. Repareer eerst de foto en je komt zelden aan een schuifregelaar.

Een foto maken die het model kan lezen

  • Verlicht de pagina gelijkmatig en houd je eigen schaduw eraf.
  • Fotografeer recht op de pagina, niet onder een hoek.
  • Snijd strak bij tot het schrift, zodat het model niet ook je bureau leest.
  • Zet een gedraaide pagina recht voordat je haar analyseert.
  • Verhoog het contrast bij vaag potlood in plaats van de temperatuur.

De gereedschappen die helpen

Bijsnijden, draaien, aan canvas aanpassen en de helderheids- en contrastregelingen staan allemaal op het canvas, dus je kunt een afbeelding ter plekke opschonen en de analyse opnieuw draaien zonder het project te verlaten.

De vision-acties

Drie manieren om een afbeelding een vraag te stellen.

Wat je kunt vragen

  • Afbeelding uitleggen — een beschrijving van wat de afbeelding toont en lijkt te betekenen.
  • Gegevens extraheren — tekst en getallen uit de afbeelding, in bewerkbare vorm.
  • Eigen prompt — je eigen vraag over de afbeelding, in je eigen woorden.

Een goede beeldprompt schrijven

Zeg wat de afbeelding is en wat je terug wilt. „Dit is een foto van het handgeschreven natuurkundeantwoord van een leerling; transcribeer het exact en houd de regelafbrekingen aan” verslaat „lees dit” elke keer. Bewaar wat werkt als eigen prompt.

Drie configuraties om te bewaren

Bewaar deze als aparte configuraties in plaats van dezelfde regelaars bij elke taakwissel opnieuw af te stellen.

Startpunten

  • Transcriptie: het kleinste vision-model dat het aankan, temperatuur dicht bij 0,0, max tokens op de pagina afgestemd.
  • Een schema uitleggen: een middelgroot model, temperatuur rond 0,4, max tokens 500.
  • Een antwoordblad nakijken: temperatuur 0,0–0,2, max tokens 500, met je correctiemodel in de prompt.
  • Ideeën uit een schets: temperatuur 0,7 of hoger, max tokens 500.

Eén ding tegelijk veranderen

Is een resultaat fout, verander dan de foto, de prompt, de temperatuur of het model — maar per poging slechts één daarvan. Twee tegelijk betekent dat je niets van het resultaat leert.

Gerelateerde gidsen