ai-dict.orgDe gids met de beste AI-tools
← Gids

AI-automatisering

AI offline gebruiken op je telefoon (lokale LLM)

Niveau: BeginnerStappen: 9Stand: juli 2026

Kort uitgelegd

Ja, een AI-model draait volledig op je smartphone – zonder internet, account of abonnement: met een gratis app zoals PocketPal AI of MLC Chat download je één keer een klein model (bijv. Gemma of Llama, 1B-klasse) en daarna chat je zelfs in vliegtuigmodus. Je invoer verlaat het toestel nooit – het compromis: kleinere modellen en tragere antwoorden.

Bij de bekende assistenten zoals ChatGPT draait het eigenlijke AI-model in de cloud – je telefoon stuurt de vraag alleen heen en weer. Een lokale LLM is het tegenovergestelde: het hele model staat op je toestel en rekent daar. Het grote voordeel is maximale privacy – noch je invoer noch de antwoorden verlaten de telefoon, en het werkt in een vliegtuig, in een tunnel of met het netwerk volledig uit. De afweging: het zijn kleinere modellen. Ze zijn goed voor samenvatten, opstellen, snelle vragen en als offline naslagwerk – maar ze vervangen geen groot cloudmodel bij lastige redeneringen. Voor beginners is het een spannende, gratis ingang tot het thema 'AI die van jezelf is'.

Vereisten

Goed om te weten: het downloaden van het model heeft één keer internet nodig. Daarna draait alles offline – je kunt de telefoon in vliegtuigmodus zetten en toch blijven chatten.

Gratis

  1. Installeer een gratis offline AI-app – voor beginners werken PocketPal AI (Android en iPhone) of MLC Chat goed.
  2. Kies en download in de app een klein model. Een goed startmodel is een 1B-model zoals Gemma 3 1B, Llama 3.2 1B of Qwen2.5 1.5B.
  3. Wacht tot de download klaar is (één keer internet nodig). Daarna kun je de telefoon in vliegtuigmodus zetten.
  4. Stel gewoon een vraag in het chatvenster – het antwoord wordt volledig op het toestel gemaakt.
  5. Als de app crasht of erg traag wordt, is het model te groot voor je telefoon – kies dan een kleiner model.
Voorbeeldprompt

Vat de volgende tekst samen in vijf eenvoudige punten en leg moeilijke begrippen in een korte bijzin uit: [TEKST PLAKKEN]

Grenzen: Kleine modellen maken bij complex redeneren meer fouten en antwoorden langzamer dan de cloud. Controleer bij feitvragen het antwoord liever.

Voor gevorderden

  1. Als je telefoon genoeg RAM heeft (8–12 GB), kies dan een groter 3–4B-model: het geeft duidelijk betere antwoorden voor maar iets meer geheugengebruik.
  2. Zoek modellen in GGUF-formaat op Hugging Face en laad ze in de app: zo heb je de volledige keuze in plaats van alleen de voorgestelde modellen.
  3. Let op 4-bit-versies (Q4): ze besparen geheugen; kies voor complexere taken liever een hoger kwaliteitsniveau.
  4. Wie wil, gebruikt op Android een terminaloplossing (bijv. Ollama) om modellen op desktop-achtige wijze te beheren.
Voorbeeldprompt

Herschrijf deze e-mail beleefder en korter zonder de inhoud te veranderen. Geef me daarna één versie in losse en één in formele toon: [TEKST PLAKKEN]

Meerwaarde: Grotere modellen geven duidelijk betere antwoorden en meer context – met volledige privacy. Ideaal voor gevoelige teksten die de cloud niet mag zien.

Veelgestelde vragen

Welke telefoon heb ik hiervoor nodig?

Geen high-end toestel: een Android of iPhone vanaf ongeveer 2021 met 6–8 GB RAM volstaat voor 1B-modellen. Het werkgeheugen is de doorslaggevende factor – grotere 3–4B-modellen vragen een vlaggenschip met 8–12 GB.

Is een lokaal model net zo goed als ChatGPT?

Nee – cloudmodellen zijn bij complex redeneren duidelijk sterker. Maar voor samenvatten, herformuleren, snelle vragen en offline naslaan zijn de kleine modellen verrassend bruikbaar. Velen gebruiken beide: lokaal voor het gevoelige, cloud voor de rest.

Waarom is dit privater dan gewone AI-apps?

Omdat het hele model op het toestel rekent: noch je invoer, noch de antwoorden worden naar een server gestuurd. Alleen de eenmalige modeldownload heeft internet nodig – daarna werkt alles in vliegtuigmodus.