Naar de inhoud
- AI-antwoorden fact-checken: hoe controleer je of het klopt?Ontdek hoe je de output van ta modellen betrouwbaar controleert. Leer praktische stappen om hallucinaties te ontdekken en feiten te verifiëren.
- AI Veilig Gebruiken Thuis: Praktische Tips voor GezinnenOntdek hoe je als gezin slim en veilig omgaat met kunstmatige intelligentie. Praktische tips over privacy, afspraken met kinderen en betrouwbare antwoorden.
- Als het niet werkt: out-of-memory, trage tokens en een GPU die niet meedoetFoutzoek-artikel voor lokale LLM-opstellingen: out-of-memory, trage tokens en een GPU die niet meedoet, met diagnose-stappenplan en oplossingen per platform.
- AnythingLLM als desktop-werkplek inrichtenComplete handleiding voor AnythingLLM als desktop-werkplek. Koppel lokale modellen, beheer vectoropslag en doorzoek documenten 100% privé.
- AVG-proof met AI: privacy-checklist voor NederlandseOntdek hoe u AI veilig en AVG-proof inzet in uw organisatie met deze praktische privacy-checklist. Inclusief DPIA, lokale modellen en dataminimalisatie.
- Backup-strategie voor lokale LLM's & dataEen praktische 3-2-1 backup-strategie voor lokaal gedraaide taalmodellen, vectordatabases, prompts en configuraties. Voorkom dataverlies.
- Je AI beter laten presteren in het NederlandsOntdek hoe je Large Language Models beter laat presteren in het Nederlands. Leer over effectieve systeemprompts, toon, register en het vermijden van…
- Contextlengte Instellen bij Lokale LLM's | Gids llmnet.nlOntdek hoe je de contextlengte optimaal instelt bij het lokaal draaien van LLM's, voorkom geheugenproblemen en balanceer GPU- en RAM-geheugen.
- AI-taken slim uitbesteden via een proxy en routeringLeer hoe je als indie developer programmeertaken delegeert aan gespecialiseerde modellen via een OpenAI-proxy, inclusief logging en kostenbeheersing per taak.
- Je Eigen Documenten Doorzoeken met Lokale AI (Privé RAG)Ontdek hoe je privé en lokaal je eigen documenten en notities kunt doorzoeken met AI. Leer alles over RAG, tools, hardware en privacy zonder cloud.
- ExLlamaV2 configureren voor maximale EXL2-snelheidOptimaliseer ExLlamaV2 en EXL2-kwantisatie voor maximale token-snelheid op Nvidia GPU's met FlashAttention-2, cache-tuning en speculatieve sampling.
- Persoonsgegevens automatisch anonimiseren met AIAutomatisch persoonsgegevens anonimiseren en pseudonimiseren met lokale AI, Microsoft Presidio, NER en LLM's conform de AVG.
- Welke hardware heb je nodig om LLM's lokaal te draaien?Ontdek welke hardware je exact nodig hebt voor lokale LLM's. Leer over RAM, VRAM, GPU versus CPU en kwantisatie. Praktische gids voor lokale AI-bouwers.
- Jan AI op Windows installeren en configurerenHandleiding voor Jan AI op Windows: installeer de desktop-app, configureer Vulkan of CUDA GPU-offloading en beheer lokale open-source modellen.
- Kobold.cpp installeren voor lokale GGUF-inferentieHandleiding voor Kobold.cpp: installeer de zelfstandige GGUF-engine, configureer GPU-offloading en draai lokale taalmodellen met context-optimalisatie.
- KV-cache kwantisatie in llama.cpp en vLLMBespaar VRAM en vergroot je contextlengte door KV-cache te kwantiseren naar FP8 of INT4 in llama.cpp en vLLM met concrete runtime-parameters en instructies.
- Kwantisatie uitgelegd: grote modellen op kleine hardwareOntdek wat LLM kwantisatie is, hoe GGUF werkt, en hoe je de ideale balans vindt tussen modelkwaliteit en geheugengebruik op bescheiden hardware.
- Llama.cpp compileren met CUDA: maximale prestatiesLeer stap voor stap llama.cpp compileren met Nvidia CUDA ondersteuning voor maximale tokendoorvoer en minimale latency op een Linux-systeem.
- GPU Passthrough Configureren in Proxmox voor LLM'sLeer hoe je GPU passthrough configureert in Proxmox VE voor lokale LLM's. Volledige stappenplan voor IOMMU, VFIO en PCIe toewijzing.
- Een lokaal taalmodel (LLM) in Docker draaienLeer waarom en hoe je een lokaal AI-taalmodel in Docker draait. Inclusief uitleg over GPU-versnelling, volumes, netwerken en prestatieverschillen per OS.
- Een LLM lokaal draaien op je eigen machine | LLM GidsLeer hoe je eenvoudig een Large Language Model (LLM) lokaal draait. Ontdek de hardware-eisen, privacyvoordelen en tools zoals Ollama en LM Studio.
- LLM draaien op oudere hardware: optimalisatiegidsOntdek hoe u bruikbare prestaties haalt uit een lokaal taalmodel op oudere hardware. Praktische gids voor RAM-beheer, kwantisatie en instellingen.
- Een LLM draaien op een Synology NASKun je een Large Language Model lokaal draaien op een Synology NAS? Ontdek de mogelijkheden, RAM-eisen en beperkingen van CPU-inference via Docker.
- LM Studio Headless als Server Inzetten | Gids llmnet.nlLees hoe je LM Studio zónder grafische interface gebruikt als OpenAI-compatibele API-server op macOS en Linux. Met achtergronddiensten en CLI-beheer.
- Een Lokaal Model Kiezen: Welke Variant Past Bij Jouw Doel?Ontdek hoe je het juiste lokale AI-model kiest voor jouw doel, zoals coderen of chatten. Leer alles over modelgrootte, snelheid en Nederlandse ondersteuning.
- Lokaal of via een API? De rekensom over drie jaarLokaal of via een API? Een kostenrekensom over drie jaar: afschrijving, stroom en beheer tegenover prijs per miljoen tokens. Gecontroleerd op 2026-08-07.
- Lokaal RAG draaien: van embedding tot antwoordBouw een complete lokale RAG-pijplijn zonder cloud. Van tekstparsing en embeddingmodellen tot vectoropslag, reranking en contextuele synthese.
- Lokale Beeldgeneratie: Zelf AI-afbeeldingen maken op jeEen complete gids voor het lokaal genereren van beelden met AI. Leer alles over de hardwarevereisten, modellen, softwaretools en prompt-instellingen.
- Continue.dev Instellen met Lokale Modellen in VS CodeLeer hoe je Continue.dev instelt in VS Code met lokale open-weight taalmodellen via Ollama voor maximale privacy en gratis code-generatie.
- Lokale Function Calling met Ollama en Python BouwenBouw betrouwbare lokale function calling met Ollama en Python. Leer schema-validatie, Pydantic-modellen, foutafhandeling en tool calling pipelines.
- Energieverbruik van je lokale LLM-opstelling metenLeer stap voor stap hoe je het exacte energieverbruik van je lokale LLM-opstelling meet op hardwareniveau, via de CLI en met slimme stekkers.
- Lokaal finetunen met LoRA: praktische gids | LLMnetPraktische gids voor het lokaal finetunen van LLM's met LoRA. Leer alles over datapreparatie, hyperparameterinstellingen en het evalueren van adapters.
- Een lokale LLM koppelen aan VS Code als codeassistentLeer hoe je een lokaal AI-model koppelt aan VS Code. Ontdek de beste extensies, instellingen voor Apple Silicon, en tips voor privacyvriendelijk coderen.
- Lokale LLM-servers veilig in je netwerk | GidsLees hoe je lokale LLM-servers veilig binnen je netwerk configureert. Voorkom onbevoegde toegang, koppel een omgekeerde proxy en regel netwerkscheiding.
- Lokale LLM's draaien op Linux: De ultieme gids voor OllamaLeer hoe je een lokale LLM draait op Linux. Stap-voor-stap handleiding voor Ollama, llama.cpp, GPU-drivers (NVIDIA/AMD) en headless server configuraties.
- Lokale LLM's draaien op Windows met LM Studio en OllamaLeer stap-voor-stap hoe je lokale LLM's zoals Llama 3 en Mistral op Windows installeert met LM Studio of Ollama. Inclusief tips voor CPU en GPU optimalisatie.
- Lokale LLM's op Apple Silicon: unified memory, MLX en Ollama vergelekenHoe unified memory de VRAM-redenering voor lokale LLM op Apple Silicon verandert: Ollama, MLX en LM Studio vergeleken voor installatie en modelkeuze.
- Lokale LLM's op Windows/WSL: installatie en verschillenOntdek of je lokale LLM's beter draait op native Windows of via WSL2. Vergelijk prestaties, installatiestappen en hardware-integratie.
- Lokale LLM op afstand veilig benaderen via Tailscale | LLMNet GidsLokaliseer je AI-modellen thuis of op kantoor en benader ze veilig vanaf elke plek ter wereld via Tailscale VPN. Stap-voor-stap handleiding voor Ollama en LM Studio.
- Lokale modellen in Docker: containers zonder gedoeDraai lokale AI-modellen geïsoleerd in Docker met GPU-doorvoer via NVIDIA Container Toolkit. Complete gids met compose-bestanden en optimalisaties.
- Een lokaal model koppelen aan je eigen documenten (RAG) opLeer hoe je lokaal op je Mac een taalmodel (LLM) koppelt aan je eigen documenten via RAG. Veilig, met tools zoals Ollama en vector-databases, voor 100%…
- Lokale re-ranking toevoegen aan je RAG-zoekpipelineVerbeter de precisie van je lokale RAG-pipeline met cross-encoders en lokale re-ranking via FlashRank en ONNX zonder data naar de cloud te sturen.
- Lokale vectordatabase opzetten: Qdrant en ChromaPraktische gids voor het lokaal opzetten en configureren van Chroma en Qdrant. Leer over databases versus bestanden, docker-opstellingen en metadata.
- Lokale Vision-Modellen Draaien voor BeeldanalyseComplete handleiding voor het lokaal draaien van vision-modellen via Ollama en vLLM voor OCR, diagramanalyse en privacyvriendelijke beeldverwerking.
- Model-updates lokaal bijhouden: versiebeheer van LLM'sLeer hoe je lokale modelversies, GGUF-hashes en Ollama-tags beheert, update-regressie voorkomt en geautomatiseerd terugrolt op je eigen hardware.
- Lokale modellen downloaden en beheren: De complete gidsLeer hoe je lokale LLM-modellen veilig downloadt, GGUF- en kwantisatieformaten kiest, en je opslagruimte efficiënt beheert zonder chaos.
- Modellen eerlijk vergelijken op je eigen hardwareStappenplan om LLM's objectief te testen op je eigen hardware: variabelen vastzetten, snelheid en kwaliteit meten en foute vergelijkingen voorkomen.
- Nederlandse en Europese open modellen lokaal draaienNederlandse en Europese open modellen lokaal draaien: wat bestaat er, hoe test je of een model echt goed Nederlands spreekt. Gecontroleerd op 2026-08-07.
- Nginx reverse proxy met authenticatie voor je LLMBeveilig je lokale LLM-server met Nginx, Bearer API-sleutels, TLS-encryptie, streamingondersteuning en rate limiting tegen overbelasting.
- Ollama installeren en je eerste lokale model draaien opOntdek stap voor stap hoe je Ollama installeert en lokale taalmodellen draait op macOS. Inclusief hardware-eisen, terminal-commando's en handige tips.
- Ollama Modelfile aanpassen: systeemprompt en parametersLeer hoe je met een Ollama Modelfile de systeemprompt en parameters instelt. Uitgebreide gids met voorbeelden, parameteruitleg en beheer.
- Open WebUI opzetten: een prettige chat-interface voor jeOntdek hoe je Open WebUI opzet als gebruiksvriendelijke chat-interface voor je lokale LLM's via Ollama. Praktische gids voor installatie en configuratie.
- Power limits en fancurves voor GPU-serversPraktische handleiding voor power limits, persistentie en fancurves op Linux GPU-servers voor energiezuinige, stille en thermisch stabiele AI-inferentie.
- Privacyvriendelijk AI gebruiken in het dagelijks werkPraktische gids voor veilig AI-gebruik op werk. Ontdek welke data u beter lokaal houdt, essentiële privacy-instellingen en gratis privacy-bewuste tools.
- Quantisatie in de praktijk: zelf comprimerenLeer stap voor stap hoe je zelf open-source taalmodellen converteert naar GGUF en kwantiseert met llama.cpp voor optimale lokale prestaties.
- Speculative decoding instellen voor snellere LLM-tokensPraktische handleiding voor het configureren van speculative decoding in llama.cpp, vLLM en Ollama met draft-modellen voor maximale token-doorvoer.
- Spraak lokaal omzetten naar tekstLeer hoe je spraak lokaal en privacyvriendelijk omzet naar tekst op je eigen Mac. Ontdek de beste modellen, hardware-eisen en diarization-technieken.
- Wat kost het stroomverbruik van lokale AI? (GPU/CPU RekensomBereken exact wat het stroomverbruik van lokale AI-modellen kost. Praktische formules voor GPU/CPU inferentie, sluimerverbruik en een cloud-vergelijking.
- Gevormde JSON Outputs Afdwingen bij Lokale LLM'sDwing geldige JSON af bij lokale LLM's: JSON-schema's in Ollama, LM Studio en vLLM, GBNF-grammatica's in llama.cpp, plus schema-ontwerp en foutafhandeling.
- Tabby als lokale code-assistent met Docker installerenLeer stap voor stap hoe je Tabby als zelf-gehoste AI-code-assistent installeert met Docker en GPU-ondersteuning voor VS Code en JetBrains.
- Text Generation WebUI installeren op LinuxInstalleer Text Generation WebUI (oobabooga) op een Linux-server. Praktische handleiding met CUDA, loaders, CLI-vlaggen en netwerkconfiguratie.
- Twee GPU's combineren voor lokale taalmodellenPraktische gids voor dual-GPU setups: tensor en pipeline parallelism, PCIe-bandbreedte, VRAM poolen en configuratie in llama.cpp en vLLM.
- vLLM configureren voor hoge doorvoer op LinuxLees hoe je vLLM op Linux instelt voor optimale doorvoer bij meerdere gelijktijdige verzoeken. Een gids over geheugenbeheer, batching en beveiliging.
- VRAM-rekenhulp: hoeveel geheugen heeft een model nodig?Bereken exact hoeveel VRAM een lokaal LLM vereist. Formules voor modelparameters, kwantisatie, contextlengte, KV-cache en CUDA-overhead.
- Embeddingmodel voor Nederlandse Documenten KiezenOntdek welk embeddingmodel het beste presteert voor Nederlandstalige documenten in een lokale RAG-opstelling. Met benchmarks, geheugeneisen en praktijktips.