Interne voorbereiding voor Jamal. Vervolg op het eerdere verslag "AVG-proof lokale AI — research voor Greenvox". Dit deel gaat puur over de techniek en hardware: welke machine, welke telefoon, en wat voor app. Dit is research, geen juridisch advies en geen garantie. Alle bedragen zijn indicatief en moeten bij aanschaf gecontroleerd worden — chip-tekorten maken de tarieven nu grillig.
Jamal besprak met Jarvis de technische uitvoering van de Greenvox-tool. De kern:
Goed nieuws vooraf: die laatste aanname klopt niet helemaal. Apple Silicon (Mac mini / Mac Studio) is juist sterk voor lokale AI. Dat leg ik hieronder uit.
De 5 actiepunten zijn nu uitgezocht — met echte bronnen en indicatieve tarieven:
Een lokaal taalmodel is vooral geheugen-bandbreedte-werk. Het model moet helemaal in het geheugen passen.
Apple heeft hier een truc: unified memory. Het werkgeheugen en het grafische geheugen zijn één geheel. Daardoor kan een Mac een groot model laden dat niet op een gewone losse videokaart past.
Bron: Best GPU for Llama 70B in 2026 (DEV Community) · RTX 4090 local LLM benchmarks (Hardware Corner)
(a) Mac Studio / Mac mini (Apple Silicon)
Bron: Mac Studio M4 Max 128GB — 70B models tested (CraftRigs) · M4 Max AI inference benchmarks (Sean Kim)
Let op de Mac mini: een Mac mini M4 Pro kan een 70B-model technisch laden, maar de bandbreedte is lager, dus dan zak je naar 4–7 woorden per seconde. Voor een kleiner model (bv. een 8B–32B model) is de Mac mini juist weer prima.
Bron: Run Llama 3.1 70B on Apple M4 (SpecPicks)
(b) NVIDIA GPU-server
Bron: 2x RTX 4090 for LLMs guide (Will It Run AI) · Mac M3 Max vs RTX 4090 showdown (SitePoint)
Bron: Ollama VRAM requirements table (Local AI Master)
De aanname "Apple is niet geschikt" is onjuist. Voor een EU-/lokaal model met een beperkt aantal gebruikers is een Mac Studio met veel unified memory vaak de simpelste, zuinigste en stilste keuze. Een GPU-server is beter zodra je veel mensen tegelijk wilt bedienen of maximale snelheid wilt.
De juiste machine hangt niet af van wat klinkt als "het sterkste", maar van hoe Greenvox het gebruikt. Drie vragen bepalen alles:
Vuistregel: tekst schrijven is licht werk. Het wordt pas zwaar als er veel mensen op hetzelfde moment een antwoord vragen. Dan heb je software als vLLM nodig (verdeelt het werk slim) en meer rekenkracht.
| Scenario | Situatie | Passende hardware (indicatief) |
|---|---|---|
| Klein | 1–3 klantmanagers, af en toe, alleen tekst | Mac mini M4 Pro of 1x RTX 4090 + middelgroot model |
| Midden | 3–8 klantmanagers, dagelijks gebruik | Mac Studio M4 Max (64 GB+) of 2x RTX 4090 + 70B-model |
| Groot | 8+ tegelijk, hele dag, zware documenten | GPU-server (2x 24 GB+) met vLLM, of meerdere Macs |
Voor Jamal: dit moet je bij Greenvox uitvragen. Vraag concreet: hoeveel mensen, hoe vaak, en wat voor taken? Zonder dat antwoord koop je of te weinig (traag) of te veel (zonde van het geld).
Bedragen zijn indicatief (incl. btw, NL, juni 2026). Altijd controleren vlak voor aankoop — de tarieven schommelen door chip-tekorten. Apple heeft het instap-tarief van de Mac mini M4 Pro recent zelfs verhoogd om die reden.
Bron prijsbeweging: Apple hikes M4 Pro Mac mini price amid memory costs (MacRumors)
| Optie | Wat | Indicatief tarief | Geschikt voor |
|---|---|---|---|
| Instap | Mac mini M4 Pro (veel geheugen) óf 1x RTX 4090-pc | ± 2.000 – 3.000 euro | klein gebruik, middelgroot model |
| Midden | Mac Studio M4 Max (64 GB+ unified) | ± 3.000 – 5.000 euro | dagelijks, 70B-model, zuinig |
| Krachtig | GPU-server met 2x sterke NVIDIA-kaart | ± 5.000 – 10.000+ euro | veel gebruikers tegelijk, max snelheid |
Bron tarief-indicatie Mac Studio/mini: Apple Mac Studio · Apple Mac mini. Exacte euro-tarieven en geheugenopties wisselen — sommige 128 GB-opties zijn tijdelijk niet leverbaar — dus op de Apple-site checken op het moment van kopen.
Alle drie de opties koop je één keer en zet je lokaal neer (bij Greenvox op kantoor, of bij ons). Dan geldt:
Dit is precies het verkoopargument richting Greenvox' IT'er Hamza: eigen hardware = controleerbaar.
Voor klantmanagers die met gevoelige data werken telt vooral: lang beveiligingsupdates + bedrijf kan de telefoon beheren (MDM) + sterke beveiligingschip. Drie sterke kandidaten onder de 500 euro:
Bron: Pixel update-beleid (Google Help) · Titan M2 uitleg (Android Authority)
Bron: Samsung Knox vs Android Enterprise (AirDroid) · Knox Platform for Enterprise (Samsung Knox)
Bron: Ranking beste smartphones onder 500 euro (Notebookcheck)
Advies: voor maximale levensduur + privacy → Pixel 9a. Voor maximaal zakelijk beheer (MDM/Knox) → Samsung Galaxy A56. Beide ruim onder de 500 euro (tarief controleren bij aankoop).
Greenvox wil een telefoon-app. Er zijn twee soorten:
| Functie | PWA |
|---|---|
| Bij bestanden | Ja — file system access wordt nu breed ondersteund |
| Pushmeldingen | Ja op Android (volwaardig). Op iPhone beperkt (alleen na "zet op beginscherm") |
| Offline werken | Ja — via service workers |
| Installeren zonder app-store | Ja — dat is juist de kracht |
Bron: PWA vs Native App 2026 (MagicBell) · Push notifications in PWAs (MagicBell)
Een native app moet door de goedkeuring van Apple/Google heen, kost meer om in twee versies te bouwen, en updates duren langer. Een PWA is één website die je direct kunt updaten — geen wachten op een store.
Voor een intern bedrijfstooltje (niet voor het grote publiek) is de app-store-zichtbaarheid niet nodig. Daarom is een PWA hier logisch.
Bron: PWA vs Native App 2026 (Capslock Agency)
Bron: App-distributie via MDM (ManageEngine)
Begin met een PWA. Sneller te bouwen, één codebasis, direct te updaten, geen app-store-gedoe, en op door het bedrijf beheerde telefoons prima uit te rollen. Kies vooral Android-telefoons (Samsung met Knox), want daar werken pushmeldingen volledig. Pas als er later een harde reden is (zware hardware-functies), kun je naar native.
De telefoon-app praat met de lokale AI-server van Greenvox. Die verbinding moet dicht. De bouwstenen:
Samengevat: model lokaal, verbinding via VPN/Tailscale + HTTPS, toegang met biometrie, telefoons beheerd via MDM. Zo blijft de UWV-data binnen het pand en achter slot en grendel.
Bronnen staan als klikbare links door het verslag heen.
🎙️ Bespreek met Jarvis