Blog · 17 juli 2026

Een Mac mini als AI-server voor je kantoor: wat kan er echt voor onder de 2.000 euro?

Voor een eenmalig bedrag onder de 2.000 euro draait een Mac mini open AI-modellen lokaal. Wat er kan, wat er niet kan, en de prijzen met bron.

Voor minder dan 2.000 euro eenmalig zet je een Mac mini op kantoor die open AI-modellen lokaal draait: snel genoeg voor samenvattingen, concepten en invoerwerk, zonder abonnement per gebruiker en zonder dat er data de deur uit gaat. De Mac mini met M4-chip begint bij € 969, de zwaardere M4 Pro-uitvoering bij € 1.919 (prijzen apple.com/nl, juli 2026).

Dit is de opstelling die aitonomi standaard doorrekent voor kantoren van tien tot vijftig mensen, omdat hij de instapdrempel van lokale AI verrassend laag legt: één apparaat, één investering, geen maandbedragen.

Waarom een Mac mini en geen GPU-server?

Het korte antwoord: geheugen. Bij een Mac delen processor en grafische chip hetzelfde werkgeheugen (Apple noemt dit unified memory). Daardoor passen relatief grote taalmodellen in het geheugen zonder dat er een aparte videokaart met eigen duur geheugen nodig is. Een vergelijkbare GPU-server is er ook, maar die is luider, zuipt meer stroom en vraagt meer beheer.

Daarnaast is een Mac mini gewoon kantoorvriendelijk: klein, stil en zuinig. Hij staat in een kast naast de router in plaats van in een serverruimte die je niet hebt.

Welke modellen draaien er op?

Met een runtime als Ollama draai je open modellen van onder meer Meta (Llama), Mistral en Alibaba (Qwen). De documentatie van Ollama hanteert als richtlijn grofweg 8 GB geheugen voor modellen rond de 7 miljard parameters en 16 GB voor modellen rond de 13 miljard. Vertaald naar de Mac mini-configuraties:

Configuratie Draait comfortabel
M4, 16 GB Modellen tot circa 8 miljard parameters
M4, 24 GB Modellen rond 13 miljard parameters
M4 Pro, 24 GB of meer Grotere modellen en meer ruimte voor gelijktijdig werk

Dit zijn vuistregels, geen garanties: het werkelijke gebruik hangt af van het model, de compressie (quantisatie) en hoeveel er tegelijk gebeurt. Test met je eigen werk voordat je een configuratie vastlegt.

Wat kan zo’n server wel en niet?

Wel, en goed:

  • Samenvattingen van gesprekken en documenten
  • Concepten voor mails, brieven en verslagen
  • Gegevens uit documenten halen en klaarzetten voor je crm of dossier
  • Documentstromen stuk voor stuk verwerken, de hele dag door

Niet, of niet lekker. Kies deze opstelling níet als je dit zoekt:

  • Tientallen gelijktijdige gebruikers die allemaal live met een chatmodel werken: dan wil je meer geheugen, meerdere machines of een Europese cloud-GPU.
  • Frontier-kwaliteit redeneerwerk: complexe juridische of financiële analyses blijven het domein van de grote modellen, zie Welk AI-model heb je nodig voor kantoorwerk?
  • Beeld- of videogeneratie op schaal: ander soort werk, andere hardware.

Wat kost het vergeleken met een abonnement per gebruiker?

De vergelijking die het snelst inzicht geeft, voor een kantoor van 25 mensen:

Optie Kosten
Microsoft 365 Copilot Business, 25 gebruikers Circa € 5.460 per jaar, elk jaar opnieuw (prijspagina Microsoft, juli 2026, excl. btw; zie de volledige rekensom)
Mac mini M4 of M4 Pro als lokale AI-server € 969 tot € 1.919 eenmalig (apple.com/nl, juli 2026), plus stroom en beheer

Dit is geen een-op-een-vergelijking, dat hoort erbij gezegd: Copilot is een persoonlijke assistent in je office-programma’s, een lokale server automatiseert werkstromen op de achtergrond. Maar voor het terugkerende volumewerk is het prijsverschil te groot om te negeren.

Hoe zo’n server onderdeel wordt van een werkend systeem (runtime, orkestratie, koppelingen met je bestaande software) staat bij lokale AI-systemen. Twijfel je of je kantoor er klaar voor is, begin dan bij de AI-readiness scan.