Wat kost lokale AI voor jouw organisatie?
Schuif op bedrijfsgrootte en gebruik, en zie welke DAIA-appliance er nodig is om AI volledig lokaal te draaien — inclusief modellen, benchmarks en een realistische prijsindicatie. Een schatting voor het gesprek, geen offerte.
Aanbevolen: DAIA Core
Werkpaard — 27B+ Q4 volledig in VRAM — past 25 actieve gebruikers, 13M tokens/maand
Hardware
Aanbevolen modellen
PACE platform — Local Business
| DAIA-appliance (hardware)DAIA Core · 24 GB | €1.700€1.300–€3.000 |
| Setup PACE3 agents, 3 integraties, 27–35B modellen | €7.500 |
| Platformper maand · updates, support, agents | €2.495 |
| Totaal jaar 1 | €39.140 |
| Totaal 3 jaar (lokaal ≈ geen tokenkosten) | €99.020 |
Lokaal: marginale compute-kosten ≈ €0 — data verlaat het gebouw niet. PACE Local-tarieven conform PACE-PRICING-MODEL.md v0.9 (sep 2026).
De appliance-ladder — capaciteit vs. behoefte
Behoefte: 2 gelijktijdige sessies · 13M tokens/maand — tegenover wat elke DAIA-band fysiek kan.
Tokencapaciteit per band: DAIA Edge ≈ 13M/mo · DAIA Core ≈ 19M/mo · DAIA Pro ≈ 21M/mo · DAIA Ultra ≈ 28M/mo · DAIA Rack ≈ 87M/mo (bij ~55% benutting). Overschrijdt het volume de band, dan stap je op — tot de Rack; daarboven is PACE Cloud het hybride alternatief.
Model-database
Chat & Inzichten · niveau DAIA Core en één stap hoger — benchmarks sept 2026 · klik op een model voor de details
- 84.3MMLU-Prokennis—AIME '26wiskunde90.3LCB v6code86SWE-bench Vagentic
- Architectuur
- Dense 27B + visie (28B)
- Context
- 262K
- Licentie
- Apache 2.0
- VRAM Q4 / Q8
- 16.5 / 29 GB
- Opmerking
- MMLU/SWE 3rd-party (Vals AI)
Methodologie & aannames
- Actieve gebruikers = medewerkers × adoptie. Tokens/maand = actieve gebruikers × sessies/dag × ~6K tokens per sessie × 22 werkdagen.
- Piek gelijktijdig = actieve gebruikers × 5% (werkbelasting-afhankelijk). Capaciteit per band =
tok/s × reactiebudget ÷ output-tokens, min 1 sessie. - Decode is geheugenbandbreedte-gebonden: 24GB @ 936 GB/s (gebruikte RTX 3090) is de waarde-koning; een langzamere 32GB kaart verslaat een snelle 16GB kaart. Cijfers zijn single-stream schattingen op het hoofdmodel.
- PACE-platform-tier: Starter (≤4 gelijktijdig, ≤5M tok/mo) / Business (≤15, ≤20M) / Enterprise (custom) — conformeert aan PACE-PRICING-MODEL.md.
- Kimi K3 en DeepSeek V4-Pro staan in de DAIA-lijn maar zijn datacenter-modellen (1.5TB+ Q4): alleen bereikbaar in de Rack-configuratie of via PACE Cloud / frontier-brug. Alle benchmarks zijn openbaar gepubliceerd (HuggingFace model cards, unsloth, benchlm, artificialanalysis, lmarena) — zie bronnenlijst onderaan de DAIA-calculator-standalone.
Bronnen & status
Interne sales-estimate — berekeningen op basis van publieke benchmarks (sept 2026), geen offerte. Hardwareprijzen zijn NL-straatprijzen incl. btw en bewegen wekelijks (GDDR7-schaarste). Bronnen:
- · PACE DAIA lijn (Z.ai GLM-5.2, DeepSeek V4, Kimi K3, MiniMax-M3, Qwen3.8, Gemma 4, Laguna S/XS 2.1)
- · HuggingFace model cards & unsloth GGUF repos
- · benchlm.ai · artificialanalysis.ai · lmarena.ai (sep 2026)
- · codesota.com · azerty.nl · Apple NL — hardwareprijzen (sep 2026)
- · PACE-PRICING-MODEL.md v0.9 (2026-09-08) · PACE-DAIA.txt
Klaar om AI écht in je organisatie aan het werk te zetten?
Plan binnen 30 minuten een gerichte demonstratie met live agenten gekoppeld aan je eigen bedrijfsprocessen.