PACE logoPACE
DAIA Rekenmodel

Wat kost lokale AI voor jouw organisatie?

Schuif op bedrijfsgrootte en gebruik, en zie welke DAIA-appliance er nodig is om AI volledig lokaal te draaien — inclusief modellen, benchmarks en een realistische prijsindicatie. Een schatting voor het gesprek, geen offerte.

Actieve gebruikers
25
25% van 100 medewerkers (adoptie 25%)
Interacties / dag
100
à 6K tokens gemiddeld
Tokens / maand
13M
× 22 werkdagen
Piek gelijktijdig
2
sessies tegelijk
Reactietijd
27 s
gemiddeld antwoord op DAIA Core
memory

Aanbevolen: DAIA Core

Werkpaard — 27B+ Q4 volledig in VRAM — past 25 actieve gebruikers, 13M tokens/maand

Local Business

Hardware

Systeem1× RTX 3090 24GB (gebruikt) of RTX 4090 24GB
GPU-geheugen24 GB
Decode-snelheid55 tok/s
Vermogen / vormDesktop tot pedestal — stil tot rack
Hardware (eenmalig)€1.300–€3.000

Aanbevolen modellen

Alibaba Qwen3.8-27BGoogle Gemma 4 26B-A4BPoolside Laguna XS 2.1Google Gemma 4 31B+1 niveau: MiniMax MiniMax-M3, DeepSeek DeepSeek V4-Flash (0731), Z.ai GLM-5.3-Flash

PACE platform — Local Business

DAIA-appliance (hardware)DAIA Core · 24 GB€1.700€1.300€3.000
Setup PACE3 agents, 3 integraties, 27–35B modellen€7.500
Platformper maand · updates, support, agents€2.495
Totaal jaar 1€39.140
Totaal 3 jaar (lokaal ≈ geen tokenkosten)€99.020

Lokaal: marginale compute-kosten ≈ €0 — data verlaat het gebouw niet. PACE Local-tarieven conform PACE-PRICING-MODEL.md v0.9 (sep 2026).

De appliance-ladder — capaciteit vs. behoefte

Behoefte: 2 gelijktijdige sessies · 13M tokens/maand — tegenover wat elke DAIA-band fysiek kan.

DAIA Edge
Starter doos — 1 model tegelijk
Voldoet
12–16 GB
VRAM
38 tok/s
Snelheid
4
Sessies
Belasting 2€950€1.450
1× RTX 3060 12GB (gebruikt) · Arc B580 · RTX 5060 Ti 16GB
DAIA Core
Werkpaard — 27B+ Q4 volledig in VRAM
Aanbevolen
24 GB
VRAM
55 tok/s
Snelheid
6
Sessies
Belasting 2€1.300€3.000
1× RTX 3090 24GB (gebruikt) of RTX 4090 24GB
DAIA Pro
Frontier MoE's — GLM-Flash, V4, M3
Voldoet
48–128 GB
VRAM
60 tok/s
Snelheid
7
Sessies
Belasting 2€5.100€7.200
Mac Studio M5 Max 128GB of 1× RTX 6000 Ada 48GB (gebruikt)
DAIA Ultra
Grote MoE's in Q3/Q4 — hoog gelijktijdig gebruik
Voldoet
192–512 GB
VRAM
80 tok/s
Snelheid
9
Sessies
Belasting 2€13.000€33.000
Mac Studio M5 Ultra 256GB+ of 2× RTX PRO 6000 Blackwell 96GB
DAIA Rack
Flagships — GLM-5.2, V4-Pro, Kimi K3
Voldoet
480 GB+
VRAM
250 tok/s
Snelheid
30
Sessies
Belasting 2€45.000€75.000
6–8× A100 80GB (gebruikt) / H100 — server, rack, datacenter

Tokencapaciteit per band: DAIA Edge ≈ 13M/mo · DAIA Core ≈ 19M/mo · DAIA Pro ≈ 21M/mo · DAIA Ultra ≈ 28M/mo · DAIA Rack ≈ 87M/mo (bij ~55% benutting). Overschrijdt het volume de band, dan stap je op — tot de Rack; daarboven is PACE Cloud het hybride alternatief.

Model-database

Chat & Inzichten · niveau DAIA Core en één stap hoger — benchmarks sept 2026 · klik op een model voor de details

  • 84.3
    MMLU-Pro
    kennis
    AIME '26
    wiskunde
    90.3
    LCB v6
    code
    86
    SWE-bench V
    agentic
    Architectuur
    Dense 27B + visie (28B)
    Context
    262K
    Licentie
    Apache 2.0
    VRAM Q4 / Q8
    16.5 / 29 GB
    Opmerking
    MMLU/SWE 3rd-party (Vals AI)

Methodologie & aannames

  1. Actieve gebruikers = medewerkers × adoptie. Tokens/maand = actieve gebruikers × sessies/dag × ~6K tokens per sessie × 22 werkdagen.
  2. Piek gelijktijdig = actieve gebruikers × 5% (werkbelasting-afhankelijk). Capaciteit per band = tok/s × reactiebudget ÷ output-tokens, min 1 sessie.
  3. Decode is geheugenbandbreedte-gebonden: 24GB @ 936 GB/s (gebruikte RTX 3090) is de waarde-koning; een langzamere 32GB kaart verslaat een snelle 16GB kaart. Cijfers zijn single-stream schattingen op het hoofdmodel.
  4. PACE-platform-tier: Starter (≤4 gelijktijdig, ≤5M tok/mo) / Business (≤15, ≤20M) / Enterprise (custom) — conformeert aan PACE-PRICING-MODEL.md.
  5. Kimi K3 en DeepSeek V4-Pro staan in de DAIA-lijn maar zijn datacenter-modellen (1.5TB+ Q4): alleen bereikbaar in de Rack-configuratie of via PACE Cloud / frontier-brug. Alle benchmarks zijn openbaar gepubliceerd (HuggingFace model cards, unsloth, benchlm, artificialanalysis, lmarena) — zie bronnenlijst onderaan de DAIA-calculator-standalone.
MMLU-Pro kennisAIME '26 wiskunde / redenerenLiveCodeBench v6 code generatieSWE-bench V agentic coding (scaffold-afhankelijk)Q4/Q8 GGUF VRAM-voetafdruk in GB

Bronnen & status

Interne sales-estimate — berekeningen op basis van publieke benchmarks (sept 2026), geen offerte. Hardwareprijzen zijn NL-straatprijzen incl. btw en bewegen wekelijks (GDDR7-schaarste). Bronnen:

  • · PACE DAIA lijn (Z.ai GLM-5.2, DeepSeek V4, Kimi K3, MiniMax-M3, Qwen3.8, Gemma 4, Laguna S/XS 2.1)
  • · HuggingFace model cards & unsloth GGUF repos
  • · benchlm.ai · artificialanalysis.ai · lmarena.ai (sep 2026)
  • · codesota.com · azerty.nl · Apple NL — hardwareprijzen (sep 2026)
  • · PACE-PRICING-MODEL.md v0.9 (2026-09-08) · PACE-DAIA.txt

Klaar om AI écht in je organisatie aan het werk te zetten?

Plan binnen 30 minuten een gerichte demonstratie met live agenten gekoppeld aan je eigen bedrijfsprocessen.