NinA AI

NinA Benchmarks

AI-modellen vergeleken op het werk dat bedrijven doen.

we voegen ze doorlopend toe

De meeste benchmarks zijn geschreven voor onderzoekers: lastige namen, scores zonder context. Wij testen modellen op taken uit de praktijk en laten de uitkomst zien zoals je hem kunt gebruiken. Welk model past bij welk werk, en wat kost het?

Dit zijn de eerste. We voegen er doorlopend nieuwe benchmarks aan toe, en de nieuwste modellen zodra ze uitkomen.

01Benchmark · bijgewerkt 1 oktober 2026

Wat krijg je voor je geld?

Hoe slim een model is, afgezet tegen wat één taak gemiddeld kost.

Zo lees je het

  • Hoe hoger de stip, hoe beter het model presteert.
  • Hoe verder naar links, hoe goedkoper per taak.
  • Linksboven is dus het beste: veel kwaliteit voor weinig geld.
  • Sleep een kader over de grafiek om in te zoomen.

Wat betekent dit voor jou

Het duurste model is niet altijd het beste. Voor taken die je duizenden keren per maand draait, scheelt een model dat bijna even goed is maar een fractie kost meer dan het kwaliteitsverschil waard is.

02Benchmark · bijgewerkt 1 oktober 2026

Automatisering Benchmark

Hoe goed een model een bedrijfsworkflow automatiseert.

Zo lees je het

  • Elke staaf is de gemiddelde score van één model.
  • Hoger is beter.
  • Wijs een staaf aan voor de details.

Wat betekent dit voor jou

Een model dat bovenaan staat in een algemene ranglijst, staat hier niet automatisch bovenaan. Welk model het beste werkt, hangt af van het werk dat je het geeft. Daarom kiezen we per toepassing.

03Benchmark · bijgewerkt 1 oktober 2026

AA-Briefcase Benchmark

Modellen tegen elkaar op zakelijke opdrachten, uitgedrukt in een ELO-score.

Zo lees je het

  • ELO werkt als een schaakrating: modellen worden steeds tegen elkaar vergeleken, en wie vaker wint stijgt.
  • Hoger is beter.
  • Wijs een staaf aan voor de boven- en ondergrens. Overlappen die van twee modellen, dan zijn ze in de praktijk vrijwel even goed.

Wat betekent dit voor jou

Kleine verschillen in score zeggen weinig. Kijk naar de marges: liggen twee modellen dicht bij elkaar, dan geven prijs, snelheid en waar je data staat de doorslag.

Verder

Een benchmark kiest geen model voor je. Wij wel.

Welk model het beste is, hangt af van jullie werk, jullie data en wat het per maand mag kosten. In een AI Partnership kiezen we per toepassing, en wisselen we als er een beter model uitkomt.

Meer over hoe we dat aanpakken: het AI Partnership.

Welk model past bij jullie?

Laat ons het vergelijken op jullie werk.

Een kennismaking van 15 minuten. Daarna weet je welke modellen en welke aanpak bij jullie processen passen.

  • 160+ organisaties
  • Sessies met een 9,3
  • Amsterdam
Vertrouwd doorSchiphol GroupASMLActionVan Berkel ProfessionalsDe BaakGemeente LelystadKernBouwDA Drogist