Door Kevin Kolart, managing partner · Devolvio
Route 1: AI Endpoints
AI Endpoints is de serverloze dienst van OVHcloud voor open-weight modellen, gelanceerd in april 2025. De modellen zijn beschikbaar via een API die compatibel is met de OpenAI-API en worden in Europa gehost. Je beheert geen infrastructuur en betaalt naar gebruik.
Omdat het om open-weight modellen gaat, kun je hetzelfde model later ook zelf draaien. Dat beperkt de afhankelijkheid, maar een serverloze dienst blijft een dienst van één leverancier.
Route 2: zelf hosten
Je draait het model zelf, bijvoorbeeld op GPU-instances of in Managed Kubernetes met GPU-nodes. Je bepaalt dan zelf welke modelversie draait, wat er wordt gelogd en wie toegang heeft. Daar staat beheer tegenover: capaciteit, updates, monitoring, en de kosten van GPU's die ook doorlopen bij weinig gebruik.
Hoe kies je?
- Gevoeligheid van de gegevens, en de eisen die klanten, toezichthouders of het eigen beleid daaraan stellen.
- Gebruikspatroon: wisselend of beperkt gebruik past bij een serverloze API; constant hoog gebruik kan zelf hosten rendabel maken.
- Modelkeuze: staat het gewenste model in de catalogus, of is een eigen of aangepast model nodig?
- Beheercapaciteit: kan het team modellen, GPU-capaciteit en monitoring structureel beheren?
Controleer per dienst
Kwalificaties zoals SecNumCloud gelden bij OVHcloud per aanbod. Controleer voor AI Endpoints en voor GPU-instances afzonderlijk welke certificeringen en afspraken gelden, en leg vast wat er met prompts en logging gebeurt.
Wat altijd geldt
Europese hosting maakt een AI-toepassing nog niet soeverein. Autorisatie bij het ophalen van bronnen, evaluatie en beheer blijven even belangrijk — ongeacht de route.