On-premise AI

Uw LLM's draaien bij u.

Sommige data hoort niet thuis in een cloud, zelfs geen Europese. Wij installeren in uw gebouw een inferentieserver op maat van uw gebruik: lokale taalmodellen, transcriptie, beeldgeneratie. Alles draait op uw netwerk, onder uw controle.

Wat u krijgt

  • Een GPU-server op maat van uw echte gebruik, geïnstalleerd in uw gebouw
  • Recente open-weight LLM's, geschikt voor commercieel gebruik, geconfigureerd voor uw use-cases
  • Transcriptie, spraaksynthese en beeldgeneratie volgens uw behoeften
  • Standaard-API: uw tools koppelen erop zoals op een clouddienst
  • Geen data die uw netwerk verlaat, geen abonnement per gebruiker

Waarom een server binnen uw muren

Medische dossiers, juridische stukken, industriële data, R&D: sommige informatie mag van geen enkele externe leverancier afhangen. Een lokale server snijdt de vraag bij de wortel af. Geen transfer buiten uw netwerk, geen cloudverwerker om te auditen, geen abonnementen per gebruiker die zich opstapelen. De machine is van u, de data blijft bij u.

Wat we installeren

Recente open-weight modellen, gecontroleerd voor commercieel gebruik: taalmodellen voor uw documenten en automatiseringen, transcriptie, spraaksynthese, beeldgeneratie. Alles geserveerd via een standaard-API, compatibel met het bestaande ecosysteem: uw software koppelt erop zoals op een clouddienst, zonder herschrijven.

Op maat van uw gebruik, niet van de marketing

Geen datacenter nodig. Voor de meeste kmo-workloads volstaat één goed gekozen machine, met een beheerst stroomverbruik. We vertrekken van uw echte volumes: hoeveel gebruikers, welke documenten, welke modellen. De hardware volgt het gebruik, nooit omgekeerd.

Geïnstalleerd, uitgelegd, onderhouden

We leveren een draaiende server, geen kartonnen doos. Installatie ter plaatse, integratie met uw tools, opleiding van het team, daarna onderhoud op afstand: model- en beveiligingsupdates, monitoring. We draaien elke dag onze eigen inferentie op dit soort machine, dus we weten wat het vraagt in productie.

Veelgestelde vragen

Welke hardware is er nodig?

Een GPU-server afgestemd op de beoogde modellen. Voor de meeste kmo-workloads volstaat een machine ter grootte van een kantoortoren-pc. We dimensioneren na het bekijken van uw echte gebruik, niet ervoor.

Welke modellen kunnen erop draaien?

Recente open-weight modellen: LLM's voor tekst en documenten, transcriptie, spraaksynthese, beeldgeneratie. We controleren de licenties voor commercieel gebruik vóór we iets installeren.

Is het even goed als ChatGPT?

Voor afgebakende taken — extractie, samenvatten, vragen beantwoorden over uw documenten — geeft een recent lokaal model dat goed geconfigureerd is uitstekende resultaten. Als uw use-case verder gaat dan wat lokaal kan, zeggen we dat vóór we een machine installeren.

Wie staat in voor het onderhoud?

Wij, op afstand of ter plaatse: modelupdates, beveiligingspatches, monitoring. U blijft eigenaar van de machine en de data, en uw team wordt opgeleid voor het dagelijkse gebruik.

En de AVG?

Dat is het hoofdargument: de data verlaat nooit uw netwerk. Geen transfers buiten de EU, geen cloudverwerker om te documenteren, een veel eenvoudiger verwerkingsregister.

We kaderen het in 20 minuten.

Eén gesprek volstaat om te weten of dit een echt project waard is.

Een installatie afbakenen