Expertise

Soevereine & commerciële AI

Van idee tot productie: wij zetten generatieve AI in die nuttig, meetbaar en conform is, met de modellen van de markt of met open-weight modellen die bij u of in Europa draaien.

Situaties die wij het vaakst tegenkomen

  • Veelbelovende prototypes die nooit in productie raken.
  • Gevoelige data die uw infrastructuur niet mag verlaten.
  • API-kosten die moeilijk te voorspellen zijn naarmate het gebruik groeit.
  • Teams die al AI gebruiken, zonder kader of beveiliging.

Wat wij doen

  1. 01

    Soevereine AI, on-premise of in de EU

    Open-weight modellen (Mistral, Llama, Qwen…) uitrollen op uw GPU’s of bij een Europese hostingpartner, aangeboden via vLLM of Ollama op Kubernetes.

  2. 02

    RAG & interne assistenten

    Assistenten gekoppeld aan uw documenten en tools, die hun bronnen vermelden en de bestaande toegangsrechten respecteren.

  3. 03

    Agents & automatisering

    Agents die taken aaneenschakelen (opzoeken, opstellen, invoeren, tickets) via uw API’s, met menselijke validatie waar nodig.

  4. 04

    Commerciële AI, goed geïntegreerd

    OpenAI, Anthropic, Mistral, Google… Het juiste model voor elke toepassing, met kosten, quota en vertrouwelijkheid onder controle.

  5. 05

    Evaluatie & guardrails

    Businesstestsets, meting van de antwoordkwaliteit, filters en logging: AI waar u voor kunt instaan.

  6. 06

    AI-infrastructuur

    GPU’s dimensioneren en delen, opschalen, en observability van modellen en hun kosten.

Technologie

  • vLLM
  • Ollama
  • Mistral
  • Llama
  • Qwen
  • LangGraph
  • LlamaIndex
  • pgvector
  • Qdrant
  • Kubernetes
  • NVIDIA GPU Operator
  • OpenTelemetry

In de praktijk

  • Overheidsadministratie

    Soevereine AI-assistent voor medewerkers

    Context
    Medewerkers moesten documenten analyseren en antwoorden voorbereiden op basis van interne kennisbanken, zonder dat data de organisatie verliet.
    Aanpak
    Lokale AI op on-premise hardware, RAG op interne databanken en kennisbanken, MCP-servers om interne software te bevragen.
    Resultaat
    Een project van zes maanden in totaal, met een MVP opgeleverd voor twee derde van het geraamde budget.

Hoe wij werken

  • Audit & diagnose

    Enkele dagen tot enkele weken om een platform, een cluster of de haalbaarheid van een AI-project te beoordelen.

    U krijgtEen duidelijk beeld en een geprioriteerde, begrote roadmap.

  • Project met vaste scope

    Eén scope, één resultaat, één engagement: een migratie, een platform, een AI-toepassing van prototype tot productie.

    U krijgtEen oplossing in productie, gedocumenteerd en overgedragen.

  • Teamversterking

    Senior engineers die in uw teams meedraaien om een project te versnellen of expertise aan te brengen die u mist.

    U krijgtMeteen extra capaciteit, en teams die groeien.

  • Beheer & support

    Wij beheren uw Kubernetes- en AI-platformen en ontwikkelen ze verder, met servicenormen die we samen vastleggen.

    U krijgtMonitoring, updates en support volgens het afgesproken serviceniveau.

Veelgestelde vragen

Wat bedoelt u met “soevereine AI”?

AI waarbij u de modellen, de infrastructuur en de data zelf in handen hebt: open-weight modellen bij u of bij een Europese hostingpartner, zonder dat data naar een derde partij gaat.

Is een open-weight model even goed als een commercieel model?

Voor veel zakelijke toepassingen (documenten doorzoeken, samenvatten, extraheren, classificeren) volstaan de beste open modellen ruimschoots. Wij toetsen dat op uw eigen data voor we iets aanraden.

En de AI Act?

De Europese verordening legt verplichtingen op volgens het risiconiveau van elke toepassing. Wij bouwen die eisen van bij het ontwerp in: documentatie, traceerbaarheid, menselijk toezicht en de juiste hostingkeuzes.

Contact

Een AI-toepassing in gedachten?

In één workshop beoordelen wij samen met u de haalbaarheid, de waarde en de meest geschikte hostingoptie.

Liever rechtstreeks?

contact@okko.be

Onze andere expertises

  • Cloud native & Kubernetes

    Betrouwbare, veilige en kostenbewuste Kubernetes-platformen ontwerpen, migreren en beheren, op AWS, Azure, Google Cloud, een Europese cloud of uw eigen servers.

    • Architectuur & migratie
    • Platform engineering & GitOps
    • Observability, security, FinOps
  • Modernisering & DevOps

    Uw ontwikkelteams helpen sneller en met meer vertrouwen naar de cloud te leveren, en AI in uw producten te integreren zonder alles te herschrijven.

    • Containerisatie & modernisering
    • CI/CD & DevOps-praktijken
    • AI-integratie in uw applicaties