AI 6 min

OpenAI API gebruiken in je applicatie

Kort antwoord

De OpenAI API is een programmatische toegangslaag tot modellen zoals GPT-4o. Je stuurt tekst (of afbeeldingen) via een HTTP-verzoek, betaalt per token en krijgt een gegenereerde reactie terug. Integratie is mogelijk in elke taal die HTTP ondersteunt, van Python tot JavaScript.

De OpenAI API geeft je directe toegang tot GPT-modellen via code. Zo werkt authenticatie, kosten en integratie in je eigen applicatie.

Wat is de OpenAI API precies?

De OpenAI API is een webservice die je programmatisch toegang geeft tot taalmodellen zoals GPT-4o, GPT-4o mini en o1. In plaats van via de ChatGPT-interface te typen, stuur je een gestructureerd verzoek vanuit je eigen code en verwerk je het antwoord direct in je applicatie. Dit maakt het mogelijk om AI-functies in te bouwen in een klantenportaal, een interne tool, een chatbot of een geautomatiseerd verwerkingsproces.

De communicatie verloopt via HTTPS en JSON. Je stuurt een messages-array mee met de gesprekshistorie, kiest een model en ontvangt een JSON-antwoord terug. Er zijn ook gespecialiseerde endpoints voor embeddings, spraak-naar-tekst en afbeeldingen.

Authenticatie: de API key

Toegang werkt via een API-sleutel: een lange reeks tekens die je aanmaakt in het OpenAI-dashboard. Je stuurt die sleutel mee als HTTP-header bij elk verzoek:

Authorization: Bearer sk-...

Bewaar de sleutel nooit in je broncode of versiebeheersysteem. Gebruik omgevingsvariabelen of een secrets-manager. OpenAI biedt ook projectsleutels en organisatielagen voor teams die meerdere applicaties beheiden.

Endpoints en wat ze doen

Het meest gebruikte endpoint is /v1/chat/completions. Je stuurt een lijst berichten mee (systeem, gebruiker, assistent) en krijgt een nieuwe assistentreactie terug. Zo kun je meerondelige gesprekken opbouwen of enkelvoudige taken uitvoeren zoals samenvatten, vertalen of extraheren.

Het /v1/embeddings-endpoint zet tekst om naar een vector: een rij getallen die de betekenis van de tekst representeert. Dit is de basis voor zoekfuncties en RAG-systemen. Meer daarover lees je in wat is retrieval-augmented generation.

Tokens en kosten begrijpen

Kosten worden berekend per token, niet per verzoek. Invoer en uitvoer worden apart geteld en afzonderlijk geprijsd. GPT-4o mini kost significant minder dan GPT-4o, maar levert voor de meeste taken vergelijkbare kwaliteit.

Praktische vuistregels:

  • 1.000 woorden tekst is circa 1.300 invoer-tokens
  • Houd de systeemprompt zo beknopt mogelijk om vaste kosten laag te houden
  • Cache herhaalde prompts met de prefix-caching-functie van OpenAI om kosten te halveren bij identieke contexten

Als je met AI in je applicatie werkt, loont het om te beginnen met het goedkoopste model en alleen op te schalen naar een zwaarder model als de kwaliteit tegenvalt. Dit staat ook centraal in starten met AI in je organisatie.

Integratie in je applicatie

De officiële Python- en Node.js-bibliotheken nemen het HTTP-verkeer voor je over. Een minimaal Python-voorbeeld ziet er zo uit:

from openai import OpenAI

client = OpenAI()
response = client.chat.completions.create(
    model="gpt-4o-mini",
    messages=[{"role": "user", "content": "Vat dit samen: ..."}]
)
print(response.choices[0].message.content)

Voor low-code omgevingen kun je de API aanspreken via n8n of Make. In n8n koppelen met een AI-model lees je hoe je dat zonder code opzet.

Rate limits en foutafhandeling

OpenAI hanteert limieten op het aantal verzoeken en tokens per minuut. Bij overschrijding krijg je een 429 Too Many Requests-fout. Bouw altijd een retry-logica in: wacht na een fout een paar seconden en probeer opnieuw, met een maximum aantal pogingen. Gebruik ook streaming voor lange antwoorden, zodat gebruikers de output al zien terwijl het model nog genereert in plaats van een lange laadtijd te zien.

Onze tip: Begin altijd met gpt-4o-mini en meet of de kwaliteit voldoende is voor jouw use case. Verander pas naar een zwaarder model als je meetbare kwaliteitsproblemen ziet. Het scheelt al snel 80 tot 90 procent op je maandelijkse API-kosten.

Veelgestelde vragen

Wat heb je nodig om de OpenAI API te gebruiken?

Je hebt een account op platform.openai.com, een API-sleutel (API key) en een tegoed nodig. De sleutel plak je als Authorization-header mee in elk verzoek. Verder heb je een programmeertaal of tool nodig die HTTP POST-verzoeken kan sturen, zoals Python, Node.js of een tool als n8n.

Wat zijn tokens en hoe beïnvloeden ze de kosten?

Een token is ruwweg vier tekens of drie kwart van een woord. Je betaalt apart voor invoer-tokens (de tekst die je instuurt) en uitvoer-tokens (de tekst die het model teruggeeft). Een kort bericht van 500 woorden kost al snel 700 tot 900 tokens. Hoe groter het model en hoe langer de context, hoe hoger de kosten per verzoek.

Wat zijn rate limits bij de OpenAI API?

OpenAI beperkt hoeveel verzoeken en tokens je per minuut mag sturen. De limieten hangen af van je tier: nieuwe accounts beginnen laag en groeien mee naarmate je meer uitgeeft. Bij een piek in gebruik kun je een 429-foutcode krijgen. Bouw altijd een retry-mechanisme in met exponential backoff om dit op te vangen.

Hier over sparren?

Plan een vrijblijvend gesprek. We luisteren mee, schetsen een aanpak en geven een eerlijk beeld van wat haalbaar is, zonder verkoopdruk.