OpenAI Decisions API maakt van beoordelingen snelle oordelen

OpenAI Decisions API maakt van beoordelingen snelle oordelen

OpenAI heeft een nieuwe tool aan zijn ontwikkelaarsplatform toegevoegd die maar één ding doet: een knoop doorhakken. De Decisions API neemt tekst, afbeeldingen of een combinatie van beide en geeft een beperkt oordeel terug in plaats van een vrij geformuleerd antwoord. Tegelijk met de lancering voert het bedrijf een eenvoudigere opzet in voor zijn betaalde API-niveaus.

De Decisions API is nu beschikbaar als openbare bèta. Volgens OpenAI volgt de algemene beschikbaarheid binnenkort.

Wat de Decisions API doet

De meeste ontwikkelaars gebruiken de modellen van OpenAI via de Responses API, die vrijwel elke soort open uitvoer kan genereren. De Decisions API is veel beperkter. Volgens OpenAI is hij ongeveer tien keer zo snel als de Responses API.

Hij ondersteunt drie soorten antwoorden:

  1. Ja/nee-waarschijnlijkheden. Het model schat in hoe waarschijnlijk het is dat een bewering klopt voor een bepaalde invoer.

  2. Keuzes uit een vaste lijst. De ontwikkelaar legt de categorieën vooraf vast en het model kiest er één.

  3. Beoordelingen op een schaal. Het model plaatst de invoer ergens op een vooraf bepaald bereik.

Geen van de drie vormen geeft het model ruimte om af te dwalen. De ontwikkelaar bepaalt de vorm van het antwoord en het model vult de lege plek in.

Waar OpenAI toepassingen ziet

OpenAI noemt een paar praktische voorbeelden. Een daarvan is het herkennen van schade op foto's. Een ander is het automatisch doorsturen van binnenkomende klantvragen naar de juiste plek. Een derde is het classificeren van documenten.

Het gaat om repetitieve taken in grote volumes, waarbij een lang geschreven antwoord weinig toevoegt. Een supportsysteem heeft geen opstel over een e-mail nodig. Het moet weten in welke wachtrij die e-mail thuishoort.

Voor organisaties die met gevoelige gegevens werken, ondersteunt de API zero-data retention: invoer wordt na verwerking niet bewaard. De API kan in de VS en Europa ook HIPAA-conform worden gebruikt. HIPAA is de Amerikaanse wet die regelt hoe gezondheidsgegevens beschermd moeten worden.

Prijs en ondersteunde modellen

Voorlopig werkt er maar één model met de Decisions API: gpt-6-luna. Invoer kost 0,10 dollar per miljoen tokens. Uitvoertokens zijn gratis.

Die prijsopbouw past bij het product. Een beslissingsaanroep levert heel weinig uitvoer op (een waarschijnlijkheid, een label of een score), dus de kosten zitten sowieso grotendeels aan de invoerkant. Door alleen de invoer te rekenen, zijn de kosten beter te voorspellen voor teams die grote aantallen classificatietaken draaien.

Een antwoord op "decision models"

De lancering lijkt het antwoord van OpenAI op een kleine maar groeiende trend. Jev zette half september een golf van zogenoemde "decision models" in gang, en andere partijen volgden met hun eigen varianten, waaronder de snelle beslismodellen van Cloudflare voor agents en een open beslismodel van AWS. Het idee erachter is steeds hetzelfde: veel stappen in een AI-workflow hebben geen volledig gegenereerd antwoord nodig, alleen een snel en betrouwbaar oordeel.

Drie niveaus in plaats van vijf

Naast de nieuwe API heeft OpenAI het aantal betaalde API-niveaus teruggebracht van vijf naar drie. Ze heten nu Build, Launch en Grow.

Organisaties gaan automatisch een niveau omhoog zodra hun totale aankopen aan tegoed de volgende drempel passeren. De maandelijkse gebruikslimieten liggen op 500 dollar voor Build, 5.000 dollar voor Launch en 200.000 dollar voor Grow.

Onze kijk

De Decisions API wijst erop dat de grote modelaanbieders beperkte, gestructureerde oordelen gaan zien als een eigen productcategorie, en niet alleen als een promptpatroon dat ontwikkelaars bovenop chatmodellen bouwen. Dat is van belang voor iedereen die agents of geautomatiseerde pipelines bouwt. Een snelle, afgebakende ja/nee- of categorie-aanroep is makkelijker te testen, goedkoper op grote schaal te draaien en lastiger van koers te brengen dan een open antwoord.

Het past ook in een bredere prijsstrijd, zichtbaar in stappen als de forse prijsverlagingen van Anthropic voor Haiku. Gratis uitvoertokens zijn in die race een agressief signaal.

Het is de moeite waard om te volgen of OpenAI voor de algemene beschikbaarheid meer modellen toevoegt naast gpt-6-luna, en hoe de beloofde snelheid standhoudt bij echte workloads. Het eenvoudigere systeem met niveaus zou het intussen voor kleinere teams makkelijker moeten maken om te zien wat ze kunnen uitgeven voordat ze tegen een plafond aanlopen.