# OpenAI lanceert GPT‑6 Astra Ultrafast op NVIDIA Blackwell-gpu’s

> De nieuwe Astra Ultrafast-modus is nu beschikbaar in de OpenAI API en genereert voor daarvoor in aanmerking komende gebruikers tot acht keer sneller tokens.

Oossa · 2026-10-02 · https://oossa.com/nl/openai-launches-gpt-6-astra-ultrafast-on-nvidia-blackwell-gpus

OpenAI heeft een nieuwe prestatiemodus toegevoegd aan zijn GPT‑6-model: Astra Ultrafast. De modus draait op grafische chips van NVIDIA met Blackwell-architectuur en is al beschikbaar via de OpenAI API voor gebruikers met een ChatGPT Work- of Codex-abonnement. Volgens het bedrijf kan de modus tot acht keer sneller tokens genereren dan de standaardinstelling Astra, waardoor interactieve AI-toepassingen responsiever aanvoelen.

## Waarom snelheid belangrijk is voor ontwikkelaars

Snellere tokengeneratie verkort de cyclus waarin een AI-assistent code schrijft, een tool aanroept, het resultaat controleert en de volgende stap bepaalt. Philippe Tillet, hoofd inference bij OpenAI, merkt op dat de snelheidswinst agents helpt om sneller bewerk-, test- en debugcycli af te ronden. De versnelling verlaagt ook de latentiegerelateerde kosten, wat van belang kan zijn wanneer één workflow veel aanroepen omvat.

## Hoe NVIDIA-hardware de snelheidswinst mogelijk maakt

OpenAI schrijft de winst toe aan NVIDIA’s “grote investeringen in tools en documentatie”, waardoor het bedrijf krachtige kernels kan schrijven die de Blackwell-architectuur optimaal benutten. OpenAI gebruikt ook eigen modellen om de inferentiesoftware op de GPU’s voortdurend te verbeteren. Dat betekent dat de prestaties na de lancering mogelijk verder toenemen.

## De feiten

- Astra Ultrafast draait op NVIDIA Blackwell-gpu’s.
- De modus is nu beschikbaar in de OpenAI API voor daarvoor in aanmerking komende ChatGPT Work- en Codex-gebruikers.
- Volgens OpenAI genereert Ultrafast tot 8× sneller tokens dan de standaardmodus Astra.
- Philippe Tillet is hoofd inference bij OpenAI en gaf commentaar op de samenwerking met NVIDIA.
- OpenAI biedt ontwikkelaars een handleiding met prijs- en implementatiedetails.

## Waarom het ertoe doet

Ontwikkelaars die tools voor codegeneratie bouwen, kunnen merkbaar snellere reacties krijgen, waardoor de bewerk-, test- en debugcyclus korter wordt. Kortere wachttijden betekenen ook dat gebruikers minder lang hoeven te wachten op AI-functies in apps, wat de algehele ervaring verbetert. Het valt nog te bezien hoeveel de lagere latentie de kosten voor eindgebruikers zal drukken.

## Bronnen en referenties

1. [How NVIDIA GPUs Help Accelerate OpenAI’s GPT-6 Astra Ultrafast](https://blogs.nvidia.com/blog/gpus-openai-gpt-6-astra-ultrafast/) – NVIDIA, 2026-10-01

Laatst bijgewerkt: 2026-10-02
