Exposanten login
Nvidia 01 oktober 2026

NVIDIA's Rol in de Versnelling van OpenAI’s GPT-6 Astra Ultrafast

NVIDIA's Rol in de Versnelling van OpenAI’s GPT-6 Astra Ultrafast

NVIDIA heeft een significante rol gespeeld in de ontwikkeling van OpenAI’s GPT-6 Astra Ultrafast, dat draait op de Blackwell GPU's. Deze geavanceerde technologie is nu toegankelijk via de OpenAI API voor geselecteerde ChatGPT Work en Codex gebruikers. Dankzij de optimalisaties in inferentie kunnen ontwikkelaars profiteren van een tot 8 keer snellere token-generatie in vergelijking met de Astra Standard modus. Dit heeft directe voordelen voor ontwikkelaars, die hun edit-test-debug cycli kunnen verkorten en de tijd die nodig is voor het genereren van responsen tussen tooloproepen kunnen verminderen, waardoor interactieve toepassingen responsiever aanvoelen.

De snelheid van het antwoord is cruciaal, vooral wanneer deze in een workflow wordt herhaald. Wanneer een agent bijvoorbeeld code schrijft, een tool gebruikt en de resultaten controleert, maakt Astra Ultrafast dit tijdsgevoelige proces efficiënter. De AI-infrastructuur van NVIDIA stelt OpenAI in staat om nuttige modeloutputs te leveren op het moment dat ontwikkelaars deze het meest nodig hebben. Philippe Tillet, de inferentie lead bij OpenAI, benadrukt dat de diepgaande investering van NVIDIA in tooling en documentatie het mogelijk heeft gemaakt om modellen optimaal in te zetten op Blackwell en Rubin GPU's. Hierdoor worden de reacties van modellen sneller tijdens complexe taken.

De prestaties blijven verbeteren, zelfs na de uitrol van het model. OpenAI gebruikt zijn eigen modellen om de inferentie-software op NVIDIA GPU's te verfijnen, wat ervoor zorgt dat modelreacties in de loop van de tijd sneller worden en dat de geïmplementeerde infrastructuur productiever is. Uday Ruddarraju, CTO van Compute bij OpenAI, stelt dat de samenwerking met NVIDIA hen helpt de snelheid en bruikbaarheid van AI te verbeteren. De programmeerbaarheid van het NVIDIA-platform stelt ontwikkelaars en onderzoekers in staat om infrastructuur te hergebruiken naarmate modellen zich ontwikkelen, wat de gebruiksefficiëntie verbetert en overprovisionering voorkomt.

Ontwikkelaars kunnen nu gebruikmaken van GPT-6 Astra Ultrafast via de API. Voor toegang, prijsinformatie en implementatiedetails is er een Ultrafast-gids beschikbaar.

Lees het volledige artikel op blogs.nvidia.com

https://blogs.nvidia.com/blog/gpus-openai-gpt-6-astra-ultrafast/