Agenter

Ultrafast-läget accelererar GPT-6 Astra upp till 8 gånger via OpenAI API

6 oktober 2026 · 1 min läsning

a large circular object in a large building
Homa Appliances / Unsplash

OpenAI har gjort Ultrafast-läget tillgängligt för modellen GPT-6 Astra via API för alla användare, men med begränsningar för initial användning. Läget fungerar genom att välja modellen GPT-6-astra och sedan välja tjänsten ultrafast. Företaget rekommenderar användning av WebSockets för att minska kostnaderna för att skapa anslutningar i tidskänsliga applikationer.

OpenAI bekräftar att läget kan ge hastigheter upp till åtta gånger den standardtjänst som erbjuds, med resultat som varierar beroende på längden av indata och utdata samt belastningen. NVIDIA har också förklarat att implementeringen är beroende av Blackwell- och Vera Rubin-enheter inom inferenslagret, så detta är en betald tjänsteökning och inte en ny version av modellen. Den nya funktionen innebär en snabbare drift för applikationer och agenter.

Ultrafast-läget kräver högre kostnader än standardlagret och tjänsten stöder endast datalagring inom USA eller global bearbetning, och fungerar inte med regionala slutpunkter. Därför bör den faktiska kostnaden och latensen testas på applikationens belastning istället för att bara förlita sig på den maximala hastighetsnumret.

Hastighet är viktig när agentcykeln upprepas. Ultrafast är särskilt fördelaktigt för agenter som gör långsiktiga anrop; några hundra millisekunder vid varje steg kan göra en tydlig skillnad. För enkel chatt kanske kostnadsökningen inte är motiverad.