Ultrafast acelera GPT-6 Astra até 8 vezes através da interface OpenAI API
6 de outubro de 2026 · 2 min de leitura
Também publicado em Deutsch, Svenska, עברית, Nederlands, Türkçe, हिन्दी, Français, Norsk, Polski, Русский
A OpenAI disponibilizou o modo Ultrafast para o modelo GPT-6 Astra através da interface API para todos os usuários, porém com limites de uso iniciais baixos. O modo funciona ao selecionar o modelo GPT-6-astra e escolher o serviço ultrafast, enquanto a empresa recomenda o uso de WebSockets para reduzir o custo de criação de conexões em aplicações sensíveis ao tempo.
A OpenAI afirma que o modo oferece uma velocidade que pode chegar até oito vezes a do serviço padrão, com a variação nos resultados dependendo do comprimento das entradas e saídas e da carga. A NVIDIA também destacou que a implementação depende das unidades Blackwell e Vera Rubin dentro da camada de inferência. Assim, trata-se de um aumento de serviço pago e não de uma nova versão do modelo em si.
O modo Ultrafast requer um custo superior ao da camada padrão, e a serviço suporta armazenamento de dados dentro dos Estados Unidos ou processamento global, não funcionando com pontos finais regionais. Portanto, é necessário testar os custos e a latência reais na carga da aplicação em vez de confiar apenas no número de velocidade máxima.
A velocidade é crucial quando um ciclo de agente se repete. O Ultrafast é particularmente útil para agentes que realizam uma longa série de chamadas, pois algumas centenas de milissegundos em cada passo se tornam uma diferença significativa. Para conversas simples, o aumento de custo pode não ser justificável.