Tecnologia

OpenAI apresenta modo Ultrafast para GPT-5.6 Sol com respostas até 14× mais rápidas

A OpenAI apresentou a prévia do modo Ultrafast, nível de serviço da API que roda o GPT-5.6 Sol até 14 vezes mais rápido, com até 750 tokens de saída por segundo, usando infraestrutura da Cerebras.

Por Redação MedSignal

Smartphone showing ChatGPT website with warm tone, highlighting AI technology.
Foto: Sanket Mishra (Pexels)

Em resumo

O modo Ultrafast é um novo nível de serviço da API da OpenAI que executa o GPT-5.6 Sol até 14 vezes mais rápido, com até 750 tokens de saída por segundo, usando infraestrutura da Cerebras.

Em 30 segundos

  • O modo Ultrafast é um novo nível de serviço da API da OpenAI.
  • O GPT-5.6 Sol roda até 14 vezes mais rápido no modo Ultrafast.
  • O modo Ultrafast suporta até 750 tokens de saída por segundo.
  • A infraestrutura do modo Ultrafast é alimentada pela Cerebras.
  • A OpenAI apresentou o modo Ultrafast como prévia.

A notícia foi divulgada em 13 de agosto de 2026. A OpenAI apresentou a prévia do modo Ultrafast, novo nível de serviço da API que executa o GPT-5.6 Sol até 14 vezes mais rápido e com até 750 tokens de saída por segundo. O recurso é alimentado pela Cerebras e deve interessar a empresas que usam modelos de linguagem em escala, incluindo healthtechs que processam texto clínico.

O que aconteceu

O modo Ultrafast é um novo nível de serviço da API da OpenAI, voltado a quem precisa de mais velocidade na geração de respostas do GPT-5.6 Sol. Na prévia, o modelo roda até 14 vezes mais rápido do que no desempenho normal e sustenta até 750 tokens de saída por segundo. A infraestrutura por trás do recurso é da Cerebras, empresa que fornece hardware especializado para IA.

Em termos práticos, uma aplicação que usa a API pode receber respostas mais longas em menos tempo, o que reduz o tempo de espera do usuário e amplia o volume de texto processado por minuto.

Contexto

A Cerebras é a empresa que fornece a infraestrutura de computação do modo Ultrafast. A OpenAI, por sua vez, adiciona uma nova camada de serviço à sua API, mantendo o GPT-5.6 Sol como modelo base. Com isso, a velocidade de execução passa a ser um diferencial competitivo tão relevante quanto a qualidade do modelo, especialmente para aplicações que exigem respostas rápidas em escala.

Por que importa

Para gestores de tecnologia, healthtechs e equipes de engenharia no Brasil que utilizam a API da OpenAI, o modo Ultrafast pode reduzir a latência em fluxos intensivos de linguagem natural, como transcrição de atendimentos, resumos de prontuários e triagens por texto. Mais velocidade no modelo significa respostas mais curtas e experiências digitais mais fluidas para pacientes e profissionais de saúde. No setor de saúde, em que cada segundo de espera pesa na operação clínica, avanços desse tipo ajudam a tornar viáveis aplicações que antes esbarravam no tempo de processamento.

Números do anúncio

Os valores abaixo foram citados pela fonte original do anúncio:

  • 14
  • 750

Por que isso importa

Para gestores de tecnologia, healthtechs e equipes no Brasil que utilizam a API da OpenAI, o modo Ultrafast pode reduzir a latência em fluxos intensivos de linguagem natural, como transcrição de atendimentos, resumos de prontuários e triagens por texto. Mais velocidade na geração de respostas significa menos tempo de espera para pacientes e profissionais de saúde, além de permitir que aplicações clínicas e operacionais processem volumes maiores de texto em tempo real.

Fontes

Correções factuais são registradas e versionadas. Veja nossa política de correções.

Relacionados

Tecnologia

Sandbar levanta US$ 36 milhões para anel de voz com IA

A Sandbar, startup por trás do anel de voz privado Stream, soma US$ 36 milhões captados, incluindo uma Série A de US$ 23 milhões liderada por Adjacent e Kindred Ventures. A aposta: voz como próxima fronteira dos wearables de IA.

Redação MedSignal

Newsletter · Semanal

Receba os sinais que estão transformando a medicina

Uma curadoria editorial de tecnologia e negócios em medicina, sem spam.