A pergunta mais simples é a que mais custa. Descobrir se um comentário é ofensivo, decidir em qual fila uma mensagem entra ou julgar se uma resposta merece nota alta costuma exigir uma conversa inteira com um modelo de linguagem, longa e cobrada como se o pedido fosse complexo.
Para essas tarefas, a OpenAI (abre em nova aba) abriu em 6 de outubro de 2026 o acesso público de testes da Decisions API (abre em nova aba). API é a porta pela qual um programa usa um serviço remoto; esta em particular não conversa. Ela responde perguntas objetivas sobre textos e imagens, com respostas de formato fixo, e a empresa promete velocidade e preço baixo, com os números na frente. São respostas até 10 vezes mais rápidas que o caminho tradicional, na conta da própria OpenAI, e US$ 0,10 por milhão de tokens de entrada.
O que a API devolve
O princípio é restringir a resposta. O programa envia o material, um texto ou mensagens com texto e imagens, junto com perguntas de três tipos, e recebe números e categorias em vez de prosa.

| Tipo | Resposta | Uso citado pela OpenAI |
|---|---|---|
| Predicado | a chance, entre 0 e 1, de uma afirmação ser verdadeira | classificar conteúdo |
| Escolha | uma opção de uma lista fixa, com as probabilidades de cada alternativa e um valor de confiança | encaminhar solicitações |
| Nota | uma pontuação em escala, calculada como média ponderada das posições | priorizar trabalho |
Um aplicativo de atendimento que precisa encaminhar cada mensagem de cliente a uma equipe não lê texto nenhum do modelo, só a opção vencedora. A resposta chega pronta para virar código, sem interpretar parágrafo.
A conta da velocidade
O número mais repetido no anúncio tem dono. A comparação oficial é entre a Decisions API e a Responses API (a interface anterior da OpenAI para conversas com modelos), rodando em ambos os casos o mesmo modelo. No anúncio à comunidade de desenvolvedores (abre em nova aba), a empresa fala em "até 10 vezes" mais rápido; na documentação técnica, em "cerca de 10 vezes". É medida de fabricante, ainda sem verificação independente divulgada.
O lançamento da beta pública foi confirmado pela conta oficial de desenvolvedores da OpenAI no X, que resume para que o serviço existe.
Deixe seu aplicativo escolher o modelo, a ferramenta ou a ação certa quase em tempo real com a Decisions API, agora disponível para todos os desenvolvedores em beta pública. A Decisions API toma decisões até 10 vezes mais rápido que o GPT-6 Luna por meio da Responses API.
Preço
US$ 0,10 por milhão de tokens de entrada, e só. Token é o pedaço de texto, em geral menor que uma palavra, em que os modelos fatiam o material recebido. Segundo a OpenAI, não há cobrança por token de saída nem pelas operações de leitura e escrita de cache, que em outros serviços têm preço próprio. Na prática, o custo fecha antes de qualquer resposta sair.
Modelo e percurso
O único modelo disponível nesta fase é o GPT-6 Luna, chamado de gpt-6-luna nas requisições, que vão para um endereço dedicado, o POST /v1/decisions. Segundo a cobertura do Unite.AI, o GPT-6 Luna é um modelo de raciocínio lançado em 22 de setembro de 2026, junto com o GPT-6 Sol. A Decisions API já tinha circulado antes, no DevDay, o evento de desenvolvedores da OpenAI, em 29 de setembro, então em prévia limitada. A beta de 6 de outubro abriu o acesso a todos.
Dados sensíveis
Quem precisa de garantias encontra três itens na documentação. O serviço aceita Zero Data Retention, regime em que a OpenAI não retém os dados enviados, para clientes elegíveis, e atende ao HIPAA, a lei americana de privacidade de dados de saúde. Também permite escolher a região de hospedagem entre os Estados Unidos e a Europa, que aqui inclui o Espaço Econômico Europeu e a Suíça.
O que muda agora
A OpenAI espera converter a beta em versão definitiva nas próximas semanas, prazo declarado e sem data marcada. Até lá, o serviço já cumpre o uso mais imediato. Quem roda triagem, classificação e roteamento dentro de aplicativos ganhou um endereço dedicado para perguntas de resposta curta, com a conta fechando só na entrada.

