Um projeto open source chamado Codex Relay (abre em nova aba) resolve um incômodo conhecido de quem usa o Codex (abre em nova aba), o assistente de programação da OpenAI: o limite de uso da conta. A ferramenta permite conectar até 26 contas diferentes a uma única interface e, quando uma delas bate o limite, o sistema troca sozinho para outra conta disponível antes de qualquer resposta começar a ser gerada.
O Codex é o agente de programação da OpenAI, e contas de assinatura costumam ter cotas de uso por período, como janelas de algumas horas ou semanas. É exatamente essa história de limite que o Codex Relay automatiza. Segundo o repositório oficial, o funcionamento é local, ou seja, tudo roda no próprio computador do usuário, e os arquivos, conversas e projetos não mudam de lugar.
O projeto se descreve como um "experimento independente", com licença MIT, o que significa que o código é aberto e pode ser usado, alterado e redistribuído gratuitamente. Ele não é um produto oficial da OpenAI, e a própria página do GitHub deixa isso claro no título.

Como o trânsito de contas funciona
O mecanismo tem um desenho específico, descrito passo a passo na documentação:
- O Codex envia a conversa inteira para o gateway local, na porta 4000.
- O gateway escolhe uma conta conectada que não esteja em espera forçada (o chamado cooldown, o período de resfriamento após um limite).
- Cada conta roda em um processo isolado, em portas próprias de 4001 a 4026, que faz a autenticação e repassa o pedido ao serviço de assinatura.
- Se chega um erro de limite de uso antes de qualquer saída começar, a conta entra em espera e outra é tentada automaticamente.
- A resposta volta ao Codex, e os metadados da atividade são gravados localmente.
Ou seja: quem tem mais de uma assinatura não precisa parar o trabalho para trocar de conta manualmente. A troca acontece antes de a resposta ou as ferramentas do agente entrarem em ação, o que evita trabalho perdido no meio de uma tarefa.
O painel e o acompanhamento de uso
Além do roteamento de contas, o Codex Relay traz um painel com informações de consumo. O usuário pode ver o limite relatado em janelas de cinco horas e semanal, as porcentagens restantes e os horários de reinício de cada cota. Dados de quota, o nome técnico para o limite de consumo, são lidos uma vez por minuto diretamente do serviço de assinatura, e as porcentagens não são calculadas a partir de totais de tokens, as unidades de texto que modelos de linguagem processam.
O painel também mostra os agentes e subagentes do Codex registrados, com indicadores de requisições observadas. Agentes são as tarefas executadas pelo Codex, e subagentes são trabalhos delegados por elas. É possível inspecionar pedidos capturados, uso de tokens, tempos, resultados e gráficos, além de exportar tudo em CSV, um formato de tabela aberto.
Há limites importantes no que o controle enxerga. Os totais de tokens cobrem apenas os pedidos vistos pelo gateway desde o início do acompanhamento, incluindo as verificações de conta. Não são totais vitalícios da conta nem uma fatura. Pedidos sem campo de uso ficam sem medição.
Instalação e exigências
A instalação documentada é para Windows e tem pré-requisitos claros:
- Windows com Python 3.11, incluindo o lançador
py - Codex já instalado e conectado
- Pelo menos duas contas diferentes para o esquema fazer sentido
O processo clona o repositório do GitHub, roda um script de configuração e outro de inicialização, e o painel abre no navegador no endereço local http://127.0.0.1:4000/. Cada conta adicional ganha sua "mesa" isolada, com processo próprio, até o teto de 26. O login só acontece em auth.openai.com, e a documentação sugere um perfil separado do navegador para a segunda conta quando necessário.
Antes de configurar o Codex, o painel oferece uma verificação de contas que consome um pedido curto por conta. O modelo usado continua vindo da configuração existente do Codex, e todas as contas conectadas precisam ter acesso ao modelo escolhido. Um detalhe prático: conversas antigas podem manter o provedor com que foram criadas, por isso a recomendação é reiniciar o Codex e abrir um chat novo após a configuração.
O que fica no seu computador
Os metadados das requisições são mantidos localmente e sobrevivem a reinícios, mas o texto das conversas não é armazenado no registro de atividade. A pasta de dependências, chamada .runtime, não deve ser movida nem apagada depois da ativação sem restaurar antes o provedor de backup.
Tecnicamente, o gateway é uma implementação própria em FastAPI, um framework de servidor em Python, com auxiliares de OAuth do LiteLLM, e não o proxy completo dessa ferramenta. O roteamento de contas, o controle de uso e a troca automática, contudo, ficam por conta do projeto.
A ressalva fica por conta da própria natureza da ferramenta: trata-se de um experimento independente, sem vínculo com a OpenAI, e quem conecta múltiplas contas a um gateway local precisa saber que o comportamento descrito é o documentado pelo projeto, não uma garantia do serviço de assinatura.

