O erro "Selected model is at capacity. Please try a different model." passou a aparecer no Codex logo depois que a OpenAI lançou o GPT-6 Astra, no início de setembro de 2026. Trocar de modelo geralmente não resolve, e não é a sua cota que acabou: é o servidor da OpenAI recusando a sessão. Veja como confirmar isso antes de perder tempo, e como configurar um provider de reserva pra não ficar refém de um único motor.
O que significa "Selected model is at capacity"?
É um erro do lado do servidor da OpenAI, não da sua cota. A issue #43738, aberta em 08/09/2026 no repositório oficial do Codex, reúne os relatos: erro recorrente em Astra e nos modelos Sol mais antigos, em CLI, extensão de IDE e na versão web, com janelas de indisponibilidade de mais de 5 horas. Um dos relatos descreve uma tarefa de cerca de 2 horas que consumiu 80% da cota semanal antes de travar com esse erro, sem terminar o trabalho.
É a minha cota ou é o servidor?
Rode /status pra ver a configuração da sessão e o uso de tokens, e /usage pra ver a atividade da conta em janela diária, semanal ou cumulativa. Se a cota está longe do limite e o erro insiste, o problema não é seu.
Confira também status.openai.com antes de tentar comando atrás de comando. Já houve um incidente parecido, declarado e resolvido pela própria OpenAI em 16/06/2026: cerca de 3 horas, classificado como degradação de desempenho nos componentes do Codex.
Trocar de modelo resolve?
Normalmente não. Nos relatos reunidos na issue #43738, trocar de modelo bate no mesmo erro na maior parte das vezes, porque a causa é de admissão e roteamento no servidor, não do modelo específico escolhido. Se a thread ainda guarda o estado da conversa, a próxima requisição que passar retoma o trabalho de onde parou. É a única saída documentada além de esperar.
Dá pra configurar um provider de reserva no Codex?
Dá. O config.toml do Codex aceita múltiplos model_providers, e trocar de motor não exige editar o arquivo toda vez que o erro aparece.
[model_providers.verboo]
name = "Verboo Code"
base_url = "https://code.verboo.ai/router/v1"
env_key = "VERBOO_API_KEY"
wire_api = "chat"
Com a chave exportada (gerada em code.verboo.ai/api-keys):
export VERBOO_API_KEY="sua-chave-aqui"
codex --config model_provider='"verboo"' --model glm-5.2
Isso troca o motor só naquela sessão. Pra deixar reutilizável, salve como perfil em ~/.codex/verboo.config.toml e chame com codex --profile verboo sempre que "at capacity" aparecer de novo.
Configurar esse provider de reserva significa não ficar preso numa fila que só a OpenAI controla. Na Verboo Code os modelos rodam em GPU dedicada, com token ilimitado nos planos Junior a Ultra: veja como configurar em verboo.ai.



