2

Estou testando OmniRoute + OpenCode para centralizar Claude, Codex e Qwen e reduzir custos. Alguém já tentou algo parecido?

Estou tentando montar um setup para conseguir tocar vários projetos usando IA, mas gastando menos e mantendo o contexto o mais centralizado possível.

Antes eu usava Claude Code e Codex separadamente. Funcionava bem, mas além de acabar gastando bastante, meu contexto ficava espalhado entre ferramentas diferentes.

Resolvi então testar uma abordagem usando o OmniRoute para centralizar os modelos/provedores. Atualmente montei um combo com:

  • Claude Code
  • Codex
  • Antigravity CLI
  • Qwen Cloud (peguei o plano mais barato, de ~US$ 6)

Estou usando o OpenCode como harness e o OmniRoute para fazer o roteamento entre os modelos.

O que mais me interessou foi o Auto-Combo do OmniRoute. Pelo que entendi, ele consegue direcionar automaticamente as tarefas para modelos diferentes dependendo da necessidade, usando modelos mais baratos/simples quando são suficientes e deixando os modelos mais poderosos para tarefas que realmente precisam deles.

A ideia é conseguir economizar nas assinaturas/uso e, ao mesmo tempo, centralizar melhor o contexto dos projetos, sem precisar ficar alternando manualmente entre Claude Code, Codex e outras ferramentas.

Ainda estou testando e não consegui chegar a uma conclusão sobre a qualidade.

Alguém aqui já montou um setup parecido usando OmniRoute + OpenCode?

Principalmente quem usa o Auto-Combo: vocês perceberam alguma perda de qualidade, consistência ou contexto em comparação com usar Claude Code/Codex diretamente?

Se a qualidade se mantiver próxima, me parece uma solução muito boa para quem trabalha em vários projetos e quer aproveitar vários modelos sem ficar preso a uma única ferramenta.

Carregando publicação patrocinada...
1

O uso do Auto-Combo eh uma otima sacada, pois ele calcula custo, saude da API, latencia e ate estabilidade em tempo real para tomar a decisao.

Para maximizar a economia no seu plano, tente configurar o Auto-Combo com a estrategia cost ou eco, assim ele sempre prioriza a opcao mais barata que estiver online.

So tome cuidado ao adicionar novos modelos: o OpenCode tem um atraso e nao descobre modelos novos em tempo real nas sessoes abertas, entao lembre de forcar uma sincronizacao ou reinicia-lo quando alterar o OmniRoute.

Ha um detalhe conhecido no OmniRoute onde a selecao do Auto-Combo nao verifica previamente se a janela de contexto do modelo escolhido suporta o tamanho do seu prompt.

Como voce está balanceando tarefas para modelos menores/baratos (como o Qwen que voce mencionou), se o codigo for muito longo, ele pode rotear para um modelo de janela curta e a requisicao vai falhar.

Fora isso, como trabalha-se com chamadas de API, em teoria, nao deveria ter problemas com perda de contexto (exceto tamanho de janela) - mas dependendo de outras funcionalidades que voce ativar (como compressao) isso pode influenciar.

E de uma olhada na opcao "auto" na requisicao de modelo, que ele (deveria) criar um combo virtual ondemand.

1

Hoje ja usa o combo auto e coloquei todos os modelos da anthropic la e do codex tbm alem desses que a qwen disponibiliza, em alguns contextos tava dando 429 na chamada do opus 4.5 e 4.6 ai removi do combo.
Eu queria saber se o fato de usar um harness que nao foi feito pra essas llms poderia prejudicar mais do que ajudar, o que vc acha?

1

Eu uso o plano opencode go no opencode. Pago 10 dólares por mês para usar as principais IA opensource como é o caso do deepseek, glm, kimi, qwen e outros.
Super recomendo.
Se você assinar a partir de um link igual ao link abaixo, você ganha 5 dólares de crédito para usar. No primeiro mês você recebe os limites lá, mas paga só 5 dólares.

https://opencode.ai/go?ref=KSG1MWNK6B

1