Um router de modelos de IA é uma camada que fica entre a sua automação e os modelos de IA: recebe cada pedido, avalia se é simples ou difícil e envia-o para o modelo mais barato que, em princípio, o resolve bem. Os pedidos fáceis (classificar uma fatura comum, separar um email de publicidade) vão para um modelo económico; os difíceis seguem para um modelo de topo. Para uma PME que já usa uma API de IA com volume, por exemplo milhares de documentos por mês, é uma forma direta de reduzir custos da API de IA sem trocar de fornecedor. Com poucas centenas de pedidos por mês, a poupança é de cêntimos e não paga a complexidade.
Este artigo é para quem já tem IA ligada aos seus sistemas; se ainda não chegou aí, comece pelo guia de automação com n8n. Mais conteúdos sobre faturas e documentos na área Administrativo.
O que faz um router de modelos de IA?
Pense numa receção de oficina: a mudança de óleo vai para o mecânico mais novo, o barulho estranho no motor vai para o chefe de oficina. O router faz o mesmo com os pedidos à IA. A sua automação deixa de chamar um modelo concreto e passa a chamar o router, que escolhe o modelo, lhe envia o pedido e devolve a resposta, normalmente com a indicação do modelo usado.
A diferença de preço justifica o esforço. O Claude Opus 5.5 custa cerca de 3,52 € por milhão de tokens de entrada e cerca de 17,61 € por milhão de saída; o Claude Haiku 4.5, o mais económico da Anthropic, custa cerca de 0,88 € e cerca de 4,40 €, quatro vezes menos. Entre o GPT-6 Sol e o GPT-6 Luna, da OpenAI, a distância é de vinte vezes. Um token é um pedaço de texto, um pouco menos do que uma palavra; paga-se pelos tokens que envia e pelos que o modelo escreve. A lista completa de modelos e preços está em novos modelos de IA de setembro de 2026.
Como decide o router?
Há três mecanismos, e a maioria das ofertas combina dois ou três:
- Complexidade do pedido. Um pequeno modelo lê o pedido, estima o tipo e a dificuldade e prevê que modelo dá uma resposta suficientemente boa.
- Escalões de custo. Define até onde está disposto a pagar. O router só escolhe dentro desse escalão, mesmo que um modelo mais caro fosse ligeiramente melhor.
- Alternativa em caso de falha. Se o modelo escolhido falhar, o router tenta o seguinte da lista. Não poupa dinheiro, mas evita que a automação pare.
Que opções existem e quanto custam?
| Opção | Como decide | Custo do router | Notas |
|---|---|---|---|
| OpenRouter Auto Router | Classifica o pedido em cerca de 30 tipos de tarefa e escolhe pelo que a comunidade OpenRouter mais usa para esse tipo, dentro do escalão de custo | Sem custo extra; paga o modelo escolhido | 5 escalões; sem escalão definido, fica perto do mais barato |
| Microsoft Foundry (Azure), model router | Modelo treinado que avalia complexidade e raciocínio; modos Equilibrado, Custo e Qualidade | Cerca de 0,12 € por milhão de tokens de entrada (cerca de 0,14 € na opção Data Zone) | Inclui modelos OpenAI, Anthropic, xAI, DeepSeek e Meta, mas ainda não os de setembro |
| Amazon Bedrock, intelligent prompt routing | Prevê a qualidade da resposta de dois modelos da mesma família e só sobe ao mais caro se a diferença compensar | Cerca de 0,88 € por cada 1000 pedidos | Otimizado só para prompts em inglês; modelos antigos na lista de suportados |
| Not Diamond | Recomenda o modelo; não é ele que faz a ligação ao fornecedor | Cerca de 0,04 € por milhão de tokens encaminhados | Acesso por candidatura; tem um modo em que não vê o conteúdo dos pedidos |
| Regras próprias na n8n | Regras que escreve: modelo barato primeiro, sobe se a resposta não passar num teste | Nenhum, além do tempo de montagem | Controlo total sobre para onde vão os dados |
Valores sem IVA. Não incluímos a Martian, outro fornecedor conhecido de routers, porque não conseguimos confirmar os preços numa página oficial.
OpenRouter Auto Router
A OpenRouter dá acesso a centenas de modelos com uma só conta. O Auto Router, renovado a 10 de agosto de 2026, escolhe o modelo com base no que os clientes da OpenRouter mais gastam em cada tipo de tarefa nos últimos 7 dias, o que o mantém atualizado quando sai um modelo novo. Define o escalão de custo (do mais barato ao mais caro: low, medium, high, xhigh e max) e pode limitar a lista, por exemplo, só a modelos da Anthropic. Segundo a documentação, a classificação dos pedidos é feita sem os guardar, e o router respeita as restrições da conta, incluindo a retenção zero de dados.
Não há taxa pelo router, mas a OpenRouter cobra 5,5% sobre a compra de créditos (8% no plano Business, que permite fixar o processamento na UE). A OpenRouter também aceita uma lista de modelos por ordem de preferência: se o primeiro falhar, tenta o seguinte e cobra apenas o que respondeu.
Microsoft Foundry: model router
Para quem já tem Azure, o model router instala-se como mais um modelo. No modo Custo, aceita uma margem de qualidade maior (a Microsoft dá o exemplo de 5% a 6% abaixo do melhor modelo para aquele pedido) e escolhe o mais barato dentro dela. Pode restringir o conjunto de modelos e, nas implementações Data Zone, a Microsoft diz que respeita os limites da zona de dados; há regiões na UE, como França Central e Suécia Central. A lista atual vai até à família GPT-5.6 e ao Claude Opus 4.8: os modelos de setembro ainda não constam.
Amazon Bedrock: intelligent prompt routing
A Amazon escolhe entre dois modelos da mesma família e só sobe ao mais caro a partir da “diferença de qualidade” que definir. A própria Amazon avisa que o serviço está otimizado só para prompts em inglês, uma limitação séria para faturas e emails em português. E, em pedidos curtos, a taxa por pedido pode comer boa parte da poupança.
A alternativa simples: regras próprias na n8n
Muitas PME não precisam de um router comercial. Na n8n, o nó Model Selector escolhe entre vários modelos ligados, segundo condições que define. Uma receita possível:
- Envia o pedido ao modelo barato e pede-lhe uma resposta em formato fixo, com um campo “confiança”.
- Verifica a resposta com regras simples: o NIF tem 9 dígitos, a categoria existe na lista, a confiança é alta.
- Se falhar, reenvia o mesmo pedido ao modelo de topo.
- Se o modelo de topo também tiver dúvidas, a fatura fica marcada para revisão humana.
É menos sofisticado, mas sabe sempre que modelo respondeu, porquê, e para que fornecedor foram os dados.
Exemplo de contas: 10 000 faturas por mês
Exemplo ilustrativo: uma empresa de distribuição classifica 10 000 faturas de fornecedores por mês em categorias de contabilidade (combustível, material de escritório, subcontratos). O texto de cada fatura já foi extraído; cada pedido leva cerca de 1500 tokens de entrada (fatura e instruções) e devolve cerca de 100 tokens. Ao todo, 15 milhões de tokens de entrada e 1 milhão de saída por mês. Assumimos que 85% das faturas são simples e 15% precisam do modelo de topo. Estes números são hipóteses para mostrar a ordem de grandeza, não medições.
| Cenário | Conta | Custo por mês |
|---|---|---|
| Tudo no Claude Opus 5.5 | 15 × 3,52 € + 1 × 17,61 € | cerca de 70 € |
| Tudo no Claude Haiku 4.5 | 15 × 0,88 € + 1 × 4,40 € | cerca de 18 € |
| Regras na n8n: Haiku primeiro, 15% repetidas no Opus | 18 € + 15% de 70 € | cerca de 28 € |
| Router que decide à partida (85% Haiku, 15% Opus) | 85% de 18 € + 15% de 70 € | cerca de 26 €, mais a taxa do router |
Com um router pago, a taxa soma-se: no exemplo, cerca de 1,85 € no Azure, cerca de 8,81 € no Bedrock (10 000 pedidos) e menos de 1 € na Not Diamond.
Com as regras na n8n, a poupança é de cerca de 42 € por mês, perto de 500 € por ano. Um pormenor joga a favor do router: segundo a Anthropic, os modelos a partir do Claude 4.7 usam um contador de tokens que produz cerca de 30% mais tokens para o mesmo texto, o que torna o Opus 5.5 ainda mais caro do que a tabela sugere face ao Haiku 4.5.
Agora o mesmo exemplo com 500 faturas por mês: tudo no Opus custa cerca de 3,50 €, com regras cerca de 1,40 €. São 2 € por mês. Não compensa uma hora de trabalho de ninguém.
Se as faturas não têm pressa, o processamento em lote corta outros 50% em qualquer dos cenários, como explicamos em IA em lote: como pagar metade. Router e lote combinam-se: o router escolhe o modelo, o lote baixa o preço.
Valores convertidos para euros ao câmbio do BCE de 30 de setembro de 2026. Valores sem IVA.
Quando vale a pena e quando não
Compensa quando:
- tem milhares de pedidos por mês, e a maioria é repetitiva;
- já paga um modelo de topo para tudo, por comodidade;
- consegue verificar automaticamente se a resposta está certa (um NIF, uma categoria de uma lista, um total que bate certo).
Não compensa quando:
- o volume é baixo: abaixo de algumas centenas de euros por ano de fatura de API, o tempo de montagem e de testes custa mais do que se poupa;
- todos os pedidos são difíceis, como resumir contratos longos: o router manda quase tudo para o modelo caro;
- um erro custa caro (uma resposta a um cliente, um valor que entra na contabilidade sem revisão).
Riscos: qualidade e dados
Qualidade. O router acerta na maior parte dos casos, não em todos. Às vezes envia ao modelo barato um pedido que precisava do caro, e ninguém dá por isso. Antes de ligar, compare 100 a 200 pedidos reais com as respostas do modelo de topo; depois, guarde que modelo respondeu a cada pedido e reveja uma amostra todos os meses. Os routers que se atualizam sozinhos podem mudar de comportamento sem aviso.
Dados. Este é o ponto que mais vezes fica esquecido. Com um modelo fixo, sabe para que empresa vão as faturas. Com um router que escolhe entre fornecedores, os dados podem ir para a Anthropic num pedido, para a OpenAI no seguinte e para um fornecedor que nem conhecia no outro. Antes de ligar um router a dados pessoais:
- Limite a lista de modelos aos fornecedores com quem tem acordo de tratamento de dados (o DPA, o contrato que define o que o fornecedor pode fazer com os dados). Todas as opções da tabela o permitem.
- Ative a retenção zero de dados onde existir. Na OpenRouter, há uma definição na conta que só deixa usar fornecedores sem retenção; explicamos o conceito em retenção zero de dados na IA.
- Confirme onde são processados os pedidos: o endereço europeu da OpenRouter, as implementações Data Zone na UE do Azure ou as regiões europeias da Amazon. O tema está desenvolvido em IA com dados na Europa.
- Registe o router no registo de atividades de tratamento, com a lista de subcontratantes possíveis.
Este artigo não é aconselhamento jurídico.
O que fazer esta semana
Abra o painel de custos do seu fornecedor de API e veja, para o último mês, quantos pedidos fez, a que modelo e quanto pagou. Se a fatura for de poucas dezenas de euros, fique como está. Se passar das centenas, peça a quem trata das suas automações um teste simples: 200 pedidos reais no modelo barato, comparados com as respostas do modelo atual. Se 80% ou mais forem iguais, monte primeiro as regras na n8n, com a lista de modelos limitada aos fornecedores com quem já tem contrato. Para pôr lado a lado as horas de montagem e a poupança, use a calculadora de poupança com automação.
Preços e funcionalidades verificados a 1 de outubro de 2026. Valores convertidos para euros ao câmbio do BCE de 30 de setembro de 2026.
Fontes
- OpenRouter: Auto Router (documentação)
- OpenRouter: anúncio do novo Auto Router
- OpenRouter: alternativas de modelo em caso de falha
- OpenRouter: retenção zero de dados
- OpenRouter: planos e preços
- Microsoft Learn: model router no Microsoft Foundry
- Microsoft: API de preços de retalho do Azure (Model Routers)
- AWS: intelligent prompt routing no Amazon Bedrock
- AWS: preços do Amazon Bedrock
- Not Diamond: preços
- n8n: nó Model Selector
- Anthropic: preços da API
- OpenAI: preços da API
- BCE: taxas de câmbio de referência do euro
Escrevemos para quem gere empresas em Portugal. Cada preço tem fonte e data; quando algo muda, atualizamos o artigo.
Precisa de ajuda a implementar?
Trabalhamos com parceiros com experiência a pôr estas ferramentas a funcionar em PME portuguesas. Diga-nos o que quer montar e ligamos-lhe para perceber o que faz sentido, quanto custa e quanto tempo demora.
- Resposta em até 24 horas
- Primeira conversa sem custo nem compromisso
- Pode juntar um apoio do Estado ao projeto, se houver aviso aberto



