Saltar para o conteúdo
Superinteligência ArtificialResumo semanal

Routers de modelos de IA: o modelo mais barato para cada pedido

Um router de modelos de IA manda cada pedido para o modelo mais barato que o resolve. Opções, contas em euros, quando compensa e o que verificar nos dados.

Redação10 min de leitura

Um router de modelos de IA é uma camada que fica entre a sua automação e os modelos de IA: recebe cada pedido, avalia se é simples ou difícil e envia-o para o modelo mais barato que, em princípio, o resolve bem. Os pedidos fáceis (classificar uma fatura comum, separar um email de publicidade) vão para um modelo económico; os difíceis seguem para um modelo de topo. Para uma PME que já usa uma API de IA com volume, por exemplo milhares de documentos por mês, é uma forma direta de reduzir custos da API de IA sem trocar de fornecedor. Com poucas centenas de pedidos por mês, a poupança é de cêntimos e não paga a complexidade.

Este artigo é para quem já tem IA ligada aos seus sistemas; se ainda não chegou aí, comece pelo guia de automação com n8n. Mais conteúdos sobre faturas e documentos na área Administrativo.

O que faz um router de modelos de IA?

Pense numa receção de oficina: a mudança de óleo vai para o mecânico mais novo, o barulho estranho no motor vai para o chefe de oficina. O router faz o mesmo com os pedidos à IA. A sua automação deixa de chamar um modelo concreto e passa a chamar o router, que escolhe o modelo, lhe envia o pedido e devolve a resposta, normalmente com a indicação do modelo usado.

A diferença de preço justifica o esforço. O Claude Opus 5.5 custa cerca de 3,52 € por milhão de tokens de entrada e cerca de 17,61 € por milhão de saída; o Claude Haiku 4.5, o mais económico da Anthropic, custa cerca de 0,88 € e cerca de 4,40 €, quatro vezes menos. Entre o GPT-6 Sol e o GPT-6 Luna, da OpenAI, a distância é de vinte vezes. Um token é um pedaço de texto, um pouco menos do que uma palavra; paga-se pelos tokens que envia e pelos que o modelo escreve. A lista completa de modelos e preços está em novos modelos de IA de setembro de 2026.

Como decide o router?

Há três mecanismos, e a maioria das ofertas combina dois ou três:

  • Complexidade do pedido. Um pequeno modelo lê o pedido, estima o tipo e a dificuldade e prevê que modelo dá uma resposta suficientemente boa.
  • Escalões de custo. Define até onde está disposto a pagar. O router só escolhe dentro desse escalão, mesmo que um modelo mais caro fosse ligeiramente melhor.
  • Alternativa em caso de falha. Se o modelo escolhido falhar, o router tenta o seguinte da lista. Não poupa dinheiro, mas evita que a automação pare.

Que opções existem e quanto custam?

OpçãoComo decideCusto do routerNotas
OpenRouter Auto RouterClassifica o pedido em cerca de 30 tipos de tarefa e escolhe pelo que a comunidade OpenRouter mais usa para esse tipo, dentro do escalão de custoSem custo extra; paga o modelo escolhido5 escalões; sem escalão definido, fica perto do mais barato
Microsoft Foundry (Azure), model routerModelo treinado que avalia complexidade e raciocínio; modos Equilibrado, Custo e QualidadeCerca de 0,12 € por milhão de tokens de entrada (cerca de 0,14 € na opção Data Zone)Inclui modelos OpenAI, Anthropic, xAI, DeepSeek e Meta, mas ainda não os de setembro
Amazon Bedrock, intelligent prompt routingPrevê a qualidade da resposta de dois modelos da mesma família e só sobe ao mais caro se a diferença compensarCerca de 0,88 € por cada 1000 pedidosOtimizado só para prompts em inglês; modelos antigos na lista de suportados
Not DiamondRecomenda o modelo; não é ele que faz a ligação ao fornecedorCerca de 0,04 € por milhão de tokens encaminhadosAcesso por candidatura; tem um modo em que não vê o conteúdo dos pedidos
Regras próprias na n8nRegras que escreve: modelo barato primeiro, sobe se a resposta não passar num testeNenhum, além do tempo de montagemControlo total sobre para onde vão os dados

Valores sem IVA. Não incluímos a Martian, outro fornecedor conhecido de routers, porque não conseguimos confirmar os preços numa página oficial.

OpenRouter Auto Router

A OpenRouter dá acesso a centenas de modelos com uma só conta. O Auto Router, renovado a 10 de agosto de 2026, escolhe o modelo com base no que os clientes da OpenRouter mais gastam em cada tipo de tarefa nos últimos 7 dias, o que o mantém atualizado quando sai um modelo novo. Define o escalão de custo (do mais barato ao mais caro: low, medium, high, xhigh e max) e pode limitar a lista, por exemplo, só a modelos da Anthropic. Segundo a documentação, a classificação dos pedidos é feita sem os guardar, e o router respeita as restrições da conta, incluindo a retenção zero de dados.

Não há taxa pelo router, mas a OpenRouter cobra 5,5% sobre a compra de créditos (8% no plano Business, que permite fixar o processamento na UE). A OpenRouter também aceita uma lista de modelos por ordem de preferência: se o primeiro falhar, tenta o seguinte e cobra apenas o que respondeu.

Microsoft Foundry: model router

Para quem já tem Azure, o model router instala-se como mais um modelo. No modo Custo, aceita uma margem de qualidade maior (a Microsoft dá o exemplo de 5% a 6% abaixo do melhor modelo para aquele pedido) e escolhe o mais barato dentro dela. Pode restringir o conjunto de modelos e, nas implementações Data Zone, a Microsoft diz que respeita os limites da zona de dados; há regiões na UE, como França Central e Suécia Central. A lista atual vai até à família GPT-5.6 e ao Claude Opus 4.8: os modelos de setembro ainda não constam.

Amazon Bedrock: intelligent prompt routing

A Amazon escolhe entre dois modelos da mesma família e só sobe ao mais caro a partir da “diferença de qualidade” que definir. A própria Amazon avisa que o serviço está otimizado só para prompts em inglês, uma limitação séria para faturas e emails em português. E, em pedidos curtos, a taxa por pedido pode comer boa parte da poupança.

A alternativa simples: regras próprias na n8n

Muitas PME não precisam de um router comercial. Na n8n, o nó Model Selector escolhe entre vários modelos ligados, segundo condições que define. Uma receita possível:

  1. Envia o pedido ao modelo barato e pede-lhe uma resposta em formato fixo, com um campo “confiança”.
  2. Verifica a resposta com regras simples: o NIF tem 9 dígitos, a categoria existe na lista, a confiança é alta.
  3. Se falhar, reenvia o mesmo pedido ao modelo de topo.
  4. Se o modelo de topo também tiver dúvidas, a fatura fica marcada para revisão humana.

É menos sofisticado, mas sabe sempre que modelo respondeu, porquê, e para que fornecedor foram os dados.

Exemplo de contas: 10 000 faturas por mês

Exemplo ilustrativo: uma empresa de distribuição classifica 10 000 faturas de fornecedores por mês em categorias de contabilidade (combustível, material de escritório, subcontratos). O texto de cada fatura já foi extraído; cada pedido leva cerca de 1500 tokens de entrada (fatura e instruções) e devolve cerca de 100 tokens. Ao todo, 15 milhões de tokens de entrada e 1 milhão de saída por mês. Assumimos que 85% das faturas são simples e 15% precisam do modelo de topo. Estes números são hipóteses para mostrar a ordem de grandeza, não medições.

CenárioContaCusto por mês
Tudo no Claude Opus 5.515 × 3,52 € + 1 × 17,61 €cerca de 70 €
Tudo no Claude Haiku 4.515 × 0,88 € + 1 × 4,40 €cerca de 18 €
Regras na n8n: Haiku primeiro, 15% repetidas no Opus18 € + 15% de 70 €cerca de 28 €
Router que decide à partida (85% Haiku, 15% Opus)85% de 18 € + 15% de 70 €cerca de 26 €, mais a taxa do router

Com um router pago, a taxa soma-se: no exemplo, cerca de 1,85 € no Azure, cerca de 8,81 € no Bedrock (10 000 pedidos) e menos de 1 € na Not Diamond.

Com as regras na n8n, a poupança é de cerca de 42 € por mês, perto de 500 € por ano. Um pormenor joga a favor do router: segundo a Anthropic, os modelos a partir do Claude 4.7 usam um contador de tokens que produz cerca de 30% mais tokens para o mesmo texto, o que torna o Opus 5.5 ainda mais caro do que a tabela sugere face ao Haiku 4.5.

Agora o mesmo exemplo com 500 faturas por mês: tudo no Opus custa cerca de 3,50 €, com regras cerca de 1,40 €. São 2 € por mês. Não compensa uma hora de trabalho de ninguém.

Se as faturas não têm pressa, o processamento em lote corta outros 50% em qualquer dos cenários, como explicamos em IA em lote: como pagar metade. Router e lote combinam-se: o router escolhe o modelo, o lote baixa o preço.

Valores convertidos para euros ao câmbio do BCE de 30 de setembro de 2026. Valores sem IVA.

Quando vale a pena e quando não

Compensa quando:

  • tem milhares de pedidos por mês, e a maioria é repetitiva;
  • já paga um modelo de topo para tudo, por comodidade;
  • consegue verificar automaticamente se a resposta está certa (um NIF, uma categoria de uma lista, um total que bate certo).

Não compensa quando:

  • o volume é baixo: abaixo de algumas centenas de euros por ano de fatura de API, o tempo de montagem e de testes custa mais do que se poupa;
  • todos os pedidos são difíceis, como resumir contratos longos: o router manda quase tudo para o modelo caro;
  • um erro custa caro (uma resposta a um cliente, um valor que entra na contabilidade sem revisão).

Riscos: qualidade e dados

Qualidade. O router acerta na maior parte dos casos, não em todos. Às vezes envia ao modelo barato um pedido que precisava do caro, e ninguém dá por isso. Antes de ligar, compare 100 a 200 pedidos reais com as respostas do modelo de topo; depois, guarde que modelo respondeu a cada pedido e reveja uma amostra todos os meses. Os routers que se atualizam sozinhos podem mudar de comportamento sem aviso.

Dados. Este é o ponto que mais vezes fica esquecido. Com um modelo fixo, sabe para que empresa vão as faturas. Com um router que escolhe entre fornecedores, os dados podem ir para a Anthropic num pedido, para a OpenAI no seguinte e para um fornecedor que nem conhecia no outro. Antes de ligar um router a dados pessoais:

  1. Limite a lista de modelos aos fornecedores com quem tem acordo de tratamento de dados (o DPA, o contrato que define o que o fornecedor pode fazer com os dados). Todas as opções da tabela o permitem.
  2. Ative a retenção zero de dados onde existir. Na OpenRouter, há uma definição na conta que só deixa usar fornecedores sem retenção; explicamos o conceito em retenção zero de dados na IA.
  3. Confirme onde são processados os pedidos: o endereço europeu da OpenRouter, as implementações Data Zone na UE do Azure ou as regiões europeias da Amazon. O tema está desenvolvido em IA com dados na Europa.
  4. Registe o router no registo de atividades de tratamento, com a lista de subcontratantes possíveis.

Este artigo não é aconselhamento jurídico.

O que fazer esta semana

Abra o painel de custos do seu fornecedor de API e veja, para o último mês, quantos pedidos fez, a que modelo e quanto pagou. Se a fatura for de poucas dezenas de euros, fique como está. Se passar das centenas, peça a quem trata das suas automações um teste simples: 200 pedidos reais no modelo barato, comparados com as respostas do modelo atual. Se 80% ou mais forem iguais, monte primeiro as regras na n8n, com a lista de modelos limitada aos fornecedores com quem já tem contrato. Para pôr lado a lado as horas de montagem e a poupança, use a calculadora de poupança com automação.

Preços e funcionalidades verificados a 1 de outubro de 2026. Valores convertidos para euros ao câmbio do BCE de 30 de setembro de 2026.

Fontes

Redação Superinteligência Artificial

Escrevemos para quem gere empresas em Portugal. Cada preço tem fonte e data; quando algo muda, atualizamos o artigo.

Precisa de ajuda a implementar?

Trabalhamos com parceiros com experiência a pôr estas ferramentas a funcionar em PME portuguesas. Diga-nos o que quer montar e ligamos-lhe para perceber o que faz sentido, quanto custa e quanto tempo demora.

  • Resposta em até 24 horas
  • Primeira conversa sem custo nem compromisso
  • Pode juntar um apoio do Estado ao projeto, se houver aviso aberto

Continue a ler