Escolher um modelo para o agente: capacidade, latência e custo

Frameworks e modelos 8 min de leitura

Uma balança desenhada em papel pesa velocidade contra precisão, ao lado de um portátil
Cada passo da execução tem a sua própria resposta a esta pergunta.

A pergunta que se faz é qual o melhor modelo para agentes. A que produz um bom sistema é: qual o melhor modelo para este passo, nos nossos dados, dentro do nosso orçamento de latência — e a resposta é normalmente mais do que um.

Uma execução não é homogénea. Decidir a ação seguinte exige raciocínio. Extrair três campos de um documento não. Resumir um resultado para o utilizador também não.

Dividam a execução antes de escolher#

Escolher um modelo para o agente: capacidade, latência e custo — Dividam a execução antes de escolher
PassoO que exigeNível de modelo sensato
Planear ou escolher açãoRaciocínio, seguir instruçõesO mais forte que puderem pagar
Chamar ferramenta com argumentosSaída estruturada fiávelGama média com esquemas estritos
Extrair campos de um resultadoPrecisão em texto curtoPequeno e rápido
Classificar ou encaminharConsistênciaPequeno ou classificador afinado
Escrever a resposta ao utilizadorTom e clarezaGama média

Os benchmarks fazem a lista curta, não a decisão#

Os benchmarks públicos dizem que modelos são plausíveis. Não dizem qual aguenta os vossos esquemas, formatos e clientes difíceis. Construam trinta casos reais dos vossos registos e passem a lista curta por eles.

Incluam casos em que o correto é recusar ou perguntar.

As três restrições que apertam#

  1. Piso de latência: cada chamada tem um e um agente faz várias.
  2. Fiabilidade da saída estruturada: 97% de argumentos válidos parte uma execução em dez com três chamadas.
  3. Comportamento com contexto: contexto longo custa e dilui a atenção.

Encaminhamento sem projeto de investigação#

O encaminhamento de modelos soa sofisticado e costuma ser um ficheiro de configuração. Modelo por omissão por tipo de passo, substituição por ferramenta e registo de que modelo produziu que decisão.

Perguntas frequentes

Uso o maior modelo para tudo?

Só se não mediram. O passo de decisão costuma beneficiar; extração, classificação e formatação raramente.

Os modelos abertos servem para agentes?

Para passos estreitos com esquemas estritos muitas vezes sim.

Com que frequência rever a escolha?

Em cada versão que possam adotar e, de resto, a cada dois trimestres.

escolher llmseleção de modelo para agentesencaminhamento de modeloslatência de agentessaída estruturada

Todos os guias

Última atualização 2026-08-04 por aiagentdevelopment.info · Sobre nós

Escrito por quem constrói

Cada guia é escrito por engenheiros que operam agentes em produção, não reescrito a partir de outros sites.

Revisto com regularidade

A área muda depressa. Cada guia traz a data da última revisão, publicada mesmo quando nada mudou.

Sem espaços pagos

Nenhum fornecedor de modelos, framework ou plataforma pode comprar uma menção, uma posição ou uma ligação.

Doze idiomas

Cada guia é traduzido, não substituído por máquina — cada idioma tem o seu URL e a sua data de revisão.

Limites nomeados

Dizemos com clareza quando uma tarefa não precisa de agente e um script simples sairia mais barato e mais fiável.