ReAct vs ReWOO: que padrão de execução se adequa ao agente?

Tradução automática

Este artigo foi traduzido automaticamente a partir da versão original em inglês.

Use ReAct quando a ação seguinte depender de um tool result que não consegue prever antecipadamente. Considere ReWOO quando um modelo conseguir descrever os passos necessários e as dependências entre os seus resultados antes da execução. Uma arquitetura com planeador e executor ajuda quando um plano explícito precisa de execução e revisão controladas.

Escolha o padrão com base nas dependências da tarefa e nos requisitos de recuperação de falhas. Depois, meça as chamadas ao modelo e os erros.

Quando é que o modelo examina os tool results?

PadrãoDecisõesCompromisso prático
ReActO modelo escolhe uma ação depois de ler as observaçõesAdapta-se a novas informações, com chamadas repetidas ao modelo
ReWOOO planeador escreve os passos e as referências aos resultados; o módulo de resolução recebe os resultadosMenos contexto de planeamento repetido, com dependências resolvidas durante a execução
Planeador e executorO planeador cria um plano; a execução pode desencadear novo planeamentoProgresso e recuperação explícitos, com estado adicional do plano

O artigo sobre ReAct alterna raciocínio, ações e observações. Isto adequa-se a pesquisas exploratórias em que cada resultado determina a consulta seguinte. Conservar todos os resultados anteriores pode aumentar o comprimento da entrada; a gestão do contexto continua a fazer parte da implementação.

ReWOO separa o planeamento, o trabalho das ferramentas e a síntese final. Os passos podem referir-se a resultados anteriores: primeiro obter uma localização e depois pesquisar restaurantes perto dela. A segunda chamada tem de esperar pela primeira. Só os passos independentes podem ser executados em paralelo.

Defina a recuperação de falhas antes de comparar custos

Um plano precisa de regras para um tool result em falta, argumentos inválidos e um resultado que altere a tarefa. Decida se a execução tenta novamente, para, pede esclarecimentos ou regressa ao planeador. Um plano fixo sem essas regras pode falhar mesmo quando os passos originais pareciam razoáveis.

Execute as mesmas tarefas representativas com os padrões candidatos. Conte as tarefas concluídas com sucesso, as ações erradas, as chamadas ao modelo, as novas tentativas e os tokens, e meça o tempo decorrido. Inclua passos dependentes e falhas de ferramentas; uma demonstração em que tudo corre bem não mostra o comportamento de recuperação.

Não existe uma ordem universal de custo em tokens entre estes padrões. O comprimento da tarefa, o tamanho da saída das ferramentas, as novas tentativas e a implementação podem inverter o resultado da comparação.

Para a escolha prévia do modo de automatização, consulte agente vs fluxo de trabalho. A secção sobre padrões de agentes do LLM Engineering Guide relaciona a orquestração com tool calls e structured output.