How it worksFeaturesDocsEarly accessGitHubDashboard

Como Configurar Limites de Resposta

Limite o quão grande a resposta de uma ferramenta pode ficar antes de chegar à IA, para que uma resposta upstream muito grande não estoure o contexto do cliente de IA.

Passos

  1. Abra o servidor e vá na aba Configurações.

    Abra o servidor de captura cujos limites de resposta serão demonstrados

  2. Encontre Limites de Resposta e habilite.

    Abra a aba Configurações, onde fica o painel Limites de Resposta

    Garanta que Limites de Resposta esteja habilitado para disponibilizar os quatro campos, inclusive ao recuperar uma execução interrompida

  3. Defina os limites que você precisa:

    • Máx. resposta (chars) — o tamanho máximo (em caracteres) do JSON enviado para a IA, de 1.000 a 10.000.000.

    • Profundidade máxima — quantos níveis de aninhamento JSON são mantidos, de 1 a 50.

    • Corte de array — o número máximo de itens mantidos em qualquer array, de 1 a 10.000.

    • Tamanho de truncamento de erro — o tamanho máximo de uma mensagem de erro, de 100 a 1.000.000.

      Defina o número máximo de caracteres da resposta enviada à IA

      Defina quantos níveis do JSON aninhado serão preservados

      Defina o número máximo de itens mantidos em cada array

      Defina o número máximo de caracteres preservados no corpo de um erro

      Restaure o tamanho máximo de resposta do estado-base da fixture

      Restaure a profundidade máxima de JSON do estado-base da fixture

      Restaure o limite de itens por array do estado-base da fixture

      Restaure o tamanho do corpo de erro do estado-base da fixture

      Desabilite Limites de Resposta pelo checkbox para devolver a fixture ao seu estado-base

  4. As mudanças salvam automaticamente um momento depois que você para de digitar.

Confirme que funcionou

Chame uma ferramenta que normalmente retorna uma resposta grande ou profundamente aninhada — a resposta que a IA recebe agora está truncada/limitada de acordo com suas configurações.

Bom saber

  • Isso limita o próprio payload JSON (tamanho, aninhamento, tamanho de array), não um limite bruto de bytes HTTP — é aplicado quando o Arthur mapeia a resposta upstream antes de entregá-la à IA.
  • Útil para APIs que retornam listas grandes ou objetos profundamente aninhados que de outra forma inundariam a janela de contexto da IA.

Relacionado

Vídeo tutorial