Como Configurar Limites de Resposta
Limite o quão grande a resposta de uma ferramenta pode ficar antes de chegar à IA, para que uma resposta upstream muito grande não estoure o contexto do cliente de IA.
Passos
Abra o servidor e vá na aba Configurações.

Encontre Limites de Resposta e habilite.


Defina os limites que você precisa:
Máx. resposta (chars) — o tamanho máximo (em caracteres) do JSON enviado para a IA, de 1.000 a 10.000.000.
Profundidade máxima — quantos níveis de aninhamento JSON são mantidos, de 1 a 50.
Corte de array — o número máximo de itens mantidos em qualquer array, de 1 a 10.000.
Tamanho de truncamento de erro — o tamanho máximo de uma mensagem de erro, de 100 a 1.000.000.









As mudanças salvam automaticamente um momento depois que você para de digitar.
Confirme que funcionou
Chame uma ferramenta que normalmente retorna uma resposta grande ou profundamente aninhada — a resposta que a IA recebe agora está truncada/limitada de acordo com suas configurações.
Bom saber
- Isso limita o próprio payload JSON (tamanho, aninhamento, tamanho de array), não um limite bruto de bytes HTTP — é aplicado quando o Arthur mapeia a resposta upstream antes de entregá-la à IA.
- Útil para APIs que retornam listas grandes ou objetos profundamente aninhados que de outra forma inundariam a janela de contexto da IA.
Relacionado
Vídeo tutorial