Lição 0: Por que uma camada de IA dedicada?
Um projeto de IA começa pequeno: um componente chama a API do LLM diretamente, e funciona muito bem. Depois se adiciona uma segunda funcionalidade — um chatbot de suporte, digamos — e ela chama a mesma API de novo, a partir de um lugar completamente diferente do código. Depois uma terceira funcional
Como uma única estação da cozinha que prepara cada prato do restaurante, em vez de três cozinheiros improvisando cada um no seu canto — quando um ingrediente muda, você muda em um lugar só, não em três cantos diferentes.
- Camada de IA
- Um único módulo dedicado que centraliza cada chamada ao LLM, o retrieval e a construção do prompt, de modo que o resto do app o chama sem saber quais detalhes internos podem mudar.
- Guardrails
- Mecanismos de proteção que impedem que um utilizador manipule o prompt para vazar instruções de sistema ou levar o modelo a um comportamento não pretendido.
- Fallback e Retry
- Lógica que tenta novamente ou muda para um provedor alternativo quando uma chamada ao modelo falha ou retorna um erro temporário.
- Observabilidade
- A capacidade de ver exatamente o que foi enviado ao modelo e o que voltou — essencial para depuração e para acompanhar custo e qualidade.