RAG (Geração Aumentada por Recuperação)
O assistente que consulta antes de opinar: RAG é a arquitetura em que o modelo, antes de responder, busca trechos relevantes numa base de documentos confiável, normas, relatórios, contratos, e gera a resposta ancorada no que encontrou, idealmente citando as fontes. Ataca de uma vez os dois calcanhares do LLM puro: a alucinação e o conhecimento desatualizado.
Exemplo Prático
Perguntado sobre uma regra de fundos, o assistente com RAG recupera o trecho da resolução vigente e responde com base nele, apontando o documento; o assistente sem RAG responde do que "lembra" do treinamento, que pode ser a norma revogada. Em compliance financeiro, a diferença entre os dois é a diferença entre ferramenta e risco.
PlatomAI Explica
O RAG é a ponte entre a fluência do modelo e a verdade dos documentos: o LLM entra com a linguagem, a base entra com os fatos, e a resposta herda o melhor dos dois, com trilha auditável. É a arquitetura natural da IA em domínios regulados, e a régua desta casa a resume na pergunta de auditoria: "de onde veio essa resposta?", sistema sério aponta o parágrafo-fonte; sistema que não aponta está pedindo a confiança que os verbetes desta vertical ensinaram a não dar de graça.

