Monte o pipeline RAG

Ordene as etapas de um sistema RAG respondendo uma pergunta.

RAG (Retrieval-Augmented Generation): a IA busca o contexto antes de responder.

Um RAG não responde de cabeça: ele busca o contexto primeiro. Monte a ordem. ⚗️
  1. 1Montar o prompt colocando os trechos como contexto.
  2. 2Receber a pergunta do usuário.
  3. 3A LLM gera a resposta usando esse contexto.
  4. 4Buscar na base os trechos mais parecidos com a pergunta.
  5. 5Devolver a resposta com as fontes citadas.