RAG ponta a ponta: conectando Qdrant, embeddings e LLM
Você vai montar um fluxo RAG completo: gerar embeddings com modelos abertos, indexar e buscar no Qdrant, montar contexto e entregar respostas aumentadas por recuperação usando LLM local. O objetivo é garantir buscas sem hallucination, com contexto relevante para cada pergunta.
