Tecnologia Python

IA aplicada com Ollama e modelos abertos: LLMs locais, RAG e agentes

Este curso ensina como rodar modelos de linguagem de grande porte (LLMs) localmente com o Ollama, integrando-os ao Open WebUI e usando técnicas como RAG (Retrieval-Augmented Generation) com bancos vetoriais abertos, como o Qdrant. Você vai entender desde a arquitetura…

Cache, filas e workers: lidando com aumento de carga

Quando a aplicação Django começa a receber mais tráfego, gargalos aparecem. Cache e processamento assíncrono são essenciais para manter desempenho e evitar sobrecarga. Nesta lição, você aprende a usar Redis para cache, Celery para filas e como configurar workers para escalar de verdade.