Tecnologia Zookeeper

Controle de acesso: permissões e ACLs no Kafka

O Apache Kafka utiliza listas de controle de acesso (ACLs) para definir quem pode produzir, consumir e administrar tópicos. O gerenciamento correto dessas permissões é essencial para proteger dados e operações em ambientes críticos.

Kafka Streams: processamento de eventos em tempo real

Kafka Streams permite criar aplicações de processamento de eventos em tempo real diretamente sobre tópicos Kafka, sem a complexidade de clusters externos. Ele oferece operações de transformação, agregação, join e gerenciamento de estado local, tornando possível desenvolver pipelines de dados robustos e escaláveis.

Kafka Connect: integrando bancos de dados relacionais e NoSQL

Kafka Connect é o framework oficial do Apache Kafka para integração de dados entre sistemas externos e o cluster Kafka. Ele permite conectar bancos relacionais, NoSQL e outros sistemas de forma escalável e resiliente, automatizando ingestão e exportação de dados sem código customizado.

Ajustando produtores e consumidores para alta performance

A performance do Apache Kafka depende de ajustes finos nos parâmetros dos clientes. Entenda como batch.size, linger.ms e buffer.memory afetam a latência e throughput do produtor, e como fetch.min.bytes e max.poll.records impactam o consumidor. Timeouts, controle de erros e monitoramento completam o cenário de alta performance.

Parâmetros essenciais: retenção, compactação e limites

A retenção e a compactação de logs no Apache Kafka determinam até quando e como os dados ficam disponíveis, impactando performance e confiabilidade. Ajustar limites de tamanho de mensagens e partições é fundamental para evitar perda de dados e gargalos.

Produzindo e consumindo mensagens na prática

Aprenda a criar tópicos, produzir e consumir mensagens no Apache Kafka usando apenas as ferramentas de linha de comando. Veja como testar offsets e grupos de consumidores para garantir o fluxo correto dos dados.

Instalando Apache Kafka e Zookeeper do zero

Instalar Apache Kafka exige atenção aos pré-requisitos e à ordem de inicialização dos serviços. Nesta lição, você aprende a baixar, configurar e executar Kafka e Zookeeper em modo standalone, além de validar o funcionamento com comandos nativos.

Planejamento de recursos: CPU, memória, disco e rede

Dimensionar corretamente CPU, memória, disco e rede é essencial para um cluster Kafka estável e eficiente. Cada recurso impacta diretamente throughput, latência e disponibilidade. Essa lição mostra como planejar esses recursos, com exemplos reais e recomendações baseadas na documentação oficial.

Calculando throughput, latência e armazenamento

Dimensionar um cluster Kafka exige entender o volume de dados, a taxa de eventos, a latência e o impacto das políticas de retenção e compactação. Sem essas estimativas, você corre o risco de gargalos e perda de dados.

Modelando mensagens e contratos de dados

Modelar mensagens e contratos de dados no Apache Kafka exige padronização, versionamento seguro e validação rigorosa. Escolher entre Avro, JSON e Protobuf impacta diretamente a evolução dos schemas e a governança dos dados trafegados.

Definindo tópicos e partições para performance e resiliência

Projetar tópicos e partições no Apache Kafka é o que determina o throughput e a resiliência da sua arquitetura. A escolha de partições, tópicos e políticas de replicação precisa alinhar requisitos de negócio com limitações físicas e operacionais do cluster.