wils@web ~ $ cat ~/ajuda/como-escalar-aplicacoes-em-kubernetes-1-26-usando-hpa-guia-pratico.md

DevOps

Como escalar aplicações em Kubernetes 1.26 usando HPA: Guia prático

atualizado em 31/08/2026

O Horizontal Pod Autoscaler (HPA) é uma ferramenta poderosa do Kubernetes que permite escalar automaticamente o número de pods de uma aplicação com base em métricas observadas, como uso de CPU ou memória. Neste guia prático, abordaremos como configurar e usar o HPA na versão 1.26 do Kubernetes.

Pré-requisitos

  • Cluster Kubernetes 1.26 em funcionamento.
  • kubectl instalado e configurado.
  • Metrics Server instalado no cluster.

Passo a Passo para Configurar HPA

1. Verifique o Metrics Server

Primeiro, certifique-se de que o Metrics Server está instalado e funcionando corretamente. Execute o seguinte comando:

kubectl get pods -n kube-system

2. Criar um Deployment

Vamos criar um Deployment simples para exemplificar. Execute:

kubectl create deployment minha-aplicacao --image=nginx

3. Expor o Deployment

Exponha o Deployment como um serviço:

kubectl expose deployment minha-aplicacao --port=80 --target-port=80 --name=minha-aplicacao-service

4. Criar o HPA

Agora, crie o Horizontal Pod Autoscaler. Neste exemplo, escalaremos a aplicação com base no uso de CPU:

kubectl autoscale deployment minha-aplicacao --cpu-percent=50 --min=1 --max=10

5. Monitorar o HPA

Para verificar o status do HPA, utilize o comando:

kubectl get hpa

6. Testar o Escalonamento

Para simular carga e testar o escalonamento, você pode usar ferramentas como stress ou hey. Por exemplo:

kubectl run -i --tty load-generator --image=busybox /bin/sh -c 'while true; do wget -q -O- http://minha-aplicacao-service; done'

Conclusão

O HPA é uma ferramenta essencial para gerenciar a escalabilidade de suas aplicações no Kubernetes. Ao monitorar e ajustar automaticamente o número de pods, você garante que sua aplicação se mantenha responsiva sob diferentes cargas de trabalho. Dica: Sempre monitore as métricas e ajuste os limites de CPU e memória conforme necessário para otimizar o desempenho.

Precisa de ajuda com isso no seu servidor? A gente resolve pra você.

falar no WhatsApp

// deu erro ou não funcionou?

Achou algo errado neste manual?

Conta pra gente o que deu errado ou qual erro apareceu — a gente corrige. Se quiser retorno, deixe seu contato.