wils@web ~ $ cat ~/ajuda/como-escalar-aplicacoes-no-kubernetes-1-26-usando-autoescalamento-de-pods.md

DevOps

Como escalar aplicações no Kubernetes 1.26 usando autoescalamento de pods

atualizado em 12/08/2026

O Kubernetes é uma plataforma poderosa para orquestração de contêineres e o autoescalamento de pods permite que suas aplicações se ajustem automaticamente à demanda. Neste manual, abordaremos como configurar o autoescalamento de pods no Kubernetes 1.26.

Introdução

O Horizontal Pod Autoscaler (HPA) é um recurso do Kubernetes que ajusta automaticamente o número de pods em uma replicação com base em métricas observadas, como uso de CPU ou memória.

Pré-requisitos

  • Kubernetes 1.26 instalado e configurado.
  • kubectl configurado para se conectar ao seu cluster.
  • Metrics Server instalado no cluster.

Passo a Passo para Configurar o Autoescalamento de Pods

1. Instalar o Metrics Server

O Metrics Server é necessário para coletar métricas de uso de recursos. Para instalá-lo, execute:

kubectl apply -f https://github.com/kubernetes-sigs/metrics-server/releases/latest/download/components.yaml

2. Criar um Deployment

Vamos criar um exemplo de Deployment de uma aplicação simples:

kubectl create deployment minha-aplicacao --image=nginx

3. Expor o Deployment como um Serviço

Exponha o Deployment para acessá-lo:

kubectl expose deployment minha-aplicacao --type=LoadBalancer --port=80

4. Criar o Horizontal Pod Autoscaler

Agora, vamos criar o HPA para escalar a aplicação com base no uso de CPU:

kubectl autoscale deployment minha-aplicacao --min=2 --max=10 --cpu-percent=50

5. Verificar o Status do HPA

Para verificar se o HPA está funcionando corretamente, use:

kubectl get hpa

Conclusão

O autoescalamento de pods no Kubernetes é uma maneira eficaz de garantir que sua aplicação tenha a capacidade necessária para lidar com a carga de trabalho. Mantenha sempre monitoradas as métricas de performance e ajuste os limites de escalonamento conforme necessário.

Dica: Considere configurar alertas para monitorar o uso de recursos e ajustar as políticas de escalonamento de acordo com o comportamento da sua aplicação.

Precisa de ajuda com isso no seu servidor? A gente resolve pra você.

falar no WhatsApp

// deu erro ou não funcionou?

Achou algo errado neste manual?

Conta pra gente o que deu errado ou qual erro apareceu — a gente corrige. Se quiser retorno, deixe seu contato.