Flowbix · AWS ECS · Containers
CADA TASK NO AR, UMA SÓ TELA.
Monitoramento de clusters Amazon ECS e Fargate em tempo real — serviços e tasks (running/pending/desired), CPU e memória reservadas e utilizadas, storage efêmero e rede do Fargate. Do cluster EC2 ao serverless, consolidado numa única sala de operação sobre Zabbix (CloudWatch).
99,7%
Tasks saudáveis · ECS/Fargate
/ CLUSTERS
ATIVOS
8
EC25
Fargate3
/ TASKS
AO VIVO
Running428/432
Pending4
/ SERVIÇOS
ESTÁVEIS
64
Estáveis61
Degradados3
/ CPU · MEMÓRIA
AO VIVO
58%
CPU reservation58%
Memória64%
/ FARGATE
SERVERLESS
148 tasks
Storage efêmero62%
vCPU alocada96
/ ALARMES
ATENÇÃO
4
Em ALARM1
Cluster >70%2
Sala de operação de containers
Clusters ECS & Fargate em tempo real
8
Clusters
428
Tasks running
64
Serviços
58%
CPU média
24×7
Monitoramento
01/08
Consolidação Flowbix · Amazon ECS/Fargate4 fontes → 1 NOC
CloudWatchus-east-15 clusters
CloudWatchsa-east-13 clusters
CloudWatchalarms4 ALARM
ZabbixHTTP2,4k itens
consolidado
NOC Cloud · ECS
Clusters · Serviços/Tasks · CPU/Mem · Fargate · Alarmes — uma tela, ao vivo
Índice operacional consolidado97,2/100
8
Clusters · 5 EC2 · 3 FG
428/432
Tasks running · 4 pending
64
Serviços · 61 estáveis
58%
CPU méd · Mem 64%
148
Fargate tasks · 12 svc
4
Em ALARM · 0 críticos
01 · CLUSTERSONLINE
Clusters & Visão
8 clusters ECS — instâncias, tasks e reserva de CPU.
Clusters8
EC2 / FG5/3
Instâncias34
Tasks428/432
Serviços64
CPU reserv.71%
Net rx1,8 Gb/s
Net tx1,2 Gb/s
Tasks ativas · 24 hmáx 432
−24 h−12 hagora
Tasks por cluster · top 33 de 8
8 clusters · 34 instâncias · 428 tasks ativas
02 · SERVIÇOSAO VIVO
Serviços & Tasks
running / pending / desired por serviço (LLD).
Serviços64
Running428
Desired432
Pending4
Estáveis61
Em deploy3
Task sets5
Restart 24h12
Tasks running · 24 hmáx 434
−24 h−12 hagora
Tasks por serviço · top 3rollout ativo
428/432 tasks · 4 pending · 3 em rollout
03 · CPU/MEMATENÇÃO
CPU & Memória
utilização vs. reserva — cluster e serviço.
CPU cluster58%
Mem cluster64%
CPU pico82%
Mem pico88%
CPU reserv.71%
Mem reserv.76%
Svc >80%3
Throttle0
CPU util · % · 24 h · limiar 80máx 82
−24 h−12 hagora
Uso CPU por serviço · limiar 80%3 >80%
CPU 58% · Mem 64% · 3 serviços >80%
04 · FARGATESERVERLESS
Fargate · Storage & Rede
storage efêmero e rede das tasks serverless.
FG tasks148
Serviços FG12
Storage ef.62%
Efêm. usado1,3 TB
Disk util58%
Rd/Wr240 MB/s
Net rx820 Mb/s
Net tx540 Mb/s
Storage efêmero · % · 24 hmáx 66
−24 h−12 hagora
Storage efêmero por svc FG · %62% méd
148 tasks · 1,3 TB efêmero · rede 1,36 Gb/s
05 · ALARMES4 ATIVOS
Alarmes CloudWatch
estado OK / INSUFFICIENT / ALARM por métrica.
Configurados128
Em ALARM4
OK121
Insuf. dados3
Críticos0
Warning4
MTTA3 min
MTTR18 min
Alarmes ativos · 24 hmáx 7
−24 h−12 hagora
Estado alarmes · 16 janelas 1,5 h4 warn · 1 alert
4 em ALARM · 0 críticos · 121 OK
Flowbix · AWS ECS · 5 dashboards numa sessão
02 / 08
Clusters8/8 ativos
8
5 EC2 · 3 Fargate
Tasks running4 pending
428/432
280 EC2 · 148 Fargate · desired 432
Serviçosestável
64
62 stable · 2 deploying
Container inst.EC2/ASG
22
3 AZ · 0 draining
Fargate tasksserverless
148
112 FARGATE · 36 SPOT · 0 provisioning
CPU & memória dos clusters · 24hmeta 70%
100,0 %75,0 %50,0 %25,0 %0,0 %
00h04h08h12h16h20h24h
CPU reservadaMemóriameta 70%% reservado agregado · 8 clusters
Por clusterCPU / Mem
Tasks EC2 · Fargate280 · 148
Capacity providersFARGATE · SPOT · EC2/ASG
CPU / Mem médio (cluster)51% · 58%
Clusters6 normais · 2 atenção
| Cluster | Tipo | Inst. | Svc | Tasks | CPU% | Mem% | Status |
|---|---|---|---|---|---|---|---|
| ecs-prod-cluster | EC2 | 8 | 16 | 118 | 64 | 71 | Mem alta |
| ecs-prod-fargate | Fargate | — | 10 | 72 | 58 | 63 | Normal |
| ecs-api-cluster | EC2 | 5 | 12 | 74 | 68 | 66 | Normal |
| ecs-worker-cluster | EC2 | 4 | 9 | 52 | 55 | 60 | Normal |
| ecs-ingest-fargate | Fargate | — | 5 | 48 | 74 | 69 | CPU alta |
| ecs-staging-cluster | EC2 | 3 | 6 | 24 | 34 | 41 | Normal |
| ecs-batch-fargate | Fargate | — | 3 | 28 | 41 | 52 | Normal |
| ecs-edge-cluster | EC2 | 2 | 3 | 12 | 18 | 27 | Normal |
Distribuiçãolaunch type
Clusters EC2 · Fargate5 · 3
Serviços EC2 · Fargate46 · 18
Container instances (EC2)22 · 3 AZ
Tasks running / desired428 / 432
Flowbix · Clusters · CPU/mem reservation, tasks e services
03 / 08
Serviços2 clusters
64
52 EC2 · 12 Fargate
Running / Desired99,1%
428/432
4 tasks abaixo do desejado
Pendingprovisionando
4
3 svc · início < 60 s
DegradadosCPU/mem >80%
3
1 alert · 2 warn
Task setsblue/green · CODE_DEPLOY
5 ativos
3 PRIMARY · 2 canário (ACTIVE) · 0 rollback · 2 deploys rolling
Tasks por estado · agrupado por serviço3 degradados
running
pending / provisionando
stopped
1 bloco = 1 task · top 12 de 64 svc
svc-api16/16
svc-worker14/14
svc-web12/12
svc-search10/12
fargate-ingest10/10
svc-cart9/9
svc-auth8/8
svc-media6/8
svc-payments7/7
svc-notify6/6
svc-graphql5/6
svc-reports4/4
+52 serviços · 321 tasks running · 100%428 running · 4 pending · 2 stopped
Tasks running vs desired · 24h2 séries · gap 4
440430420410400
00h04h08h12h16h20h24h
running (tasks) desired (tasks)- - SLO ≥ 420 · vale 421 às 04h40 · gap atual 4
Serviços · running / pending / desired8 de 64 · ordenado por risco
| Serviço | Cluster | Run | Pend | Desej. | CPU% | Mem% | Estado |
|---|---|---|---|---|---|---|---|
| svc-media | ecs-prod-cluster | 6 | 1 | 8 | 74 | 88 | Degradado |
| svc-search | ecs-prod-cluster | 10 | 2 | 12 | 82 | 61 | Degradado |
| svc-graphql | ecs-stage-cluster | 5 | 1 | 6 | 44 | 52 | Deploy |
| svc-worker | ecs-prod-cluster | 14 | 0 | 14 | 71 | 66 | Normal |
| svc-api | ecs-prod-cluster | 16 | 0 | 16 | 63 | 58 | Normal |
| fargate-ingest | ecs-prod-cluster | 10 | 0 | 10 | 48 | 57 | Normal |
| svc-payments | ecs-prod-cluster | 7 | 0 | 7 | 39 | 44 | Normal |
| svc-auth | ecs-stage-cluster | 8 | 0 | 8 | 33 | 41 | Normal |
+56 serviços · 100% running · CPU méd. 41% · Mem méd. 49%Σ 64 svc · 428/432 tasks · gatilho CPU/mem >80%
Saúde dos serviços3 degradados
Estáveis61 svc
Degradados · CPU/mem >80%3 svc
Desired não atingido4 tasks
Deployments em andamento2 rolling
Task sets ativos5 · 3 PRIMARY
Alarmes CloudWatch em ALARM2
Flowbix · Serviços · running/pending/desired por serviço
04 / 08
CPU cluster media< 70%
58%
meta < 70% · pico 24h 66%
Memoria cluster< 80%
64%
meta < 80% · pico 24h 72%
Clusters > 70%nenhum
0/2
prod + staging · pico 66% < 70%
Servicos > 80%2 svc
2/7
svc-api 86% · svc-checkout 82%
CPU reserved totalreservas
5.888 u
5,75 vCPU · 48% de 12.288 u · Mem 11,5 GB reservada
CPU
48%
MEM
72%
CPU & memoria utilizacao · 24hCPU 58% · Mem 64%
100,0 %85,0 %70,0 %55,0 %40,0 %
00h04h08h12h16h20h24h
CPU utilMem util% util · - - 70% cluster · - - 80% servico
Top servicos por CPU / memtop 6 · 7 svc
CPU / mem por servico7 servicos · util % da reserva
| Servico | CPU res. | CPU % | Mem res. | Mem % | Mem util. |
|---|---|---|---|---|---|
| svc-apiEC2 | 1.024 u | 86% | 2.048 MB | 78% | 1.598 MB |
| svc-checkoutEC2 | 512 u | 82% | 1.024 MB | 74% | 758 MB |
| svc-workerEC2 | 1.024 u | 71% | 2.048 MB | 69% | 1.413 MB |
| fargate-ingestFG | 2.048 u | 64% | 4.096 MB | 72% | 2.949 MB |
| svc-authEC2 | 512 u | 58% | 1.024 MB | 61% | 625 MB |
| svc-notifyFG | 256 u | 47% | 512 MB | 55% | 282 MB |
| svc-batchFG | 512 u | 39% | 1.024 MB | 44% | 451 MB |
Reservas vs usoright-sizing
CPU reservado total5.888 u · 5,75 vCPU
Memoria reservada11.776 MB · 11,5 GB
Sub-provisionados (> 80%)2 svc
Super-provisionados (< 50%)2 svc
Headroom p/ reservarCPU 52% · Mem 28%
Flowbix · CPU & memória · utilização por cluster e serviço
05 / 08
Fargate tasks146/148
148 tasks
146 running · 2 pending · 148 desired
Ephemeral util4,41 TB res.
63,4%
utilizado 2,80 TB · reservado 4,41 TB
Disk util · picofargate-media
82,1%
agregado 54,7% · limite 80%
Rede rx / txpico 512 MB/s · 03h
365 MB/s
rx 222 ↓ · tx 143 ↑ · awsvpc · 1 ENI/task
Storage read / writeefêmero · ext4
2,02 GB/s
read 1,22 · write 0,80 GB/s · StorageR/W bytes
Rede rx/tx Fargate · 24hpico rx 512 MB/s · 03h12
520,0 MB/s410,0300,0190,080,0 MB/s
00h04h08h12h16h20h24h
rx · NetworkRxBytestx · NetworkTxBytes- - limite ENI 480 MB/s · agora rx 222 · tx 143 MB/s
Storage efêmero por serviçoutilizado / reservado
Disk util agregado · 6 serviços54,7%
Pico disk util82,1% · fargate-media
Ephemeral total (util / res.)2,80 / 4,41 TB · 63,4%
Serviços Fargate6 serviços · 148 tasks
| Serviço | Tasks | Eph. res. | Utiliz. | Disk % | Storage r/w | Rede rx/tx | Status |
|---|---|---|---|---|---|---|---|
| fargate-ingest | 42 | 20 GB | 12,4 GB | 62% | 0,38 / 0,21 GB/s | 68 / 44 MB/s | Normal |
| fargate-api | 36 | 20 GB | 9,1 GB | 46% | 0,22 / 0,14 GB/s | 82 / 58 MB/s | Normal |
| fargate-worker | 28 | 40 GB | 26,8 GB | 67% | 0,31 / 0,19 GB/s | 24 / 12 MB/s | Normal |
| fargate-media | 18 | 60 GB | 49,4 GB | 82% | 0,18 / 0,16 GB/s | 38 / 24 MB/s | Disco alto |
| fargate-batch | 14 | 40 GB | 22,1 GB | 55% | 0,09 / 0,07 GB/s | 6 / 3 MB/s | Normal |
| fargate-report | 10 | 20 GB | 6,8 GB | 34% | 0,04 / 0,03 GB/s | 4 / 2 MB/s | Normal |
Σ 148 tasks · eph. reservado 4,41 TB · utilizado 2,80 TB (63,4%) · read 1,22 · write 0,80 GB/s · rx 222 / tx 143 MB/s · ephemeral 20–200 GB/task
Storage & rede · agregadoFargate
1,22 GB/s
storage read
0,80 GB/s
storage write
Ephemeral reservado · total4,41 TB
Ephemeral utilizado · total2,80 TB · 63,4%
Network rx / tx agregado222 / 143 MB/s
Storage read / write bytes1,22 / 0,80 GB/s
Tasks Fargate · Linux 1.4.0+148 / 148
Tasks Windows / EC2 launch0 / 0
Serviços Fargate6 · 1 atenção
Platform version1.4.0 (LATEST)
awsvpc · ext4 · StorageReadBytes / StorageWriteBytes · gatilho disk > 80%
Flowbix · Fargate · storage efêmero, disco e rede rx/tx
06 / 08
AlarmesLLD · 60 s
4
3 métricas · 1 cluster + 3 serviços
OK 2ALARM 1INSUF 1
Em ALARM1 disparado
1
svc-api · CPU 86% > 80%
há 12 min · 3/3 datapoints
Insufficientsem dados
1
fargate-ingest · storage efêmero
gap métrica há 6 min
Clusters > 70%0 críticos
0
CPU máx 62% · Mem máx 58%
Serviços > 80%2 acima do limite
2
limite de alarme 80% · 3 pts p/ disparar
Alarmes por alvo × 24h · estado avaliadobins de 2h
OKBreaching / InsufficientALARMsem coleta
000204060810121416182022
svc-api · CPU
svc-worker · Mem
fgt-ingest · St
ecs-prod · Tasks
ecs-prod · CPU
ecs-prod · Mem
svc-api em ALARM desde 11:35 · bin 10–12hfgt-ingest sem datapoints de storage há 6 min
Por estado & alvo4 alarmes
Por estado · CloudWatch
Por alvo · pior métrica atual
Alarmes ativos · CloudWatch (ECS)1 ALARM · 1 INSUFFICIENT
| Alarm name | Cluster / serviço | Métrica | Estado | Limiar | Razão | Idade |
|---|---|---|---|---|---|---|
| cw-svcapi-cpu-hi | ecs-prod · svc-api | CPU | ALARM | > 80% (3) | CPUUtilization 86% por 3/3 pts | 12 min |
| cw-fgtingest-store | ecs-prod · fargate-ingest | Storage | INSUFF. | > 85% | EphemeralStorageUtilized sem datapoints | 6 min |
| cw-svcworker-mem-hi | ecs-prod · svc-worker | Mem | OK | > 80% (3) | MemoryUtilization 84% · 2/3 pts | 4 min |
| cw-ecsprod-tasks-lo | ecs-prod-cluster | RunningTasks | OK | < 16 | RunningTaskCount 18/18 desired ≥ 16 | 2 h |
Últimas transições de estado
11:35cw-svcapi-cpu-hi→ALARMsvc-api · CPU cruzou 80% (3 pts)
11:41cw-fgtingest-store→INSUFFICIENTgap de coleta · storage efêmero
08:12cw-svcworker-mem-hi→OKrecuperou de pico de memória
Saúde da coleta · Zabbix → CloudWatchnominal
metrics.checkOK · 42 ms
alarms.checkOK · 58 ms
Monitorados1 cluster · 3 serviços
Discovery (LLD)4 alarmes · há 2 min
120 ms90 ms60 ms30 ms0 ms
00h04h08h12h16h20h24h
tempo de resposta · getMetricDataatual 42 ms · - - SLA 100 ms
Flowbix · Alarmes CloudWatch do ECS
07 / 08
Próximo passo
Vamos centralizar?
Agende uma demo da Missão Crítica Flowbix, fale com o time comercial e traga energia, no-break, gerador, CFTV e controle de acesso dos seus sites críticos para uma única sala de operação.
service
FLOWBIX
Comercial · Flowbix ✓
Conta verificada
Escaneie para iniciar uma conversa
Flowbix
·
Missão Crítica · Monitoramento de Sites Críticos
08 / 08