Home›Perspectivas›Artigos›Gestão delegada de infraestrutura de TI: como operar 24/7 sem engenheiros no local
Blog · Serviços gerenciados · Infraestrutura
Gestão delegada de infraestrutura de TI: como operar 24/7 sem engenheiros no local
Centenas de máquinas virtuais, mais de 300 bancos de dados e dois centros de dados, operados de forma 100 % remota. O que aprendemos ao administrar a infraestrutura de uma firma de serviços profissionais Big Four na América Latina.
O tamanho do desafio
O escopo do serviço dá uma ideia da complexidade que envolve operar uma infraestrutura corporativa moderna:
- 484 máquinas virtuais VMware , das quais 369 estão em produção.
- 9 servidores físicos x86 distribuídos entre o site principal e o de recuperação de desastres (DRP).
- 5 sistemas de armazenamento IBM FlashSystem .
- Mais de 300 bancos de dados SQL Server e MongoDB administrados.
A isso se soma um ambiente multiplataforma — VMware, Windows, Linux, IBM Power e IBM FlashSystem — que exige especialistas distintos para cada camada. Cobrir tudo isso com pessoal próprio, em turnos de 24 horas, nos 365 dias do ano, requer uma equipe considerável e difícil de reter.
O que significa realmente "gestão delegada"
Delegar a infraestrutura não é o mesmo que terceirizar o suporte técnico. Num modelo de gestão delegada, o fornecedor assume a responsabilidade pela operação diária: monitora, detecta, atende, escala, documenta e reporta. O cliente mantém o controle estratégico e a visibilidade, mas deixa de carregar o trabalho operacional.
Para que funcione, o modelo precisa de quatro peças:
- Um centro de operação permanente que vigie a infraestrutura 24 horas por dia.
- Processos padronizados , idealmente baseados em marcos reconhecidos como o ITIL.
- SLA definidos por criticidade , para que cada incidente receba a atenção que o seu impacto exige.
- Rastreabilidade : o cliente deve poder ver o que aconteceu, quando e o que foi feito.
A gestão delegada funciona quando o cliente sabe exatamente o que está acontecendo na sua infraestrutura, sem ter de operá-la.
Como operamos: o modelo por trás do serviço
Neste cliente, a Redsis presta o serviço por meio do seu Centro de Atendimento ao Cliente (CAC), que opera sob as práticas do ITIL com monitoramento 24/7/365. Os incidentes são classificados por criticidade e os de nível 1 têm um tempo de resposta de 15 minutos.
A classificação por criticidade é uma prática central do ITIL: a prioridade de um incidente é determinada combinando o seu impacto — quantos usuários ou serviços afeta — com a sua urgência — com que rapidez o dano cresce. Um servidor de testes fora do ar não pesa o mesmo que um banco de dados de produção inacessível, e o SLA deve refletir isso.
Todo o serviço é 100 % remoto, sem engenheiros no local. O cliente tem acesso a um portal de autoatendimento e recebe relatórios mensais de gestão, o que lhe dá rastreabilidade completa sobre a operação.
Cinco lições para delegar a infraestrutura sem perder o controle
1. Inventariar antes de assinar
Um bom serviço gerenciado começa com um inventário preciso: quantas máquinas virtuais, quantas em produção, quais servidores, qual armazenamento, quantos bancos de dados e em quais motores. Sem esse ponto de partida, os SLA são negociados às cegas.
2. Definir a criticidade com o negócio
A matriz de prioridades não é decidida pela TI sozinha. É preciso acordar com as áreas de negócio quais serviços são críticos e qual impacto cada um tem. Esse acordo é o que permite comprometer, por exemplo, uma resposta de 15 minutos para os incidentes de nível 1.
3. Tratar a contingência como parte da operação
O site de recuperação de desastres não é um seguro que se revisa uma vez por ano. Neste cliente, a cobertura inclui tanto o site principal quanto o DRP, de modo que a continuidade do negócio faz parte do serviço diário e não de um plano guardado numa gaveta.
4. Aproveitar as capacidades da plataforma
O armazenamento moderno faz parte do trabalho. O IBM FlashSystem, por exemplo, inclui detecção de ransomware baseada em IA, cópias imutáveis ( Safeguarded Copy ), replicação de dados e administração centralizada de múltiplos sistemas por meio do IBM Storage Virtualize. Um operador que conhece a fundo essas capacidades pode usá-las para fortalecer a proteção e a continuidade.
5. Medir e mostrar
Um SLA que não é reportado não existe. O portal de autoatendimento e os relatórios mensais de gestão transformam a operação em algo auditável: o cliente pode verificar o cumprimento, identificar tendências e tomar decisões informadas sobre a sua infraestrutura.
O resultado: infraestrutura de missão crítica com menos custo operacional
Hoje a firma conta com uma operação de infraestrutura 24/7/365 sob o ITIL, com SLA por criticidade e resposta em 15 minutos para incidentes de nível 1, cobertura dos seus sites principal e DRP e um ambiente multiplataforma administrado de ponta a ponta. Tudo sem engenheiros no local, com menor custo operacional do que uma equipe interna dedicada e com rastreabilidade total por meio do portal de autoatendimento e dos relatórios mensais.
Para a Redsis, este serviço demonstra algo importante: um modelo de gestão delegada escalável e replicável para grandes contas empresariais, capaz de operar infraestrutura de missão crítica com SLA auditáveis.
Por onde começar?
Se a sua equipe de TI dedica a maior parte do seu tempo a manter a infraestrutura funcionando, se cobrir as noites e os fins de semana é um problema recorrente ou se você não tem uma visão clara do cumprimento dos seus próprios níveis de serviço, vale a pena avaliar um modelo de gestão delegada. Na Redsis combinamos mais de 25 anos de experiência em infraestrutura para a região, parcerias com IBM (Platinum) e Cisco (Premier), e um Centro de Atendimento ao Cliente que opera sob o ITIL 24 horas por dia.
Leia o caso completo
Conheça como a Redsis opera a infraestrutura de TI de uma firma de serviços profissionais Big Four.