Veja o estado do RAID da HPE Smart Array no Windows Server com SSA e ssacli, ache o disco com falha pela baía e pelo número de série e crie alertas.

Para que serve

Na maioria dos servidores da E-Consulters, os SSDs de sistema ficam em RAID por hardware na controladora HPE Smart Array. O Windows enxerga apenas um disco pronto, e o Gerenciamento de Discos não avisa quando um dos SSDs do espelho falha. Este artigo mostra como verificar o RAID da HPE Smart Array no Windows Server 2022/2025 com o SSA e o ssacli, como ler os logs de eventos, identificar o disco com falha e acompanhar a reconstrução.

O Windows roda em VM no Proxmox? Então a VM não enxerga a controladora, e a verificação é feita no host, com o artigo "Como verificar o RAID da controladora HPE Smart Array (ssacli) no Linux e no Proxmox". Este artigo vale para o Windows Server instalado direto no servidor.

Os NVMe não passam pela controladora e não aparecem no SSA. No Windows instalado direto no servidor, a forma de usar os NVMe é escolha sua (a E-Consulters não gerencia essa configuração). As opções mais comuns são:

  • Espaços de Armazenamento com espelho bidirecional: confira com Get-VirtualDisk (coluna HealthStatus) e Get-PhysicalDisk.
  • Volume espelhado (disco dinâmico) no Gerenciamento de Discos: o estado aparece no próprio diskmgmt.msc.
  • Discos independentes, sem espelho: mais espaço, mas a falha de um NVMe perde os dados dele; dependa do backup.

Pré-requisitos

  • Acesso de administrador ao Windows Server (RDP ou console).
  • Acesso ao console remoto: Central do Cliente → Serviços → clique no servidor → Console.
  • Backup recente fora do servidor. RAID não protege contra exclusão, ransomware ou corrupção.

1. Instalar o SSA e o ssacli para Windows

No site de suporte da HPE (HPE Support Center), procure o modelo do servidor ou "Smart Storage Administrator" e baixe, para Windows 64 bits:

  • HPE Smart Storage Administrator (SSA): interface gráfica, aberta pelo menu Iniciar.
  • HPE SSA CLI (ssacli): linha de comando, a mais útil para diagnóstico e scripts.
  • HPE SSA Diagnostics (ssaducli): gera um relatório para o suporte.

Os mesmos componentes vêm no Service Pack for ProLiant (SPP). Alguns downloads da HPE pedem login. Depois de instalar, o executável costuma ficar em C:\Program Files\Smart Storage Administrator\ssacli\bin\ssacli.exe. No PowerShell como administrador:

Set-Location 'C:\Program Files\Smart Storage Administrator\ssacli\bin'
.\ssacli.exe version

2. Ver o status da controladora e dos discos

.\ssacli.exe ctrl all show status
.\ssacli.exe ctrl all show config

Exemplo de saída com o RAID saudável:

Smart Array P408i-a SR Gen10 in Slot 0 (Embedded)
   Array A (Solid State SATA, Unused Space: 0 MB)
      logicaldrive 1 (223.54 GB, RAID 1, OK)
      physicaldrive 1I:1:1 (port 1I:box 1:bay 1, SATA SSD, 240 GB, OK)
      physicaldrive 1I:1:2 (port 1I:box 1:bay 2, SATA SSD, 240 GB, OK)

Anote o slot da controladora (aqui, 0). Os estados que pedem atenção:

EstadoO que significa
Interim Recovery ModeO RAID perdeu um disco e roda sem redundância.
Recovering, NN% completeReconstrução (rebuild) em andamento.
FailedDisco físico fora do RAID.
Predictive FailureDisco ainda funciona, mas deve ser trocado.

No SSA gráfico, o mesmo aparece ao selecionar a controladora: o painel mostra alertas, discos lógicos e a lista de discos físicos.

3. Identificar o disco com falha

.\ssacli.exe ctrl slot=0 pd all show detail | Select-String 'physicaldrive|Status|Serial Number|Model|Usage remaining|Current Temperature'
.\ssacli.exe ctrl slot=0 pd 1I:1:2 show detail

Anote a baía (ex.: 1I:1:2 = porta 1I, caixa 1, baía 2), o número de série e o modelo. Se o disco com defeito não responder mais, anote a baía dele e o número de série do disco bom.

E o SMART? O smartctl -d cciss,N só funciona no Linux e no FreeBSD. No Windows, os dados de saúde de cada SSD vêm do próprio pd ... show detail (vida útil restante, temperatura, horas de uso).

4. O que o Gerenciamento de Discos mostra

Abra diskmgmt.msc ou rode:

Get-PhysicalDisk | Format-Table FriendlyName, MediaType, Size, HealthStatus, OperationalStatus

O volume da controladora aparece como um único disco, com nome do tipo HPE LOGICAL VOLUME. O HealthStatus dele continua Healthy mesmo com um SSD falho, porque o Windows só vê o volume. Por isso a fonte confiável é o ssacli ou o SSA. Os NVMe aparecem separados, cada um com o seu modelo.

5. Logs de eventos

O driver da controladora e o serviço de gerenciamento da HPE (Agentless Management Service, quando instalado) registram eventos no log do Sistema. Para listar erros e avisos de armazenamento dos últimos 7 dias:

Get-WinEvent -FilterHashtable @{LogName='System'; Level=1,2,3; StartTime=(Get-Date).AddDays(-7)} |
  Where-Object { $_.ProviderName -match 'pqi|ciss|smart|disk|ntfs|ams' } |
  Format-Table TimeCreated, ProviderName, Id, Message -Wrap

Eventos da origem disk (IDs 7, 11, 51 e 153) indicam blocos com erro, falhas de controladora ou repetições de I/O. No Visualizador de Eventos, use Logs do Windows → Sistema → Filtrar Log Atual e veja também Logs de Aplicativos e Serviços, onde os componentes da HPE podem criar logs próprios.

6. Acompanhar o rebuild

Com a recuperação automática (padrão nas controladoras HPE), a reconstrução começa sozinha quando o disco substituto entra. Acompanhe com:

while ($true) { .\ssacli.exe ctrl slot=0 ld all show status; Start-Sleep 60 }

O servidor segue em uso, com desempenho de disco menor. Para priorizar o rebuild fora do horário de pico: .\ssacli.exe ctrl slot=0 modify rebuildpriority=high.

Não use comandos de alteração (delete, create, modify em discos lógicos) nem a opção de limpar configuração do SSA para "consertar" o RAID: isso pode apagar o volume do Windows.

7. Alertas com tarefa agendada

Salve como C:\Scripts\Verifica-RaidHPE.ps1:

$ssacli = 'C:\Program Files\Smart Storage Administrator\ssacli\bin\ssacli.exe'
$pasta  = 'C:\ProgramData\RaidHPE'
New-Item -ItemType Directory -Force -Path $pasta | Out-Null
$config = (& $ssacli ctrl all show config 2>&1) | Out-String
$status = (& $ssacli ctrl all show status 2>&1) | Out-String
$linhas = ($config + "`n" + $status) -split "`r?`n"
$problemas = @($linhas | Where-Object {
  ($_ -match 'logicaldrive|physicaldrive' -and $_ -notmatch 'OK\)\s*$') -or
  ($_ -match 'Status:' -and $_ -notmatch 'Status: (OK|Not Configured)') })
if ($config -notmatch 'logicaldrive') { $problemas += 'ssacli nao listou discos' }
$problemas.Count | Set-Content "$pasta\problemas.txt"
if ($problemas.Count -gt 0) {
  if (-not [System.Diagnostics.EventLog]::SourceExists('RaidHPE')) {
    New-EventLog -LogName Application -Source RaidHPE }
  Write-EventLog -LogName Application -Source RaidHPE -EventId 1001 -EntryType Error `
    -Message ("RAID HPE com problema:`n" + ($problemas -join "`n"))
}

Agende para rodar a cada hora como SYSTEM:

$acao = New-ScheduledTaskAction -Execute 'powershell.exe' -Argument '-NoProfile -ExecutionPolicy Bypass -File C:\Scripts\Verifica-RaidHPE.ps1'
$gatilho = New-ScheduledTaskTrigger -Once -At (Get-Date) -RepetitionInterval (New-TimeSpan -Hours 1)
Register-ScheduledTask -TaskName 'Verifica RAID HPE' -Action $acao -Trigger $gatilho -User 'SYSTEM' -RunLevel Highest
Start-ScheduledTask -TaskName 'Verifica RAID HPE'
Get-Content C:\ProgramData\RaidHPE\problemas.txt   # 0 = tudo OK

O script usa os cmdlets New-EventLog/Write-EventLog do Windows PowerShell 5.1, que já vem no Windows Server. Com o Zabbix Agent 2 no Windows, crie um item com a chave vfs.file.contents[C:\ProgramData\RaidHPE\problemas.txt] e um trigger para valor maior que 0; ou monitore o log com eventlog[Application,,,RaidHPE] (item ativo). Outra opção é a ferramenta de monitoramento que você já usa ler o evento 1001 da origem RaidHPE.

8. Quando o Windows não inicia

O console da Central do Cliente (Serviços → clique no servidor → Console) mostra só a tela remota do servidor, não as páginas de status de storage do iLO. Se o Windows não subir:

  • Reinicie pelo menu de energia da janela do console e observe a tela de inicialização: a controladora Smart Array mostra ali avisos de disco com falha ou volume degradado.
  • Anote (ou fotografe) a mensagem e abra um ticket: o suporte da E-Consulters consulta o estado da controladora e dos discos pelo lado do hardware.

Como saber se funcionou

  • ssacli ctrl all show config mostra OK em todos os discos lógicos e físicos.
  • A tarefa "Verifica RAID HPE" aparece no Agendador de Tarefas com a última execução bem-sucedida e problemas.txt contém 0.

Problemas comuns

  • No controllers detected: o Windows está em VM (verifique no host), a controladora é da linha MR (usa o storcli) ou os SSDs estão ligados sem RAID por hardware.
  • O SSA gráfico não abre: use o ssacli, que traz as mesmas informações.
  • Erro de política de execução ao rodar o script: mantenha o -ExecutionPolicy Bypass na tarefa agendada.

Perguntas frequentes

O Gerenciamento de Discos avisa quando um SSD do RAID falha?

Não. Ele vê só o disco lógico. Use o ssacli ou o SSA.

Posso instalar o ssacli dentro de uma VM Windows?

Não adianta: a VM não tem acesso à controladora. Verifique no host Proxmox.

Como espelhar os NVMe no Windows Server?

A escolha é sua: Espaços de Armazenamento com espelho bidirecional, volume espelhado no Gerenciamento de Discos ou discos independentes com backup. A E-Consulters não gerencia essa configuração.

Consigo ver o RAID pela interface web do iLO?

Não. O console da Central do Cliente dá acesso só à tela remota. Use o ssacli ou o SSA no Windows, ou abra um ticket se o servidor não iniciar.

O rebuild começa sozinho?

Sim, com a configuração padrão, assim que o disco substituto é instalado.

Leitura complementar

Precisa de ajuda?

Para a troca física de um disco, abra um ticket informando a baía (ex.: 1I:1:2) e o número de série do disco com falha, com a saída de ssacli ctrl all show config. Se puder, anexe o relatório gerado com ssaducli -f C:\Temp\adu-report.zip (pasta ssaducli\bin da instalação). Com RAID por hardware redundante (RAID 1, 5, 6 ou 10), a troca é feita a quente, sem desligar o servidor, e a controladora reconstrói o volume sozinha. Em RAID 0 não há redundância: o disco com falha leva junto os dados do volume, que precisam ser restaurados do backup.

Esta resposta lhe foi útil? 0 Usuários acharam útil (0 Votos)

Leia também