Veja o estado do RAID da HPE Smart Array no Windows Server com SSA e ssacli, ache o disco com falha pela baía e pelo número de série e crie alertas.
Para que serve
Na maioria dos servidores da E-Consulters, os SSDs de sistema ficam em RAID por hardware na controladora HPE Smart Array. O Windows enxerga apenas um disco pronto, e o Gerenciamento de Discos não avisa quando um dos SSDs do espelho falha. Este artigo mostra como verificar o RAID da HPE Smart Array no Windows Server 2022/2025 com o SSA e o ssacli, como ler os logs de eventos, identificar o disco com falha e acompanhar a reconstrução.
Os NVMe não passam pela controladora e não aparecem no SSA. No Windows instalado direto no servidor, a forma de usar os NVMe é escolha sua (a E-Consulters não gerencia essa configuração). As opções mais comuns são:
- Espaços de Armazenamento com espelho bidirecional: confira com
Get-VirtualDisk(colunaHealthStatus) eGet-PhysicalDisk. - Volume espelhado (disco dinâmico) no Gerenciamento de Discos: o estado aparece no próprio
diskmgmt.msc. - Discos independentes, sem espelho: mais espaço, mas a falha de um NVMe perde os dados dele; dependa do backup.
Pré-requisitos
- Acesso de administrador ao Windows Server (RDP ou console).
- Acesso ao console remoto: Central do Cliente → Serviços → clique no servidor → Console.
- Backup recente fora do servidor. RAID não protege contra exclusão, ransomware ou corrupção.
1. Instalar o SSA e o ssacli para Windows
No site de suporte da HPE (HPE Support Center), procure o modelo do servidor ou "Smart Storage Administrator" e baixe, para Windows 64 bits:
- HPE Smart Storage Administrator (SSA): interface gráfica, aberta pelo menu Iniciar.
- HPE SSA CLI (
ssacli): linha de comando, a mais útil para diagnóstico e scripts. - HPE SSA Diagnostics (
ssaducli): gera um relatório para o suporte.
Os mesmos componentes vêm no Service Pack for ProLiant (SPP). Alguns downloads da HPE pedem login. Depois de instalar, o executável costuma ficar em C:\Program Files\Smart Storage Administrator\ssacli\bin\ssacli.exe. No PowerShell como administrador:
Set-Location 'C:\Program Files\Smart Storage Administrator\ssacli\bin'
.\ssacli.exe version
2. Ver o status da controladora e dos discos
.\ssacli.exe ctrl all show status
.\ssacli.exe ctrl all show config
Exemplo de saída com o RAID saudável:
Smart Array P408i-a SR Gen10 in Slot 0 (Embedded)
Array A (Solid State SATA, Unused Space: 0 MB)
logicaldrive 1 (223.54 GB, RAID 1, OK)
physicaldrive 1I:1:1 (port 1I:box 1:bay 1, SATA SSD, 240 GB, OK)
physicaldrive 1I:1:2 (port 1I:box 1:bay 2, SATA SSD, 240 GB, OK)
Anote o slot da controladora (aqui, 0). Os estados que pedem atenção:
| Estado | O que significa |
|---|---|
Interim Recovery Mode | O RAID perdeu um disco e roda sem redundância. |
Recovering, NN% complete | Reconstrução (rebuild) em andamento. |
Failed | Disco físico fora do RAID. |
Predictive Failure | Disco ainda funciona, mas deve ser trocado. |
No SSA gráfico, o mesmo aparece ao selecionar a controladora: o painel mostra alertas, discos lógicos e a lista de discos físicos.
3. Identificar o disco com falha
.\ssacli.exe ctrl slot=0 pd all show detail | Select-String 'physicaldrive|Status|Serial Number|Model|Usage remaining|Current Temperature'
.\ssacli.exe ctrl slot=0 pd 1I:1:2 show detail
Anote a baía (ex.: 1I:1:2 = porta 1I, caixa 1, baía 2), o número de série e o modelo. Se o disco com defeito não responder mais, anote a baía dele e o número de série do disco bom.
E o SMART? O smartctl -d cciss,N só funciona no Linux e no FreeBSD. No Windows, os dados de saúde de cada SSD vêm do próprio pd ... show detail (vida útil restante, temperatura, horas de uso).
4. O que o Gerenciamento de Discos mostra
Abra diskmgmt.msc ou rode:
Get-PhysicalDisk | Format-Table FriendlyName, MediaType, Size, HealthStatus, OperationalStatus
O volume da controladora aparece como um único disco, com nome do tipo HPE LOGICAL VOLUME. O HealthStatus dele continua Healthy mesmo com um SSD falho, porque o Windows só vê o volume. Por isso a fonte confiável é o ssacli ou o SSA. Os NVMe aparecem separados, cada um com o seu modelo.
5. Logs de eventos
O driver da controladora e o serviço de gerenciamento da HPE (Agentless Management Service, quando instalado) registram eventos no log do Sistema. Para listar erros e avisos de armazenamento dos últimos 7 dias:
Get-WinEvent -FilterHashtable @{LogName='System'; Level=1,2,3; StartTime=(Get-Date).AddDays(-7)} |
Where-Object { $_.ProviderName -match 'pqi|ciss|smart|disk|ntfs|ams' } |
Format-Table TimeCreated, ProviderName, Id, Message -Wrap
Eventos da origem disk (IDs 7, 11, 51 e 153) indicam blocos com erro, falhas de controladora ou repetições de I/O. No Visualizador de Eventos, use Logs do Windows → Sistema → Filtrar Log Atual e veja também Logs de Aplicativos e Serviços, onde os componentes da HPE podem criar logs próprios.
6. Acompanhar o rebuild
Com a recuperação automática (padrão nas controladoras HPE), a reconstrução começa sozinha quando o disco substituto entra. Acompanhe com:
while ($true) { .\ssacli.exe ctrl slot=0 ld all show status; Start-Sleep 60 }
O servidor segue em uso, com desempenho de disco menor. Para priorizar o rebuild fora do horário de pico: .\ssacli.exe ctrl slot=0 modify rebuildpriority=high.
delete, create, modify em discos lógicos) nem a opção de limpar configuração do SSA para "consertar" o RAID: isso pode apagar o volume do Windows.7. Alertas com tarefa agendada
Salve como C:\Scripts\Verifica-RaidHPE.ps1:
$ssacli = 'C:\Program Files\Smart Storage Administrator\ssacli\bin\ssacli.exe'
$pasta = 'C:\ProgramData\RaidHPE'
New-Item -ItemType Directory -Force -Path $pasta | Out-Null
$config = (& $ssacli ctrl all show config 2>&1) | Out-String
$status = (& $ssacli ctrl all show status 2>&1) | Out-String
$linhas = ($config + "`n" + $status) -split "`r?`n"
$problemas = @($linhas | Where-Object {
($_ -match 'logicaldrive|physicaldrive' -and $_ -notmatch 'OK\)\s*$') -or
($_ -match 'Status:' -and $_ -notmatch 'Status: (OK|Not Configured)') })
if ($config -notmatch 'logicaldrive') { $problemas += 'ssacli nao listou discos' }
$problemas.Count | Set-Content "$pasta\problemas.txt"
if ($problemas.Count -gt 0) {
if (-not [System.Diagnostics.EventLog]::SourceExists('RaidHPE')) {
New-EventLog -LogName Application -Source RaidHPE }
Write-EventLog -LogName Application -Source RaidHPE -EventId 1001 -EntryType Error `
-Message ("RAID HPE com problema:`n" + ($problemas -join "`n"))
}
Agende para rodar a cada hora como SYSTEM:
$acao = New-ScheduledTaskAction -Execute 'powershell.exe' -Argument '-NoProfile -ExecutionPolicy Bypass -File C:\Scripts\Verifica-RaidHPE.ps1'
$gatilho = New-ScheduledTaskTrigger -Once -At (Get-Date) -RepetitionInterval (New-TimeSpan -Hours 1)
Register-ScheduledTask -TaskName 'Verifica RAID HPE' -Action $acao -Trigger $gatilho -User 'SYSTEM' -RunLevel Highest
Start-ScheduledTask -TaskName 'Verifica RAID HPE'
Get-Content C:\ProgramData\RaidHPE\problemas.txt # 0 = tudo OK
O script usa os cmdlets New-EventLog/Write-EventLog do Windows PowerShell 5.1, que já vem no Windows Server. Com o Zabbix Agent 2 no Windows, crie um item com a chave vfs.file.contents[C:\ProgramData\RaidHPE\problemas.txt] e um trigger para valor maior que 0; ou monitore o log com eventlog[Application,,,RaidHPE] (item ativo). Outra opção é a ferramenta de monitoramento que você já usa ler o evento 1001 da origem RaidHPE.
8. Quando o Windows não inicia
O console da Central do Cliente (Serviços → clique no servidor → Console) mostra só a tela remota do servidor, não as páginas de status de storage do iLO. Se o Windows não subir:
- Reinicie pelo menu de energia da janela do console e observe a tela de inicialização: a controladora Smart Array mostra ali avisos de disco com falha ou volume degradado.
- Anote (ou fotografe) a mensagem e abra um ticket: o suporte da E-Consulters consulta o estado da controladora e dos discos pelo lado do hardware.
Como saber se funcionou
ssacli ctrl all show configmostraOKem todos os discos lógicos e físicos.- A tarefa "Verifica RAID HPE" aparece no Agendador de Tarefas com a última execução bem-sucedida e
problemas.txtcontém0.
Problemas comuns
No controllers detected: o Windows está em VM (verifique no host), a controladora é da linha MR (usa ostorcli) ou os SSDs estão ligados sem RAID por hardware.- O SSA gráfico não abre: use o
ssacli, que traz as mesmas informações. - Erro de política de execução ao rodar o script: mantenha o
-ExecutionPolicy Bypassna tarefa agendada.
Perguntas frequentes
O Gerenciamento de Discos avisa quando um SSD do RAID falha?
Não. Ele vê só o disco lógico. Use o ssacli ou o SSA.
Posso instalar o ssacli dentro de uma VM Windows?
Não adianta: a VM não tem acesso à controladora. Verifique no host Proxmox.
Como espelhar os NVMe no Windows Server?
A escolha é sua: Espaços de Armazenamento com espelho bidirecional, volume espelhado no Gerenciamento de Discos ou discos independentes com backup. A E-Consulters não gerencia essa configuração.
Consigo ver o RAID pela interface web do iLO?
Não. O console da Central do Cliente dá acesso só à tela remota. Use o ssacli ou o SSA no Windows, ou abra um ticket se o servidor não iniciar.
O rebuild começa sozinho?
Sim, com a configuração padrão, assim que o disco substituto é instalado.
Leitura complementar
Precisa de ajuda?
Para a troca física de um disco, abra um ticket informando a baía (ex.: 1I:1:2) e o número de série do disco com falha, com a saída de ssacli ctrl all show config. Se puder, anexe o relatório gerado com ssaducli -f C:\Temp\adu-report.zip (pasta ssaducli\bin da instalação). Com RAID por hardware redundante (RAID 1, 5, 6 ou 10), a troca é feita a quente, sem desligar o servidor, e a controladora reconstrói o volume sozinha. Em RAID 0 não há redundância: o disco com falha leva junto os dados do volume, que precisam ser restaurados do backup.
