Hiper incident

Lentidão no sistema

Minor Resolved View vendor source →

Hiper experienced a minor incident on August 18, 2026 affecting Hiper Gestão, lasting 6h 9m. The incident has been resolved; the full update timeline is below.

Started
Aug 18, 2026, 11:52 AM UTC
Resolved
Aug 18, 2026, 06:01 PM UTC
Duration
6h 9m
Detected by Pingoru
Aug 18, 2026, 11:52 AM UTC

Affected components

Hiper Gestão

Update timeline

  1. investigating Aug 18, 2026, 11:52 AM UTC

    Neste momento estamos passando por uma instabilidade no sistema causando lentidão em parte dos fluxos. A investigação da causa raiz já está em andamento e em breve traremos novas informações.

  2. monitoring Aug 18, 2026, 12:25 PM UTC

    A instabilidade ocorreu devido a uma oscilação com a infraestrutura dos servidores. Foram aplicadas ações para mitigar o incidente e no momento o acesso está normalizado. Seguiremos monitorando e acompanhando para garantir a estabilidade das aplicações.

  3. resolved Aug 18, 2026, 06:01 PM UTC

    Após o monitoramento ostensivo ao longo da tarde, não identificamos mais nenhum impacto proveniente do incidente evidenciado durante o período da manhã, dessa forma, consideramos estamos encerrando a tratativa deste incidente.

  4. postmortem Sep 18, 2026, 03:03 PM UTC

    Esta publicação tem por objetivo detalhar os eventos que envolveram o incidente do dia 18/08/2026 afetando a experiência de uso e ocasionando intermitência no acesso ao Hiper Gestão. No decorrer do relatório serão apresentadas informações gerais do incidente, causas, ações de remediação e próximos passos. ‌ **Código:** 2026081801 **Data:** 18/08/2026, terça-feira **Horário de início:** 08h37 \(horário de Brasília\) **Horário de resolução:** 09h06 \(horário de Brasília\) **Tempo total de impacto:** 29 minutos **Impacto:** degradação de performance no acesso ao Hiper Gestão ‌ **Detalhamento do incidente** Foi identificado um aumento no consumo de CPU em todas as instâncias do _cluster_ principal de hospedagem do Hiper Gestão simultaneamente. Durante o incidente todas as instâncias do _cluster_ principal apresentaram alto consumo de CPU, reduzindo a performance das requisições processadas por estas instâncias e causando intermitência no acesso ao Hiper Gestão. Pelo fato de todas as instâncias apresentarem alto consumo de CPU simultaneamente, nosso time atuou de forma proativa para reduzir a janela de impacto, provisionando novas instâncias e desativando as instâncias problemáticas. Enquanto o processo de provisionamento ocorria, houve intermitência no acesso ao Hiper Gestão. A causa raiz do alto consumo de CPU não foi identificada, pois o consumo abrupto de CPU impossibilitou a coleta de dados dos processos em execução. Analisando os _logs_ de aplicação também não foi possível identificar a causa raiz do incidente. Como próximos passos, nosso time está desenvolvendo uma automação que realiza o _dump_ de memória RAM de forma automatizada todas as vezes que um pico de CPU é evidenciado de forma preditiva, permitindo a análise de causa raiz de futuros incidentes que ocasionam o mesmo efeito.