Incident e reperibilità

Perstat apre un incident per ogni guasto confermato e gli assegna un solo responsabile. Ogni piano allerta il tuo team in chat e tramite webhook.

L’elenco degli incident in Perstat con incident aperti e passati e la loro durata.
In questa pagina

Un incident dal guasto al ripristino

Ogni piano apre incident automatici quando un monitor fallisce. Per i monitor con sonde regionali, l’incident si apre solo dopo che il quorum configurato ha confermato il guasto. Resta aperto finché non si raggiunge il quorum di ripristino.

Perstat mantiene al massimo un incident automatico aperto per monitor. La timeline tiene collegati a quell’evento il guasto, le notifiche, il responsabile e il ripristino.

Mentre è attiva una finestra di manutenzione pianificata, non si apre alcun nuovo incident automatico.

Presa in carico e snooze hanno scopi diversi

La presa in carico ferma l’escalation e silenzia tutti gli altri dispositivi. I promemoria vanno poi al responsabile invece che all’intero team. Dichiara a tutto il team che qualcuno ha preso in carico l’incident.

Lo snooze è personale e temporaneo. La vista web dell’allarme critico può silenziare l’incident per 15 minuti senza rendere responsabile chi ha attivato lo snooze. Usa la presa in carico per la responsabilità e lo snooze per una breve interruzione che lascia invariato lo stato del team.

Perstat avvisa via chat, paging e webhook

Perstat invia gli eventi di apertura e di ripristino degli incident a queste destinazioni:

  • Chat: Slack, Microsoft Teams, Discord e Google Chat
  • Paging: PagerDuty e Opsgenie
  • Webhook: webhook firmati

Il push nativo è disponibile su iPhone e Apple Watch. Il browser può mostrare un allarme critico a schermo intero, con suono e comandi per la presa in carico e lo snooze.

Le integrazioni di chat, paging e webhook sono in uscita. Prendi in carico e risolvi in Perstat o tramite un’azione MCP autorizzata, non nella chat o nella destinazione di paging. Tutti i limiti dei canali sono nella pagina delle integrazioni.

Scegli tra SMS personali e turni di reperibilità

Gli alert SMS personali iniziano con Pulse. Ogni persona li attiva per sé e riceve un SMS per ogni incident critico. Non serve un turno di reperibilità.

Sentinel aggiunge turni di reperibilità, rotazione manuale e settimanale e livelli di escalation temporizzati. L’escalation può passare dal push all’SMS e poi a una telefonata, finché qualcuno non prende in carico l’incident.

Le telefonate esistono solo nell’escalation di reperibilità, con un massimo di 2 per incident. SMS e telefonate richiedono un numero verificato con un codice monouso.

Cosa copre la reperibilità

TemaCome funziona
TurniUno per organizzazione, rotazione manuale o settimanale
Passaggio di consegneNel fuso orario dell’organizzazione
Livelli di escalationUn momento, destinatari e canali per livello
DestinatariChi è reperibile, una persona, un ruolo, owner e admin, o un connettore
Nessuno reperibileL’ultimo livello scatta subito
ChiamateAl massimo 2 per incident, solo numeri verificati
Allarmi dipendentiTrattenuti da 1 minuto a 24 ore mentre un monitor di origine è down

Incident manuali e follow-up restano una scelta esplicita

A partire da Sentinel, un operatore può aprire un incident manualmente, anche per un evento che nessun monitor ha aperto. Impatto, causa, lezioni e azioni con responsabili restano collegati all’incident nel suo post-mortem.

Il flusso offre al team un solo luogo in cui registrare l’evento e il suo follow-up. Non è un report normativo automatico.

Guarda la reperibilità e l’alert su iPhone

La configurazione della reperibilità in Perstat, con livelli di escalation da push a SMS e telefonata.
Il turno di reperibilità e i suoi livelli di escalation. Interfaccia reale del prodotto, dati di esempio. I tempi sono configurabili.
Un alert nativo di Perstat su un dispositivo Apple con un controllo per prendere in carico l’incident.
Un alert nativo di incident su un dispositivo Apple. Interfaccia reale del prodotto, dati di esempio.

Post-mortem

Un post-mortem è la fase di revisione dentro il flusso dell’incident.

Il follow-up resta legato all’incident

I registri automatici degli incident esistono in ogni piano. Sentinel aggiunge incident manuali, post-mortem e azioni. La revisione resta collegata all’evento, invece di dividere timeline, riscontri e responsabili fra la chat e un archivio documentale separato.

Trasforma i riscontri in azioni assegnate

Un post-mortem registra impatto, causa radice, lezioni e azioni da svolgere. Un’azione può avere un responsabile, così il follow-up operativo resta accanto all’incident che lo ha generato.

Pubblicare è una decisione separata

Pubblicare un incident manuale o un post-mortem su una pagina di stato scelta è un’azione esplicita. Salvare solo la revisione interna non la rende visibile ai clienti. La pagina di stato scelta mantiene la propria configurazione di accesso e pubblicazione.

Esamina la schermata reale del prodotto

La pagina del post-mortem in Perstat con la revisione dell’incident e le relative sezioni.
Un post-mortem collegato a un incident. Interfaccia reale del prodotto, dati di esempio.

Limiti del post-mortem

Perstat non descrive il post-mortem come un registro immutabile o a prova di manomissione. Non è un report di assurance, una segnalazione normativa o un export SLA self-service.

Il registro di disponibilità tiene separati la timeline grezza, il registro curato dei disservizi e l’attività. Quella pagina spiega anche la conservazione e l’attuale limite dell’export manuale.

Leggi la documentazione sugli incident oppure confronta il piano Sentinel.

Il piano definisce il percorso di risposta

FunzionalitàA partire da
Incident automatici e presa in caricoFree
Alert SMS personalePulse
Turni di reperibilità, rotazione, livelli SMS e telefonataSentinel
Incident manuali, post-mortem e azioniSentinel

Oggi non esiste un’app nativa per Android. Gli SMS e le chiamate di reperibilità funzionano anche senza un dispositivo Apple. Quote e limiti esatti sono nei prezzi.

Inizia a monitorare gratis, oppure configura il percorso di risposta con la documentazione su alert e reperibilità.

Prova un check in parallelo, poi decidi

Verifica quorum, consegna degli alert, comunicazione di stato ed evidenze nel flusso operativo reale, prima di dismettere il percorso precedente.