Creazione automatica dagli alert dei monitor
Configura un servizio per aprire un incidente automaticamente quando un monitor fallisce, così nessuno deve cliccare "Dichiara incidente" nel mezzo della notte.
Dichiara, monitora e chiudi gli incidenti senza lasciare la piattaforma. Livelli di severity, aggiornamenti strutturati, collegamento ai servizi coinvolti e una timeline pubblica. Gli incidenti possono crearsi automaticamente da qualsiasi guasto di monitor e risolversi automaticamente al ripristino.
Ogni incidente ha una severity, uno stato, una timeline di aggiornamenti e un elenco di servizi coinvolti. Il tuo ingegnere di reperibilità lo vede nel momento in cui scatta; i tuoi utenti lo vedono sulla pagina di stato; il tuo team scrive il prossimo aggiornamento. Tutto nello stesso posto.
Configura un servizio per aprire un incidente automaticamente quando un monitor fallisce, così nessuno deve cliccare "Dichiara incidente" nel mezzo della notte.
Gli incidenti sono minor, major o critical. Questa etichetta è ciò che i visitatori vedono sulla pagina di stato. Le etichette da P1 a P4 non vengono usate.
Ogni transizione di stato (Investigating, Identified, Monitoring, Resolved) è registrata con timestamp. I visitatori vedono la cronologia completa; il tuo team ha un audit trail.
Gli incidenti vengono pubblicati sulla tua pagina di stato pubblica automaticamente. I componenti passano a "Degraded" o "Outage" e tornano a "Operational" quando risolvi. Nessun aggiornamento separato necessario.
Sai chi è stato cercato, chi ha riconosciuto e chi sta lavorando attivamente sull'incidente. I responsabili passano attraverso gli stati Triggered, Acknowledged e Resolved con timestamp.
Pubblica aggiornamenti con data e ora da Investigating a Resolved. I documenti di postmortem strutturati non esistono ancora.
Quando un monitor fallisce, Site Qwality può aprire un incidente, impostare la severity, collegare il servizio coinvolto, cercare il responsabile di reperibilità e aggiornare la pagina di stato, tutto prima che qualcuno abbia digitato una sola parola su Slack. Intervieni per aggiungere contesto, non per avviare il processo.
Dopo la risoluzione, la timeline dell'incidente resta sul registro: cosa hai pubblicato, quando l'hai pubblicato e chi hai informato. I documenti di postmortem strutturati non esistono ancora.
intervallo di controllo più breve, che limita il tempo fino all'incidente
livelli di severity: minor, major e critical
degli incidenti pubblicati visibili nella timeline
piano gratuito, flusso di lavoro completo per gli incidenti incluso
Sì. Configura un servizio con la creazione automatica degli incidenti e Site Qwality apre un incidente nel momento in cui un monitor collegato fallisce. Puoi anche richiedere una conferma manuale, oppure disabilitare la creazione automatica e dichiarare gli incidenti manualmente.
Gli incidenti usano minor, major o critical. La severity determina come etichetti l'evento sulla pagina di stato. Le etichette da P1 a P4 non vengono usate.
Sì. Quando risolvi un incidente, i componenti coinvolti tornano a "Operational" e un aggiornamento di risoluzione viene pubblicato automaticamente sulla timeline della pagina di stato. Gli abbonati ricevono una notifica di risoluzione.
Ogni cambio di stato (Investigating, Identified, Monitoring, Resolved) viene registrato con un timestamp e il messaggio facoltativo che fornisci. La timeline è visibile al tuo team e, se pubblicata, ai visitatori della tua pagina di stato.
Oggi non esiste un tipo di documento postmortem. Tieni la storia sulla timeline dell'incidente.
Uptime, cron, synthetic, log, RUM, incidenti e pagine di stato. Piano gratuito su ogni prodotto.