La rete di sonde

Perstat esegue i check da 6 regioni, una per continente abitato. Undici tipi di check votano tra le regioni prima che si apra un incident, mentre i monitor agent e heartbeat segnalano direttamente.

Un monitor Perstat con i tempi di risposta da sei regioni e i risultati per regione e indirizzo IP.
In questa pagina

Le regioni

RegionePoPCittàContinente
naewrNewarkNord America
sagruSão PauloSud America
eufraFrancoforteEuropa
afjnbJohannesburgAfrica
assgpSingaporeAsia
ocesydSydneyOceania

Tutte e 6 le regioni sono attive. Free usa 2 regioni, Pulse 3, Sentinel e i piani superiori tutte e 6.

L’API, MCP e il report SLA di esempio usano le chiavi delle regioni qui sopra. Le viste del prodotto indicano il continente.

Il voto regionale riguarda 11 tipi di check regionali. I monitor agent e heartbeat non usano né regioni di sonda né quorum regionale, e seguono invece le proprie regole per i segnali in ingresso.

Come si esegue un check

I nodi sonda prendono il lavoro dal control plane. A intervalli di pochi secondi, ogni nodo chiede i check previsti nella sua regione, li esegue e riporta il risultato completo. Un nodo che tace smette di prendere lavoro e non può far sparire in silenzio i tuoi check.

Ogni nodo esegue un proprio resolver DNS ricorsivo e validante. I risultati DNS vengono dall’albero DNS reale, non dalla cache di un resolver pubblico. Perstat riporta dns_ms separato dalla latenza totale, così un resolver lento non sembra mai un’applicazione lenta.

I check di raggiungibilità possono girare su IPv4, IPv6 o entrambi, e riportano un risultato per indirizzo IP. Senza una scelta, un check usa IPv4. I check DNS, igiene DNS e dominio girano senza famiglie di indirizzi, e il traceroute segue un solo indirizzo IP.

Quando un check di sonda supportato produce un’attribuzione, il risultato indica uno di questi livelli:

  • La tua applicazione
  • Il tuo DNS
  • La rete intermedia
  • Il nostro resolver
  • Il nostro nodo sonda

Unknown resta uno stato valido finché l’attribuzione non è determinata. Non tutti i risultati hanno un livello di causa.

Come votano gli 11 tipi di check regionali

Per questi 11 tipi, tra un check fallito e un alert ci sono due soglie:

  1. Dentro una regione. L’algoritmo aggrega i risultati freschi dei nodi e richiede il 75% di accordo quando è attivo più di un nodo sonda. Oggi ciascuna delle 6 regioni ha un solo nodo attivo, quindi questo livello vale 1/1. Non aggiunge una seconda conferma indipendente dentro la regione.
  2. Tra le regioni. Un incident si apre solo quando un quorum di regioni conferma il guasto, 2 regioni di default. Un quorum separato conferma il ripristino. I risultati più vecchi della finestra di freschezza non contano per il quorum. Questa è la conferma attiva tra regioni nella topologia attuale.

Sotto il quorum, Perstat non scarta nulla in silenzio. Un incident in formazione è visibile nel prodotto e indica la prima regione in errore.

Le divergenze sotto quorum, come una regione in drift o una famiglia IP che fallisce, finiscono su una lista di osservazione invece di allertare qualcuno. Anche il disaccordo tra nodi compare lì, quando una regione ha più di un nodo attivo. Una voce della lista deve durare un intervallo di check completo prima di essere segnalata.

Un incident inizia alla conferma del quorum, al secondo. Il tuo registro di disponibilità usa poi lo stesso confine.

I clienti ricevono dettagli di egress su richiesta

I clienti che hanno bisogno dei dettagli di egress delle sonde per le proprie allowlist li ricevono su richiesta. Gli indirizzi IP dei nodi e i provider di hosting non sono pubblicati.

I nodi sonda non conservano dati degli account dei clienti: misurano e riferiscono. Il control plane resta nell’UE, gestito da un’azienda tedesca. Il resto di questa storia è nella pagina della sicurezza.

Fai il tour, oppure guarda i tipi di check che la flotta esegue.