Verificato ogni minuto, con 30 giorni di cronologia.
Lo stato in tempo reale viene misurato fuori dalla nostra piattaforma, su Cloudflare, così continua a rispondere quando noi non lo facciamo. Questa pagina descrive cosa monitoriamo, gli obiettivi che ci diamo e come gestiamo la manutenzione.
Cosa controllano le sonde ogni minuto, da un capo all’altro.
Dashboard web
app.logpulse.io: UI di ricerca, dashboard, alert
API
api.logpulse.io: REST + WebSocket
Ingestione dei log
Endpoint OTLP HTTP + JSON generico
Motore di query
LPQL su ClickHouse Cloud
AI Investigator
Ricerca in linguaggio naturale + indagine
Obiettivi ingegneristici che ci imponiamo. Gli SLA contrattuali sono disponibili con il piano Enterprise.
Uptime della piattaforma
99.9%
Obiettivo mobile su 30 giorni
Latenza delle query (P95)
< 200ms
Tier hot, query semplici
Latenza di ingest (P99)
< 500ms
Dall'API a interrogabile
RPO dei backup
< 1h
Recupero a un punto nel tempo
Rispecchiano gli SLO pubblicati nella pagina sicurezza e conformità. Tutti i dettagli sulla sicurezza
Puntiamo a deploy senza tempi di inattività, ma a volte dobbiamo mettere in pausa l'ingest o portare ClickHouse offline per le migrazioni. Quando lo facciamo:
Incidenti confermati, con causa principale e cronologia di risoluzione.
La cronologia degli incidenti è sulla pagina di stato
Gli incidenti in corso e la loro cronologia vengono pubblicati lì nel momento in cui accadono. Per ogni incidente che ha toccato gli utenti pubblichiamo qui un post-mortem.
Apri lo stato in tempo realeIscriviti agli aggiornamenti di stato e ti invieremo un'email quando un componente passa allo stato di degrado o interruzione, oltre che prima di qualsiasi finestra di manutenzione pianificata.