Takk for at du sendte din henvendelse! En av våre teammedlemmer vil kontakte deg straks.
Takk for at du sendte din bestilling! En av våre teammedlemmer vil kontakte deg straks.
Varighet 14 timer
Kursplan
Innføring i AIOps
- Hva er AIOps og hvorfor det er viktig
- Tradisjonell overvåking vs. AIOps-drevet synlighet
- AIOps-arkitektur og komponenter
Innsamling og normalisering av driftsdata
- Typer av synlighetsdata: metrikker, logger og spor
- Inntak av data fra flere kilder (servere, containere, sky)
- Bruk av agenter og eksportører (Prometheus, Beats, Fluentd)
Datakorrelasjon og anomali-deteksjon
- Tidsrekkekorrelasjon og statistiske metoder
- Bruk av ML-modeller for anomali-deteksjon
- Deteksjon av hendelser i distribuerte systemer
Alarmering og støyreduksjon
- Design av intelligente alarmregler og terskelverdier
- Undertrykkelse, duplikatfjerning og gruppering av alarmer
- Integrering med Alertmanager, Slack, PagerDuty eller Opsgenie
Hovedårsaksanalyse og visualisering
- Bruk av dashboards til visualisering av metrikker og trendanalyse
- Utforsking av hendelser og tidslinjer for RCA
- Spor av problemer gjennom lag med distribuerte sporingsverktøy
Automatisering og reparasjon
- Utløsing av automatiserte skript eller arbeidsflyter fra hendelser
- Integrering med ITSM-systemer (ServiceNow, Jira)
- Bruksområder: selvhelbredelse, skalering, omdirigering av trafikk
Open Source- og kommersielle AIOps-plattformer
- Oversikt over verktøy: Prometheus, Grafana, ELK, Moogsoft, Dynatrace
- Vurderingskriterier for valg av AIOps-plattform
- Demo og praktisk arbeid med valgt stakk
Oppsummering og neste steg
Krav
- Forståelse av IT-drift og konsepter for systemovervåking
- Erfaring med overvåkingsverktøy eller dashboards
- Kjennskap til grunnleggende logg- og metrikksformater
Målgruppe
- Driftsteam ansvarlig for infrastruktur og applikasjoner
- Site Reliability Engineers (SRE)
- IT-overvåkings- og synlighetsteam