Kurs · Modul 188
Services betreiben, warten und überwachen
Nach diesem Kurs betreibst du IT-Services so, wie es professionelle Betriebe tun: Du beschreibst einen Service mit seinen Komponenten im Servicekatalog, vereinbarst messbare Servicelevels und rechnest Verfügbarkeiten, Ausfallbudgets und ganze Komponentenketten sicher aus. Du planst ein Monitoring mit End-to-End-Checks, begründeten Schwellwerten und einer Alarmierung, die nur meldet, was eine Handlung verlangt. Störungen priorisierst du aus Auswirkung und Dringlichkeit, koordinierst die Kommunikation bei einer P1-Störung und dokumentierst Tickets so, dass andere damit weiterarbeiten können. Wiederkehrende Fehler führst du mit Logs und der 5-Why-Methode auf ihre Ursache zurück, Änderungen planst du als Change mit Risiko, Test und Rückweg. Mit MTTR, MTBF, Kapazitätsprognosen, Monatsberichten und Runbooks zeigst du, wie gut der Betrieb läuft und wo er besser werden muss. 14 Python-Labore, ein durchgehendes Projekt beim Online-Händler Sportxpress und eine Prüfungssimulation sorgen dafür, dass du es nicht nur liest, sondern selbst machst. Üben musst du trotzdem selbst, am besten im eigenen Heimlabor und im Lehrbetrieb.
Dein nächster Schritt
Denken in Services und ITIL-Grundbegriffe
Du erklärst, was ein Service ist und woraus er besteht, unterscheidest Incident, Service Request, Problem, Change und Event sicher und beschreibst einen Service im Servicekatalog. · 35 Min.
Dein KI-Lerncoach
Lernen mit KI, aber richtig
Der Tutor kennt dieses Modul, deine Lektion und deine Aufgaben. Er führt dich zur Lösung, statt sie vorzusagen.
Training
…
Aufgaben gelöst
Karteikarten
…
Karten im Kurs
Praxisprojekt
…
Meilensteine
Prüfung
…
bestes Ergebnis
Deine Kompetenzen
offen begonnen sicher gemeistert
Berechnet aus deinen gelösten Aufgaben. Ziel für den Kompetenznachweis: überall mindestens «sicher» auf Stufe 2.
| 1 · Grundlagen | 2 · Fortgeschritten | 3 · Erweitert | |
|---|---|---|---|
| A · Services definieren | 0% | 0% | – |
| B · Monitoring einrichten | – | – | – |
| C · Störungen bearbeiten | 0% | – | – |
| D · Ursachen finden | 0% | – | – |
| E · Changes und Wartung | 0% | – | – |
| F · Kennzahlen und Dokumentation | – | – | – |
Abzeichen
Lektionen
- 1Denken in Services und ITIL-GrundbegriffeDu erklärst, was ein Service ist und woraus er besteht, unterscheidest Incident, Service Request, Problem, Change und Event sicher und beschreibst einen Service im Servicekatalog.Gratis35 Min.
- 2SLA, OLA und Verfügbarkeit berechnenDu weisst, was in ein SLA gehört, grenzt OLA und Underpinning Contract ab, rechnest Verfügbarkeit und Ausfallbudget für jede Servicezeit und begründest Ziele mit der Komponentenkette.45 Min.
- 3Monitoring aufbauen: Ebenen, Methoden, WerkzeugeDu planst ein Monitoring vom Netzwerk bis zur Benutzersicht, kennst Ping, SNMP, Agent und HTTP-Checks, verstehst PRTG, Zabbix und Checkmk und weist mit einem Test-Alarm nach, dass es funktioniert.40 Min.
- 4Schwellwerte und Alarmierung ohne AlarmflutDu leitest Schwellwerte aus Baseline und Reaktionszeit ab, senkst Lärm mit Dauer, Hysterese, Abhängigkeiten und Deduplizierung und legst Kanäle und Eskalation pro Schweregrad fest.45 Min.
- 5Incidents und Service Requests bearbeitenDu bearbeitest Störungen nach einem klaren Ablauf, bestimmst die Priorität aus Auswirkung und Dringlichkeit, eskalierst rechtzeitig, führst die Kommunikation bei P1 und dokumentierst sauber.45 Min.
- 6Ursachen finden: Problem ManagementDu erkennst wiederkehrende Störungen, wertest Logs zentral aus, leitest mit 5 Why eine Ursache her, belegst sie mit Daten und dokumentierst einen Known Error.45 Min.
- 7Changes, Patches und WartungsfensterDu unterscheidest Standard-, normale und Notfall-Changes, schreibst einen Change-Antrag mit Risiko, Test und Rückweg und planst Patches und Wartungen ohne Überraschungen.45 Min.
- 8Kennzahlen und MonatsberichtDu berechnest Verfügbarkeit, MTTR, MTBF und SLA-Erfüllung, baust einen Monatsbericht für die Leitung und leitest aus den Zahlen konkrete Verbesserungen ab.40 Min.
- 9Kapazitätsplanung, Runbooks und BetriebshandbuchDu prognostizierst Kapazitäten mit einer Trendlinie, bestimmst den Handlungszeitpunkt und schreibst Runbooks und ein Betriebshandbuch, mit denen auch das Pikett sicher arbeitet.45 Min.