Lernportal für angehende FachinformatikerAdministration
Prüfungsvorbereitung für die schriftliche Abschlussprüfung Teil 2 · Kapitel 02

IT-Systeme administrieren und betreiben

Fortschritt wird geladen …
Am ZPA-Prüfungskatalog ausgerichtetStand: 2. September 2026

Nach der Inbetriebnahme beginnt der dauerhaft verantwortete Betrieb eines IT-Systems. Administration umfasst deshalb weit mehr als das Anlegen von Benutzern: Systeme müssen sicher konfiguriert, überwacht, aktualisiert, dokumentiert und bei Störungen kontrolliert wiederhergestellt werden. In der Prüfung zählt besonders, Betriebsdaten richtig zu deuten und aus ihnen eine begründete Maßnahme abzuleiten.

Betrieb planbar und nachvollziehbar organisieren

Ein stabiler Betrieb benötigt definierte Zuständigkeiten, wiederholbare Abläufe und eine aktuelle Dokumentation. Für jeden wichtigen Dienst sollte klar sein, wer ihn betreibt, welche Abhängigkeiten bestehen, wie er überwacht wird und was bei einer Störung geschieht. Betriebsaufgaben werden nach festen Intervallen oder durch Ereignisse ausgelöst.

Standardisierte Tätigkeiten wie Benutzeranlage, Patchen oder Zertifikatswechsel sollten als Arbeitsanweisung beschrieben werden. Das reduziert Fehler und macht Vertretung möglich. Kritische Änderungen benötigen zusätzlich Freigabe, Sicherung und Rückfallplan.

BetriebsaufgabeAuslöserErforderlicher Nachweis
Monitoring prüfenfortlaufend oder nach AlarmMesswert, Zeitstempel und Bearbeitungsstatus
Updates einspielenPatchzyklus oder SicherheitsmeldungFreigabe, Test, Installation und Ergebnis
Berechtigungen kontrollierenregelmäßig sowie bei RollenwechselSoll-Ist-Abgleich und dokumentierte Freigabe
Datensicherung prüfennach Sicherungslauf und WiederherstellungstestProtokoll, Fehlerbehandlung und Restore-Nachweis
Dokumentation pflegennach jeder relevanten ÄnderungVersion, Verantwortlicher und Änderungsgrund

Identitäten, Rollen und Berechtigungen verwalten

Benutzer erhalten nur die Rechte, die sie für ihre Aufgabe benötigen. Statt Einzelberechtigungen werden möglichst Rollen oder Gruppen verwendet. Dadurch lassen sich Änderungen nachvollziehbar umsetzen und regelmäßig kontrollieren. Administrative Konten werden von normalen Benutzerkonten getrennt; gemeinsam genutzte Konten sind zu vermeiden, weil Handlungen sonst nicht eindeutig zugeordnet werden können.

Der Lebenszyklus einer Identität beginnt beim Eintritt, umfasst Rollenwechsel und endet beim Austritt. Besonders kritisch sind verwaiste Konten, dauerhaft gültige temporäre Rechte und technische Dienstkonten mit zu weitreichenden Berechtigungen. Für privilegierte Zugänge sind zusätzliche Schutzmaßnahmen wie Mehrfaktorauthentifizierung und gesicherte Administrationsgeräte sinnvoll.

Joiner

Identität nach bestätigtem Auftrag anlegen, Grundrolle zuweisen und Erstanmeldung absichern.

Mover

Bei Aufgabenwechsel alte Rechte entfernen und neue Rechte nach Freigabe ergänzen.

Leaver

Zugang fristgerecht sperren, Geräte und Daten übergeben sowie Gruppenmitgliedschaften auflösen.

Rezertifizierung

Verantwortliche bestätigen regelmäßig, dass Rollen und Sonderrechte weiterhin benötigt werden.

Konfigurationen und Änderungen kontrollieren

Konfigurationsmanagement hält fest, welche Komponenten und Einstellungen zu einem System gehören. Ein dokumentierter Soll-Zustand erleichtert Vergleiche, Wiederherstellung und Fehlersuche. Änderungen sollten über einen geregelten Prozess erfolgen, damit technische Auswirkungen, Sicherheitsrisiken und betroffene Geschäftszeiten vorab bewertet werden.

Nicht jede Änderung benötigt denselben Aufwand. Eine vorab genehmigte Standardänderung ist risikoarm und wiederholt sich häufig. Eine normale Änderung wird geplant und freigegeben. Eine Notfalländerung darf beschleunigt umgesetzt werden, muss aber trotzdem dokumentiert und nachträglich bewertet werden.

  • Ziel, Umfang und betroffene Systeme eindeutig beschreiben
  • Abhängigkeiten, Ausfallrisiko und Wartungsfenster bewerten
  • Sicherung sowie technisch realistischen Rückfallweg festlegen
  • Änderung zunächst in einer geeigneten Testumgebung prüfen
  • Ergebnis kontrollieren und Betriebsdokumentation aktualisieren

Patch- und Versionsmanagement sicher durchführen

Updates schließen Sicherheitslücken, korrigieren Fehler oder ändern Funktionen. Sie dürfen weder ungeprüft auf alle Systeme verteilt noch unbegrenzt verschoben werden. Grundlage ist eine aktuelle Inventarisierung: Nur bekannte Betriebssysteme, Anwendungen, Firmwarestände und Abhängigkeiten können gezielt bewertet werden.

Die Priorität ergibt sich aus Kritikalität der Schwachstelle, Erreichbarkeit des Systems, Schutzbedarf und verfügbaren Gegenmaßnahmen. Nach dem Test folgt eine gestufte Verteilung, etwa zunächst auf Pilotgeräte. Anschließend werden Installation, Dienstzustand und fachliche Funktion kontrolliert. Fehlgeschlagene Installationen müssen erkannt und behandelt werden.

Informieren

Herstellerhinweise, Schwachstellenbewertung und betroffene Versionen prüfen.

Bewerten

Risiko, Dringlichkeit, Abhängigkeiten und notwendige Ausfallzeit bestimmen.

Testen

Kompatibilität, Installation, Deinstallation und Rückfallweg erproben.

Verteilen

Freigegebenes Update kontrolliert und möglichst gestuft ausrollen.

Verifizieren

Versionsstand, Dienste, Protokolle und fachliche Kernfunktionen prüfen.

Monitoring, Logging und Alarmierung unterscheiden

Monitoring erfasst Zustände und Messwerte, beispielsweise Erreichbarkeit, CPU-Last, Speicherbelegung, Antwortzeit oder Ablaufdaten von Zertifikaten. Logging zeichnet Ereignisse auf und unterstützt Nachvollziehbarkeit sowie Fehleranalyse. Eine Alarmierung bewertet Messwerte oder Ereignisse anhand festgelegter Regeln und benachrichtigt die zuständige Stelle.

Ein einzelner Messwert ist selten ausreichend. Hohe CPU-Last kann eine Störung, eine geplante Verarbeitung oder lediglich einen kurzen Laststoß darstellen. Deshalb werden Zeitverlauf, Vergleichswerte und zusammenhängende Messgrößen betrachtet. Schwellenwerte benötigen eine sinnvolle Dauer und Hysterese, damit kurzzeitige Ausschläge nicht unnötig alarmieren.

SignalMögliche BedeutungSinnvolle nächste Prüfung
Datenträger fast vollWachstum, temporäre Dateien oder fehlerhafte ProtokollrotationVerzeichnisgrößen, Wachstumsrate und Aufbewahrung
Antwortzeit steigtLast, Netzwerk, Datenbank oder abhängiger DienstZeitverlauf und Messwerte aller beteiligten Komponenten
Viele FehlanmeldungenFehlkonfiguration, vergessenes Kennwort oder AngriffQuelle, Konto, Zeitraum und betroffene Systeme
Sicherung dauert längergrößere Datenmenge, langsames Ziel oder NetzengpassDatenrate, Änderungsmenge, Zielsystem und Fehlerprotokoll

Kapazität und Verfügbarkeit im laufenden Betrieb sichern

Kapazitätsmanagement beobachtet nicht nur aktuelle Grenzwerte, sondern Trends. Aus Wachstumsrate und verbleibender Reserve wird abgeleitet, wann eine Erweiterung erforderlich wird. Dabei sind technische Grenzen, Beschaffungszeit, Wartungsfenster und Lizenzierung zu berücksichtigen.

Verfügbarkeit wird über einen definierten Zeitraum gemessen. Geplante Wartung kann je nach Vereinbarung ein- oder ausgeschlossen sein. Die reine Prozentzahl muss immer im Zusammenhang mit dem Zeitraum betrachtet werden: Dieselbe Ausfallzeit wirkt sich bei monatlicher und jährlicher Betrachtung unterschiedlich aus.

  • Messzeitraum und Servicezeit eindeutig festlegen
  • ungeplante Ausfallzeit von vereinbarter Wartung unterscheiden
  • Kapazität anhand von Trends statt erst beim Erreichen von 100 Prozent erweitern
  • Redundante Systeme regelmäßig auf tatsächliche Umschaltfähigkeit prüfen
  • wiederkehrende Störungen als Problem und nicht nur als einzelne Tickets behandeln

Datensicherung und Wiederherstellung betreiben

Im Betrieb muss nach jedem Sicherungslauf erkennbar sein, ob alle vorgesehenen Daten geschützt wurden. Ein erfolgreich beendeter Job ist noch kein vollständiger Nachweis: Aufbewahrung, Verschlüsselung, Trennung vom Produktivsystem und Wiederherstellbarkeit müssen ebenfalls kontrolliert werden.

Für die Wiederherstellung werden Reihenfolge und Abhängigkeiten festgelegt. Häufig müssen zunächst Infrastruktur- oder Identitätsdienste, anschließend Datenbanken und erst danach Anwendungen verfügbar sein. Regelmäßige Restore-Tests prüfen nicht nur die Daten, sondern auch Zugangsdaten, Dokumentation, Verantwortlichkeiten und benötigte Zeit.

KontrolleZu prüfender Punkt
SicherungslaufVollständigkeit, Fehler, Datenmenge, Dauer und Sicherungsziel
AufbewahrungGenerationen, Löschfristen, unveränderliche oder getrennte Kopie
SchutzBerechtigungen, Verschlüsselung und gesicherte Schlüssel
Restore-TestLesbarkeit, Konsistenz, benötigte Zeit und fachliche Nutzbarkeit
DokumentationReihenfolge, Zuständigkeit, Zugang und Eskalationsweg

Störungen strukturiert analysieren und beheben

Bei einer Störung steht zunächst die Wiederherstellung des vereinbarten Dienstes im Vordergrund. Gleichzeitig müssen unkoordinierte Änderungen vermieden werden. Symptome, Zeitpunkt, betroffene Nutzer und zuletzt erfolgte Änderungen werden erfasst. Danach wird der Fehlerbereich schrittweise eingegrenzt und jede Hypothese durch eine gezielte Prüfung bestätigt oder verworfen.

Ein Incident beschreibt die aktuelle Beeinträchtigung. Ein Problem untersucht die zugrunde liegende Ursache, insbesondere bei wiederkehrenden oder schweren Störungen. Ein Workaround stellt den Dienst vorübergehend wieder her, beseitigt aber nicht zwingend die Ursache. Nach der Lösung werden Maßnahmen und Erkenntnisse dokumentiert.

Erfassen

Symptom, Beginn, Umfang, Dringlichkeit und betroffene Dienste dokumentieren.

Eingrenzen

Gemeinsamkeiten, Abhängigkeiten, Änderungen und Protokolle auswerten.

Hypothese

Eine mögliche Ursache formulieren und mit einer gezielten Prüfung testen.

Beheben

Freigegebene Maßnahme umsetzen oder einen sicheren Workaround verwenden.

Kontrollieren

Technische Messwerte und fachliche Funktion gemeinsam prüfen.

Abschließen

Ursache, Lösung, Auswirkungen und vorbeugende Maßnahmen festhalten.

Betriebs- und Sicherheitsdokumentation aktuell halten

Dokumentation ist Teil des Betriebs und kein nachträglicher Zusatz. Eine Systemdokumentation beschreibt Aufbau, Konfiguration und Abhängigkeiten. Betriebshandbücher enthalten wiederkehrende Tätigkeiten, Überwachung, Sicherung, Start- und Stoppreihenfolge sowie Störungsverfahren. Änderungen müssen versioniert und für berechtigte Personen erreichbar sein.

Geheimnisse wie Kennwörter oder private Schlüssel gehören nicht ungeschützt in allgemeine Dokumente. Stattdessen wird beschrieben, wo und durch wen diese sicher verwaltet werden. Auch Protokolldaten benötigen Zugriffsschutz und festgelegte Aufbewahrungsfristen.

  • Netz-, System- und Datenflusspläne nach Änderungen aktualisieren
  • Konfigurationswerte und bewusst getroffene Abweichungen begründen
  • Betriebsverfahren mit Voraussetzungen, Schritten und Erfolgskontrolle beschreiben
  • Notfallkontakte und Eskalationswege regelmäßig überprüfen
  • Änderungshistorie und Freigabestand nachvollziehbar führen

Typischer Lösungsweg in der Prüfung

Prüfungsaufgaben verbinden häufig ein Fehlerbild mit Auszügen aus Monitoring, Protokollen oder Konfigurationen. Werte nicht isoliert betrachten: Ordne zuerst Dienst, Abhängigkeiten und zeitlichen Verlauf ein. Schlage danach eine Maßnahme vor, die Ursache und Risiko berücksichtigt, und nenne eine Kontrolle, mit der sich der Erfolg nachweisen lässt.

  • Soll-Zustand und beobachtetes Symptom gegenüberstellen.
  • Betroffene Nutzer, Systeme und Zeiträume eingrenzen.
  • Protokolle und Messwerte auf gemeinsame Ursache und Reihenfolge prüfen.
  • Vor einer Änderung Sicherung, Auswirkung und Rückfallweg berücksichtigen.
  • Maßnahme fachlich begründen und nicht nur einen Befehl nennen.
  • Erfolg durch Messwert, Funktionstest oder Restore-Nachweis kontrollieren.
IT-Systeme administrieren und betreiben | Abschlussprüfung Teil 2 Systemintegration