ML-Lernarten
Holger
Holger
| 27-07-2026
Astronomieteam · Astronomieteam
Stellen Sie sich vor, Sie haben einen Roboter, der lernen soll, Obst zu sortieren. Sie geben ihm eine Kiste mit Äpfeln, Orangen und Bananen.
Beim überwachten Lernen zeigen Sie dem Roboter die beschrifteten Früchte und erklären ihm, welche Frucht welche ist. Er erhält also die richtigen Antworten als Orientierung.
Beim unüberwachten Lernen hingegen ist der Roboter auf sich allein gestellt – ohne Beschriftungen und ohne Hinweise. Er muss selbst herausfinden, wie sich die Früchte anhand ihrer Eigenschaften, etwa Größe oder Farbe, sinnvoll gruppieren lassen.
Dieses einfache Beispiel veranschaulicht zwei der wichtigsten Verfahren des maschinellen Lernens: das überwachte und das unüberwachte Lernen. Schauen wir uns an, wie beide Methoden funktionieren, wo sie eingesetzt werden und warum sie so wichtig sind.

Was ist überwachtes Lernen?

Überwachtes Lernen funktioniert wie Unterricht mit einem Lehrer. Das Modell lernt anhand eines Datensatzes mit beschrifteten Beispielen. Jedes Beispiel besteht aus einer Eingabe – etwa einem Bild einer Frucht – und einer dazugehörigen Ausgabebezeichnung wie „Apfel“.
Ziel ist es, die Beziehung zwischen Eingabe und Ausgabe zu erlernen, damit das Modell neue, bisher unbekannte Daten korrekt klassifizieren oder vorhersagen kann.
- Der Ablauf: das Training beginnt mit einem Datensatz, dessen Ausgaben bereits bekannt sind. Das Modell lernt, anhand der Eingabedaten die richtige Ausgabe vorherzusagen, beispielsweise Bilder den Kategorien „Katze“, „Hund“ oder „Auto“ zuzuordnen;
- Training und Test: die Daten werden üblicherweise in Trainings- und Testdaten aufgeteilt. Während das Modell mit den Trainingsdaten lernt, wird seine Leistung anschließend anhand bisher unbekannter Testdaten überprüft;
- Praxisbeispiel: bei der Erkennung von Spam-E-Mails wird ein System mit bereits als Spam oder Nicht-Spam gekennzeichneten Nachrichten trainiert. Es lernt dabei, welche Merkmale – etwa bestimmte Wörter, Absender oder Betreffzeilen – typisch für Spam sind.
ML-Lernarten

Was ist unüberwachtes Lernen?

Beim unüberwachten Lernen stehen keine beschrifteten Daten zur Verfügung. Statt vorgegebener Antworten sucht der Algorithmus selbstständig nach verborgenen Mustern, Strukturen oder Zusammenhängen in den Daten.
- Der Ablauf: der Algorithmus analysiert die Daten eigenständig und gruppiert ähnliche Objekte, erkennt Ausreißer oder reduziert die Komplexität der Daten, um deren Struktur besser sichtbar zu machen;
- Praxisbeispiel: im Marketing können Unternehmen unüberwachtes Lernen nutzen, um Kunden anhand ihres Kaufverhaltens zu gruppieren. Der Algorithmus bildet beispielsweise Gruppen wie „Stammkunden“ oder „Gelegenheitskäufer“, ohne dass diese Kategorien zuvor definiert wurden.

Die wichtigsten Unterschiede zwischen überwachtem und unüberwachtem Lernen

Nachdem die Grundlagen beider Verfahren klar sind, lassen sich ihre wichtigsten Unterschiede zusammenfassen.
Beschriftete oder unbeschriftete Daten
- Überwachtes Lernen: arbeitet mit beschrifteten Datensätzen, bei denen die richtige Ausgabe bereits bekannt ist;
- Unüberwachtes Lernen: nutzt unbeschriftete Daten und erkennt deren Struktur eigenständig.
Ziel des Lernens
- Überwachtes Lernen: ziel ist die Vorhersage einer bekannten Ausgabe anhand vorhandener Eingabedaten, etwa bei Klassifikations- oder Regressionsaufgaben;
- Unüberwachtes Lernen: ziel ist es, verborgene Muster oder Strukturen zu entdecken, beispielsweise durch Clusterbildung oder Dimensionsreduktion.
Komplexität
- Überwachtes Lernen: da bekannte Ergebnisse vorliegen, lässt sich die Genauigkeit des Modells relativ einfach bewerten;
- Unüberwachtes Lernen: weil keine eindeutige richtige Lösung existiert, ist die Bewertung schwieriger. Der Schwerpunkt liegt auf der explorativen Analyse der Daten.

Wann eignet sich überwachtes Lernen?

Überwachtes Lernen ist ideal, wenn die gewünschte Ausgabe bereits bekannt ist und Vorhersagen getroffen werden sollen.
- Klassifikationsaufgaben: ddaten werden festen Kategorien zugeordnet, etwa bei der Diagnose von Krankheiten anhand von Symptomen oder der Erkennung handgeschriebener Ziffern;
- Regressionsaufgaben: hier werden kontinuierliche Werte vorhergesagt, beispielsweise Immobilienpreise anhand von Lage, Größe und Alter oder zukünftige Verkaufszahlen auf Basis historischer Daten.
Beispiel: autonome Fahrzeuge nutzen überwachtes Lernen, um Fußgänger, andere Fahrzeuge und Verkehrszeichen zuverlässig zu erkennen. Die Trainingsdaten enthalten dabei bereits korrekt beschriftete Objekte.

Wann eignet sich unüberwachtes Lernen?

Unüberwachtes Lernen eignet sich besonders für große Datenmengen, deren innere Struktur zunächst unbekannt ist.
- Clusterbildung: ähnliche Datenpunkte werden automatisch zu Gruppen zusammengefasst, beispielsweise Kunden mit vergleichbarem Kaufverhalten;
- Anomalieerkennung: ungewöhnliche Datenpunkte lassen sich identifizieren, etwa verdächtige Banktransaktionen zur Betrugserkennung;
- Dimensionsreduktion: die Anzahl der Variablen wird reduziert, ohne wesentliche Informationen zu verlieren. Dadurch lassen sich komplexe Datensätze einfacher analysieren und visualisieren.
Beispiel: in der Genomforschung hilft unüberwachtes Lernen dabei, genetische Ähnlichkeiten oder Unterschiede zwischen Personen zu erkennen, ohne dass vorher Kategorien festgelegt wurden.

Herausforderungen und Grenzen

Sowohl das überwachte als auch das unüberwachte Lernen bieten leistungsstarke Möglichkeiten, bringen jedoch jeweils eigene Herausforderungen mit sich.
- Überwachtes Lernen: es benötigt große Mengen hochwertiger, korrekt beschrifteter Daten. Deren Erstellung ist oft zeitaufwendig und kostspielig. Außerdem besteht die Gefahr des sogenannten Overfittings, bei dem sich das Modell zu stark an die Trainingsdaten anpasst und bei neuen Daten schlechter abschneidet;
- Unüberwachtes Lernen: ohne bekannte Zielwerte ist es schwieriger, die Qualität der Ergebnisse objektiv zu bewerten. Zudem können die Berechnungen bei sehr großen Datensätzen erhebliche Rechenleistung erfordern.
Beispiel: soll ein Modell mithilfe überwachten Lernens Krankheiten vorhersagen, können fehlerhafte oder unvollständige Beschriftungen zu falschen Ergebnissen führen.
ML-Lernarten
Beim unüberwachten Lernen besteht dagegen das Risiko, dass die gebildeten Kundengruppen wenig aussagekräftig oder praktisch kaum nutzbar sind.
Wer die Unterschiede zwischen überwachtem und unüberwachtem Lernen versteht, kann für jede Aufgabe die passende Methode auswählen. Während überwachtes Lernen ideal ist, wenn beschriftete Daten und konkrete Vorhersagen gefragt sind, eignet sich unüberwachtes Lernen hervorragend, um verborgene Muster in unstrukturierten Daten zu entdecken.
Mit der fortschreitenden Entwicklung des maschinellen Lernens werden beide Verfahren weiterhin eine Schlüsselrolle bei der Entwicklung intelligenterer und autonomerer Systeme spielen.