Suchen
KI-generiertes Bild - Künstliche Intelligenz Lernen, KI-Lernen, Machine Learning Bild ist KI-generiert

Was ist maschinelles Lernen?

Maschinelles Lernen für Führungskräfte erklärt: Was es ist, wie es funktioniert, welche Typen es gibt und wo es messbaren Mehrwert im Betrieb schafft

Die Grundlagen des maschinellen Lernens

Maschinelles Lernen ist ein Teilgebiet der künstlichen Intelligenz, in dem statistische Modelle Muster aus Daten erlernen und diese Muster nutzen, um Vorhersagen, Klassifikationen, Empfehlungen oder andere Entscheidungen auf Basis neuer Daten zu treffen. Das System erhält keine separate Regel für jede mögliche Situation, sondern verbessert iterativ ein definiertes Leistungsmaß durch Training, Evaluierung und Feedback. 1,3

Ein Modell verknüpft Eingaben mit Ausgaben anhand von Mustern, die aus realen Beispielen gelernt wurden. So kann beispielsweise ein Betrugserkennungsmodell aus früheren Transaktionen und deren Ergebnissen lernen und dann einschätzen, ob eine neue Transaktion ungewöhnlich ist. Das Modell „versteht“ Betrug nicht wie ein Mensch. Es berechnet ein Ergebnis auf Basis von Mustern, die in den Daten und Parametern abgebildet sind.

Maschinelles Lernen ist am nützlichsten, wenn die Aufgabe wiederholbar ist, relevante Daten vorhanden sind, der Erfolg gemessen werden kann und ein probabilistisches Ergebnis operativ akzeptabel ist. Menschliches Urteilsvermögen bleibt wichtig für die Festlegung von Zielen, die Validierung von Ergebnissen, den Umgang mit Ausnahmen und die Entscheidung, wie Vorhersagen genutzt werden sollen.

Wie sich maschinelles Lernen von regelbasierter Software unterscheidet

Traditionelle Software folgt einer Logik, die explizit von Entwicklern geschrieben wurde: Wenn eine definierte Bedingung eintritt, führt das Programm eine definierte Aktion aus. Dies funktioniert gut, wenn Regeln stabil sind und klar beschrieben werden können.

Maschinelles Lernen ist dann sinnvoll, wenn die Zusammenhänge zu zahlreich, zu variabel oder zu subtil sind, um sie als vollständigen Regelsatz auszudrücken. Anstatt jede Entscheidung zu programmieren, stellen Teams Beispiele und ein Lernziel bereit. Das resultierende Modell schätzt für neue Fälle einen Ausgabewert.

Die beiden Ansätze arbeiten häufig zusammen. Geschäftsregeln können verbindliche Kontrollen durchsetzen, während ein Machine-Learning-Modell Fälle priorisiert, den Bedarf prognostiziert, Anomalien erkennt oder eine Maßnahme empfiehlt.

Training, Validierung, Inferenz und Feedback

Beim Training passt ein Algorithmus iterativ die Modellparameter an, um die Leistung bei ausgewählten Daten zu verbessern. Ein separater Validierungs- oder Testdatensatz prüft, ob das Modell über die bereits gesehenen Beispiele hinaus verallgemeinern kann. Nach der Bereitstellung bezeichnet Inferenz den Prozess, bei dem das trainierte Modell verwendet wird, um eine Ausgabe für neue Daten zu erzeugen. 1, 2

Der Lebenszyklus setzt sich nach dem Launch fort. Teams überwachen Modellqualität, Latenz, Fairness, Sicherheit, Datenveränderungen und Geschäftsergebnisse. Neue Daten und verifizierte Ergebnisse können genutzt werden, um das Modell neu zu trainieren oder zu ersetzen, wenn die Leistung die Anforderungen nicht mehr erfüllt.

Maschinelles Lernen im Vergleich zur traditionellen Analytik

Traditionelle Analytik erklärt häufig, was geschehen ist – mithilfe von Berichten, Dashboards, deskriptiver Statistik und vordefinierten Abfragen. Maschinelles Lernen hingegen konzentriert sich darauf, Zusammenhänge zu erlernen, die auf neue Daten angewendet werden können, beispielsweise um abzuschätzen, was als Nächstes eintreten könnte, oder um die wahrscheinlichste Kategorie auszuwählen.

Die Grenze ist nicht absolut. Statistische Methoden unterstützen sowohl Analytik als auch maschinelles Lernen, und viele Unternehmenslösungen kombinieren Reporting, Prognosen, Optimierung und menschliche Entscheidungsfindung. Die richtige Methode ist die einfachste, die die geschäftlichen, risikobezogenen und leistungsbezogenen Anforderungen erfüllt.

Maschinelles Lernen, Data Science und Data Mining

Maschinelles Lernen ist eine Sammlung von Methoden zur Erstellung von Modellen, die aus Daten verallgemeinern. Data Science ist die übergeordnete Disziplin, die Data Engineering, Statistik, Visualisierung, Fachwissen und Maschinelles Lernen kombiniert, um Fragen zu beantworten und Entscheidungen zu unterstützen. Data Mining überschneidet sich mit maschinellem Lernen, konzentriert sich jedoch stärker auf die Entdeckung bisher unbekannter Muster in vorhandenen Daten, während maschinelles Lernen in der Regel daran gemessen wird, wie gut ein Modell neue Daten vorhersagt oder auf diese reagiert. 1

Deskriptive, prädiktive und präskriptive Ausgaben

Je nach Geschäftsziel kann maschinelles Lernen deskriptive Analysen (was ist passiert), prädiktive Analysen (was wird wahrscheinlich passieren) und präskriptive Entscheidungsunterstützung (welche Maßnahme sollte in Betracht gezogen werden) unterstützen. Diese Ansätze können zusammenwirken: Ein System kann ein Muster erkennen, ein Ergebnis vorhersagen und eine Reaktion empfehlen, während eine Person oder ein gesteuerter Workflow die endgültige Kontrolle behält. 2

Welchen Mehrwert für das Unternehmen kann maschinelles Lernen schaffen?

Maschinelles Lernen kann Entscheidungen und Prozesse im gesamten Unternehmen unterstützen, schafft jedoch keinen Mehrwert allein durch die Erstellung eines präzisen Modells. Vorteile entstehen, wenn Prognosen relevant und vertrauenswürdig sind, in Workflows integriert werden und anhand von Geschäftsergebnissen gemessen werden. Die überzeugendsten Anwendungsfälle verbinden in der Regel eine wiederholbare Entscheidung, ausreichende Daten und eine klare Maßnahme, die aus dem Modell-Output folgt.

Schnellere und konsistentere Entscheidungen

Modelle können viele Datenpunkte und Variablen auf wiederholbare Weise auswerten und innerhalb von Sekunden Bewertungen, Klassifizierungen oder Empfehlungen liefern. Dies ist nützlich für Aufgaben mit hohem Volumen, wie die Priorisierung von Serviceanfragen, die Überprüfung von Transaktionen, die Bestandsprognose oder die Identifizierung von Datensätzen, die die Aufmerksamkeit von Fachkräften erfordern.

Automatisierung sollte dem Risiko angemessen sein. Risikoarme Entscheidungen können automatisiert werden, während folgenreiche Ergebnisse möglicherweise eine Genehmigung, Erläuterung oder einen Eskalationspfad erfordern.

Automatisierung in großem Maßstab

Maschinelles Lernen kann analytische Schritte automatisieren, die mit festen Regeln schwer zu handhaben sind, darunter Bildklassifizierung, natürliche Sprachverarbeitung (Natural Language Processing, NLP), Anomalieerkennung und Empfehlungen. NLP wendet maschinelles Lernen auf Text- und Sprachaufgaben an, wie Klassifizierung, Informationsextraktion, Suche, Übersetzung, Zusammenfassung und Chatbot-Interaktionen. Dies kann Routinearbeiten reduzieren und Fachkräften helfen, sich auf Ausnahmen und Entscheidungen mit höherem Mehrwert zu konzentrieren.

Ein nützliches Modell muss mit Anwendungen, APIs, Datenpipelines und operativen Workflows verbunden sein. Ohne diese Integration bleibt eine Prognose ein Experiment und entwickelt sich nicht zu einer geschäftlichen Fähigkeit.

Genauere Prognosen

Prognosemodelle kombinieren historische Muster mit relevanten Einflussfaktoren wie Saisonalität, Werbeaktionen, Preisen, Wetter, Kapazitäten oder Wirtschaftsindikatoren. Sie können die Bedarfsplanung, das Workload-Management, die Energieprognose und die Cashflow-Planung unterstützen.

Die Prognosequalität hängt von der Datenabdeckung und sich ändernden Bedingungen ab. Teams sollten das Modell mit transparenten Baselines vergleichen, Fehler nach Geschäftssegment messen und planen, wie sie reagieren, wenn ungewöhnliche Ereignisse die Genauigkeit beeinträchtigen.

Frühzeitige Risiko- und Anomalieerkennung

Maschinelles Lernen kann Transaktionen, Gerätesignale, Netzwerkereignisse oder Prozessverhalten identifizieren, das von erwarteten Mustern abweicht. Das Ergebnis kann ein Risiko-Score oder eine priorisierte Meldung sein – keine abschließende Entscheidung.

Effektive Anomalieerkennung balanciert übersehene Ereignisse gegen Fehlalarme. Schwellenwerte, Review-Kapazität, Feedback von Fachkräften und die Konsequenzen von Fehlern müssen gemeinsam berücksichtigt werden.

Personalisierte Kundenerlebnisse

Empfehlungs- und Propensity-Modelle können Unternehmen dabei helfen, relevante Produkte, Inhalte, Maßnahmen oder Serviceoptionen für verschiedene Kunden auszuwählen. Ein Kundenservice-Chatbot kann auch maschinelles Lernen nutzen, um Absichten zu klassifizieren, relevante Informationen abzurufen oder Antwortoptionen zu priorisieren. Segmentierungsmodelle können Gruppen mit ähnlichem Verhalten identifizieren, ohne sich ausschließlich auf vordefinierte Kategorien zu stützen.

Personalisierung sollte transparent und datenschutzbewusst sein sowie der Kundenbeziehung entsprechen. Sensible Attribute, unzulässige Rückschlüsse und Feedback, die die Auswahlmöglichkeiten der Kunden einschränken, erfordern eine sorgfältige Governance.

Der Mehrwert hängt vom Anwendungsfall ab

Ein technisch beeindruckendes Modell kann eine begrenzte geschäftliche Wirkung haben, wenn die Entscheidung selten vorkommt, die Prognose zu spät eintrifft oder keine praktische Maßnahme folgt. Umgekehrt kann ein vergleichsweise einfaches Modell erheblichen Mehrwert schaffen, wenn es einen häufigen, kostenintensiven oder zeitkritischen Prozess verbessert.

Definieren Sie vor der Entwicklung die zu verbessernde Entscheidung, den Nutzer des Ergebnisses, die akzeptable Fehlerquote, die betrieblichen Rahmenbedingungen und die Kennzahlen, anhand derer sich zeigt, ob die Lösung funktioniert.

Wie funktioniert maschinelles Lernen?

Machine Learning beginnt mit einer geschäftlichen Fragestellung und endet mit einem operativen Feedback-Loop. Teams übersetzen die Fragestellung in eine messbare Aufgabe, bereiten repräsentative Daten vor, wählen einen Ansatz, trainieren und evaluieren ein Modell, integrieren es in einen realen Prozess und überwachen, ob es weiterhin wie vorgesehen funktioniert. 1, 2, 3

Das Training ist nur ein Teil des Lebenszyklus. Datenpipelines, Anwendungsintegration, Sicherheit, Monitoring, Dokumentation und menschliche Aufsicht entscheiden häufig darüber, ob ein Modell zuverlässig im Produktivbetrieb eingesetzt werden kann.

1. Problem und Erfolgskriterien definieren

Beginnen Sie mit der Entscheidung oder dem Prozess, der verbessert werden soll. Bestimmen Sie, ob das gewünschte Ergebnis eine Kategorie, ein Wert, eine Rangfolge, eine Empfehlung, ein Anomalie-Score oder eine Abfolge von Maßnahmen ist.

Definieren Sie den Erfolg sowohl in Modell- als auch in Geschäftsbegriffen. Genauigkeit allein ist möglicherweise nicht ausreichend; Präzision, Recall, Kalibrierung, Latenz, Fairness, Kosten pro Entscheidung, Nutzerakzeptanz oder finanzielle Auswirkungen können relevanter sein.

2. Datenbasis aufbauen

Identifizieren Sie die Daten, die zur Darstellung des Problems und des Ergebnisses erforderlich sind. Relevante Datenpunkte können aus Transaktionen, Sensormesswerten, Bildern, Dokumenten, Prozessprotokollen, Kundeninteraktionen, Wartungsaufzeichnungen oder externem Kontext stammen.

  • Berechtigung, Zweck, Eigentümerschaft, Herkunft, Aufbewahrung und Zugriffskontrollen bestätigen
  • Prüfen Sie, ob die Daten die relevanten Bevölkerungsgruppen und Betriebsbedingungen abdecken
  • Trainings-, Validierungs- und Testdaten trennen, um Datenlecks und zu optimistische Ergebnisse zu vermeiden
  • Etablieren Sie eine zuverlässige Methode zur Erfassung künftiger Ergebnisse und Rückmeldungen

Von Daten zum Produktionsmodell

Rohdaten müssen in eine stabile, verwaltete Pipeline umgewandelt werden, die Entwicklung und laufenden Betrieb unterstützt. Dazu gehören Bereinigung und Transformation, Feature-Erstellung, Modellauswahl, Evaluierung, Deployment und Monitoring. Die getroffenen Entscheidungen sollten das Geschäftsziel, den Bedarf an Erklärbarkeit, die Datensensitivität, Latenz, Skalierung und Kosten widerspiegeln.

Daten vorbereiten und beschriften

Die Datenvorbereitung kann zeitaufwendig sein und umfasst möglicherweise das Entfernen von Duplikaten, den Umgang mit fehlenden Werten, die Standardisierung von Formaten, das Zusammenführen von Quellen, das Ausbalancieren von Klassen sowie die Umwandlung von Text, Bildern oder Zeitreihensignalen in modellfertige Darstellungen.

Überwachtes Lernen erfordert zuverlässige Labels. Das Erstellen und Überprüfen dieser Labels kann zeitaufwändig sein, daher sollten Definitionen dokumentiert und auf Konsistenz geprüft werden. Wenn Ergebnisse verzögert oder unsicher sind, kann der Beschriftungsprozess selbst die größte Fehlerquelle des Modells darstellen.

Daten erkunden und Features entwickeln

Vor dem Training hilft die explorative Datenanalyse (EDA) Teams dabei, Verteilungen, fehlende Werte, Ausreißer, Klassenungleichgewichte und potenzielle Datenlecks zu untersuchen. Das Feature-Engineering wandelt anschließend Roheingaben mithilfe von Techniken wie Feature-Selektion, Feature-Extraktion, Skalierung, Kodierung oder domänenspezifischen Berechnungen in Variablen um, die ein Modell verwenden kann. Die Dimensionsreduktion komprimiert viele Variablen in eine kleinere Darstellung, wobei nützliche Informationen erhalten bleiben, was Rauschen, Trainingszeit und das Risiko von Overfitting reduzieren kann. Das Entfernen zu vieler Informationen kann jedoch zu Underfitting beitragen. 1, 3

Modelle auswählen, trainieren und optimieren

Beginnen Sie mit einer transparenten Baseline und vergleichen Sie komplexere Ansätze nur dann, wenn sie eine bedeutsame Verbesserung bieten. Die Modellauswahl hängt von der Aufgabe, dem Datenvolumen, der Interpretierbarkeit, der Latenz, den Rechenressourcen und der Betriebsumgebung ab.

Beim Training werden Modellparameter angepasst. Hyperparameter-Tuning und Kreuzvalidierung helfen beim Vergleich von Konfigurationen, aber wiederholtes Experimentieren darf nicht dazu führen, dass der Testdatensatz zu einem weiteren Trainingsdatensatz wird.

Über die Trainingsdaten hinaus prüfen

Die Evaluierung sollte prüfen, ob das Modell mit repräsentativen, bisher ungesehenen Daten und unter realen Bedingungen über wichtige Segmente, Standorte und Zeiträume hinweg funktioniert. Teams sollten nicht nur die durchschnittliche Leistung untersuchen, sondern auch Fehlermodi und die Konsequenzen falscher Vorhersagen.

Die Validierung sollte Prüfungen auf Datenlecks, Robustheitstests, Sicherheitsbewertungen, Fairness-Analysen (sofern relevant) sowie Benutzerakzeptanztests im vorgesehenen Arbeitsablauf umfassen.

Modellleistung mit den richtigen Metriken messen

Evaluierungsmetriken müssen zur Aufgabe und zu den Fehlerkosten passen. Klassifikationsmodelle können eine Konfusionsmatrix, Präzision, Recall, F1-Score und die Fläche unter der ROC-Kurve verwenden; Regressionsmodelle nutzen häufig den mittleren absoluten Fehler oder den quadratischen Mittelwert des Fehlers. Die Kreuzvalidierung schätzt, wie stabil die Leistung über verschiedene Stichproben hinweg ist, während die Kalibrierung prüft, ob vorhergesagte Wahrscheinlichkeiten die beobachteten Ergebnisse widerspiegeln. Business-Teams sollten diese Metriken gemeinsam mit Latenz, Fairness, Betriebskosten sowie den Konsequenzen von falsch positiven und falsch negativen Ergebnissen interpretieren.

Bereitstellen, überwachen und neu trainieren

Ein Produktionsmodell kann über eine API, einen Batch-Prozess, eine Unternehmensanwendung, einen Cloud-Dienst, eine private Umgebung oder ein Edge-Gerät betrieben werden. Die Bereitstellung muss Versionierung, Zugriffskontrolle, Protokollierung, Rollback und eine klar definierte Verantwortlichkeit umfassen.

Nach dem Launch sollten Eingabedaten, Vorhersagequalität, Latenz, Drift, Vorfälle, Nutzerverhalten und Geschäftsergebnisse kontinuierlich überwacht werden. Trainieren Sie das Modell neu, kalibrieren Sie es neu oder stellen Sie es außer Betrieb, wenn Belege zeigen, dass sich Bedingungen oder Anforderungen geändert haben.

Welche Infrastruktur erfordert maschinelles Lernen?

Die geeignete Architektur hängt von der Datensensibilität, Latenz, Skalierung, Modellkomplexität, Souveränität und Compliance-Anforderungen ab. Einige Workloads laufen effektiv auf Standard-CPUs; Deep Learning, Simulationen und umfangreiches Training können GPUs oder andere Beschleuniger erfordern. Cloud, Private Cloud, hybride und Edge-Umgebungen lassen sich je nach Entstehungsort der Daten und dem Ort, an dem Entscheidungen getroffen werden müssen, kombinieren.

Ein vernetzter Enterprise-Machine-Learning-Stack

  • Datenplattformen und Pipelines für Erfassung, Qualität, Transformation und kontrollierten Zugriff
  • Entwicklungsumgebungen, Feature Stores, Experiment-Tracking und Modell-Repositories
  • CPU-, GPU- oder Beschleuniger-Kapazitäten für Training und Inferenz
  • APIs und Integrations-Services, die Vorhersagen mit Geschäftsanwendungen verbinden
  • Identitäts-, Verschlüsselungs-, Netzwerksicherheits-, Secrets-Management- und Audit-Logging-Funktionen
  • Überwachung von Datenqualität, Drift, Performance, Kosten, Verfügbarkeit und Geschäftsergebnissen
  • Bereitstellungsoptionen für Cloud-, private Infrastruktur- und Edge-Umgebungen

Gängige Machine-Learning-Tools und Frameworks

Machine-Learning-Teams verwenden im gesamten Lebenszyklus unterschiedliche Tools. Python ist weit verbreitet für die Datenvorbereitung und Modellierung, mit Bibliotheken wie scikit-learn für klassisches maschinelles Lernen, XGBoost für Gradient Boosting sowie TensorFlow oder PyTorch für Deep Learning. Jupyter Notebooks unterstützen die explorative Analyse, während Modellregistrierungen, Pipeline-Tools und MLOps-Plattformen eine kontrollierte Bereitstellung und Überwachung ermöglichen. AutoML- und No-Code-Tools können Routineaufgaben beschleunigen, ersetzen jedoch nicht die Notwendigkeit von Datenqualitätsprüfungen, Validierung, Sicherheit und klarer Verantwortlichkeit. 1

Impulse Newsletter

Erhalten Sie die neuesten Trends zur digitalen Transformation, Best Practices, Forschungsstudien sowie Einladungen zu Webinaren und Veranstaltungen.

Was sind die wichtigsten Arten des maschinellen Lernens?

Machine-Learning-Methoden unterscheiden sich hauptsächlich im Lernsignal, das dem Modell zur Verfügung steht. Beim überwachten Lernen (Supervised Learning) werden gekennzeichnete Beispiele verwendet; beim unüberwachten Lernen (Unsupervised Learning) wird nach Strukturen in nicht gekennzeichneten Daten gesucht; beim halbüberwachten Lernen (Semi-Supervised Learning) werden begrenzte Kennzeichnungen mit größeren nicht gekennzeichneten Datensätzen kombiniert; beim selbstüberwachten Lernen (Self-Supervised Learning) werden Trainingsziele aus den Daten selbst abgeleitet; und beim bestärkenden Lernen (Reinforcement Learning) werden Handlungen durch Belohnungen und Bestrafungen verbessert. 1, 3

Überwachtes Lernen

Überwachtes Lernen wird anhand von Beispielen trainiert, die sowohl Eingaben als auch bekannte Ergebnisse enthalten. Klassifikationsmodelle sagen Kategorien vorher, während Regressionsmodelle kontinuierliche Werte schätzen.

Geschäftliche Beispiele umfassen Churn-Prognosen, Betrugserkennung, Nachfrageprognosen, Bildklassifizierung, Dokumentenweiterleitung und Lieferzeitschätzung. Das Modell kann nur Unterscheidungen erlernen, die in den gekennzeichneten Daten konsistent repräsentiert sind.

Unüberwachtes Lernen

Unüberwachtes Lernen arbeitet mit Daten, die keine vordefinierte Ziel-Kennzeichnung haben. Es identifiziert Muster wie Cluster, Assoziationen, niedrigdimensionale Darstellungen oder ungewöhnliche Beobachtungen.

Unternehmen nutzen es für die Kundensegmentierung, explorative Analysen, Ähnlichkeitssuche, Themenidentifikation und Anomalieerkennung. Die von einem Modell gefundenen Gruppen erfordern jedoch noch eine Interpretation und Validierung, bevor sie in Entscheidungen einfließen.

Halbüberwachtes und selbstüberwachtes Lernen

Halbüberwachtes Lernen kombiniert einen kleineren gekennzeichneten Datensatz mit einem größeren Pool von nicht gekennzeichneten Daten. Es kann den Kennzeichnungsaufwand reduzieren, wenn Beispiele in großer Menge vorhanden sind, die Annotation durch Experten jedoch kostspielig ist.

Selbstüberwachtes Lernen erstellt Lernziele aus der Struktur der Daten selbst, beispielsweise durch die Vorhersage verborgener Teile von Texten oder Bildern. Es wird häufig eingesetzt, um wiederverwendbare Repräsentationen zu erlernen und Foundation Models vorzutrainieren, bevor sie für spezifische Aufgaben angepasst werden.

Bestärkendes Lernen

Bestärkendes Lernen (Reinforcement Learning) trainiert einen Agenten, Handlungen in einer Umgebung auszuwählen. Der Agent erhält Belohnungen oder Bestrafungen und erlernt eine Strategie, die darauf ausgerichtet ist, die kumulative Belohnung über die Zeit zu maximieren.

Zu den Anwendungen können Robotik, Planung, Steuerung, Ressourcenzuweisung und simulationsbasierte Optimierung gehören. Sichere Exploration, realistische Umgebungen, Gestaltung der Belohnungsfunktion und menschliche Aufsicht sind entscheidend, wenn Handlungen physische oder risikoreiche Systeme betreffen.

Welche Machine-Learning-Algorithmen sind gängig?

Es gibt keinen universell besten Algorithmus. Die geeignete Wahl hängt von der Zielvariable, der Datenstruktur, dem Volumen, der Interpretierbarkeit, der Latenz, der Robustheit und den Wartungsanforderungen ab. Enterprise-Teams vergleichen in der Regel mehrere Modellfamilien mit einer einfachen Baseline und wählen den Ansatz, der den besten operativen Kompromiss bietet, anstatt sich ausschließlich am höchsten Laborwert zu orientieren.

Regression und Klassifizierung

Lineare Regression schätzt numerische Werte, während logistische Regression Klassenwahrscheinlichkeiten schätzt. Support-Vektor-Maschinen und Nächste-Nachbarn-Verfahren können mithilfe verschiedener Darstellungen der Grenze zwischen Beispielen klassifizieren oder regressieren.

Diese Ansätze können eine gute Wahl für strukturierte Daten sein, insbesondere wenn Transparenz, begrenzte Datenmengen oder vorhersehbare Inferenzkosten eine Rolle spielen.

Naive-Bayes-Klassifikatoren verwenden Wahrscheinlichkeitsschätzungen zur Kategorisierung und können bei der Textklassifikation, Spam-Erkennung und anderen hochdimensionalen Aufgaben effektiv sein.

Entscheidungsbäume und Ensemble-Methoden

Entscheidungsbäume teilen Daten durch eine Abfolge verständlicher Bedingungen auf. Random Forests kombinieren viele Bäume, um die Robustheit zu verbessern, während Gradient-Boosting-Methoden Bäume sequenziell aufbauen, um frühere Fehler zu korrigieren.

Baumbasierte Modelle werden häufig für tabellarische Geschäftsdaten eingesetzt, da sie nichtlineare Zusammenhänge und Interaktionen erfassen und gleichzeitig praktische Erklärungsmethoden unterstützen.

Clustering und Anomalieerkennung

Clustering-Algorithmen wie k-Means oder dichtebasierte Verfahren gruppieren ähnliche Beobachtungen. Anomalieerkennungsansätze schätzen, welche Beobachtungen von erwarteten Mustern abweichen.

Der Nutzen dieser Modelle hängt davon ab, wie Ähnlichkeit definiert wird, wie Schwellenwerte festgelegt werden und ob die resultierenden Cluster oder Hinweise eine echte Entscheidung unterstützen.

Assoziationsregelanalyse (Association Rule Mining) identifiziert Elemente oder Ereignisse, die häufig gemeinsam auftreten, während Dimensionsreduktionstechniken kompaktere Darstellungen komplexer Daten erstellen. Beide können die Exploration und Vorverarbeitung unterstützen, ihre Ergebnisse erfordern jedoch weiterhin eine geschäftliche Interpretation.

Neuronale Netze und Deep Learning

Neuronale Netze erlernen mehrschichtige Transformationen und können komplexe Zusammenhänge in Bildern, Audio, Text, Video und Zeitreihendaten abbilden. Deep Learning bezeichnet neuronale Netze mit mehreren Schichten und ist ein Teilbereich des maschinellen Lernens. 1, 3

Diese Modelle können den manuellen Aufwand für das Feature-Engineering reduzieren, erfordern jedoch häufig mehr Daten, Rechenleistung, spezialisierte Fachkenntnisse sowie Kontrollmechanismen für Interpretierbarkeit und Robustheit.

Zeitreihen- und Empfehlungsmodelle

Zeitreihenmodelle lernen aus geordneten Beobachtungen, um Werte vorherzusagen, Veränderungen zu erkennen oder zukünftige Ereignisse zu schätzen. Das Modell muss Trends, Saisonalität, unregelmäßige Intervalle und sich ändernde externe Bedingungen berücksichtigen.

Empfehlungssysteme kombinieren Benutzer-, Element- und Kontextsignale, um relevante Optionen zu bewerten. Sie erfordern eine sorgfältige Bewertung von Vielfalt, Feedback-Loops, Cold-Start-Fällen, Datenschutz und dem Geschäftsziel hinter dem Ranking.

Welche Grundlagen brauchen Sie, um Maschinelles Lernen zu erlernen?

Die Lernkurve hängt vom Ausgangspunkt und Ziel des Lernenden ab. Grundlegende Algebra, Wahrscheinlichkeitsrechnung, Statistik und etwas Differenzialrechnung helfen dabei zu erklären, wie Modelle lernen, wie Fehler gemessen werden und wie Optimierung funktioniert. Python ist die am weitesten verbreitete Programmiersprache für praktisches maschinelles Lernen, da sie Datenvorbereitung, Modelltraining, Auswertung und Experimente unterstützt. Ein Lernender kann die wesentlichen Konzepte auch ohne Programmierkenntnisse verstehen, doch das eigenständige Erstellen und Bewerten von Modellen erfordert Programmiererfahrung, Kenntnisse im Umgang mit Daten und iterative Arbeit an praktischen Projekten.

Wie verhält sich maschinelles Lernen zu KI, Deep Learning und GenAI?

Künstliche Intelligenz ist das übergeordnete Fachgebiet, das Systeme umfasst, die Aufgaben ausführen sollen, die mit intelligentem Verhalten verbunden sind. Maschinelles Lernen ist ein Ansatz innerhalb der KI. Deep Learning ist eine Teilmenge des maschinellen Lernens, die auf mehrschichtigen neuronalen Netzen basiert. Generative KI bezeichnet Modelle, die darauf ausgelegt sind, neue Inhalte zu erstellen, wie Texte, Bilder, Audioinhalte, Software-Code oder synthetische Daten. Große Sprachmodelle (Large Language Models, LLMs) sind eine Klasse generativer KI-Modelle, die auf großen Textsammlungen trainiert werden, um Sprache zu verarbeiten und zu generieren. In dieser Hierarchie sind LLMs eine „Teilmenge einer Teilmenge": Sie sind Deep-Learning-Modelle, Deep Learning ist eine Teilmenge des maschinellen Lernens, und maschinelles Lernen ist eine Teilmenge der KI. 1

KI, maschinelles Lernen und Deep Learning

Nicht jedes KI-System verwendet maschinelles Lernen. Eine KI-Anwendung kann auch auf Regeln, Optimierung, Suche, Wissensgraphen oder Kombinationen verschiedener Techniken basieren. Umgekehrt sind Machine-Learning-Modelle in der Regel Komponenten innerhalb einer größeren Anwendung, die auch Daten, Software, Workflows, Steuerungsmechanismen und Menschen umfasst.

Deep Learning ist besonders effektiv für komplexe unstrukturierte Daten, aber traditionelles maschinelles Lernen kann für strukturierte Datensätze, kleinere Stichproben, strengere Anforderungen an die Interpretierbarkeit und geringere Rechenbudgets besser geeignet sein.

Generative KI und prädiktives maschinelles Lernen

Prädiktive Modelle schätzen eine Kategorie, einen Wert, eine Wahrscheinlichkeit, eine Rangfolge oder eine Anomalie. Generative Modelle erlernen Muster, die es ihnen ermöglichen, neue Ausgaben zu erzeugen. Beide können Deep Learning nutzen und beide erfordern Data Governance, Evaluierung, Sicherheit und Monitoring.

In Unternehmens-Workflows können sich die Ansätze gegenseitig ergänzen. Ein prädiktives Modell kann einen Fall priorisieren, während ein generatives Modell die Belege für einen menschlichen Prüfer zusammenfasst. Die Kontrollen sollten die spezifischen Risiken jeder Komponente widerspiegeln.

Wo wird Maschinelles Lernen eingesetzt?

Fertigung und Automotive

Hersteller nutzen maschinelles Lernen für die visuelle Qualitätsprüfung, vorausschauende Wartung, Prozessoptimierung, Nachfrageprognose, Energiemanagement und Produktionsplanung. Automotive-Anwendungen umfassen Wahrnehmung, Batterie-Analytik, Garantieanalyse, Lieferkettenplanung und Kundenservice-Automatisierung.

Betriebstechnologiedaten erfordern Domänenwissen. Sicherheit, Latenz, Cybersicherheit und die Integration in Industriesysteme müssen von Anfang an berücksichtigt werden.

Finanzdienstleistungen und Versicherungen

Zu den Anwendungsfällen zählen Betrugserkennung, Priorisierung der Geldwäschebekämpfung, Kredit- und Schadensfallanalytik, Kundenservice-Routing, Prognosen und Dokumentenverarbeitung.

Modelle, die den Zugang zu Finanzdienstleistungen beeinflussen, erfordern eine starke Governance, repräsentative Daten, Erklärbarkeit, menschliche Aufsicht und die Einhaltung der geltenden Branchen- und KI-Vorschriften.

Gesundheitswesen und Biowissenschaften

Maschinelles Lernen kann die Analyse medizinischer Bilder, die Prognose von Patientenströmen, die Betriebsplanung, die Forschung, die Pharmakovigilanz, das Qualitätsmanagement sowie die Mustererkennung in klinischen oder genomischen Daten unterstützen.

Der klinische Einsatz erfordert validierte Daten, einen klar definierten Verwendungszweck, fachkundige Aufsicht, Datenschutzmaßnahmen und Nachweise, die dem medizinischen und regulatorischen Kontext entsprechen. Modelle sollten das fachliche Urteilsvermögen unterstützen und nicht stillschweigend ersetzen.

Öffentlicher Sektor

Öffentliche Organisationen können maschinelles Lernen für die Dokumentenklassifizierung, Servicevermittlung, Infrastrukturplanung, Anomalieerkennung, Prognosen und Entscheidungsunterstützung einsetzen.

Anwendungen im öffentlichen Sektor müssen Barrierefreiheit, Transparenz, Grundrechte, Beschaffung, Datenschutz, Überprüfbarkeit sowie die Möglichkeit berücksichtigen, folgenreiche Ergebnisse anzufechten oder einer Überprüfung zu unterziehen.

Einzelhandel, Logistik und Lieferketten

Einzelhändler und Logistikanbieter nutzen maschinelles Lernen für Bedarfsprognosen, Bestandszuweisung, Empfehlungen, Routenplanung, Lieferzeitschätzung, Lageroptimierung und Betrugserkennung.

Modelle müssen sich an Aktionen, Saisonalität, Netzwerkstörungen, veränderte Kundenverhalten sowie unvollständige Daten über Lieferanten und Kanäle hinweg anpassen.

Energie, Versorgungsunternehmen, Chemie und Pharmazeutika

Zu den Anwendungen gehören Lastprognosen, Netz- und Anlagen-Analytik, Prozessoptimierung, vorausschauende Wartung, Qualitätskontrolle, Labor-Analytik, Energieeffizienz sowie Planung bei variablem Angebot und variabler Nachfrage.

Kritische Infrastrukturen und regulierte Umgebungen erfordern robuste Cybersicherheit, Rückverfolgbarkeit, kontrollierten Einsatz und klar definierte menschliche Eingriffe, wenn sich Modelle unerwartet verhalten.

Industrielle KI

Industrielle KI setzt Maschinelles Lernen, Computer Vision und Echtzeit-Analytik ein, um Daten von Maschinen, Sensoren, Produktionssystemen und Unternehmensanwendungen zu verarbeiten. Sie verbindet digitale Intelligenz mit physischen Abläufen und hilft Unternehmen, von reaktiven Prozessen zu prädiktiven, automatisierten und kontinuierlich optimierten Arbeitsweisen überzugehen.

Zu den gängigen Anwendungsfällen industrieller KI zählen vorausschauende Wartung, visuelle Qualitätsprüfung, Prozess- und Energieoptimierung, intelligente Logistik, digitale Zwillinge und Sicherheitsüberwachung. Eine erfolgreiche Implementierung erfordert mehr als ein präzises Modell: Unternehmen müssen IT- und Betriebstechnologiedaten verknüpfen, Vorhersagen in reale Arbeitsabläufe integrieren und eine sichere, skalierbare Infrastruktur für Training und Inferenz bereitstellen.

Häufige Anwendungsfälle für maschinelles Lernen in Unternehmen

Dieselbe Machine-Learning-Methode kann sehr unterschiedliche Geschäftsergebnisse unterstützen. Anwendungsfälle sollten daher nicht allein um einen Algorithmus herum formuliert werden, sondern um die Entscheidung, die verfügbaren Daten, die Maßnahme und das Risiko. Die folgenden Beispiele veranschaulichen wiederkehrende Praxisanwendungen, die auf verschiedene Branchen übertragen werden können.

Vorausschauende Wartung

Modelle analysieren Sensordatenpunkte, Betriebsdaten und Wartungsaufzeichnungen, um das Ausfallrisiko, die verbleibende Nutzungsdauer oder anomales Anlagenverhalten abzuschätzen. Die Vorhersage kann Teams dabei unterstützen, Inspektionen oder Wartungsarbeiten vor einem Ausfall einzuplanen – vorausgesetzt, die Warnmeldungen sind mit Asset-Management-Workflows verknüpft und werden im Hinblick auf die Kosten von Fehlalarmen und übersehenen Ausfällen validiert.

Betrugs- und Risikoerkennung

Klassifizierungs- und Anomalie Modelle können Transaktionen, Ansprüche, Konten oder Ereignisse für die Prüfung priorisieren. Sie sind am effektivsten, wenn Ermittler Feedback geben können, neue Betrugsmuster überwacht werden und Entscheidungen Modellausgaben mit Regeln, Kontext und menschlicher Expertise kombinieren.

Bedarfsprognose und -planung

Prognosen unterstützen Entscheidungen in den Bereichen Lagerbestand, Kapazität, Personalplanung, Energie und Lieferkette. Erfolgreiche Lösungen nutzen den richtigen Planungshorizont, berücksichtigen relevante externe Einflussfaktoren, quantifizieren Unsicherheiten und messen, ob Nutzer auf Basis der Ergebnisse handeln.

Qualitätsprüfung und Computer Vision

Computer-Vision-Modelle können Defekte erkennen, Produkte klassifizieren, Montageschritte überprüfen oder Bilder für die Prüfung durch Fachkräfte priorisieren. Die Leistung muss unter den in der Produktion vorherrschenden Bedingungen getestet werden – einschließlich Beleuchtung, Ausrüstung, Materialien, Kamerapositionen und Defekthäufigkeiten.

Kundenintelligenz und Empfehlungen

Maschinelles Lernen kann Abwanderung vorhersagen, die nächstbesten Maßnahmen identifizieren, Kunden gruppieren oder Produkte und Inhalte bewerten. Die Bewertung sollte nicht nur Klicks oder Conversions umfassen, sondern auch Relevanz, Vielfalt, Fairness, Datenschutz, langfristigen Kundenwert und unerwünschte Feedback-Loop.

Intelligente Dokument- und Prozessautomatisierung

Modelle können Dokumente klassifizieren, Informationen extrahieren, Anfragen weiterleiten, fehlende Daten erkennen und die Priorisierung von Fällen unterstützen. Die stärksten Lösungen kombinieren maschinelles Lernen mit Workflow-Regeln, Validierung, Ausnahmebehandlung und nachvollziehbarer menschlicher Prüfung.

Was macht maschinelles Lernen vertrauenswürdig?

Vertrauenswürdiges maschinelles Lernen erfordert Governance über den gesamten Lebenszyklus hinweg: klare Verantwortlichkeiten, rechtskonforme und zweckgebundene Datennutzung, dokumentierte Annahmen, repräsentative Datensätze, angemessene Transparenz, menschliche Aufsicht, Sicherheit, Robustheit und kontinuierliches Monitoring.

Risikokontrollen sollten dem jeweiligen Anwendungsfall angemessen sein. Eine Empfehlung für interne Inhalte hat nicht dieselben Konsequenzen wie ein Modell, das in den Bereichen Beschäftigung, Kredit, Gesundheitswesen, Sicherheit oder kritische Infrastruktur eingesetzt wird. Regulatorische Pflichten hängen von der Rolle der Organisation, dem geografischen Standort, der Branche und der Systemklassifizierung ab; Rechts- und Compliance-Spezialisten sollten die geltenden Anforderungen validieren.

  • Erfassung der beabsichtigten und verbotenen Verwendung, verbotene Verwendung, Eigentümer, Modellversionen, Datenherkunft und Evaluierungsergebnisse
  • Prüfung der Leistung über relevante Gruppen und Betriebsbedingungen hinweg, nicht nur anhand eines Durchschnittswerts
  • Bereitstellung von Erklärungen sowie Prüf-, Einspruchs- oder Überschreibungsmechanismen, wenn Entscheidungen wesentliche Auswirkungen auf Menschen haben können
  • Überwachung von Drift, Incidents, Cybersicherheit und unbeabsichtigte Nutzung nach der Bereitstellung

KI-Lösungen von T-Systems

Lassen Sie uns Ihre Vorstellungen zum Leben erwecken.

Wie kann ein Unternehmen maschinelles Lernen implementieren?

Eine pragmatische Implementierung beginnt mit dem Geschäftsprozess, nicht mit dem Algorithmus. Wählen Sie einen klar abgegrenzten Anwendungsfall, stellen Sie sicher, dass die Daten und Betriebsbedingungen geeignet sind, definieren Sie messbare Ergebnisse, stellen Sie ein multidisziplinäres Team zusammen und gestalten Sie die Governance vor der Entwicklung. Validieren Sie das Modell anschließend im realen Arbeitsablauf und skalieren Sie es erst, wenn technische und geschäftliche Belege vorliegen.

Mit einem wertvollen, messbaren Problem beginnen

Priorisieren Sie eine wiederholbare Entscheidung, bei der eine bessere Prognose oder Klassifizierung eine Maßnahme verändern kann. Beziehen Sie den Prozessverantwortlichen und die Personen ein, die das Ergebnis nutzen oder davon betroffen sein werden.

Ist maschinelles Lernen für diesen Anwendungsfall geeignet?

  • Gibt es genügend relevante und rechtlich nutzbare Daten?
  • Lässt sich der Nutzen und der Mehrwert für das Unternehmen messen?
  • Wird die Aufgabe häufig genug wiederholt, um Entwicklung und Betrieb zu rechtfertigen?
  • Sind probabilistische Fehler akzeptabel und handhabbar?
  • Kann die Prognose in einen realen Workflow integriert werden?
  • Sind die Anforderungen an Erklärbarkeit, menschliches Review und Compliance verstanden?

Daten, Machbarkeit und Risiken bewerten

Analysieren Sie Datenqualität, Abdeckung, Kennzeichnungen, Zugriff, Herkunft, Datenschutz und Aktualisierungshäufigkeit. Vergleichen Sie das vorgeschlagene Modell mit einfacheren Regeln oder Analytik und schätzen Sie die Kosten für Entwicklung, Infrastruktur, Integration und laufenden Betrieb.

Identifizieren Sie potenzielle Schäden, Missbrauchsmöglichkeiten, Sicherheitsrisiken, operative Abhängigkeiten und regulatorische Einstufungen frühzeitig genug, um das Design zu beeinflussen.

Auswählen der richtigen Architektur und des richtigen Modells

Wählen Sie Cloud-, Private-, Hybrid- oder Edge-Deployment entsprechend Datenspeicherort, Latenz, Souveränität, Resilienz und Kosten. Verwenden Sie die einfachste Modellfamilie, die die Anforderungen an Performance und Erklärbarkeit erfüllen kann.

Entwerfen Sie das vollständige System, einschließlich Datenpipelines, APIs, Identitätsverwaltung, Protokollierung, Monitoring, Fallback-Verhalten und Benutzerinteraktion.

Führen Sie ein gezieltes Pilotprojekt durch

Testen Sie das Modell mit repräsentativen Daten und Nutzern in einem kontrollierten Umfang, der den beabsichtigten realen Workflow widerspiegelt. Ein Pilotprojekt sollte definierte Fragen zu Mehrwert, Machbarkeit, Risiko, Datenqualität, Integration und Akzeptanz beantworten – und nicht lediglich zeigen, dass ein Algorithmus trainiert werden kann.

Verwenden Sie eine Baseline und vorab vereinbarte Abbruchkriterien. Dokumentieren Sie, was sich ändern muss, bevor eine breitere Bereitstellung erfolgt.

Das Modell in Workflows integrieren

Legen Sie fest, wie Benutzer das Ergebnis erhalten und darauf reagieren, welche Nachweise angezeigt werden, welche Schwellenwerte Maßnahmen auslösen und wie Ausnahmen behandelt werden. Integrieren Sie das Modell in die Systeme, die Arbeitsaufträge, Fälle, Empfehlungen oder Genehmigungen erstellen.

Sammeln Sie Benutzerfeedback und verifizierte Ergebnisse, damit die Lösung iterativ bewertet und verbessert werden kann.

Operationalisierung mit MLOps

Richten Sie eine Versionskontrolle für Daten, Code, Konfiguration und Modelle ein; automatisieren Sie Tests und Deployments, wo dies sinnvoll ist; pflegen Sie reproduzierbare Umgebungen; und definieren Sie Rollback- und Wiederherstellungsverfahren.

Überwachen Sie gemeinsam die technischen Service-Level und das Modellverhalten. Die Verantwortung sollte den gesamten Zeitraum von der ersten Bereitstellung bis zum Neutraining oder zur Außerbetriebnahme abdecken.

Klare Verantwortlichkeiten und Kontrollen schaffen

Weisen Sie verantwortliche Business-, Daten-, Modell-, Sicherheits-, Risiko- und operative Eigentümer zu. Legen Sie fest, wer die Bereitstellung genehmigen, Schwellenwerte ändern, auf Daten zugreifen, Ergebnisse übersteuern, Vorfälle untersuchen und das Modell außer Betrieb nehmen darf.

Schulen Sie Benutzer in Bezug auf den Zweck und die Einschränkungen des Modells. Ein gut verwaltetes Modell kann dennoch scheitern, wenn Personen seine Ausgabe falsch verstehen oder missbrauchen.

Skalierung erfolgreicher Ansätze

Skalieren Sie erst dann, wenn der Pilot seinen Wert bewiesen hat und das Betriebsmodell wiederholbar ist. Standardisieren Sie wiederverwendbare Komponenten wie Daten-Konnektoren, Evaluierungsvorlagen, Modellregister, Sicherheitskontrollen, Monitoring und Dokumentation.

Portfolio Governance hilft dabei, doppelte Experimente, unkontrollierte Modelle, inkonsistente Kontrollen und Infrastrukturen zu vermeiden, die den Produktionsanforderungen nicht gerecht werden.

Was sind die wichtigsten Herausforderungen und Risiken?

Systeme des maschinellen Lernens können aufgrund schlechter Daten, irreführender Zielvorgaben, Overfitting, Drift, unsicherer Integration, verzerrter Ergebnisse, unzureichender Erklärbarkeit oder einer Diskrepanz zwischen Modell und Arbeitsablauf versagen. Unternehmen sollten die Wahrscheinlichkeit und die Auswirkungen von Fehlern bewerten, vor dem Launch Kontrollen einrichten und nach der Bereitstellung die Überwachung fortsetzen.

Datenqualität, Verzerrung und Repräsentativität

Modelle reproduzieren Muster in ihren Trainingsdaten. Fehlende Bevölkerungsgruppen, inkonsistente Kennzeichnungen, historische Verzerrungen, Messfehler oder Datenlecks können zu Ergebnissen führen, die insgesamt präzise wirken, bei wichtigen Fällen jedoch schlecht abschneiden.

Qualitätskontrollen für Daten sollten Herkunft, Dokumentation, Sampling-Review, Bewertung auf Segmentebene und einen Prozess zur Behebung neuer Probleme umfassen.

Overfitting und Underfitting

Overfitting tritt auf, wenn ein Modell die Trainingsdaten – einschließlich Rauschen oder zufälliger Muster – so genau erlernt, dass es bei unbekannten Daten schlecht abschneidet. Underfitting tritt auf, wenn das Modell oder seine Merkmale zu einfach sind, um wichtige Zusammenhänge zu erfassen, was zu schwacher Leistung sowohl bei Trainings- als auch bei Testdaten führt. Separate Validierungsdaten, Kreuzvalidierung, Regularisierung, Merkmalsauswahl, einfachere oder komplexere Modelle sowie zusätzliche repräsentative Daten können Teams dabei helfen, ein besseres Gleichgewicht zu finden.

Sicherheit, Datenschutz und Legacy-Integration

Maschinelles Lernen erweitert die Angriffsfläche durch Datenpipelines, Modelle, APIs, Notebooks, Abhängigkeiten, Zugangsdaten und verbundene Anwendungen. Die Kontrollen sollten Zugriff, Verschlüsselung, Software-Lieferkette, adversarielle Eingaben, Protokollierung und Incident-Response abdecken.

Legacy-Systeme bieten möglicherweise keine konsistenten Schnittstellen oder Datenqualität. Die Integration sollte vermeiden, fragile manuelle Schritte oder unkontrollierte Kopien sensibler Informationen zu erzeugen.

Fähigkeiten, Erklärbarkeit und Wandel

Erfolgreiche Lösungen erfordern die Zusammenarbeit von Fachexperten, Dateningenieuren, Datenwissenschaftlern, Softwareteams, Fachleuten aus den Bereichen Sicherheit, Risiko, Recht, Betrieb und Nutzern. Unternehmen benötigen außerdem die Fähigkeit, ein Modell zu hinterfragen und seine Grenzen zu interpretieren.

Change Management ist entscheidend, weil eine Prognose verändert, wie Menschen Arbeit priorisieren, Urteile fällen und Verantwortung übernehmen.

Modell-Drift und Skalierung über Pilotprojekte hinaus

Datenverteilungen, Kundenverhalten, Geräte, Richtlinien und Marktbedingungen ändern sich. Ein Modell, das beim Start gut funktioniert hat, kann ohne offensichtliche Fehler weniger genau oder weniger geeignet werden.

Für eine erfolgreiche Skalierung sind automatisierte Datenpipelines, wiederholbare Deployments, Monitoring, Kapazitätsplanung, Support-Prozesse sowie Governance über mehrere Modellversionen und Geschäftsbereiche hinweg erforderlich.

Was ist MLOps und warum ist es wichtig?

Grafik zur Erläuterung des MLOps-Lebenszyklus

MLOps wendet Software-Engineering, Data-Engineering und operative Praktiken auf den Machine-Learning-Lebenszyklus an. Ziel ist es, die Modellentwicklung reproduzierbar, die Bereitstellung kontrolliert und das Produktionsverhalten beobachtbar zu machen. Es verbindet Experimente mit den Tests, Releases, dem Monitoring, der Governance und der Wartung, die für zuverlässige Enterprise-Services erforderlich sind.

Reproduzierbare Entwicklung und Bereitstellung

Teams versionieren Datenreferenzen, Code, Abhängigkeiten, Parameter und Modellartefakte, damit Ergebnisse reproduziert und auditiert werden können. Automatisierte Tests prüfen Datenverträge, Code, Modellqualität, Sicherheit und Integration vor der Freigabe.

Kontrollierte Deployment-Strategien, wie Shadow-, Canary- oder Phased-Rollout, reduzieren die Auswirkungen unerwarteten Verhaltens und unterstützen das Rollback.

Monitoring, Governance und Nachtraining

Die Produktionsüberwachung sollte Service-Metriken mit Modell- und Geschäftsmetriken kombinieren. Dazu können Verfügbarkeit, Latenz, Input-Drift, Output-Verteilung, Kalibrierung, Segment-Performance, Override-Raten, Nutzerfeedback und realisierte Ergebnisse gehören.

Retraining sollte evidenzbasiert ausgelöst und iterativ gesteuert werden, wobei jedes Update denselben Validierungs- und Freigabekontrollen unterliegt wie die ursprüngliche Version.

Automatisierung über den gesamten Modelllebenszyklus

Automatisierung kann Datenvalidierung, Feature-Generierung, Training, Evaluierung, Modellregistrierung, Freigabe, Deployment, Monitoring und Warnmeldungen orchestrieren. Das Ziel besteht nicht darin, Governance zu entfernen, sondern sie konsistent anzuwenden und nachvollziehbare Nachweise zu erstellen.

Änderungen mit hohem Risiko erfordern möglicherweise weiterhin eine explizite menschliche Prüfung, während routinemäßige Aktualisierungen mit geringem Risiko vordefinierten Kontrollen folgen können.

Was kommt als Nächstes beim maschinellen Lernen?

Diese Grafik erläutert die verschiedenen KI-Programme, die T-Systems anbietet

Maschinelles Lernen wird zunehmend verteilter, spezialisierter und stärker mit generativer KI integriert. Der künftige Unternehmenswert wird weniger von einem einzelnen Modell abhängen als vielmehr von der Fähigkeit, Modelle, Daten, Software, Infrastruktur und menschliche Expertise sicher zu kombinieren. Effizienz, Datensouveränität, Nachvollziehbarkeit und Lebenszyklusmanagement werden ebenso wichtig werden wie die reine Modellleistung.

Edge und Echtzeit-Maschinelles Lernen

Die Ausführung von Inferenz in der Nähe der Datenquelle kann Latenz, Bandbreitennutzung und die Abhängigkeit von einer kontinuierlichen Konnektivität reduzieren. Edge-Deployment ist relevant für Fabriken, Fahrzeuge, Versorgungsunternehmen, Geschäfte und andere Umgebungen, die schnelle oder resiliente Entscheidungen erfordern.

Edge-Modelle erfordern sichere Update-Mechanismen, Geräteüberwachung, hardwaregerechte Optimierung und einen Plan zur Synchronisierung von Feedback mit zentralen Systemen.

Kleinere, spezialisierte und multimodale Modelle

Unternehmen vergleichen zunehmend große Allzweckmodelle mit kleineren Modellen, die auf eine bestimmte Domäne oder Aufgabe zugeschnitten sind. Kleinere Modelle können bei klar definierten Aufgaben geringere Latenz, niedrigere Kosten, engere Kontrolle und eine einfachere Bereitstellung bieten.

Multimodale Systeme können Text, Bilder, Audio, Video und strukturierte Daten kombinieren, erweitern jedoch auch die Anforderungen an Evaluierung und Governance.

Datenschutzerhaltung und föderiertes Lernen

Datenschutzfördernde Ansätze zielen darauf ab, Mehrwert zu gewinnen und gleichzeitig unnötige Datenexposition zu reduzieren. Federated Learning trainiert über verteilte Datenquellen hinweg, ohne alle Rohdaten zu zentralisieren, während Techniken wie Differential Privacy und Secure Computation das Risiko der Offenlegung reduzieren können.

Diese Methoden bringen ihre eigenen Kompromisse in Bezug auf Genauigkeit, Komplexität, Kommunikation, Sicherheit und Prüfbarkeit mit sich und sollten für einen definierten Bedarf ausgewählt werden.

Von der Strategie bis zur Produktion mit T-Systems

T-Systems kann den Machine-Learning-Lebenszyklus der Anwendungsfall- und KI-Strategieentwicklung über Datengrundlagen, Modell-Engineering, Infrastruktur, Integration, Sicherheit und Betrieb unterstützen. Relevante Portfolio-Fähigkeiten umfassen KI-Strategie, Künstliche Intelligenz and Data Analytics, AI Solution Factory, AI Foundation Services und Industrial AI Cloud.

Die geeignete Kombination hängt vom Anwendungsfall, der Datensensitivität, der Latenz, der Modellkomplexität, der Souveränität und dem Betriebsmodell ab.

Maschinelles Lernen in der Praxis bei T-Systems

Maschinelles Lernen schafft Mehrwert, wenn Daten, Modelle, Infrastruktur, Sicherheit und Geschäftsprozesse zusammenwirken. Die Kundenprojekte von T-Systems zeigen, wie diese Elemente in den Bereichen Telekommunikation, Automotive, Logistik, öffentliche Infrastruktur, Netzwerkbetrieb und Gesundheitswesen kombiniert werden können. Die Beispiele reichen von der Einrichtung sicherer Datengrundlagen bis hin zur Bereitstellung von Modellen des maschinellen Lernens, die Anomalien erkennen, Bilder interpretieren, Mobilität optimieren und schnellere Entscheidungen unterstützen.

Sichere Datenbasis für congstar

Für congstar entwickelte T-Systems eine BSI-konforme Sicherheitslösung auf AWS zur Analyse anonymisierter Daten. Die Umgebung bietet Zugang zu Datentransformations- und Machine-Learning-Tools und setzt dabei Verschlüsselung, Zugriffskontrollen, Multi-Faktor-Authentifizierung, Logging, regionale Einschränkungen und Sicherheitsautomatisierung ein. T-Systems erweiterte die Umgebung später zu einer Multi-Account-Landing-Zone und gab congstar damit eine flexiblere und sicherere Grundlage für die Entwicklung weiterer Analytik- und Machine-Learning-Anwendungsfälle.

Connected-Car-Daten verbessern das Fahrerlebnis

Ein Automobilhersteller in China wollte verstehen, wie Fahrer vernetzte Fahrzeugfunktionen nutzen, und diese Insights auf zukünftige Services und die Fahrzeugentwicklung anwenden. T-Systems extrahierte, bereinigt und modellierte anonymisierte Daten aus dem Connected-Car-Backend und nutzte Public-Cloud-Ressourcen für Analytik und maschinelles Lernen. Der browserbasierte Service wurde in sechs Wochen von der Idee bis zum Go-live umgesetzt und ermöglicht schnellere Insights, neue Service-Möglichkeiten und eine kontinuierliche Verbesserung des Fahrerlebnisses.

Ausfälle erkennen, bevor sie Kunden beeinträchtigen

Ein globaler Logistikanbieter benötigte frühzeitigere Warnungen bei Ausfällen, die kundenseitige Systeme betrafen. T-Systems entwickelte individuelle Machine-Learning-Modelle zur Anomalieerkennung auf Basis interner Produktionsmetriken und externer Daten. Die Modelle speisen ein Echtzeit-Alarmsystem, das Kundensupport- und Incident-Response-Teams per E-Mail, SMS und Teams-Webhook informiert. Die Lösung unterstützt zudem die Ursachenanalyse und hilft dem Kunden, Vorfälle schneller zu beheben, Ausfallkosten zu senken, den Supportaufwand zu reduzieren und die Customer Experience der Endkunden zu verbessern.

Maschinelles Lernen hält den Stadtverkehr am Laufen

Im Hamburger Projekt 5G-LOGINNOV analysierten T-Systems und seine Partner Daten aus 400.000 Testfahrten, um zu untersuchen, wie vernetzte Mobilitätslösungen den Lkw-Verkehr rund um den Hafen verbessern könnten. Maschinelles Lernen und KI unterstützten die Auswertung von Platooning, Geschwindigkeitsempfehlungen und emissionsarmem Mobilitätsmanagement. Die erfassten Ergebnisse zeigten eine Reduzierung der staubedingten Zeitverluste um 59 Prozent, einen um 20 Prozent geringeren Kraftstoffverbrauch und eine Verringerung des CO₂-Fußabdrucks um 17 Prozent.

Technische Zeichnungen in operative Intelligenz umwandeln

Deutsche Telekom Technik verwendete manuell erstellte Microsoft-Visio-Zeichnungen zur Planung und Optimierung von Flächen in ihren Netzwerkbetriebszentren. T-Systems entwickelte den Data Transformer, einen durch maschinelles Lernen gestützten Microservice, der Domänenregeln mit Computer-Vision-Deep-Learning kombiniert. Er erkennt und interpretiert automatisch Objekte in den Zeichnungen, stellt die Ergebnisse über eine REST-API und eine Frontend-Anwendung bereit und erstellt strukturierte Daten, die die Prozessautomatisierung und einen ganzheitlichen Digital Twin des Netzwerkzentrums unterstützen können. Die Lösung reduziert den manuellen Aufwand, spart Zeit und trägt zur Senkung der Betriebskosten bei.

KI-gestützte Zweitmeinungen für Radiologen

Fuse-AI nutzt Künstliche Intelligenz zur Analyse von MRT-Bildern und unterstützt Radiologen dabei, Auffälligkeiten zu erkennen, die auf Krebs hinweisen könnten. Verschlüsselte Scans werden mithilfe skalierbarer Ressourcen aus T Cloud Public verarbeitet, wobei der Algorithmus Auffälligkeiten hervorhebt, Metadaten hinzufügt und die Ergebnisse an das System des Radiologen zurücksendet. Die Lösung ist darauf ausgelegt, schnellere und präzisere Diagnosen zu unterstützen und dabei hohe Anforderungen an sichere Infrastruktur, Datenschutz und Skalierbarkeit zu erfüllen.

KI-gestützte Zweitmeinungen für Radiologen

Fuse-AI nutzt Künstliche Intelligenz zur Analyse von MRT-Bildern und unterstützt Radiologen dabei, Anomalien zu erkennen, die auf Krebs hinweisen könnten. Verschlüsselte Scans werden mithilfe skalierbarer Ressourcen der T Cloud Public verarbeitet, wobei der Algorithmus Anomalien hervorhebt, Metadaten hinzufügt und die Ergebnisse an das System des Radiologen zurückübermittelt. Die Lösung ist darauf ausgelegt, schnellere und präzisere Diagnosen zu unterstützen und dabei hohe Anforderungen an sichere Infrastruktur, Datenschutz und Skalierbarkeit zu erfüllen.

Einführung von Maschinelles Lernen im Unternehmen

Maschinelles Lernen kann Prognosen, Automatisierung, Risikoerkennung, Qualität und Kundenentscheidungen verbessern, wenn es auf das richtige Problem angewendet wird und auf zuverlässigen Daten und einer soliden Governance basiert.

Ein praktischer nächster Schritt besteht darin, eine Entscheidung mit hohem Wertschöpfungspotenzial zu identifizieren, ihr Daten- und Risikoprofil zu bewerten und einen messbaren Weg vom Ausgangszustand über das Pilotprojekt bis hin zum Produktivbetrieb zu gestalten. T-Systems-Experten können dabei helfen, den Anwendungsfall, die Architektur, die Kontrollmechanismen und das Betriebsmodell zu evaluieren.

Relevante Lösungen

Robuste Cyber-Resilienz: Moderne Datensicherung

Eine Lösung von Dell zur Datenwiederherstellung bildet eine Verteidigungslinie hinter der „Last Line of Defense“.

Customer Analytics and Insights

Verwandeln Sie Rohdaten in verwertbares Wissen für optimierte Kundenkontakte und informierte Entscheidungen.

Verkehrsanalyse & Optimierung

Effizienzsteigerung im öffentlichen Verkehr durch die Optimierung von Routen, Fahrplänen und Ressourcen.

Daten- und KI-basierter Optimierungsansatz

Beherrschen Sie komplexe Produktionssysteme und Prozesse, um verborgene Effizienzpotenziale zu erschließen.

FAQ

Was ist maschinelles Lernen in einfachen Worten?

Maschinelles Lernen ist eine Methode, mit der Computersysteme Muster aus Beispielen erlernen und diese Muster auf neue Daten anwenden können. Anstatt für jeden Fall eine separate Regel zu erhalten, wird ein Modell trainiert, um eine Ausgabe zu erzeugen – beispielsweise eine Vorhersage, Klassifizierung, Empfehlung oder einen Anomalie-Score.

Ist maschinelles Lernen dasselbe wie Künstliche Intelligenz?

Nein. Künstliche Intelligenz ist das übergeordnete Fachgebiet der Systeme, die Aufgaben ausführen, die mit intelligentem Verhalten verbunden sind. Maschinelles Lernen ist ein Ansatz innerhalb der KI. Ein KI-System kann auch Regeln, Suche, Optimierung, Wissensgraphen oder mehrere Methoden gemeinsam nutzen.

Was sind die wichtigsten Arten des maschinellen Lernens?

Die wichtigsten Typen sind überwachtes Lernen, unüberwachtes Lernen, halbüberwachtes Lernen, selbstüberwachtes Lernen und bestärkendes Learning. Sie unterscheiden sich darin, ob das Training gekennzeichnete Beispiele, nicht gekennzeichnete Muster, aus den Daten selbst abgeleitete Ziele oder Feedback aus Aktionen verwendet.

Wie lernt ein Machine-Learning-Modell?

Während des Trainings passt ein Algorithmus iterativ die Modellparameter an, um Fehler zu reduzieren oder ein definiertes Ziel auf den Trainingsdaten zu optimieren. Anschließend werden Validierungs- und Testdaten verwendet, um zu prüfen, ob das Modell auf unbekannte Fälle verallgemeinert. Im Produktivbetrieb zeigt das Monitoring, ob sich verändernde Daten eine Neukalibrierung oder ein erneutes Training erfordern.

Welche Daten werden für maschinelles Lernen benötigt?

Die erforderlichen Daten hängen von der Aufgabe ab. Sie müssen die relevanten Eingaben, Ergebnisse, Zielgruppen und Betriebsbedingungen abbilden. Qualität, Genehmigung, Herkunft, Kennzeichnung, Aktualisierungshäufigkeit und die Möglichkeit, künftiges Feedback zu erfassen, sind in der Regel wichtiger als das bloße Volumen.

Was ist der Unterschied zwischen ML und Deep Learning?

Deep Learning ist eine Teilmenge des maschinellen Lernens, die mehrschichtige neuronale Netze verwendet. Es ist besonders effektiv für komplexe Bilder, Audio, Text und Video, erfordert jedoch häufig mehr Daten, Rechenleistung und spezialisierte Kontrollen. Traditionelles maschinelles Lernen kann für strukturierte Daten und interpretierbare Entscheidungen besser geeignet sein.

Wie unterscheidet sich maschinelles Lernen von generativer KI?

Prädiktives maschinelles Lernen schätzt in der Regel eine Klasse, einen Wert, eine Wahrscheinlichkeit, ein Ranking oder eine Anomalie. Generative KI erstellt neue Inhalte wie Texte, Bilder, Audioinhalte oder Code. Beide können Deep Learning nutzen, und beide erfordern Data Governance, Evaluierung, Sicherheit und Monitoring, die ihren jeweiligen Risiken angemessen sind. LLMs sind generative KI-Modelle, die für Sprachaufgaben wie Zusammenfassung, Beantwortung von Fragen, Inhaltserstellung und Chatbot-Antworten entwickelt wurden. Sowohl prädiktive als auch generative Modelle können Deep Learning nutzen, und beide erfordern Data Governance, Evaluierung, Sicherheit und Monitoring, die ihren jeweiligen Risiken angemessen sind.

Was ist MLOps und warum ist es wichtig?

MLOps ist eine Reihe von Engineering- und Betriebspraktiken, die zur Versionierung, zum Testen, Bereitstellen, Überwachen, Steuern, Nachtrainieren und Außerbetriebsetzen von Machine-Learning-Modellen eingesetzt werden. Es hilft Unternehmen, von einmaligen Experimenten zu reproduzierbaren und wartbaren Produktionsservices überzugehen.

Was ist Feature Engineering beim maschinellen Lernen?

Feature Engineering ist der Prozess der Auswahl, Transformation oder Erstellung von Variablen, die Rohdaten für ein maschinelles Lernmodell nutzbar machen. Dazu können die Skalierung numerischer Werte, die Kodierung von Kategorien, die Extraktion von Informationen aus Texten oder Bildern sowie die Dimensionsreduktion gehören.

Was ist der Unterschied zwischen Overfitting und Underfitting?

Overfitting bedeutet, dass ein Modell auf Trainingsdaten gut abschneidet, bei neuen Daten jedoch schlecht, weil es Rauschen oder zu spezifische Muster erlernt hat. Underfitting bedeutet, dass es die wichtigen Muster nicht erlernt hat und sowohl bei Trainings- als auch bei Testdaten schlecht abschneidet.

Welche Tools werden häufig für maschinelles Lernen verwendet?

Zu den gängigen Tools gehören Python, scikit-learn, XGBoost, TensorFlow, PyTorch, Jupyter Notebooks und MLOps-Plattformen. Die richtige Kombination hängt von der Modellfamilie, dem Datentyp, der Deployment-Umgebung, den Governance-Anforderungen und den Fähigkeiten des Teams ab.

Maschinelles Lernen in Mehrwert verwandeln

Sprechen Sie mit unseren Expertinnen und Experten über Ihren Anwendungsfall, Ihre Daten, Infrastruktur, Governance und Deployment-Anforderungen – und definieren Sie einen praxisnahen Weg von der Idee bis zur Produktion.

Quellen

1 AI Risk Management Framework, 2023, National Institute of Standards and Technology

2 Europäische Kommission, „AI Act." Verordnung (EU) 2024/1689

3 MLOps: Continuous delivery and automation pipelines in machine learning, Google Cloud Architecture Center, 2024, Google

Besuchen Sie t-systems.com außerhalb von Germany? Besuchen Sie die lokale Website für weiterführende Informationen und Angebote für Ihr Land.