# ITSM Ticket-Klassifizierung - (Deep Learning Guide)

> Schluss mit manuellem Ticket-Sorting! Wir zeigen, wie wir mit DistilBERT eine KI zur ITSM-Klassifizierung trainiert haben. Inklusive Link zum kompletten Code-Repository zum Nachbauen.

Die Ergebnisse des Experiments bestätigen die Überlegenheit des spezialisierten Ansatzes. Das feingetunte DistilBERT-Modell erreichte nach 6 Trainings-Epochen einen Gesamt-F1-Score von 0,95 (95%) auf den Validierungsdaten. Im direkten Vergleich übertraf es das beste generative LLM im Zero-Shot-Verfahren (Llama 4:17b) deutlich in der Klassifizierungs- und Priorisierungsgüte.

> 🤖 **KI-Hinweis:** Diese Markdown-Datei ist ein für Agenten optimiertes Abbild von https://it-ruhrig.de/blog/portfolio/ITSM-Ticket-Klassifizierung-mit-distilbert

- **Autor:** Michael.Ruhrig
- **Veröffentlicht am:** July 4, 2026 • 12:04PM
- **Copyright:** © 2026 Michael Ruhrig. Namensnennung erforderlich.

---

## ITSM Ticket-Klassifizierung - (Deep Learning Guide)

 

##### Code &amp; Doku online: ITSM-Tickets automatisch klassifizieren mit Deep Learning

Ich danke recht herzlich meinem Kommilitonen Tom (Alias: AlpacaCoding), welcher mir gestattet hat die zu dem Projekt gehörende Ausarbeitung in diesem Blog zu veröffentlichen.

Und ja, hier ist sie. **Unsere [vollständige Projektarbeit](https://it-ruhrig.de/download_file/view/9b41ae0f-b233-4892-8370-1d6d6028b43e/345) zur wissensbasierten Klassifikation von ITSM-Tickets mittels Deep Learning ist ab sofort online verfügbar.**

Das Wichtigste für alle Macher vorab: Wir stellen nicht nur die Theorie vor. **Das komplette Code-Repository inkl. der verwendeten Skripte zum Training und zur Evaluierung steht auf [Github ](https://github.com/musicfiler/KI-ITSM-Priority)zum Nachbauen bereit.**

Warum ist das relevant?

In großen Unternehmen entstehen täglich hunderte IT-Supportanfragen. Die manuelle Klassifizierung und Zuweisung (z.B. nach Priorität "Kritisch" vs. "Niedrig") ist zeitaufwendig, fehleranfällig und schwer skalierbar. Eine Fehlklassifizierung führt zu ineffizienter Ressourcenallokation und gefährdet Service Level Agreements (SLAs).

Unser Projekt zeigt eine Lösung für dieses Kernproblem des IT-Betriebs.

##### Die Herausforderung:

##### Unstrukturierte Daten und hohe Varianz

Der Prozess der Ticket-Klassifizierung besteht im Kern aus zwei Dimensionen:

- der thematischen Kategorisierung (z.B. Hardware -&gt; Drucker) und der
- Priorisierung (Dringlichkeitsbewertung).
 
Die Herausforderung liegt in der Natur der Daten. Tickets bestehen oft aus unstrukturierten Freitextfeldern (Betreff, Beschreibung), die Umgangssprache, Tippfehler oder irrelevante Informationen enthalten können.

Um eine automatisierte, wissensbasierte Klassifikation zu ermöglichen, erfordert es daher leistungsfähige Methoden aus dem Bereich des Natural Language Processing (NLP). Klassische Machine-Learning-Ansätze stoßen hier oft an Grenzen.

##### Technischer Ansatz:

##### Warum wir auf Encoder-Modelle setzen

Für unser Experiment haben wir einen Datensatz von insgesamt 61.015 Tickets aufbereitet. Ziel war die Klassifizierung in fünf diskrete Prioritätsstufen.

![Diagramm, das zeigt, wie ein Text in Token-IDs zerlegt und dann in Vektor-Embeddings umgewandelt wird.](/application/files/9817/8480/5768/Tokenizer_Diagramm.png)

Darstellung der technischen Visualisierung der Vorverarbeitungsstufe für neuronale Netze.

Technisch gesehen müssen Eingabetexte zunächst über einen **Tokenizer** in numerische IDs und anschließend über einen **Embedding Layer** in Vektorrepräsentationen umgewandelt werden, damit neuronale Netze sie verarbeiten können. Der entscheidende Unterschied liegt jedoch in der verwendeten Modellarchitektur. Suchmaschinen ziehen oft Vergleiche heran, daher haben wir zwei Ansätze gegenübergestellt:

1. **Decoder-Modelle (Generative LLMs) im Zero-Shot-Verfahren:** Diese Modelle (wie *Llama-4-scout-17b*) sind generativ. Sie sagen basierend auf Wahrscheinlichkeiten das nächste Wort voraus. Im Zero-Shot-Ansatz (ohne spezifisches Training auf die Daten) generieren sie das Label (z.B. "Priorität: hoch") als Text.
2. **Encoder-Modelle (BERT-Architektur) mit Fine-Tuning:** Diese Modelle (wie *DistilBERT*) sind auf das Verständnis von Eingabesequenzen spezialisiert. Sie lesen den Text bidirektional zeitgleich durch Self-Attention-Mechanismen. Wir haben den Kopf des Netzwerks (Classification Head) ausgetauscht und das Modell spezifisch auf unsere 5 ITSM-Klassen trainiert.
 
##### Sachlicher Modell-Vergleich: Ergebnisse der Test-Pipeline

Zur Validierung haben wir 3.051 Tickets beiseitegelegt, die nicht für das Training verwendet wurden. Um die Leistung neutral zu beurteilen, haben wir wissenschaftliche Evaluierungsmetriken wie Accuracy (Genauigkeit) und den F1-Score (harmonisches Mittel aus Precision und Recall, wichtig bei unausgeglichenen Datensätzen) herangezogen.

Die Ergebnisse unserer Test-Pipeline sprechen eine deutliche Sprache:

    **Metrik / Parameter** **DistilBERT (Spezialisiert)** **Llama-4-scout-17b (Generativ)**     **Ansatz** Feingetunter Klassifikator Zero-Shot Textgenerierung   **Genauigkeit (Accuracy)** **95,05 %** 33,29 %   **F1-Score (Macro Average)** **0,89** 0,30 %   **Validierungsdauer (3.051 Tickets)** **ca. 30,5 Sekunden** Mehrere Stunden   **Errorrate (ungültige Antworten)** 0,00 % ca. 3 % (z.B. falsches Format)   > *Hinweis zum Overfitting:*
> 
> *Das DistilBERT-Training wurde nach Epoche 6 beendet, da die Evaluation-Loss Metrik begann zu steigen, was den Beginn von Overfitting signalisierte. Zu diesem Zeitpunkt war der Sättigungspunkt erreicht.*

##### Unser persönliches Fazit und Ausblick

> *"Spezialisierung schlägt Generalisierung"*

Obwohl der Hype um riesige generative KIs (LLMs) berechtigt ist, sind sie für spezifische, abgrenzbare Automatisierungsaufgaben wie die ITSM-Ticketklassifizierung oft überdimensioniert, zu langsam und im Zero-Shot-Verfahren schlichtweg ungenauer.

Kleine Encoder-Modelle wie DistilBERT sind nach dem Fine-Tuning nicht nur enorm ressourcenschonender und schneller, sondern liefern eine beeindruckende Präzision von über 95%.

Genau diese pragmatische, datengetriebene Herangehensweise konnten wir in diesem Forschungsprojekt nachweisen.

**Neugierig geworden?**

Lade dir den Code aus unserem [Repository](https://github.com/musicfiler/KI-ITSM-Priority) herunter, schau dir die Doku an und baue deinen eigenen KI-Klassifikator!

 

## ![ITSM-Klassifizierung Forschungsprojekt.png](/application/files/8617/8480/4989/ITSM-Klassifizierung_Forschungsprojekt.png)

#### Executive Summary: Wissensbasierte Klassifikation von ITSM-Tickets mittels Deep-Learning

**Kontext und Problemstellung** In modernen, großen Unternehmensumgebungen sieht sich der IT-Support täglich mit hunderten bis tausenden von Anfragen konfrontiert. Eine schnelle und präzise Bearbeitung ist entscheidend für reibungslose Geschäftsprozesse. Zentraler Engpass ist hierbei oft die manuelle Klassifizierung und Priorisierung eingehender Tickets (Störungen/"Incidents" und Serviceanfragen/"Service Requests") sowie deren Zuweisung an die zuständigen Support-Teams. Dieser Prozess ist zeitaufwendig, fehleranfällig und angesichts steigender Ticketvolumina schwer skalierbar. Bestehende Best-Practice-Frameworks wie ITIL 4 bieten zwar strukturierte Vorgehensweisen, fokussieren sich aber auf manuelle Prozesse. Derzeitige ITSM-Tools nutzen zwar generative KI, liefern jedoch oft nur generische Antworten ohne spezifisches Domänenwissen.

**Zielsetzung und Forschungsfragen** Die Projektarbeit von Tom Schich und Michael Ruhrig adressiert diese Forschungslücke durch die experimentelle Programmentwicklung eines spezialisierten KI-Modells. Ziel ist es, ein auf der **DistilBERT-Architektur** basierendes Encoder-Modell durch Training mit spezifischen ITSM-Ticketdaten für die automatisierte Klassifizierung zu spezialisieren.

Die Arbeit geht dabei zwei zentralen Forschungsfragen nach:

1. Ist es möglich, mit einem spezifisch trainierten DistilBERT-Modell qualitativ bessere Ergebnisse bei der Klassifizierung und Priorisierung von ITSM-Tickets zu erzielen als mit größeren, nicht spezifisch trainierten Large Language Models (LLMs) im Zero-Shot-Verfahren?
2. Welcher Umfang an Trainingsdaten und welche Anzahl an Trainingsiterationen (Epochen) sind unter Berücksichtigung der Hyperparameter-Konfiguration erforderlich, um das bestmögliche Ergebnis zu erzielen?
 
**Methodik und Vorgehensweise** Die Autoren verfolgen einen kombinierten Ansatz aus experimenteller Entwicklung (Fine-Tuning) und dem konstruktionswissenschaftlichen Paradigma ("Design Science Research"). Die Arbeit gliedert sich wie folgt:

- **Grundlagen:** Erarbeitung der fachlichen (ITSM, ITIL 4, Ticket-Typen, Priorisierungsprozess basierend auf Auswirkung und Dringlichkeit) und technischen (Transformer-Architektur, Tokenizer, Embeddings, Self-Attention, Encoder- vs. Decoder-Modelle) Fundamente.
- **Umsetzung:** Beschreibung des experimentellen Designs. Als Basis dient das vortrainierte Modell „distilbert-base-uncased“. Es wird ein systematischer Vergleich mit verschiedenen kontrahierenden LLMs (z. B. Llama-4, Qwen2.5, Phi-3) durchgeführt.
- **Datenbasis und Validierung:** Nutzung öffentlicher Datensätze (z. B. von Kaggle), die harmonisiert und in die englische Sprache übersetzt wurden. Die Daten umfassen Subject, Body und Priorität (5 Stufen). Die Validierung erfolgt über einen strikten Train-Test-Split (95% Training, 5% Validierung).
- **Training und Evaluierung:** Das Modell wird feingetunt, wobei Metriken wie Accuracy, F1-Score, Konfusionsmatrizen und Loss verwendet werden, um die Performance zu bewerten und Overfitting zu vermeiden.
 
**Kernergebnisse und Fazit** Die Ergebnisse des Experiments bestätigen die Überlegenheit des spezialisierten Ansatzes. Das feingetunte DistilBERT-Modell erreichte nach 6 Trainings-Epochen einen **Gesamt-F1-Score von 0,95 (95%)** auf den Validierungsdaten. Im direkten Vergleich übertraf es das beste generative LLM im Zero-Shot-Verfahren (Llama 4:17b) deutlich in der Klassifizierungs- und Priorisierungsgüte.

Bezüglich der Trainingsparameter zeigte sich, dass mindestens 2 Epochen notwendig sind, um die Vergleichsmodelle zu übertreffen, und der Sättigungspunkt (optimales Ergebnis vor Eintritt von Overfitting) bei der gegebenen Datenmenge (ca. 46.000 Trainingsdaten) bei 6 Epochen lag.

Zusammenfassend zeigt die Arbeit, dass spezialisierte, durch Fine-Tuning optimierte Encoder-Modelle für dedizierte Klassifizierungsaufgaben im ITSM-Kontext effizienter, präziser und ressourcenschonender sind als generalistische Large Language Models.

Für detaillierte Einblicke in die technischen Spezifikationen, die Datenverteilungen und die genauen Evaluierungsergebnisse wird auf die vollständige Datei "[Künstliche Intelligenz - Klassifizierung von ITSM Tickets.pdf](https://it-ruhrig.de/download_file/view/9b41ae0f-b233-4892-8370-1d6d6028b43e/345)" verwiesen.

 

Die vollständige Arbeit steht als PDF hier und unter [Dokumente](https://it-ruhrig.de/documents) zum kostenlosen Download bereit.

Viel Freude beim Lesen und Entdecken neuer Impulse beim Nachbauen!

##### Zum Download:

 

 [ PDF - Künstliche Intelligenz - Klassifizierung von ITSM Tickets ](https://it-ruhrig.de/download_file/force/9b41ae0f-b233-4892-8370-1d6d6028b43e/345) 

 Konversation wird geladen  

 

##### Share This Article

 [](https://www.facebook.com/sharer/sharer.php?u=https%3A%2F%2Fit-ruhrig.de%2Fblog%2Fportfolio%2FITSM-Ticket-Klassifizierung-mit-distilbert) [](https://twitter.com/intent/tweet?url=https%3A%2F%2Fit-ruhrig.de%2Fblog%2Fportfolio%2FITSM-Ticket-Klassifizierung-mit-distilbert) [](https://www.linkedin.com/shareArticle?mini-true&url=https%3A%2F%2Fit-ruhrig.de%2Fblog%2Fportfolio%2FITSM-Ticket-Klassifizierung-mit-distilbert&title=ITSM+Ticket-Klassifizierung+-+%28Deep+Learning+Guide%29) [](mailto:?body=Ein%20interessanter%20Artikel%20auf%20der%20Website%20IT-Solutions%20Ruhrig%20-%20musicfiler%20IT%20%26%20Media%3A%0A%0AITSM%20Ticket-Klassifizierung%20-%20%28Deep%20Learning%20Guide%29%0Ahttps%3A%2F%2Fit-ruhrig.de%2Fblog%2Fportfolio%2FITSM-Ticket-Klassifizierung-mit-distilbert&subject=Interessanter%20Artikel) 

##### Vorheriger Artikel

 

 [![](https://it-ruhrig.de/application/files/thumbnails/blog_entry_thumbnail/4517/6615/1205/Vorschaubild_Gemini_Web_Grabber.png)](https://it-ruhrig.de/blog/portfolio/Gemini-Chat-Grabber) 

 December 19, 2025 • 3:00PM 

 [Gemini Chat Grabber](https://it-ruhrig.de/blog/portfolio/Gemini-Chat-Grabber) 

##### Nächster Artikel

 

 [![](https://it-ruhrig.de/application/files/thumbnails/blog_entry_thumbnail/4917/8480/8036/Vorschaubild_Chaoss_Struktur.png)](https://it-ruhrig.de/blog/portfolio/software-engineering) 

 July 23, 2026 • 12:00PM 

 [Software Engineering](https://it-ruhrig.de/blog/portfolio/software-engineering) 

 

##### Themen

 

- [Neuigkeiten](https://it-ruhrig.de/blog/topic/58/neuigkeiten)
- [Portfolio](https://it-ruhrig.de/blog/topic/57/portfolio)
- [Cybersecurity](https://it-ruhrig.de/blog/topic/56/cybersecurity)
- [Rezensionen](https://it-ruhrig.de/blog/topic/169/rezensionen)
 

 

 

##### From Our Blog

 

 

 

 

 [ ![](https://it-ruhrig.de/application/files/thumbnails/blog_entry_thumbnail/7017/8532/1521/Vorschaubild_Projektplanungs_Rezension_Beitrag.png) 

###### ProjectLibre die Smarte Projektplanungsalternative

July 29, 2026

 

 ](https://it-ruhrig.de/blog/reviews/hilfreiche-kostenfreie-ki-tools-2)

 

 [ ![](https://it-ruhrig.de/application/files/thumbnails/blog_entry_thumbnail/4617/8531/4466/Volksverschluesselung_Vorschaubild.png) 

###### Kostenfreie Emailsignatur

July 29, 2026

 

 ](https://it-ruhrig.de/blog/cybersecurity/emailsignatur-volsverschluesselung)

 

 [ ![](https://it-ruhrig.de/application/files/thumbnails/blog_entry_thumbnail/2517/8509/4253/Musikbibliothek_Aufraeumen_Vorschau.png) 

###### DJ Database &amp; Recovery Tool

July 26, 2026

 

 ](https://it-ruhrig.de/blog/portfolio/dj-database-recovery)

 

 [ ![](https://it-ruhrig.de/application/files/thumbnails/blog_entry_thumbnail/4917/8480/8036/Vorschaubild_Chaoss_Struktur.png) 

###### Software Engineering

July 23, 2026

 

 ](https://it-ruhrig.de/blog/portfolio/software-engineering)

 

 [ ![](https://it-ruhrig.de/application/files/thumbnails/blog_entry_thumbnail/6817/8480/5106/ITSM-Klassifizierung_Vorschau.png) 

###### ITSM Ticket-Klassifizierung - (Deep Learning Guide)

July 04, 2026

 

 ](https://it-ruhrig.de/blog/portfolio/ITSM-Ticket-Klassifizierung-mit-distilbert)

 

 [ ![](https://it-ruhrig.de/application/files/thumbnails/blog_entry_thumbnail/8817/8480/3081/musicfiler_IT_und_Media_Wuerze.png) 

###### Neuigkeiten zum Sommer 2026

July 01, 2026

 

 ](https://it-ruhrig.de/blog/news/neuigkeiten-sommer2026)

