Lokale KI

KI-Assistent in der Fertigung: ROI durch schnellere Diagnostik

Wenn eine Fertigungsanlage ausfällt, tickt die Uhr. Die Instandhaltung muss die Störung eingrenzen, einen Techniker schicken, die Ersatzteile herbeiziehen und die Anlage wieder hochfahren, alles unter Druck und im schlimmsten Fall mit nicht verfügbarem Fachwissen. Ein KI-Assistent für die Serviceabteilung, der mit den Fehlercodes der Anlage trainiert ist, verkürzt die Diagnose von 40 Minuten auf fünf Minuten. Das ist nicht nur schneller, sondern spart auch Ausfallkosten. Bei einer Anlage mit Stundensätzen von 2.000 bis 5.000 Euro sind 35 Minuten Zeiteinsparung schnell 1.000 bis 3.000 Euro wert.

Schnellantwort

Ein KI-Assistent für Serviceabteilung und Fertigung verkürzt die Diagnostische Phase bei Maschinenausfällen um 48 Minuten im Durchschnitt, weil er Fehlercodes und Wartungshistorien in Sekunden abgleicht. Bei kritischen Anlagen mit Stundensatz über 1.000 Euro amortisiert sich ein Assistent innerhalb von zwei bis sechs Monaten allein über Ausfallzeitersparnisse. Betriebe, die digitalisierten Fehlerhistorien haben und zwei bis drei Ausfälle je Anlage im Monat erleben, sollten einen Piloten starten.

Byte · Lokale KILokale KIByte24 Stunden

Wie ein KI-Assistent die Ausfallzeit wirklich senkt

Ein Maschinenausfall verursacht eine Kette: Der Operator meldet einen Fehlercode an die Instandhaltung. Jemand sucht den Code in der Dokumentation oder im digitalen Fehlerkatalog des Herstellers. Falls nicht da, ruft jemand den Hersteller an. Im Parallel dazu sucht die Instandhaltung in der Wartungshistorie, ob dieser Fehler schon vorgekommen ist, und wenn ja, was damals geholfen hat. Ist Fachwissen betroffen, wird ein erfahrener Techniker hinzugezogen. Der schaut in die Zeichnungen, in die Ersatzteilkataloge, vielleicht in alte Checklisten. Dann wird gemeinsam ein Diagnoseplan aufgestellt.

Ein KI-Assistent übernimmt diese Recherche und sucht gleichzeitig in der Bedienungsanleitung des Herstellers, den Wartungsprotokollen aus den letzten Monaten oder Jahren, den Ersatzteilkatalogen und Schaltplänen, den Instandhaltungsarbeitsblättern. Die typische Diagnose dauert mit handischen Lookups 40 bis 60 Minuten. Mit einem Assistenten vier bis sechs Minuten. Eine österreichische Kunststoffgießerei mit zwei kritischen Anlagen hatte genau diese Konstellation und erreichte die positive Amortisation nach vier Monaten.

Wer schneller weiß, was zu tun ist, spart nicht nur Zeit, sondern auch Fehlerquoten und Kosten für eilige Ersatzteile.

Ausfallkosten rechnen: Warum Diagnosezeit Geld ist

Bei einer Anlage im Mehrstoff-Spritzguss mit Stundensatz von 1.500 Euro kostet eine Minute Ausfallzeit 25 Euro. 35 Minuten eingesparte Diagnosezeit sind 875 Euro pro Ausfall. Kommt ein solcher Ausfall einmal im Monat vor, sind das 10.500 Euro im Jahr. Die Hardware für einen lokalen KI-Assistenten kostet 10.000 bis 15.000 Euro einmalig, danach rund 2.000 Euro Strom im Jahr. Der Punkt der Amortisation ist im fünften Monat erreichbar, wenn zwei Ausfälle durch den Assistenten schneller gelöst wurden.

Realistischer ist ein Betrieb mit zwei Anlagen, Stundensatz je Anlage 2.500 Euro, Ausfallrate zwei bis drei Mal im Monat je Anlage. Dann rechnet sich so: 6 Ausfälle im Monat, à 30 Minuten gespart, à 2.500 Euro Stundensatz / 60 Minuten = 1.250 Euro pro 30 Minuten. Ersparnisse pro Monat: 6 × 1.250 Euro = 7.500 Euro. Jahresersparnisse: 90.000 Euro. Hardware plus Strom: 15.000 plus 2.000 Euro, amortisiert nach zwei Monaten.

Was der Assistent in der Fertigung konkret unterscheidet

Ein KI-Assistent im Fabrik-Kontext ist anders als einer für die Administrationen. Das Ticketsystem ist der Fehlercode selbst, nicht eine Anfrage in Prosa. Der Assistent liest Fehlercode, aktuelle Parameter (Druck, Temperatur, Durchsatz), Wartungsgeschichte, Schichtinformationen (welche Bedingungen damals), und liefert Diagnose mit Wahrscheinlichkeit, erwartete Reparaturzeit, Ersatzteile zum Vorbestellen, Checkliste für den Techniker, Kontakt zum Hersteller.

Ein Beispiel aus der Praxis: Eine Verpackungsmaschine meldet Fehler 0x33A (Zylinder schwergängig). Der Assistent vergleicht mit den Logs: die Außentemperatur ist heute 32°C, die Innenklimatisierung der Fabrik ist ausgefallen, die Hydraulikflüssigkeit ist zäher geworden. Die Lösung: Filter reinigen, Temperatur normalisieren, eventuell Flüssigkeit wechseln. Typische Reparaturzeit 20 Minuten, Ersatzteile nicht nötig. Diese Diagnose dauert ohne Assistent 60 Minuten und erfordert einen Spezialisten, mit Assistent fünf Minuten und macht einen Techniker allein.

Vier Fallstricke bei der Implementierung

1. Zu wenig Trainingsdaten. Ein Assistent arbeitet nicht aus Luft. Er braucht Fehlercodes, Wartungsprotokolle und Zeichnungen als Input. Betriebe, die diese Daten nicht digitalisiert haben, müssen erst digitalisieren. Das kostet Zeit, aber der ROI hinterher ist deutlich besser.

2. Modellwahl aus Kostengründen. Ein großes Modell (70 Milliarden Parameter) versteht Kontext besser, braucht aber 96 GB VRAM. Ein kleines (7 Milliarden Parameter) ist schneller aber überfordert bei komplexen Fehlern. Die richtige Wahl ist ein mittleres Modell (32 Milliarden Parameter) im 4-Bit-Format, passt auf 16 GB RAM, läuft lokal schnell und versteht den Kontext.

3. Keine Schnittstelle zur Instandhaltungs-Software. Der Assistent muss die Fehlercodes und Wartungsprotokolle aus der bestehenden Software lesen, nicht Hand-einpflegen. Falls Ihre Software keine API hat, muss ein Konnektor dafür gebaut werden.

4. Techniker fühlen sich ersetzt. Das ist das kulturelle Risiko. Besser: klar sagen, dass Techniker weniger Zeit für Recherche haben und mehr Zeit für handwerkliche Arbeit, Feindiagnose und Kundenkontakt. Der Assistent ist ein Werkzeug zum Schneller-Werden, nicht zum Weniger-Werden.

Was ein solcher Assistent nicht ersetzt

Ein Assistent ersetzt keine Handarbeit. Ein Zylinder, der ausgetauscht werden muss, wird nicht anders getauscht, nur dass es schneller geht. Ein Fehler, der eine physikalische Messung vor Ort braucht, erklärt sich nicht allein aus Codes. Auch ersetzt ein lokaler Assistent keinen Datenschutz. Die Trainingsdaten müssen genauso geschützt werden wie vorher.

Was Sie diese Woche tun können

  • Sammeln Sie die Ausfallrate Ihrer kritischsten Anlage der letzten drei Monate. Wie oft war sie down, wie lange im Schnitt?
  • Berechnen Sie den Stundensatz: Was kostet es, wenn die Anlage nicht läuft? Material, Personalausfallzeit, Lieferverzögerung.
  • Prüfen Sie, ob Ihre Fehlercodes und Wartungsprotokolle digital vorliegen. Ohne diese Daten funktioniert kein Assistent.
  • Holen Sie einen Kostenvergleich vom Systemhaus ein für lokale GPU und für die API-Lösung, basierend auf Ihrem aktuellen Ticket-Volumen.
Wer schneller diagnostiziert, spart nicht nur Ausfallzeit, sondern auch Fehlerquoten und Kosten für Notfallteile.

Häufige Fragen

Mit welcher Reduzierung der Ausfallzeit kann ich rechnen?

30 bis 45 Minuten Zeitersparnis je Ausfall pro Assistent, je nach Komplexität der Maschinen und Verfügbarkeit der Trainingsdaten. Betriebe mit guter Dokumentation sparen mehr. Betriebe mit Papierprotokolle müssen erst digitalisieren.

Wie lange dauert es, den Assistenten auf unsere Maschinen zu trainieren?

Drei bis acht Wochen, abhängig davon, wie viel Dokumentation schon digitalisiert ist. Mit vollständigen Protokollen und Zeichnungen am unteren Ende, ohne am oberen Ende.

Was ist, wenn sich die Maschine ändert oder gewartet wird?

Der Assistent muss mit neuen Daten nachtrainiert werden. Das dauert typischerweise eine Woche für Betriebe mit kontinuierlichen Änderungen. Ein System-Update wird regelmäßig durchgeführt, etwa alle zwei bis drei Monate.

Kann ein lokaler Assistent mit Maschinentypen von verschiedenen Herstellern umgehen?

Ja, aber die Trainingsdaten müssen separat organisiert werden. Ein Assistent kann nicht automatisch zwischen Fanuc und Siemens unterscheiden, wenn die Trainingsdaten nicht bereits separiert sind.

Was kostet die eigene GPU im Vergleich zur API?

Der Rechner stellt Anschaffung, Strom und Betrieb einer eigenen Karte den Preisen je Million Token gegenüber, inklusive GPU-Dimensionierung für Ihre Last.

LLM-Kostenrechner öffnen →

Vom Pilot in den Regelbetrieb: Hosting, Berechtigungen und Rollout je Abteilung stehen auf der Seite KI-Implementierung.

Aus derselben Reihe

Ein Problemfeld, mehrere Blickwinkel, alle enden in derselben Rechnung: dem LLM-Kostenrechner.

Kostenloses Live-Webinar

In 2 Wochen vom Engpass zum KI-Piloten.

Dienstag, 06.10.2026 · 11:00 Uhr45 Min live · Q&A · AufzeichnungMasiar Ighani · Gründer und CEO
Platz sichern → kostenlos
QR-Code zur Webinar-Anmeldung auf skillbyte.de
Scannen oder antippen