Darf Gießerei-KI aus Sichtprüfung lernen? Das Messsystem-Tor für Qualitätslabels
- Castella

- vor 7 Tagen
- 4 Min. Lesezeit
Kurzantwort: Gießerei-KI sollte aus einem Prüfergebnis erst lernen, wenn der labelerzeugende Messprozess für genau diese Entscheidung Wiederholbarkeit, Reproduzierbarkeit, Stabilität und Rückverfolgbarkeit nachgewiesen hat. Eine korrekte Verknüpfung von Schuss und Bauteil ist notwendig; sie kann jedoch weiterhin einwandfreie Prozessdaten mit einem inkonsistenten „i.O.“, „Ausschuss“ oder Fehlerklassen-Label verbinden.
Der vorherige Castella-Leitfaden stellte die Verbindung vom Schuss zum Gussfehler her. Die nächste Ingenieurfrage ist schwieriger: Ist das verknüpfte Qualitätsergebnis als Lernziel belastbar?
Warum ein verknüpftes Label trotzdem falsch sein kann
Ein überwachtes Modell beobachtet die physikalische Wahrheit nicht direkt. Es lernt die Entscheidung aus Sichtprüfung, Dichtheitsprüfung, Röntgenbewertung, Maßprüfung oder Laborverfahren. Beleuchtung, Bauteiltemperatur, Oberflächenzustand, Aufnahme, Geräteauflösung, Kalibrierung, Prüferinterpretation, Fehlerterminologie oder eine revidierte Annahmeregel können das Label verändern.
NIST charakterisiert betriebliche Messprozesse unter anderem durch Wiederholbarkeit, Reproduzierbarkeit, Stabilität, Bias, Auflösung und Unterschiede zwischen Messmitteln. ISO 22514-7 betrachtet die Fähigkeit des Messprozesses relativ zur Messaufgabe: Die Messunsicherheit ist mit der Spezifikation oder der Prozessstreuung zu vergleichen. Praktisch heißt das: „Das Gerät ist kalibriert“ beweist nicht, dass der gesamte Prüfprozess verlässliche KI-Labels erzeugt.
Gussforschung zeigt die Relevanz. Eine Arbeit zur Fehlerklassifikation erklärt, wie Sichtprüfung, stochastische Fehlerentstehung und überlappende Annahmeklassen Datenraum-Überlappungen erzeugen, die überwachtes Lernen begrenzen. Eine 2025 veröffentlichte Magnesium-HPDC-Studie weist ausdrücklich darauf hin, dass die nachgelagerte visuelle Qualitätsprüfung subjektiv ist und Fehler enthalten kann. Eine weitere industrielle HPDC-Studie zeigt eine starke Bauteilrückverfolgbarkeit mittels Data-Matrix-Code, zugleich aber fehlende nachgelagerte Qualitätslabels für automatisch frühzeitig verworfene Teile. Rückverfolgbarkeit, Abdeckung und Label-Zuverlässigkeit sind getrennte Kontrollen.
Das Prüfergebnis als Messereignis speichern
Speichern Sie nicht nur den letzten Fehlercode, sondern das erzeugende Ereignis:
Bauteil-, Schuss-, Kavitäts- und Routen-ID;
Merkmal oder Fehlertaxonomie mit Regelrevision;
Methode, Gerät, Programm und Aufnahme;
Prüfer oder Version des automatisierten Systems;
Zeit, Schicht und relevante Umgebungsbedingung;
Rohwert oder Bildreferenz, Entscheidung, Konfidenz und Prüfstatus;
Nachprüfung, Schlichtung, Nacharbeit und Endentscheid als getrennte Ereignisse.
Das erweitert das Minimaldatenmodell für HPDC und LPDC. Eine späte Entscheidung kann damit die Evidenz für eine Abweichung nicht unbemerkt überschreiben.
Acht Schritte zur Qualifizierung von Guss-Qualitätslabels für KI
Die Entscheidung präzise definieren. Legen Sie Merkmal, Einheit, Fehlergrenze, Annahmeregel und vorgesehene Modellaktion fest. „Porosität“ ist zu ungenau, wenn tatsächlich Dichtheitsversagen, Freilegung nach Bearbeitung oder eine ortsspezifische Röntgenklasse entschieden wird.
Eine repräsentative Prüfmenge aufbauen. Nehmen Sie normale Streuung, bekannte Fehlerarten und Grenzteile aus relevanten Kavitäten, Werkzeugen, Legierungen, Schichten und Prozesszuständen auf. Nur eindeutige Gut- und Ausschussteile verbergen die schwierigen Entscheidungen des späteren Einsatzes.
Blind und wiederholt prüfen. Randomisieren Sie die Reihenfolge und verbergen Sie frühere Ergebnisse. Derselbe Prüfer oder dasselbe System wiederholt die Entscheidung; anschließend erfolgt die Wiederholung über Prüfer, Geräte oder Programme. Handhabung und Konditionierung müssen die Produktion abbilden.
Passende Kennzahlen verwenden. Bei kontinuierlichen Messwerten sind Auflösung, Bias, Wiederholbarkeit, Reproduzierbarkeit, Linearität und Stabilität zu untersuchen. Bei Kategorien zählen klassenweise Wiederholübereinstimmung, Prüferübereinstimmung, Verwechslungsmuster, Unklar-Rate und Klassenverteilung. Eine globale Genauigkeit kann das Versagen bei einem seltenen, sicherheitsrelevanten Fehler verdecken; auch Kappa-Kennzahlen brauchen bei stark ungleichen Klassen Kontext.
Abweichungen physisch untersuchen. Schließen Sie nicht jeden Konflikt per Mehrheitsentscheid. Nutzen Sie – wenn Merkmal und Risiko es erfordern – ein geeignetes Referenzverfahren wie kalibrierte Maßprüfung, kontrollierte Dichtheitsprüfung, CT, Schliff, Metallographie oder ein Expertengremium. Bleibt keine belastbare Referenzentscheidung möglich, muss „unklar“ erhalten bleiben.
Den Messprozess vor dem Modell korrigieren. Verbessern Sie Fehlerdefinition, Beleuchtung, Reinigung, Aufnahme, Kalibrierung, Referenzbilder, Schulung oder Schwellen der automatischen Prüfung. Nach wesentlichen Änderungen ist die Studie zu wiederholen. Modell-Tuning repariert keine Entscheidungsgrenze, die mit Prüfer oder Schicht wandert.
Labels durch ein Trainingsdaten-Tor freigeben. Kennzeichnen Sie Labels als verifiziert, vorläufig, widersprüchlich oder ausgeschlossen. Trainieren und testen Sie mit eingefrorener Taxonomie und Regelrevision. Bewahren Sie einen unabhängig geprüften Referenzsatz und berichten Sie Leistung nach Fehlerart, Kavität, Werkzeug, Schicht und Betriebszustand statt nur als Gesamtscore.
Labeldrift in der Produktion überwachen. Verfolgen Sie Abweichungs-, Unklar- und Überstimmungsraten. Neue Prüfer, Kamera, Röntgenprogramm, Dichtheitsaufnahme, Zeichnungsrevision oder Kundenregel können das Ziel verändern, obwohl der Gießprozess stabil bleibt. Führen Sie solche Änderungen durch das Tor für Modelldrift und Retraining.
Modellbeispiel: Den Klassifikator noch nicht optimieren
Dies ist ein modelliertes Beispiel, kein Castella-Kundenergebnis: Aus zwei Kavitäten werden 240 HPDC-Teile mit eindeutigen und grenzwertigen Oberflächenzuständen gewählt. Drei Prüfer bewerten die randomisierte Menge nach aktueller Anweisung zweimal. Bei offensichtlichen Blasen ist die Übereinstimmung hoch; sie ist schwach, wo Kaltlaufanzeigen kosmetische Fließspuren überlagern. Eine Referenzprüfung zeigt, dass Beleuchtungswinkel, Reinigungszustand und zwei konkurrierende Fehlerbeispiele die Grenze verschieben.
Die richtige erste Maßnahme ist nicht der Vergleich weiterer Algorithmen. Zuerst werden Prüfmethode und Beispiele korrigiert, unklare Fälle erhalten und die Übereinstimmungsstudie wiederholt. Erst danach werden verifizierte Labels mit Schussdaten verbunden und für Training freigegeben.
Was die Evidenz belegt – und was nicht
Klassische Gauge-R&R-Methodik ist für viele kontinuierliche Messaufgaben direkt geeignet, darf aber nicht mechanisch auf komplexe visuelle, radiografische oder mehrdimensionale Entscheidungen übertragen werden. Auch ISO 22514-7 richtet sich hauptsächlich an relativ einfache eindimensionale Messprozesse. Kategorische Prüfung braucht eine geplante Übereinstimmungsstudie, repräsentative Fehlerhäufigkeit und möglichst ein unabhängiges Referenzverfahren.
Ein fähiger Labelprozess garantiert kein nützliches KI-Modell. Er reduziert lediglich eine wichtige vermeidbare Unsicherheit. Merkmalsabdeckung, kausale Relevanz, zeitbasierte Validierung, Klassenungleichgewicht und Einsatzkontrollen bleiben erforderlich. Abweichung ist außerdem nicht immer „Prüferfehler“; sie kann eine mehrdeutige Spezifikation oder einen physikalisch kontinuierlichen Fehler offenlegen, der in eine binäre Klasse gezwungen wird.
FAQ
Ist vor dem KI-Training 100 Prozent Prüferübereinstimmung nötig?
Nicht automatisch. Das Akzeptanzkriterium richtet sich nach Merkmal, Entscheidungsrisiko und Referenzverfahren. Sicherheitskritische oder kundenseitige Konformität verlangt stärkere Evidenz als ein beratendes Oberflächen-Screening. Schwelle und Begründung müssen vor Sichtung der Ergebnisse dokumentiert sein.
Kann Modellkonfidenz unzuverlässige Labels ausgleichen?
Nein. Konfidenz beschreibt das Modell innerhalb seiner Daten und Annahmen; sie verwandelt widersprüchliche Lernziele nicht in physikalische Wahrheit. Labelunsicherheit ist zu speichern; unklare Fälle werden ausgeschlossen, quarantänisiert oder separat modelliert.
Überwindet mehr Trainingsdaten das Labelrauschen?
Mehr Daten können Stichprobenunsicherheit reduzieren. Wiederholte Inkonsistenz lehrt dem Modell jedoch den Bias des Prüfprozesses. Verbessern Sie zuerst den Labelprozess und sammeln Sie danach mehr repräsentative, verifizierte Beispiele.
Wie werden nachgearbeitete Teile gelabelt?
Speichern Sie Erstbefund, Nacharbeit, Nachprüfung und Endentscheid als getrennte Ereignisse. Wählen Sie das Lernziel nach dem vorgesehenen Entscheidungszeitpunkt des Modells; überschreiben Sie die Evidenz vor Nacharbeit nie mit dem Endstatus.
Quellen
Castella bleibt bewusst konservativ: den Messprozess verifizieren, Unsicherheit erhalten und das Modell seine Autorität an zukünftigen Produktionsdaten verdienen lassen.




Kommentare