Plausible Angaben können trotzdem falsch sein

Eine leere Zelle fällt auf. Eine glaubwürdig klingende Angabe rutscht leichter durch die Kontrolle. Genau deshalb brauchst du Regeln für Datenanreicherung, bevor du große Artikelmengen verarbeitest.

Nehmen wir ein fiktives Beispiel: Im Lieferantenblatt fehlt das Material eines Gehäuses. Auf dem Foto wirkt es metallisch. Eine KI trägt deshalb Aluminium ein. Tatsächlich könnte es lackierter Kunststoff sein. Der Datensatz sieht vollständig aus, enthält aber eine unbelegte Behauptung.

Das National Institute of Standards and Technology (NIST) ist eine US-Bundesbehörde im Geschäftsbereich des Handelsministeriums. Es entwickelt wissenschaftliche Grundlagen, Standards und Leitlinien, auch zum Umgang mit KI-Risiken. Für dein Produktdatenteam ist das relevant: Unbelegte KI-Angaben können als vermeintliche Fakten in Shoptexte, Filter und technische Datenblätter gelangen.

Das NIST-Profil für generative KI beschreibt selbstbewusst formulierte, falsche Inhalte als eigenes Risiko. Für Produktdaten folgt daraus: Sprachliche Sicherheit ersetzt keinen Nachweis.

Regel 1: Lege geeignete Quellen je Attribut fest

Definiere, woher ein Wert kommen darf. Ein technisches Datenblatt kann Maße belegen. Eine freigegebene Farbtabelle kann Farbnamen zuordnen. Eine allgemeine Kategoriebeschreibung sagt dagegen wenig über die Ausstattung eines einzelnen Modells aus.

Halte neben dem übernommenen Wert auch die Quelle fest. Dazu gehören Dokumentname oder URL, Fundstelle und gegebenenfalls die Dokumentversion. So kann dein Team eine Angabe später prüfen, ohne dieselbe Recherche erneut zu beginnen.

Wer Produktdaten-Onboarding automatisieren mit 2txt möchte, sollte diese Quellenlogik gemeinsam mit dem Zielformat festlegen. Die Regeln geben der Aufbereitung einen überprüfbaren Rahmen.

Regel 2: Trenne Umrechnung und Vermutung

Aus belegten 25 Zentimetern lassen sich 250 Millimeter berechnen. Dafür braucht dein Prozess eine klare Umrechnungsregel. Aus einer silbernen Oberfläche lässt sich hingegen kein Werkstoff zuverlässig ableiten.

Prüfe bei jeder Ableitung, ob alle nötigen Eingangswerte vorliegen. Schon eine unklare Einheit kann ein rechnerisch korrektes Ergebnis unbrauchbar machen. Bewahre den ursprünglichen Wert zusätzlich auf.

  • Übernehmen: Der passende Artikel ist identifiziert, die Quelle nennt den Wert ausdrücklich.
  • Berechnen: Eingangswerte und Umrechnungsregel sind eindeutig dokumentiert.
  • Offen lassen: Der Wert beruht auf Ähnlichkeit, Vermutung oder unklarer Zuordnung.

Regel 3: Behandle Widersprüche als eigenen Fall

Zwei Quellen können unterschiedliche Werte nennen. Dann hilft es wenig, automatisch die ausführlichere Beschreibung zu bevorzugen. Prüfe zuerst, ob beide Dokumente dieselbe Ausführung und denselben Versionsstand betreffen.

Lege fest, welche Quelle für welches Attribut Vorrang hat. Eine aktuelle, ausdrücklich bestätigte Korrektur kann beispielsweise ein älteres Datenblatt ersetzen. Das Datum allein beweist jedoch keine fachliche Richtigkeit.

Bleibt der Konflikt bestehen, dokumentiere beide Angaben und benenne eine zuständige Person. Die Beschaffung einer Bestätigung wird damit zu einer konkreten Aufgabe. Der offene Fall verschwindet nicht zwischen zwei Importläufen.

Regel 4: Gib fehlenden Werten einen Status

Eine leere Zelle kann vieles bedeuten: unbekannt, nicht zutreffend oder noch ungeprüft. Unterscheide diese Zustände intern. Andernfalls recherchiert dein Team dieselbe Lücke mehrfach oder interpretiert sie beim Export falsch.

Schreibe solche Statusangaben nicht ungeprüft in numerische Shopfelder. Halte Wert und Prüfstatus getrennt. Definiere anschließend, welche fehlenden Attribute eine Veröffentlichung blockieren und wer Ausnahmen entscheiden darf.

Prüfe vor allem, wie dein Zielsystem leere Werte verarbeitet. Ein leerer Importwert könnte eine vorhandene Angabe löschen oder unverändert lassen. Teste diesen Fall ausdrücklich, bevor du bestehende Artikel aktualisierst.

Fazit: Miss belegte Qualität

Dein wichtigster Takeaway: Lege für jedes relevante Attribut fest, was als ausreichender Beleg gilt. Bewerte anschließend belegte Ergänzungen und ungelöste Fälle getrennt. So wird Datenqualität messbar, ohne vollständige Tabellen mit korrekten Daten gleichzusetzen.

Häufige Fragen

Darf KI eine fehlende Maßangabe aus einem Produktfoto schätzen?

Für ein verbindliches Maßfeld solltest du solche Schätzungen nicht übernehmen. Perspektive und fehlende Referenzmaße machen Fotos dafür ungeeignet. Suche ein passendes Datenblatt oder frage den Lieferanten.

Was passiert, wenn ein Pflichtfeld unbelegt bleibt?

Kennzeichne den Datensatz intern als klärungsbedürftig und leite ihn an die zuständige Person. Prüfe die Freigaberegeln des Zielkanals. Ersetze den fehlenden Wert nicht automatisch durch null oder einen geratenen Standardwert.

Wie behandle ich widersprüchliche Herstellerangaben?

Vergleiche Modell, Ausführung, Dokumentversion und Gültigkeitsdatum. Lässt sich der Widerspruch damit nicht auflösen, bleibt der Wert offen. Dokumentiere beide Quellen und lasse den Lieferanten die Angabe bestätigen.

Muss mein Team jeden ergänzten Wert einzeln prüfen?

Der Prüfumfang hängt vom Attribut und der Quellenlage ab. Für eindeutige Übernahmen kannst du feste Prüfregeln definieren. Widersprüche und folgenreiche Angaben gehören gezielt in eine fachliche Prüfung.

Welche Felder darf deine KI ergänzen?

Bring einen unvollständigen Lieferantendatensatz zur Demo mit. Wir besprechen, welche Quellen und Attributregeln für deine Datenaufbereitung sinnvoll sind.

Weitergelesen: Produktvarianten zuordnen: Kleine Modellzusätze, große Fehler · Produktdaten-Onboarding automatisieren mit 2txt

Zurück zum Blog