Automation & AI

Produktdatenpflege automatisieren

Zwischen Quelle und Shop gehört ein Regelwerk — Zuordnung, Pflichtfelder, Plausibilitätsgrenzen. Ohne diese Schicht automatisiert man nicht die Pflege, sondern die Fehler.

Pixup MediaVeröffentlicht am 8 Min. Lesezeit
Datenflussgrafik: Lieferantendaten, PIM und Redaktion laufen über ein Regelwerk mit Plausibilitätsgrenzen nach Shopware.
Das Regelwerk in der Mitte ist der Teil, den man nicht überspringen kann.

Produktdatenpflege ist die Arbeit, die niemand sieht und die am meisten Zeit frisst. Automatisieren lässt sie sich — aber nicht, indem man eine Datei an den Shop schickt. Zwischen Quelle und Ziel fehlt sonst genau die Schicht, die verhindert, dass aus schlechten Daten schnell schlechte Daten werden.

Die drei Quellen

Lieferantendaten. Tabellen in wechselndem Format, mit unterschiedlichen Spaltennamen, mal mit Zeilenumbrüchen in Beschreibungen, mal mit Komma als Dezimaltrennzeichen. Die unzuverlässigste Quelle, meist die größte.

PIM. Strukturiert, gepflegt, verlässlich. Wer eines hat, hat das Problem weitgehend gelöst — dann geht es nur noch um die Übertragung.

Eigene Redaktion. Texte, Bilder, Kategorien. Klein an Menge, groß an Bedeutung, und die einzige Quelle, die durch einen Import überschrieben werden kann, ohne dass es auffällt.

Die Regelschicht dazwischen

Hier entscheidet sich, ob die Automatisierung trägt. Drei Bestandteile:

Feldzuordnung

Welche Spalte der Quelle wird welches Feld im Shop? Klingt banal und ist der Ort, an dem sich Fehler festsetzen — besonders bei Einheiten, Maßangaben und Preisen mit oder ohne Steuer.

Pflichtangaben

Was muss vorhanden sein, damit eine Zeile überhaupt verarbeitet wird? Produktnummer, Preis, Steuersatz. Eine Zeile ohne diese Angaben gehört abgewiesen und protokolliert, nicht halb importiert.

Plausibilitätsgrenzen

Der Teil, den fast alle weglassen und alle einmal schmerzhaft nachrüsten:

PrüfungBeispielgrenze
Preisabweichungmehr als Faktor 3 nach oben oder unten → Prüfliste
Bestandssprungvon 0 auf mehr als 1.000 → Prüfliste
TextlängeBeschreibung unter 50 Zeichen → Warnung
Bildanzahlvon mehreren auf null → Prüfliste

Eine Grenze, die einmal im Quartal anschlägt, hat sich bereits gelohnt. Der Fall, den sie verhindert, ist der Artikel, der über Nacht für 4,99 statt 499,00 Euro im Shop steht.

Der Fallstrick bei Varianten

Das ist der häufigste Importfehler in Shopware, und er ist nicht offensichtlich:

Ein leeres Feld in der Importzeile löscht den Wert nicht — es stellt die Vererbung vom Hauptprodukt wieder her.

Wir haben das an der Nullbarkeit der product-Spalten nachgemessen: 71 von 79 Spalten dürfen leer sein, und leer bedeutet in diesem Datenmodell „nimm den Wert des Elternteils". Die Details stehen in Was eine Variante von ihrem Hauptprodukt erbt.

Für den Import heißt das: Wer Variantenwerte behalten will, muss sie in jeder Zeile mitliefern. Ein Profil, das nur geänderte Spalten überträgt, hebt die Vererbung genau dort auf, wo sie gewollt war — oder stellt sie wieder her, wo sie nicht gewollt war.

Import oder API?

ImportSync-API
ArbeitsweiseDatei und Profilgezielte Schreibzugriffe
gut fürvollständige Listen, Erstbefüllunglaufende Änderungen aus einem führenden System
FehlerbildZeile scheitert, Protokoll zeigt esAnfrage scheitert, Antwort zeigt es
Tempogut bei großen Mengengut bei vielen kleinen Änderungen

Die Grundlagen zu Profilen und Feldern haben wir in Import und Export in Shopware zusammengestellt.

Ein Hinweis zu 6.7: Manche Felder nehmen keine Schreibzugriffe mehr an. Wer automatisiert pflegt, sollte vorher prüfen, ob eines davon im Profil steht — sonst meldet der Lauf Erfolg und ändert nichts.

Die Reihenfolge beim Aufbau

  1. Eine Quelle auswählen — die mit der meisten Handarbeit, nicht die mit der besten Datenqualität.
  2. Zuordnung schriftlich festhalten. Eine Tabelle Quelle → Ziel, von jemandem gegengelesen, der die Daten kennt.
  3. Pflichtangaben und Grenzen festlegen. Vor dem ersten Lauf.
  4. Gegen eine Testinstallation laufen lassen. Mit echten Daten, nicht mit Beispielzeilen.
  5. Das Ergebnis stichprobenartig gegenlesen. Zehn Produkte reichen, um die häufigsten Zuordnungsfehler zu finden.
  6. Erst dann scharf schalten — und den ersten produktiven Lauf begleiten.

Schritt 4 wird am häufigsten übersprungen und ist der billigste von allen. Welche Ereignisse den Lauf anstoßen können, steht in Flow Builder: Auslöser, Aktionen, Grenzen; was ohne laufenden Worker liegen bleibt, in Was Shopware im Hintergrund erledigt.

Was automatisierte Pflege nicht löst

Sie macht schlechte Quelldaten nicht besser. Wenn die Lieferantenliste keine Kategorien enthält, hat der Shop danach keine Kategorien — nur schneller. Datenqualität entsteht an der Quelle oder in der Redaktion, nicht in der Übertragung.

Häufige Fragen

Import oder API für Produktdaten?
Der Import arbeitet mit Dateien und Profilen und eignet sich für vollständige Listen. Die API schreibt gezielt einzelne Felder und eignet sich für laufende Änderungen aus einem führenden System.
Was ist der häufigste Fehler beim Produktimport?
Leere Felder bei Varianten. Sie löschen den Wert nicht, sondern stellen die Vererbung vom Hauptprodukt wieder her — der alte Wert erscheint also wieder.
Wie verhindere ich falsche Preise durch Automatisierung?
Mit einer Plausibilitätsgrenze vor dem Schreiben: Abweichungen über einem festgelegten Faktor gehen nicht live, sondern in eine Prüfliste. Das kostet einen Arbeitsschritt und verhindert den teuersten Fehler.
Brauche ich ein PIM?
Nicht zwingend. Ein PIM lohnt sich, wenn mehrere Kanäle dieselben Daten brauchen oder mehrere Personen pflegen. Bei einem Shop und einer Redaktion genügt oft ein sauberes Importprofil.
WeiterführendApp- und Plugin-Entwicklung