Produktdaten für KI lesbar machen
Vier Schichten, in dieser Reihenfolge: Der Crawler muss rein, die Daten müssen strukturiert sein, sie müssen stimmen, und erst dann lohnt ein Feed. Wer unten anfängt, verbessert nichts.

Die Frage „wie kommen unsere Produkte in KI-Antworten" wird meistens mit Schicht vier beantwortet: mit einem Feed. Das ist so, als würde man ein Dach decken, bevor die Wände stehen. Die Reihenfolge ist umgekehrt, und sie ist nicht verhandelbar.
Schicht 1: Kommt der Crawler überhaupt rein?
Bevor irgendetwas anderes zählt, muss die Seite abrufbar sein — für den jeweiligen Crawler, unter seiner Kennung.
Das ist keine Formsache. Wir haben einen Fall dokumentiert, in dem ein Hoster
einen KI-Crawler serverseitig abgewiesen hat: Die Anfrage kam nie bei der
Anwendung an, die robots.txt erlaubte den Zugriff ausdrücklich, und im
Shop-Backend war nichts davon sichtbar. Die ganze Geschichte steht in
Wenn der Hoster den KI-Crawler blockt.
Der Prüfweg ist einfach und wird trotzdem übersprungen: Rufen Sie eine Produktseite mit der Kennung des jeweiligen Crawlers ab und sehen Sie sich den Statuscode an. Eine leere Antwort oder ein Fehler an dieser Stelle macht alles Weitere gegenstandslos.
Welche Crawler es überhaupt gibt und welche Sie zulassen sollten, haben wir in Welche KI-Crawler Ihren Shop besuchen dürfen aufgeschlüsselt — inklusive der Unterscheidung zwischen Suche und Training, die für die Entscheidung wichtiger ist als die Namen.
Schicht 2: Sind die Daten strukturiert?
KI-Systeme lesen Fließtext, aber sie verlassen sich auf strukturierte Angaben. Für Produkte heißt das Product-Schema mit:
- Name und Beschreibung
- Bild in ausreichender Größe
- Marke — häufig leer, obwohl gepflegt
- Kennnummer: GTIN, MPN oder SKU
- Preis mit Währung
- Verfügbarkeit
Shopware liefert das über das Standard-Template weitgehend mit. Die Lücken entstehen an den Rändern: bei Varianten, bei Staffelpreisen, bei Produkten ohne Marke, bei Preisen mit Rabattlogik.
Schicht 3: Stimmen die Daten?
Das ist die Schicht, die am meisten Schaden anrichtet, wenn sie fehlt. Ein Preis im Markup, der nicht dem Preis auf der Seite entspricht, ist schlechter als gar kein Markup: Er erzeugt eine Aussage, die nachweislich falsch ist.
Typische Quellen für Abweichungen:
| Ursache | Wirkung |
|---|---|
| Kundengruppenpreise | Markup zeigt den Grundpreis, die Seite einen anderen |
| Staffelpreise | Markup zeigt den Einzelpreis, beworben wird die Staffel |
| Verfügbarkeit aus dem Cache | Markup sagt lieferbar, der Shop sagt ausverkauft |
| Varianten | Markup des Hauptprodukts, Seite zeigt eine Variante |
Prüfen lässt sich das nur mit einem Abruf der echten Seite und einem Vergleich zwischen sichtbarem Inhalt und Markup — nicht im Backend.
Schicht 4: Der Feed
Erst wenn die drei Schichten darunter stehen, lohnt ein Feed. Er ist der direkteste Weg: Statt dass eine Plattform die Seite liest, bekommt sie die Daten strukturiert geliefert.
Aus der Praxis, mit einem Händlerkonto, das wir betreuen: Feeds scheitern still. Der Upload läuft durch, die Plattform meldet Erfolg, und einzelne Produkte fehlen trotzdem — weil ein Feld leer war, weil ein Bild zu groß war, weil ein Zeichen im Titel nicht akzeptiert wurde. Die Rückmeldung darüber ist je nach Plattform dürftig bis nicht vorhanden.
Daraus folgt eine Arbeitsregel: Nach jedem Feed-Lauf gegenprüfen, wie viele Produkte tatsächlich angekommen sind. Die Zahl im eigenen Export und die Zahl auf der Plattform müssen übereinstimmen. Tun sie es nicht, ist die Differenz die eigentliche Aufgabe.
Shopware selbst bringt für diesen Bereich inzwischen einen eigenen Verkaufskanal mit — was der leistet, steht in Der Agentic-Commerce-Verkaufskanal in Shopware 6.7.
Die Reihenfolge, noch einmal
- Zugang prüfen — mit echtem Abruf unter der Crawler-Kennung
- Struktur prüfen — Product-Schema vollständig und fehlerfrei
- Übereinstimmung prüfen — Markup gegen sichtbare Seite
- Feed aufsetzen — und die Ankunft zählen
Wer bei 4 anfängt, hat am Ende einen Feed, dessen Daten aus Seiten stammen, die niemand lesen darf, und deren Preise nicht stimmen. Das ist kein theoretischer Fall — es ist die Reihenfolge, in der die meisten Projekte anfangen.
Grenzen
Dieser Artikel beschreibt ein Vorgehen, keine Messung einzelner Plattformen. Welche KI-Plattform welche Felder wie gewichtet, ist von außen nicht beobachtbar und ändert sich schnell. Was sich beobachten lässt: ob der Crawler durchkommt, ob das Markup vollständig ist, ob die Angaben übereinstimmen und wie viele Produkte am Ziel ankommen. Diese vier Dinge sind überprüfbar — alles andere ist Vermutung.
Häufige Fragen
- Was brauchen KI-Systeme, um Produkte zu verstehen?
- Zugang zur Seite, strukturierte Daten mit Preis, Verfügbarkeit, Marke und Kennnummer, und dass diese Angaben mit der sichtbaren Seite übereinstimmen. Erst danach lohnen sich Feeds.
- Reicht die robots.txt, um Crawler zuzulassen?
- Nein. Wir haben dokumentiert, dass ein Hoster KI-Crawler serverseitig abweisen kann, während die robots.txt sie erlaubt. Der einzige Nachweis ist ein Abruf mit der Kennung des Crawlers.
- Welche Felder gehören ins Product-Schema?
- Name, Beschreibung, Bild, Marke, eine Kennnummer wie GTIN oder MPN, Preis mit Währung und Verfügbarkeit. Alles davon muss mit der Seite übereinstimmen.
- Sind Produktfeeds für KI-Plattformen dasselbe wie Google-Shopping-Feeds?
- Im Format ähnlich, in den Anforderungen nicht. Einzelne Plattformen sind wählerisch bei Bildgrößen, Zeichensätzen und leeren Feldern — und sie melden aussortierte Produkte nicht immer zurück.
