Lesezeit: 8 Min · getestet auf Shopware 6.7.x
Kurz erklärt: Shopware 6 bringt für technisches SEO bereits viel mit: SEO-URL-Templates, Sitemap-Generierung, Canonical-Handling und automatische hreflang-Ausgaben. Der entscheidende Praxispunkt 2026: Neben Google & Co. solltest du auch KI-/LLM-Crawler bewusst steuern. Wer in ChatGPT, Perplexity, Claude, Gemini oder Apple-Kontexten sichtbar bleiben will, sollte seine robots.txt nicht nur klassisch für SEO, sondern auch für GEO – Generative Engine Optimization – sauber konfigurieren.
Auf einen Blick
| SEO-URLs | Einstellungen → Shop → SEO; Twig-Templates pro Entität und Verkaufskanal |
| Sitemap | Einstellungen → Shop → Sitemap; live, geplant oder manuell |
| robots.txt | je nach Shopware-Version/Setup über Admin, Datei oder Plugin; immer hostbezogen unter /robots.txt |
| KI/GEO | LLM-Crawler explizit erlauben oder sperren; Regeln regelmäßig prüfen |
| hreflang | automatisch, wenn Sprach-Domains/Verkaufskanäle korrekt konfiguriert sind |
| Getestet auf | Shopware 6.7.x |
SEO-URL-Templates in Shopware 6
Pfad: Einstellungen → Shop → SEO. Dort definierst du pro Entität – zum Beispiel Produkt, Kategorie oder Landingpage – ein Twig-Template. Das kann global oder verkaufskanalspezifisch erfolgen.
Ein bewährtes Produkt-Template ist:
{{ product.translated.name }}/{{ product.productNumber }}
Damit entsteht eine sprechende URL mit Produktname und eindeutiger Artikelnummer. Das reduziert Dubletten, erleichtert spätere Migrationen und macht Produkt-URLs stabiler. Ein grün/rotes Icon zeigt im Admin, ob die verwendeten Variablen valide sind. Nach Änderungen solltest du den SEO-Index neu aufbauen:
php bin/console dal:refresh:index
Alternativ kannst du Caches und Indizes im Admin neu aufbauen.

Beim Ändern bestehender SEO-URLs hilft der Schalter 301-Weiterleitung. Alte URLs leiten dann automatisch auf die neue kanonische URL. Das ist besonders wichtig bei Relaunches, Kategorie-Umbauten und Migrationen von Shopware 5 auf Shopware 6. Mehr dazu im Eintrag SEO-URLs bei der Migration richtig übernehmen.
Sitemap: sauberer Index statt Prioritäten-Spielerei
Pfad: Einstellungen → Shop → Sitemap. Shopware erzeugt eine XML-Sitemap beziehungsweise einen Sitemap-Index. Für größere Shops ist die geplante Generierung per Scheduled Task meist die sauberste Lösung, weil die Sitemap nicht erst beim Aufruf erzeugt werden muss.
In der Praxis zählen vor allem diese Punkte:
- Nur indexierbare 200er-URLs aufnehmen: keine Login-, Warenkorb-, Checkout-, Filter- oder leeren Seiten.
- Kanonische URLs verwenden: keine technischen Fallbacks, keine Session- oder Tracking-Parameter.
lastmodsinnvoll pflegen: nur aktualisieren, wenn sich relevanter Content geändert hat.priorityundchangefreqnicht überbewerten: Google ignoriert diese Werte; wichtiger ist eine saubere, aktuelle Sitemap.

robots.txt in Shopware 6: klassische SEO-Steuerung plus KI/GEO
Die robots.txt steuert, welche Bereiche eines Shops von kooperierenden Crawlern abgerufen werden dürfen. Wichtig: Sie ist keine Zugriffskontrolle. Sensible Inhalte gehören hinter Authentifizierung, nicht nur hinter eine robots.txt-Regel. Für SEO und GEO ist sie trotzdem zentral, weil sie Suchmaschinen- und KI-Crawlern klare Crawl-Signale gibt.
Shopware dokumentiert eine robots.txt-Vorlage mit typischen Sperren für Query-URLs, Account, Checkout, Widgets, Navigation und Bundles. Für die Praxis empfehlen wir eine erweiterte Variante, die zwei Dinge berücksichtigt:
- Pfadmuster starten mit
/: Das ist crawler-robuster und entspricht der üblichen REP-/Google-Auslegung. - KI-Crawler bekommen eigene Regeln: Eine spezifische
User-agent-Gruppe erbt nicht automatisch die Regeln ausUser-agent: *. Wer KI-Bots nur mitAllow: /einträgt, öffnet ihnen im Zweifel auch Bereiche, die für Standard-Crawler gesperrt sind.
Praxis-Template: Shopware 6 robots.txt mit KI-/GEO-Freigabe
# ==========================================================
# robots.txt — Shopware 6 + KI/GEO
# ==========================================================
# ----- Standard-Crawler -----
User-agent: *
Allow: /
# Query-/Parameter-URLs
Disallow: /*?
# Shopware-Systembereiche ohne SEO-Wert
Disallow: /account/
Disallow: /*/account/
Disallow: /checkout/
Disallow: /*/checkout/
Disallow: /widgets/
Disallow: /*/widgets/
Disallow: /navigation/
Disallow: /*/navigation/
Disallow: /bundles/
Disallow: /*/bundles/
# Rechtliche Seiten, wenn sie nicht gecrawlt werden sollen
# Achtung: Für Deindexierung zusätzlich noindex verwenden.
Disallow: /impressum$
Disallow: /*/impressum$
Disallow: /datenschutz$
Disallow: /*/datenschutz$
Disallow: /agb$
Disallow: /*/agb$
Disallow: /widerruf$
Disallow: /*/widerruf$
# ----- KI / LLM-Crawler erlauben (GEO) -----
# Wichtig: Diese Gruppe erbt nicht die Regeln aus User-agent: *.
# Deshalb werden die Shopware-Sperren hier erneut gesetzt.
User-agent: GPTBot
User-agent: OAI-SearchBot
User-agent: ChatGPT-User
User-agent: ClaudeBot
User-agent: Claude-SearchBot
User-agent: Claude-User
User-agent: PerplexityBot
User-agent: Perplexity-User
User-agent: Google-Extended
User-agent: Applebot-Extended
User-agent: CCBot
Allow: /
Disallow: /*?
Disallow: /account/
Disallow: /*/account/
Disallow: /checkout/
Disallow: /*/checkout/
Disallow: /widgets/
Disallow: /*/widgets/
Disallow: /navigation/
Disallow: /*/navigation/
Disallow: /bundles/
Disallow: /*/bundles/
Disallow: /impressum$
Disallow: /*/impressum$
Disallow: /datenschutz$
Disallow: /*/datenschutz$
Disallow: /agb$
Disallow: /*/agb$
Disallow: /widerruf$
Disallow: /*/widerruf$
# ----- Sitemaps -----
Sitemap: https://deinshop.de/sitemap.xml
Sitemap: https://deinshop.de/en/sitemap.xml
Sitemap: https://deinshop.de/fr/sitemap.xml
Warum KI-Crawler überhaupt erlauben?
Klassisches SEO denkt primär an Googlebot, Bingbot und andere Suchmaschinen-Crawler. GEO geht einen Schritt weiter: Inhalte sollen auch von generativen Systemen gefunden, verstanden und zitiert werden können. Dafür müssen relevante Produkt-, Kategorie-, Ratgeber- und Wiki-Inhalte erreichbar sein.
Das heißt nicht, dass jeder Bot blind alles bekommen sollte. Sinnvoll ist eine kontrollierte Freigabe:
| OpenAI | GPTBot, OAI-SearchBot, ChatGPT-User |
Training, ChatGPT-Suche und nutzerinitiierte Abrufe getrennt steuerbar |
| Anthropic / Claude | ClaudeBot, Claude-SearchBot, Claude-User |
Training, Suche und nutzerinitiierte Abrufe getrennt betrachten |
| Perplexity | PerplexityBot, Perplexity-User |
Sichtbarkeit in Perplexity-Ergebnissen und nutzerinitiierte Abrufe |
Google-Extended |
Robots.txt-Steuer-Token für bestimmte Gemini-/Vertex-Nutzungen | |
| Apple | Applebot-Extended |
Steuert die Nutzung von Applebot-Daten für generative Apple-Modelle |
| Common Crawl | CCBot |
Offener Web-Crawl, häufig als Datengrundlage für Forschung und KI-Systeme relevant |
Wichtig: robots.txt blockiert Crawling, nicht Indexierung
Eine robots.txt-Regel verhindert – bei kooperierenden Crawlern – den Abruf einer URL. Sie ist aber kein verlässliches Mittel, um eine bereits bekannte URL aus dem Index zu entfernen. Für Deindexierung brauchst du in der Regel noindex per Meta-Robots oder X-Robots-Tag. Das gilt besonders für rechtliche Seiten, Filterseiten, interne Suchergebnisse und dünne Landingpages.
Shopware-Umsetzung
Je nach Shopware-Version und Hosting-Setup gibt es drei Wege:
- Admin-Konfiguration: Ab Shopware 6.7.1.0 können individuelle robots.txt-Regeln pro Domain im Admin gepflegt werden.
- Datei im Public-Verzeichnis: Klassisch liegt die Datei unter
/public/robots.txtund ist dann unterhttps://deinshop.de/robots.txterreichbar. - Plugin oder Server-Regel: Sinnvoll bei mehreren Domains, mehreren Sprachshops oder abweichenden Regeln pro Verkaufskanal.
Nach jeder Änderung solltest du die Datei direkt im Browser aufrufen und zusätzlich mit der Google Search Console oder einem robots.txt-Tester prüfen.
hreflang in Shopware 6
hreflang-Angaben erzeugt Shopware automatisch, wenn mehrere Sprach-Domains beziehungsweise Verkaufskanäle korrekt gepflegt sind und hreflang aktiviert ist. Wichtig ist, dass jede Sprachversion eine echte, indexierbare Zielseite hat. Eine deutsche Kategorie sollte also nicht auf eine englische 404, eine Weiterleitung oder einen technischen Fallback zeigen.
Bei internationalen Shops gehören diese Punkte in jeden SEO-Check:
- jede Sprachversion hat eine saubere SEO-URL,
- Canonical zeigt auf die jeweilige kanonische Sprach-URL,
- hreflang verweist auf echte 200er-Seiten,
- Sitemap enthält die richtigen Sprach-URLs,
- robots.txt blockiert keine relevanten Sprachpfade.
Aus der Praxis
- Jede Kategorie braucht einen SEO-Slug. Fehlt er, landet Shopware schnell im technischen
/navigation/<UUID>-Fallback. Dieser Bereich ist häufig per robots.txt gesperrt und hat in Suchmaschinen nichts verloren. - Nach SEO-URL-Änderungen den Index neu bauen. Sonst sind die neuen URLs nicht zuverlässig aktiv.
- Sitemap-Hygiene schlägt Sitemap-Prioritäten. Google ignoriert
priorityundchangefreq; entscheidend sind kanonische, erreichbare und relevante URLs. - robots.txt nicht als Datenschutz-Tool missverstehen. Account, Checkout und interne Bereiche gehören technisch geschützt.
- KI-Crawler differenziert betrachten. Ein Bot für Training ist nicht dasselbe wie ein Bot für Suche oder nutzerinitiierte Abrufe.
- Logfiles prüfen. Nur so siehst du, welche Bots wirklich kommen, wie oft sie kommen und ob sie unnötige Parameter-URLs abrufen.
Was sich seit Shopware 6.1/6.2 geändert hat
Die Grundlogik der SEO-URL-Templates ist seit Jahren stabil, die Variablen und Admin-Oberflächen wurden aber erweitert. Neuere Shopware-Versionen machen viele SEO-Aufgaben komfortabler, insbesondere bei SEO-Templates, Sitemap-Strategien und domainbezogenen Einstellungen.
Der größte praktische Unterschied liegt heute weniger in der Shopware-URL-Logik, sondern in der Crawler-Landschaft. Früher ging es fast ausschließlich um Googlebot und klassische Suchmaschinen. Heute musst du zusätzlich entscheiden, ob deine Inhalte in KI-Suchen, Antwortmaschinen und generativen Assistenten sichtbar sein sollen. Genau dafür gehört eine GEO-fähige robots.txt inzwischen in jedes technische SEO-Setup.
Häufige Fragen
Wie ändere ich das URL-Schema meiner Produkte?
Über Einstellungen → Shop → SEO. Dort passt du das SEO-URL-Template für Produktdetailseiten an. Danach den Index neu bauen.
Bringen Sitemap-Prioritäten etwas?
Für Google nein. Google ignoriert priority und changefreq. Wichtiger sind korrekte kanonische URLs, passende Statuscodes und ein verlässliches lastmod.
Wie steuere ich die robots.txt in Shopware 6?
Je nach Version über den Admin, über eine Datei im public-Verzeichnis oder über ein Plugin beziehungsweise Server-Regeln. Wichtig ist, dass die Datei unter /robots.txt erreichbar ist.
Sollte ich GPTBot, ClaudeBot und PerplexityBot erlauben?
Wenn Sichtbarkeit in generativen Such- und Antwortsystemen gewünscht ist: ja, aber kontrolliert. Relevante Content-Bereiche freigeben, technische Shopware-Bereiche weiter sperren.
Reicht User-agent: GPTBot mit Allow: /?
Nein, nicht sauber. Eine spezifische Bot-Gruppe erbt nicht automatisch die Sperren aus User-agent: *. Deshalb sollten die wichtigsten Disallow-Regeln auch in der KI-Gruppe stehen.
Kann ich rechtliche Seiten einfach per robots.txt sperren?
Nur wenn du Crawling reduzieren willst. Wenn eine Seite nicht indexiert werden soll, ist noindex das passendere Signal.
Verwandte Einträge
- Sitemap-Prioritäten in Shopware 6
- robots.txt in Shopware 6 steuern
- SEO-URLs bei der Shopware-Migration richtig übernehmen
- Tracking, GA4 & Consent Mode v2
Quellen
- Shopware Docs – SEO settings
- Shopware Docs – Sitemap
- Shopware Docs – Creation of a robots.txt
- RFC 9309 – Robots Exclusion Protocol
- Google Search Central – How Google interprets robots.txt
- Google Search Central – Build and submit a sitemap
- OpenAI Docs – Overview of OpenAI Crawlers
- Anthropic / Claude Help Center – Claude crawler controls
- Perplexity Docs – Perplexity Crawlers
- Google for Developers – Google-Extended
- Apple Support – About Applebot and Applebot-Extended
- Common Crawl – CCBot
Teil des Konfigurations-Kurses · erstellt von great2gether · aktualisiert für Shopware 6.7.x · Fokus: technisches SEO, Sitemap, robots.txt und KI/GEO.