Kurze Antwort: Keine der sechs großen Website-Plattformen für kleine Unternehmen — Shopify, Wix, Squarespace, WordPress (.com und selbst gehostet), Webflow, GoDaddy Website Builder — blockiert ab Werk auch nur einen einzigen KI-Crawler. Wir haben das auf zwei Wegen verifiziert: durch Lektüre der offiziellen Dokumentation jeder Plattform und durch Prüfung der robots.txt von 45 echten Websites auf vier der Plattformen (null blockierten GPTBot). Die Unterschiede, die wirklich zählen, liegen woanders: Zwei Plattformen erzeugen inzwischen ungefragt eine llms.txt für Sie (Shopify und Wix), die „KI blockieren“-Schalter von Squarespace und WordPress.com nehmen still die Crawler aus, die die KI-Suche antreiben (das Umlegen entfernt Sie also nicht aus den Antworten von ChatGPT oder Perplexity), Webflow lässt Sie die robots.txt ohne Bezahltarif gar nicht bearbeiten, und GoDaddy dokumentiert überhaupt keine KI-Kontrollen. Dies ist eine Forschungssynthese mit leichter Verifikation, kein Labortest — jede Aussage unten zitiert eine Primärquelle mit Abrufdatum, und wo die Evidenz von Praktikern statt offiziell stammt, sagen wir es. Soweit wir feststellen können, hat niemand einen kontrollierten Direktvergleich der Plattformen veröffentlicht; diese Lücke benennen wir am Ende ehrlich.
Zu Ihrer Plattform springen: Shopify · WordPress · Wix · Squarespace · Webflow · GoDaddy
Zuerst der Befund, der die Frage neu stellt
Die Schauergeschichte — „Ihre Plattform blockiert die KI heimlich“ — ist nicht das, was die Daten zeigen. Großangelegte Messungen verorten KI-Crawler-Blockaden bei den großen Publishern: Eine UC-San-Diego-Studie auf der Internet Measurement Conference 2025 misst, dass 12–14 % der 5.000 größten Websites mindestens einen KI-Crawler vollständig aussperren (Liu et al., IMC 2025), und die Blockadewelle konzentriert sich im Verlagswesen — das Reuters Institute zählte Ende 2023 48 % der großen Nachrichtenseiten mit OpenAI-Blockaden (Fletcher, 2024). Websites kleiner Unternehmen verhalten sich anders: Unser eigenes Audit von 107 Websites fand nur 2,8 % mit Blockade eines großen KI-Crawlers.
Die Plattform-Ebene passt dazu. Alle sechs Plattformen liefern laut eigener Dokumentation permissive robots.txt-Dateien — und unsere Stichprobe von 45 echten Plattform-Websites fand null, die GPTBot blockieren.
Das dokumentierte technische Risiko für KI-Sichtbarkeit ist ein anderes: das Rendering. Vercel und MERJ haben gemessen, wie sich KI-Crawler tatsächlich verhalten: Keiner der großen führt JavaScript aus — die Crawler von OpenAI, Anthropic, Meta und Perplexity laden JS-Dateien herunter, ohne sie je auszuführen; Googles Gemini (auf Googlebot-Infrastruktur) ist die wichtigste Ausnahme (Vercel, Dez. 2024). Eine Website, deren Inhalt erst nach JavaScript-Ausführung existiert, ist für die meisten KI-Systeme unsichtbar.
Die Wendung für Plattform-Nutzer: Dieses Risiko verschont Sie weitgehend. Wix erklärt ausdrücklich, seine Infrastruktur sei serverseitig gerendert (Wix-SEO-Funktionen); Webflow veröffentlicht kompiliertes statisches HTML (praktiker-dokumentiert — Webflows eigene Docs benennen das Rendering-Modell nicht); Squarespace liefert Kerninhalte serverseitig (Praktiker-Beobachtung, gleicher Vorbehalt); und die GoDaddy-Websites, die wir abgerufen haben, tragen ihren vollen Text im rohen HTML. Das JavaScript-Unsichtbarkeitsproblem konzentriert sich auf individuell gebaute Websites, nicht auf Plattform-Websites. Wer auf einer großen Plattform ist, hat mit hoher Sicherheit Inhalts- und Klarheitsprobleme, keine Leitungsprobleme.
Der Vergleich auf einen Blick
| Plattform | KI-Bots ab Werk blockiert | „KI blockieren“-Einstellung | llms.txt | robots.txt bearbeitbar |
|---|---|---|---|---|
| Shopify | Keine | Kein Schalter — nur Theme-Template-Bearbeitung | Auto-generiert (seit Mai 2026) | Über robots.txt.liquid (nicht unterstützte Anpassung) |
| WordPress.com | Keine | Opt-out-Schalter, ab Werk aus — blockiert OAI-SearchBot nicht | Nein | Nein (plattformverwaltet) |
| WordPress selbst gehostet | Keine | Nichts im Core; SEO-Plugins bieten manuelle Werkzeuge | Über Plugins (AIOSEO: ab Werk an; Yoast/Rank Math: Opt-in) | Ja |
| Wix | Keine | Kein Schalter — manuelle robots.txt-Bearbeitung | Auto-generiert (Premium + eigene Domain) | Ja |
| Squarespace | Keine | Checkbox, ab Werk aus — blockiert weder PerplexityBot noch OAI-SearchBot noch ChatGPT-User | Manuell, ab Werk deaktiviert | Nein (plattformverwaltet) |
| Webflow | Keine | Kein Schalter — und robots.txt-Bearbeitung erfordert einen Bezahltarif | Manueller Upload, nur eigene Domains | Nur Bezahltarife |
| GoDaddy Website Builder | Keine (beobachtet) | Keine dokumentiert | Keine dokumentiert | Nicht dokumentiert |
Die Quellen jeder Zelle sind in den Abschnitten unten verlinkt. Abgerufen am 18.08.2026; Plattformen ändern Defaults still — siehe Aktualisierungsregel am Ende.
Der Schalter-Befund: Trainings-Opt-outs im Gewand von Sichtbarkeits-Opt-outs
Zwei Plattformen bieten eine „KI blockieren“-Checkbox. Beide Listen haben dasselbe Loch, und es ist das folgenreichste Detail dieses Berichts.
Squarespaces Einstellung „Block known artificial intelligence crawlers“ (ab Werk aus) schreibt robots.txt-Regeln für 26 Bots — GPTBot, ClaudeBot, Google-Extended, CCBot, Bytespider und mehr. Nicht auf der Liste: PerplexityBot, OAI-SearchBot und ChatGPT-User (Squarespace-Hilfe, abgerufen 18.08.2026).
WordPress.coms Einstellung „Prevent third-party sharing“ (ebenfalls ab Werk aus) ergänzt Blockaden für dreizehn Bots, darunter GPTBot, ClaudeBot und PerplexityBot — aber nicht OAI-SearchBot (WordPress.com-Support, bestätigt an der echten robots.txt einer Website mit aktivierter Option).
Warum das zählt: OpenAI und Perplexity trennen ihre Crawler nach Zweck — GPTBot sammelt Trainingsdaten, während OAI-SearchBot und ChatGPT-User die Live-Suche und Zitate antreiben. (Die meisten Plattform-Guides übersehen diese Unterscheidung komplett.) Wer einen der Schalter umlegt, hat sich also vom Modell-Training abgemeldet — erscheint aber weiterhin in ChatGPT-Suchergebnissen und Perplexity-Antworten. Wenn Sie den Schalter umgelegt haben, um sichtbar zu bleiben und zugleich die Trainingsnutzung zu begrenzen, ist das wohl genau, was Sie wollten — aber nichts in der Oberfläche sagt Ihnen, dass Sie genau diesen Deal bekommen.
llms.txt wurde zur Plattform-Entscheidung, ohne dass es jemand bemerkte
In unserer Studie mit 107 Websites hatten 25,2 % der KMU-Websites eine llms.txt — und fast kein Inhaber hatte sie dort abgelegt. Die Plattform-Docs bestätigen inzwischen den Mechanismus:
- Shopify liefert
/llms.txt(Spiegel einer primären/agents.md) auf jedem Shop, anpassbar per Theme-Templates (Shopify-Changelog, Mai 2026). - Wix „generiert und pflegt automatisch“ die llms.txt von Premium-Websites mit eigener Domain, mit Opt-out-Schalter (Wix-Hilfe). Unsere Stichprobe fand 6 von 7 echten Wix-Websites mit einer ~3-KB-llms.txt.
- All in One SEO, eines der größten WordPress-SEO-Plugins, generiert llms.txt nach Installation ab Werk (AIOSEO-Docs); Yoast und Rank Math bieten es als Opt-in.
- Squarespace (manuell, ab Werk deaktiviert) und Webflow (manueller Upload, dessen Doc das Format offen „experimentell“ nennt) überlassen es dem Inhaber. GoDaddy erwähnt es nicht.
Ob llms.txt etwas bringt, ist eine andere Frage — kein großes KI-Unternehmen hat zugesagt, die Datei zu lesen — aber Adoptionsstatistiken messen inzwischen Produktentscheidungen von Plattformen, nicht Inhaber-Verhalten. Jede Studie (unsere eingeschlossen), die llms.txt-Dateien zählt, zählt zum Teil Marktanteile von Shopify und Wix.
Shopify
Alles ab Werk erlaubt, Bot-Management auf Shopifys Netzwerkebene — die Docs sagen, Shops seien für „Suchmaschinen und große Sprachmodelle“ ohne Zutun lesbar (Crawling-Doku). Es gibt keinen Admin-Schalter für KI-Crawler — Beiträge, die einen beschreiben, meinen das eigene Cloudflare-Konto des Händlers. Kontrolle heißt: ein Theme-Template bearbeiten (robots.txt.liquid), von Shopify als nicht unterstützte Anpassung bezeichnet. Der subtile Punkt: robots.txt bewacht nur eine von zwei Türen. Shopify Catalog syndiziert ab Werk geeignete Produktdaten an KI-Shopping-Oberflächen (ChatGPT, Microsoft Copilot), und Crawler-Blockaden stoppen das nicht — es hat eigene Opt-outs pro Plattform. Ein Praktiker-Fehlermodus, den ältere Shops prüfen sollten: ein 2023er „alle KI-Bots blockieren“-Schnipsel, in robots.txt.liquid kopiert und vergessen.
WordPress
Der WordPress-Core liefert eine zweizeilige robots.txt, die nur den Admin-Bereich sperrt (Entwicklerreferenz), und keines der drei großen SEO-Plugins (Yoast, AIOSEO, Rank Math) blockiert ab Werk einen KI-Bot. WordPress.com ergänzt den oben beschriebenen Opt-out-Schalter — ab Werk aus, und aktiviert durchlässig für OpenAIs Such-Crawler. Selbst-Hoster haben volle Kontrolle und volle Verantwortung: Der 2023er Blockier-Schnipsel kursiert breit in WordPress-Tutorials (die kanonische Version stammt vom August 2023), und eine kopierte, dann vergessene robots.txt ist heute der wahrscheinlichste Weg, wie ein kleines Unternehmen aus Versehen unsichtbar wird.
Wix
Ab Werk permissiv mit echtem robots.txt-Editor, kein KI-Schalter (Blockieren ist eine dokumentierte manuelle Bearbeitung), serverseitiges Rendering laut Plattform — und die oben beschriebene auto-generierte llms.txt. Von den sechs liefert Wix derzeit ungefragt die meiste KI-Sichtbarkeits-Infrastruktur.
Squarespace
Eine plattformverwaltete robots.txt ohne Direktbearbeitung, mit der ab Werk deaktivierten Checkbox — und einem Detail, das unsere Prüfung echter Dateien zutage brachte: Squarespaces generierte robots.txt nennt die KI-Bot-Liste auf jeder geprüften Website ausdrücklich (15/15), mit pfadbezogenen Regeln, die Inhalte nicht sperren. Das Gerüst ist vorgebaut; die Checkbox legt nur den Hebel um. Behalten Sie im Kopf, was die Checkbox nicht abdeckt (Perplexity, OpenAI-Suche), bevor Sie sie als Aus-Schalter behandeln.
Webflow
Die Default-robots.txt enthält nur eine Sitemap-Zeile — nichts blockiert. Der Haken ist der Zugang: robots.txt-Regeln hinzuzufügen erfordert einen bezahlten Site-Tarif — Webflow ist damit die einzige Plattform hier, bei der Blockieren ein Premium-Feature ist. Webflow dokumentiert außerdem einen Content-Signal-HTTP-Header für granulare KI-Präferenzen (Training/Suche/Eingabe) — neu, und seine reale Wirkung hängt vollständig von der Kooperation der Crawler ab.
GoDaddy Website Builder
Die am wenigsten dokumentierte Oberfläche der sechs: keine robots.txt-Doku, keine KI-Einstellung, keine llms.txt für Websites-+-Marketing-Sites (der SEO-Hilfeartikel erwähnt nichts davon). Echte Websites, die wir abgerufen haben, liefern eine fast leere robots.txt und serverseitig gerendertes HTML — ordentliche Defaults, null Kontrolle. Beobachtungspunkt: GoDaddy kündigte eine Cloudflare-Partnerschaft an (April 2026), um AI Crawl Control in seine Hosting-Plattform zu integrieren; ob und mit welchen Defaults das den Website Builder erreicht, ist offen.
Was wir selbst geprüft haben — und die Lücke, die wir benennen
Die Dokumentations-Aussagen oben wurden an der Realität geprüft: Wir haben robots.txt und llms.txt (nur öffentliche Dateien, ehrlicher User-Agent, gedrosselte Abrufe, aggregierte Auswertung) von 45 echten Websites abgerufen, identifiziert als Shopify (8), WordPress (15), Wix (7) und Squarespace (15). Ergebnisse: null Websites blockieren GPTBot; jede Squarespace-robots.txt nennt die KI-Bot-Liste; llms.txt bei 8/8 Shopify- und 6/7 Wix-Websites gegenüber 1/15 WordPress und 0/15 Squarespace — der Plattform-Entscheidungs-Befund, sichtbar im Feld. (Die Webflow- und GoDaddy-Verifikation wartet auf eine ausreichende Stichprobe; ihre Abschnitte stützen sich auf Dokumentation und Beobachtung mit kleinem n.)
Was niemand veröffentlicht hat — wir eingeschlossen — ist ein kontrollierter Direktvergleich: dasselbe Unternehmen, derselbe Inhalt, auf jeder Plattform gebaut, identisch auditiert. Alles oben ist Synthese von Dokumentation plus Beobachtung von Websites, die sich in tausend Dingen außer ihrer Plattform unterscheiden. Wir haben nach einer solchen Studie gesucht und keine gefunden; existiert sie, verlinken wir sie hier. Existiert sie weiterhin nicht, steht ihre Durchführung auf unserer Roadmap.
Eine letzte Ehrlichkeitsnotiz, entliehen bei einem Praktiker, der seine eigenen KI-Crawler-Befunde sechs Monate später erneut testete: 11 von 17 hatten sich geändert. Dieses Feld verdirbt schnell. Allein Cloudflare änderte die KI-Crawler-Defaults für neue Domains im Juli 2025 und erneut zum September 2026. Jede Aussage dieses Berichts trägt ihr Abrufdatum (18.08.2026), und wir prüfen quartalsweise nach — die Änderungen werden ihr eigener Bericht.
Was Sie konkret tun sollten, egal auf welcher Plattform
Die Defaults Ihrer Plattform sind mit an Sicherheit grenzender Wahrscheinlichkeit nicht Ihr Problem — was bedeutet: Die Korrekturen gehören Ihnen, nicht der Plattform. Prüfen Sie die drei Dinge, die in unseren Audit-Daten sichtbare von unsichtbaren Websites trennten: Sagt Ihre Startseite klar, was Sie tun und wo? Haben Sie strukturierte Daten? Und liegt ein alter Blockier-Schnipsel in Ihrer robots.txt? Oder lassen Sie das kostenlose SeeGeo-Audit alles prüfen — einschließlich Ihrer echten, live ausgelieferten robots.txt, wie die Crawler sie sehen — in etwa 30 Sekunden.
Häufige Fragen
Blockiert Shopify ChatGPT oder andere KI-Crawler? Nein. Shopifys Default-robots.txt blockiert keine KI-Crawler, und Shopify erklärt Shops ohne Händler-Zutun für LLMs lesbar. Einen Admin-Schalter gibt es ohnehin nicht — Blockieren erfordert die Bearbeitung eines Theme-Templates. Separat: Shopify Catalog teilt geeignete Produktdaten ab Werk mit KI-Shopping-Oberflächen, geregelt über eigene Opt-outs, nicht über robots.txt.
Verschwinde ich aus ChatGPT, wenn ich den „KI blockieren“-Schalter von Squarespace oder WordPress.com aktiviere? Überwiegend nein. Beide Schalter blockieren Trainings-Crawler (GPTBot, ClaudeBot, CCBot und weitere), lassen aber die Crawler aus, die die Live-KI-Suche antreiben — OAI-SearchBot und ChatGPT-User auf beiden Plattformen, dazu PerplexityBot auf Squarespace. Ihre Inhalte können mit aktiviertem Schalter weiterhin abgerufen und in KI-Antworten zitiert werden.
Welcher Website-Baukasten ist der beste für KI-Sichtbarkeit? Nach Defaults allein blockiert keiner die KI; „am besten“ entscheidet sich daran, was für Sie gebaut oder vor Ihnen verschlossen ist: Wix und Shopify generieren llms.txt automatisch und liefern crawler-lesbares HTML; Webflow und Squarespace sind solide, lassen KI-Dateien aber manuell (und Webflow verlangt für robots.txt-Kontrolle Geld); GoDaddy bietet keine dokumentierten KI-Kontrollen. Keine Plattformwahl ersetzt klare Inhalte — dort scheitern KMU-Websites wirklich.
Brauche ich eine llms.txt-Datei? Sie ist eine günstige Versicherung, kein Ranking-Hebel — kein großes KI-Unternehmen hat zugesagt, sie zu lesen. Wenn Ihre Plattform eine generiert (Shopify, Wix oder WordPress mit AIOSEO), prüfen Sie deren Inhalt, statt eine hinzuzufügen. Der interessante Fakt: Adoptionsstatistiken messen inzwischen vor allem Plattform-Defaults, nicht Inhaber-Absicht.
Wie aktuell ist dieser Bericht? Alle Quellen und Datei-Prüfungen datieren vom 18.08.2026, jede Aussage verlinkt ihre Quelle. Plattformen ändern Defaults still — wir verifizieren quartalsweise neu und veröffentlichen, was sich geändert hat.