Was eine KI auf 70.139 Firmenwebsites vorfindet
Eigene Erhebung über 70.139 Firmenwebsites in Deutschland. Fast alle lassen KI-Crawler herein, nur 27 Prozent hinterlegen ihre Firmenangaben maschinenlesbar.

Von Jordan Wichert, Product Owner von SpotLens
Veröffentlicht am 9 Min. Lesezeit
Das Wichtigste in Kürze
- Von 70.139 Firmenwebsites aus zwölf Branchen in Deutschland lassen 97 von 100 KI-Systeme auf ihre Seiten. Nur 2,8 Prozent schliessen sie ausdrücklich aus.
- 27 von 100 Websites hinterlegen ihre Firmenangaben so, dass ein Programm sie sicher lesen kann. Bei allen anderen muss ein KI-System raten, wer hier anbietet.
- Die Datei llms.txt, die KI-Systemen das Lesen erleichtern soll, haben 11 von 100 Websites, mit echtem Inhalt 1,7 Prozent. Dass KI-Anbieter sie lesen, ist nicht belegt.
- Gemessen vom 20. bis 22. September 2026, jede Website einzeln, ohne Klick. Rohdaten als CSV und JSON unter CC BY 4.0, keine Firma erkennbar.
Inhalt
Wenn jemand ChatGPT oder Perplexity fragt, welcher Malerbetrieb in seiner Nähe infrage kommt, holt sich das System einen Teil der Antwort von den Websites der Betriebe. Es ruft die Seite auf, liest, was dort steht, und baut daraus seine Antwort. Wir wollten wissen, was es dabei vorfindet. Dafür haben wir 70.139 Firmenwebsites aus zwölf Branchen in Deutschland mit unserer Audit-Software aufgerufen und ausgewertet, so ähnlich, wie ein KI-System es tut.1
Die erste Hürde nehmen fast alle. 97 von 100 Websites lassen KI-Systeme überhaupt auf ihre Seiten. Bei der zweiten Hürde wird es dünn. Ob ein Programm auf der Startseite sicher erkennt, wie die Firma heisst und was sie anbietet, hängt davon ab, ob diese Angaben in einer bestimmten Form hinterlegt sind. Das ist bei 27 von 100 Websites der Fall. Bei allen anderen muss das System raten, so wie ein Besucher, der die Seite zum ersten Mal sieht und sich aus Logo und Fusszeile zusammenreimt, mit wem er es zu tun hat.
Was das im Einzelnen heisst, steht in den nächsten drei Abschnitten. Am Ende findest du drei Dinge, die du an deiner eigenen Website in fünf Minuten selbst nachsehen kannst.
der Firmenwebsites in Deutschland sperren KI-Crawler wie GPTBot oder ClaudeBot per robots.txt komplett aus.
1.974 von 70.139 (2,8 %)
der Firmenwebsites in Deutschland haben strukturierte Daten als JSON-LD auf der Startseite.
29.821 von 70.139 (42,5 %)
Fast alle Websites lassen KI-Systeme herein
Jede Website kann festlegen, welche automatischen Besucher sie hereinlässt. Das steht in einer kleinen Textdatei, die auf jeder Website an derselben Stelle liegt, der robots.txt, einer Art Hausordnung für Programme. Schliesst eine Website dort einen bestimmten Besucher aus, halten sich die grossen Anbieter daran. OpenAI, Anthropic und Perplexity schreiben in ihren Dokumentationen, dass ihre Systeme genau diese Datei beachten.2
Wir haben nachgesehen, wie viele Websites dort einen der fünf grossen KI-Besucher ausschliessen, also die Programme von OpenAI, Anthropic, Perplexity, Google und Common Crawl. Es sind 1.974 von 70.139, also 2,8 Prozent. Alle anderen lassen sie herein.
Die meisten haben zu KI-Systemen schlicht nichts festgelegt. Das Programm von OpenAI zum Beispiel wird auf 1.176 Websites ausdrücklich erlaubt und auf 1.405 ausdrücklich ausgeschlossen. Auf allen übrigen kommt es in der Hausordnung gar nicht vor, und was dort nicht verboten ist, ist erlaubt. Ob die Betreiber das so wollen oder sich nie damit befasst haben, können wir von aussen nicht sagen. Am Ergebnis ändert es nichts.
Nur 27 von 100 sagen einer Maschine, wer sie sind
Wer eine Website zum ersten Mal besucht, versteht sie mit einem Blick auf Logo und Fusszeile. Ein Programm hat diesen Blick nicht. Es sieht Text und muss daraus schliessen, was davon der Firmenname ist und was das Angebot.
Das Firmenprofil im Quelltext
Damit Programme nicht raten müssen, gibt es seit Jahren einen Standard, Schema.org. Die Website legt dabei ihre wichtigsten Angaben ein zweites Mal ab, unsichtbar im Quelltext, in einer festen Form. Firmenname, Anschrift, Telefon, Art des Betriebs, jeweils in einem beschrifteten Feld. Für einen Besucher ändert sich nichts. Für ein Programm ist es der Unterschied zwischen einem ausgefüllten Formular und einem Zettel mit Fliesstext.
42,5 Prozent der Websites haben so einen Datenblock im Quelltext. Bei vielen steht darin allerdings nur, dass es sich um eine Webseite handelt, und sonst nichts. Einen Block mit echten Firmenangaben haben 27,0 Prozent, das sind 18.943 Websites. Bei den übrigen 51.196 bleibt dem Programm das Raten.
Es gibt noch einen älteren und einfacheren Weg, einer Maschine in einem Satz zu sagen, worum es auf einer Seite geht, die Meta-Beschreibung. Das ist der kurze Text, den Google unter einem Suchergebnis anzeigt, und es gibt sie seit den Neunzigern. Trotzdem fehlt sie bei mehr als jeder dritten Website. 64,5 Prozent haben eine.
Was ein Firmenprofil bringt, und was nicht
Google liest diese Angaben seit Jahren aus und empfiehlt sie weiterhin.3 Im eigenen Leitfaden zur KI-Suche schreibt Google aber auch, dass sie für die neuen KI-Antworten nicht nötig sind.4 Von OpenAI, Anthropic und Perplexity gibt es dazu gar keine Aussage.
Ein Firmenprofil im Quelltext sorgt also dafür, dass kein Programm raten muss, wer du bist. Mehr verspricht es nicht, und für mehr gibt es derzeit auch keinen Beleg. Aus meiner Sicht reicht das als Grund, denn die Arbeit ist in wenigen Stunden erledigt. Dass sie bei fast drei von vier Websites fehlt, liegt wohl daran, dass vor ein paar Jahren noch niemand gefragt hat, was ein Programm auf einer Firmenwebsite vorfindet.
Die Datei, von der viele reden, hat fast niemand gefüllt
Seit Herbst 2024 kursiert in Fachkreisen ein Vorschlag, wie man es KI-Systemen leichter machen könnte. Eine eigene Textdatei auf der Website, die llms.txt, soll das Angebot in einfachen Worten zusammenfassen, damit ein KI-System nicht die ganze Seite durchsuchen muss. Wir haben gezählt, wer eine hat. Bei 69.568 Websites liess sich das eindeutig prüfen.
Elf von hundert haben die Datei. Mit echtem Inhalt gefüllt ist sie bei 1,7 Prozent, der Rest ist leer oder fast leer. Ein guter Teil der Dateien stammt ausserdem gar nicht von den Betrieben selbst. Der Baukasten Wix legt sie automatisch an, bei 1.144 von 1.213 Wix-Seiten in unserer Erhebung. Rechnet man Baukästen und Zusatzmodule heraus, bleiben 4.404 Dateien, die jemand bewusst angelegt hat. Davon haben 329 echten Inhalt.
Warum wir die Datei trotzdem zählen
Bis heute ist nicht belegt, dass ein grosser KI-Anbieter diese Datei überhaupt liest, und das sagen wir dazu, obwohl wir sie selbst mitprüfen. Google schreibt in seinem Leitfaden zur KI-Suche, dass für die Google-Suche samt KI-Funktionen keine solchen Dateien nötig sind.4 Die Dokumentationen von OpenAI, Anthropic und Perplexity nennen nur die robots.txt.2 Ahrefs hat im Juni 2026 auf 137.210 Domains ausgewertet, welche Dateien tatsächlich abgerufen werden. Bei 97 Prozent aller llms.txt-Dateien war es kein einziges Mal.5
Die 1,7 Prozent zeigen deshalb vor allem, wie wenige Firmen sich bisher mit dem Thema befasst haben. Ob eine Firma in KI-Antworten auftaucht, sagen sie nicht. Wir zählen die Datei weiter, weil sie verrät, wo jemand hingeschaut hat. Im Bericht steht sie als Hinweis ohne nachgewiesene Wirkung, nicht als Mangel.
Wo die Unterschiede liegen
Die Gesamtzahlen verdecken, wie weit die Branchen und die Systeme auseinanderliegen, mit denen Websites gebaut werden.
Nach Branche
Vorn liegen die Betriebe, die selbst Websites bauen. Von den Webdesign-Firmen haben 44,8 Prozent ein Firmenprofil im Quelltext, 18,5 Prozent eine llms.txt und 75,7 Prozent eine Meta-Beschreibung. Am anderen Ende steht die Elektroinstallation mit 22,0 Prozent, 8,2 Prozent und 59,9 Prozent. Dazwischen liegen alle anderen dicht beieinander, Maler, Dachdecker und Kanzleien bei rund 22 bis 23 Prozent Firmenprofil, Immobilienmakler bei 26,9, Photovoltaik bei 30,3.
Der bemerkenswerte Befund steckt in der Spitze. Selbst bei den Firmen, deren Beruf es ist, Websites zu bauen, hat weniger als die Hälfte die eigene Seite so angelegt, dass ein Programm sie sicher liest. Das spricht dafür, dass das Thema in der Breite noch nicht angekommen ist, und nicht dafür, dass eine Branche es verschlafen hätte.
Eine Kuriosität am Rande. KI-Systeme ausgeschlossen haben am häufigsten die Klimaanlagenbauer, 10,8 Prozent, gefolgt von der Badsanierung mit 6,4 Prozent. Alle anderen Branchen liegen unter vier Prozent. Warum, wissen wir nicht.
Nach System
Noch grösser ist der Unterschied zwischen den Systemen. Wer seine Website mit Squarespace gebaut hat, hat zu 69,6 Prozent ein Firmenprofil im Quelltext, mit Wix zu 54,1 Prozent, mit WordPress zu 46,7 Prozent. Bei Websites, die individuell oder mit einem nicht erkennbaren System gebaut wurden, sind es 13,0 Prozent, bei Jimdo 3,4 Prozent. Die Baukästen legen das Firmenprofil aus den Angaben an, die der Betreiber ohnehin eingibt. Bei individuell gebauten Seiten muss jemand daran gedacht haben.
Bei der llms.txt zeigt sich dasselbe Muster in extremer Form. Wix legt sie automatisch an, deshalb haben 94,3 Prozent der Wix-Seiten eine. Bei allen anderen Systemen liegt der Anteil zwischen 1,5 und 11,3 Prozent. Das ist der Grund, warum wir bei dieser Datei zwischen „vorhanden" und „mit Inhalt gefüllt" unterscheiden.
Fast jede Firmenwebsite lässt KI-Systeme herein. Ob die dann auch verstehen, wer hier anbietet, hängt an zwei Dingen, die in wenigen Stunden erledigt sind. Ein Firmenprofil im Quelltext und ein erster Absatz auf der Startseite, der in Worten sagt, was ihr macht und für wen.
Wie wir gemessen haben
Ausgangspunkt waren 81.811 Internetadressen von Firmen aus zwölf Branchen in Deutschland, vom Malerbetrieb bis zur Kanzlei. 11.594 davon waren nicht mehr in Betrieb oder nicht erreichbar, übrig blieben 70.139. Jede einzelne hat unsere Audit-Software vom 20. bis 22. September 2026 aufgerufen, von Deutschland aus und in zufälliger Reihenfolge. Sie hat nur die Startseite und das Impressum gelesen und dabei nichts angeklickt, kein Cookie-Banner bestätigt und kein Menü geöffnet. So sieht ein KI-System eine Seite auch.
Alle Zahlen sind gezählt. Die Prüfungen laufen ohne KI-Modell ab, wer sie wiederholt, bekommt dasselbe Ergebnis.
Die Erhebung sagt nichts darüber, wie ein bestimmtes KI-System eine bestimmte Seite tatsächlich verarbeitet, dafür müsste man dessen Antworten auswerten. Sie sieht nur, was eine Seite beim ersten Aufruf ausliefert, nachgeladene Angaben sieht sie nicht. Alle Daten liegen zusammengefasst vor, keine Firma ist erkennbar, die Adressliste veröffentlichen wir nicht. Die Rohdaten stehen als CSV und JSON mit Anzahl, Basis und Definition je Zeile unter CC BY 4.0 auf der Studienseite.
Drei Dinge, die du an deiner Website nachsehen kannst
Für die ersten beiden brauchst du nur einen Browser.
- Die Hausordnung. Ruf deine-domain.de/robots.txt auf. Steht dort „Disallow: /" unter „User-agent: GPTBot" oder einem anderen KI-Namen, hast du KI-Systeme ausgeschlossen, ob gewollt oder nicht.
- Das Firmenprofil. Öffne den Quelltext deiner Startseite (Rechtsklick, „Seitenquelltext anzeigen") und such nach „application/ld+json". Findest du nichts, gibt es kein Firmenprofil, und jedes Programm muss deinen Namen aus dem Text herauslesen.
- Der erste Absatz. Lies deine Startseite einmal so, als wüsstest du nichts über die Firma. Steht in den ersten Sätzen, was ihr anbietet und für wen? Das ist der Text, mit dem ein KI-System arbeitet.
Wie wir die Lesbarkeit einer Website insgesamt prüfen, steht auf unserer Seite zur KI-Sichtbarkeit. Und wenn du dir das Suchen sparen willst, prüf deine Startseite im kostenlosen Check. Das dauert weniger als eine Minute.
Quellen
-
70.139 Firmenwebsites in Deutschland 2026, SpotLens, Jordan Wichert, Stand 22. September 2026, Rohdaten als CSV und JSON unter CC BY 4.0 Zurück zum Text
-
Crawler-Dokumentation OpenAI (öffnet in neuem Tab), Anthropic (öffnet in neuem Tab) und Perplexity (öffnet in neuem Tab), alle drei nennen robots.txt als Steuerdatei, gelesen am [Datum] Zurück zum Text Zurück zum Text
-
Einführung in strukturierte Daten (öffnet in neuem Tab), Google Search Central, gelesen am [Datum] Zurück zum Text
-
AI features and your website (öffnet in neuem Tab), Google Search Central, Stand 10. Juli 2026, gelesen am 26. September 2026 Zurück zum Text Zurück zum Text
-
Auswertung von 137.210 Domains mit llms.txt (öffnet in neuem Tab), Ahrefs, 15. Juni 2026, gelesen am [Datum] Zurück zum Text
Mehr zum Thema: KI-Sichtbarkeit, AEO erklärt, GEO erklärt
Über diesen Artikel
Grundlage
- 70.139 Firmenwebsites in Deutschland 2026: 70.139 gemessene Websites, gemessen im September 2026. Grenzen: Wie stabil die Zahlen sind · Was diese Zahlen nicht sagen
Entstehung
Entwurf mit KI-Unterstützung, geprüft und verantwortet von Jordan Wichert.
SpotLens verkauft Audits zu den Themen dieses Blogs.
Fehler gefunden? Schreib an info@spotlens.ai. So arbeiten wir
Geschrieben von

Jordan Wichert
Product Owner von SpotLens
Product Owner von SpotLens. Hat das Prüfverfahren gebaut und veröffentlicht Erhebungen dazu, wie Websites von Suchmaschinen und KI-Assistenten gelesen werden.
Wo steht deine Seite?
Der kostenlose Check zeigt in Sekunden, wo deine Website steht. Das Audit sagt, was dort konkret zu tun ist.