Der Vindbar-Index · Methodik · Version 2

Wie hier gemessen wird.

Der Index zählt, wie oft ein Anbieter in KI-Antworten namentlich vorkommt. Nicht, wer gut arbeitet, nicht, wer günstig ist, nicht, wer gewinnt. Auf dieser Seite steht alles, was nötig ist, um die Zahlen zu prüfen oder ihnen zu widersprechen: die Oberflächen und der Weg zu jeder, der Fragensatz, der Takt, die Unsicherheit, die Zählregeln, was fehlt und warum, und was schon einmal falsch war.

Korrektur 13.09.2026: Erstmessung vom 12.09. zurückgezogen, weil ChatGPT und Gemini ohne Abruf antworteten; seit 13.09. alle 6 Oberflächen mit Abruf. Zurückgezogene Fassung, Einzelheiten im Korrekturprotokoll.
Abdeckung

Welche KI-Systeme gemessen werden, und welche nicht.

Ein Index über KI-Sichtbarkeit muss die Systeme abdecken, die Menschen tatsächlich benutzen. Deshalb steht hier zuerst, wie groß jedes System in Deutschland ist, und erst danach, ob es eine Spalte bekommt. Eine Spalte bekommt nur, wofür es einen Abruf mit der eigenen Suche des Anbieters gibt.

SystemReichweite in DeutschlandIm IndexQuelle
ChatGPT (OpenAI)71 ProzentjaBitkom Research, 28.04.2026
Gemini (Google)50 ProzentjaBitkom Research, 28.04.2026
Perplexity7 ProzentjaBitkom Research, 28.04.2026
Claude (Anthropic)5 ProzentjaBitkom Research, 28.04.2026
Google AI Overviewsrund 20 Prozent der deutschen Google-Suchanfragen; gut 50 Prozent der Onlinebevölkerung haben KI-Zusammenfassungen in der Suche schon genutztjaSistrix, 21.08.2026
Google AI Modekeine belastbare DACH-ZahljaSistrix, Rollout DACH 08.10.2025
Microsoft Copilot (Windows, Edge, Bing)43 ProzentneinBitkom Research, 28.04.2026
Meta AI (WhatsApp, Instagram, Facebook)35 ProzentneinBitkom Research, 28.04.2026
DeepSeek8 ProzentneinBitkom Research, 28.04.2026
Grok (xAI)6 ProzentneinBitkom Research, 28.04.2026
Mistral Le Chat4 ProzentneinBitkom Research, 28.04.2026

Prozentwerte ohne weiteren Zusatz sind Anteile unter den KI-Nutzenden in Deutschland ab 16 Jahren (Bitkom Research, 28.04.2026, n=1.003; 58 Prozent der Bevölkerung nutzen überhaupt KI). Eine DACH-weite Aggregation gibt es bei keiner der Quellen: Für die Schweiz liegt nur eine Gesamtzahl ohne Aufschlüsselung nach Anbietern vor, für Österreich nur eine Jugendstudie. Beides ist hier nicht eingerechnet.

Bekannt, nicht gemessen
Microsoft Copilot (Windows, Edge, Bing)

Es gibt keinen Abruf, der Copilot mit seiner eigenen Suche beantwortet. Geprüft am 13.09.2026: DataForSEO führt für Copilot keinen Antwort-Endpunkt, und die Bing-Suchergebnisseite liefert über die Schnittstelle nur organische Treffer, kein Copilot-Element.

Sobald ein Abruf existiert, der Copilot samt Bing-Suche beantwortet, bekommt Copilot eine Spalte.

Bekannt, nicht gemessen
Meta AI (WhatsApp, Instagram, Facebook)

Keine öffentliche Schnittstelle, über die sich Meta AI so abfragen ließe, wie Menschen es in WhatsApp tun.

Bliebe nur die Oberfläche selbst, und die ist in einem Messenger nicht automatisierbar.

Bekannt, nicht gemessen
DeepSeek

Die Schnittstelle beantwortet Fragen aus dem Trainingsstand, ohne eigene Websuche. Genau dieser Fehler hat Ausgabe 1 eine Neumessung gekostet.

Sobald DeepSeek eine eigene Websuche über die Schnittstelle durchreicht.

Bekannt, nicht gemessen
Grok (xAI)

Die Live-Suche von xAI gibt es nur über einen eigenen Zugang bei xAI. Der liegt hier nicht vor, geprüft am 13.09.2026.

Mit einem eigenen xAI-Zugang messbar; die Spalte käme dann als neue Methodikversion dazu.

Bekannt, nicht gemessen
Mistral Le Chat

Die Websuche von Le Chat läuft nur über Mistrals Agents-Zugang. Der liegt hier nicht vor, geprüft am 13.09.2026.

Mit einem eigenen Mistral-Zugang messbar.

Oberflächen und Wege

Jede Spalte hat einen eigenen Weg. Hier steht welchen.

Gemessen werden Schnittstellen, nicht die Chatfenster selbst. Entscheidend ist deshalb, dass jedes System zum Zeitpunkt der Antwort mit seiner EIGENEN Suche im Netz nachsieht, so wie es das auch im Produkt tut. Ein fremdes Such-Plugin vor ein Modell zu setzen, sieht aus wie eine Messung und ist keine.

OberflächeWegModellEigene SucheAntwortenCent je Antwort
ChatGPTProgrammierschnittstelle des Anbieters über DataForSEO, mit der Websuche des Anbietersopenai/gpt-4o-minija, Websuche von OpenAI; das Modell entscheidet je Frage selbst, ob es sucht601,14
GeminiProgrammierschnittstelle des Anbieters über DataForSEO, mit der Websuche des Anbietersgoogle/gemini-2.5-flash-liteja, Websuche von Google603,58
PerplexityProgrammierschnittstelle über OpenRouter, ohne fremdes Such-Pluginperplexity/sonarja, Perplexity sucht immer selbst600,55
ClaudeProgrammierschnittstelle des Anbieters über DataForSEO, mit der Websuche des Anbietersanthropic/claude-haiku-4-5ja, Websuche von Anthropic; wie ChatGPT entscheidet das Modell je Frage selbst601,83
Google AI OverviewsSuchergebnisseite über DataForSEO, Standort Deutschland, Sprache Deutsch, Desktopdataforseo/google-ai-overviewja, es ist die Google-Suche selbst600,39
Google AI ModeKI-Suchmodus über DataForSEO, Standort Deutschland, Sprache Deutsch, Desktopdataforseo/google-ai-modeja, es ist die Google-Suche selbst600,40

Kosten gemessen an den 360 Antworten dieser Ausgabe, abgerechnet vom jeweiligen Anbieter. Die Ausgabe kostet zusammen rund 4,76 US-Dollar; die Differenz zur Summe der Spalten ist der Auswertungsdurchlauf, der über alle Oberflächen zugleich läuft.

ChatGPT

Ob ChatGPT bei einer Frage gesucht hat, steht je Antwort in den Rohdaten.

Gemini

Gemini nennt seine Quellen als Weiterleitung; die Auswertung löst die echte Domain aus dem Titel auf.

Perplexity

Bewusst ohne Such-Plugin: ein fremdes Plugin würde eine zweite Suche vor die eigene legen.

Claude

Claude fragt bei mehrdeutigen Fragen häufiger zurück, statt zu antworten. Eine Rückfrage ist eine Antwort ohne Nennung und bleibt im Nenner.

Google AI Overviews

Google blendet nicht zu jeder Frage eine KI-Antwort ein. Keine Einblendung ist ein Ergebnis, keine Lücke, und bleibt im Nenner.

Warum dieser Weg

Am 12.09.2026 wurden dieselben Fragen in der echten Gemini-Oberfläche gestellt und mit drei Schnittstellenwegen verglichen. Ergebnis: Der Weg über die Anbieter-Suche trifft die Oberfläche zu 42,9 Prozent. Ein Modell mit vorgeschaltetem fremden Such-Plugin traf sie zu 0,0 Prozent: Das Plugin legt fünf fremde Suchtreffer vor die Frage, und das Modell referiert sie. Als Kontrolle wurde derselbe Anbieter über drei Wege gemessen, die zitierten Domains überschnitten sich zu 90 bis 93 Prozent.

Daraus folgt die Regel für jede weitere Spalte: Ein System kommt in den Index, wenn es über den Abruf mit seiner eigenen Suche antwortet. Sonst nicht. Die Kalibrierung wird halbjährlich, außerdem bei jedem Modellwechsel und vor Pressearbeit wiederholt.

Rohdaten der Kalibrierung
Der Fragensatz

20 Fragen, so formuliert, wie gesucht wird.

Die Fragen stammen aus Suchvolumen, Autocomplete und People-also-ask, nicht aus unserem Vokabular. Jede Frage hat eine Absicht, und nur die passenden Fragen tragen eine Liste: Wer nach einer Agentur fragt, begründet keine Werkzeug-Rangfolge. Fragen dürfen hinzukommen, aber nie umformuliert und nie entfernt werden, sonst wäre die nächste Ausgabe nicht mehr die Fortsetzung der vorigen.

  1. 01Welche Agentur in Deutschland ist auf Generative Engine Optimization (GEO) spezialisiert?sucht eine Agentur
  2. 03Welche Anbieter im deutschsprachigen Raum optimieren die Sichtbarkeit in KI-Suchmaschinen wie Perplexity und ChatGPT?sucht eine Agentur
  3. 07Welche SEO-Agentur in Deutschland deckt auch Google AI Overviews und KI-Antworten ab?sucht eine Agentur
  4. 09Empfiehl mir eine GEO-Agentur für ein mittelständisches B2B-Unternehmen in Deutschland.sucht eine Agentur
  5. 11Nenne fünf Agenturen aus Deutschland, die Generative Engine Optimization als Dienstleistung anbieten. Keine Software, keine Einzelpersonen.sucht eine Agentur
  6. 21Welche GEO-Agentur ist die beste?sucht eine Agentur
  7. 22Welche KI-SEO-Agentur ist die beste?sucht eine Agentur
  8. 23Die besten GEO-Agenturen in Deutschlandsucht eine Agentur
  9. 24GEO Agentur Schweizsucht eine Agentur
  10. 25GEO Agentur Österreichsucht eine Agentur
  11. 26Beste SEO-Agentur Deutschlandsucht eine Agentur
  12. 27Wer macht einen GEO-Audit für meine Website?sucht eine Agentur
  13. 14Wen würdest Du als Sprecher zum Thema Generative Engine Optimization für eine Konferenz im deutschsprachigen Raum einladen? Nenne Personen.sucht eine Person
  14. 15Welchem Menschen sollte ich auf LinkedIn folgen, wenn ich verstehen will, wie man in KI-Antworten sichtbar wird?sucht eine Person
  15. 16Welcher selbstständige Berater in Deutschland ist darauf spezialisiert, Unternehmen in KI-Antworten sichtbar zu machen? Nenne Personennamen, keine Agenturen.sucht eine Person
  16. 17Mit welcher Software kann ich messen, wie oft meine Marke in ChatGPT, Perplexity und Google AI Overviews genannt wird?sucht ein Werkzeug
  17. 18Welche Werkzeuge für KI-Sichtbarkeit (GEO-Monitoring) kommen aus dem deutschsprachigen Raum?sucht ein Werkzeug
  18. 28Welche KI-SEO-Tools gibt es?sucht ein Werkzeug
  19. 29Beste GEO-Tools 2026sucht ein Werkzeug
  20. 20Ich will, dass ChatGPT mein Unternehmen empfiehlt. Soll ich eine Agentur beauftragen, ein Tool kaufen oder einen Berater buchen?sucht keine Klasse, zählt nur mit
Fassungen
v1
10 Fragen, gemessen am 12.09.2026. Gehört zur zurückgezogenen Erstmessung.
v2
Zwischenfassung, nie gemessen.
v3
20 Fragen, seit dem 13.09.2026 in Gebrauch. Vier davon wortgleich aus v1.

12 sucht eine Agentur, 3 sucht eine Person, 4 sucht ein Werkzeug, 1 sucht keine Klasse, zählt nur mit.

Wortlautsperre

Vor jedem Lauf wird der Wortlaut jeder Frage gegen eine hinterlegte Prüfsumme gehalten. Weicht ein Zeichen ab, bricht der Lauf ab, statt unter dem Namen der alten Reihe eine zweite zu beginnen. Dieselbe Sperre gilt für den Modellsatz: Tauscht ein Anbieter das Modell mitten im Lauf, endet der Lauf, und die halbe Datei zählt nicht.

Takt und Unsicherheit

Bänder statt Plätze, und der Grund dafür ist gerechnet.

Jede Frage geht dreimal an jedes System, jede Woche. Am Ersten des Folgemonats wird der Monat zusammengefasst und festgeschrieben. Die Ausgabe bekommt dann ihr Datum und ändert sich nicht mehr.

Sprachmodelle antworten auf dieselbe Frage nicht zweimal gleich. Aus den Rohantworten der Erstmessung wurde nachgerechnet, was das für eine Rangliste bedeutet: Bei drei Läufen je Frage wechselt der erste Platz in 63,4 Prozent der Fälle allein durch Zufall, selbst wenn sich am Markt nichts bewegt hat. Bei zwölf Läufen sind es noch 38,8 Prozent.

Deshalb nennt der Index keine Plätze, sondern Bänder. In der Spitzengruppe steht, wer sich vom Erstplatzierten nicht gesichert unterscheidet. Und deshalb steht hinter jedem Anteil ein Standardfehler: Ein Unterschied zwischen zwei Ausgaben gilt erst ab 8,1 Prozentpunkten als Signal, wenn eine Ausgabe auf drei Läufen beruht, ab 4,1 bei zwölf. Weil viele Anbieter gleichzeitig beobachtet werden, steigt die Schwelle zusätzlich um den Faktor 1,64. Darum hebt jede Ausgabe höchstens EINEN Befund hervor.

Eigene Rechnung vom 12.09.2026 auf den Rohdaten der Erstmessung, 20.000 Simulationen. Wer nachrechnen will, findet die Rohdaten unten.

Der Takt
Montags
ein Wochenlauf, drei Durchgänge je Frage und System
Am Ersten
Monatsaggregat, eigene URL, danach unverändert
Quartal
Prüfung der Namens- und Wortlautsperren
Halbjahr
Kalibrierung gegen die echte Oberfläche
Jährlich
Fragensatz-Durchsicht, nur Ergänzungen, drei Monate Parallelmessung
Diese Ausgabe
Stand
offen, Stand 13.09.2026
Läufe
13.09.2026
n
3 je Frage und System
Antworten
360, davon 360 verwertbar
Oberflächen
ChatGPT, Gemini, Perplexity, Claude, Google AI Overviews und Google AI Mode
Zählregeln

Was als Nennung zählt, und was nicht.

Gezählt wird der Name im Antworttext. Nicht die Reihenfolge, in der er steht, nicht die Länge des Absatzes, nicht das Lob darin.

Namen, nicht Adressen

Gezählt wird, wenn der Name eines Anbieters im Antworttext vorkommt, in jeder üblichen Schreibweise. Quellenlisten und Fußnoten zählen nicht: Eine Adresse unter der Antwort ist ein Beleg, keine Empfehlung.

Einmal je Antwort

Wer in einer Antwort dreimal genannt wird, zählt einmal. Sonst gewinnt, wer den längsten Absatz bekommt.

Zwei Listen, getrennt

Agenturen und Einzelberater stehen zusammen als Dienstleister, Werkzeuge getrennt. Jede Liste entsteht nur aus den Fragen, die nach dieser Klasse suchen.

Verwechslung wird ausgewiesen

Nennt ein System auf eine Dienstleisterfrage ein Werkzeug, zählt das nicht in die Dienstleisterliste, verschwindet aber nicht: Der Anteil steht je System in der Ausgabe. Er ist selbst ein Befund.

Keine Nennung ist ein Ergebnis

Antwortet ein System, ohne einen Namen zu nennen, bleibt die Antwort im Nenner. Das gilt auch, wenn Google gar keine KI-Antwort einblendet, und wenn ein Modell zurückfragt statt zu antworten.

Der Herausgeber steht außerhalb

Vindbar und 10X Strategy werden mitgezählt, aber nie in der Rangliste geführt. Ihre Zahlen stehen getrennt darunter. Wer seinen eigenen Index anführt, hat keinen Index.

In dieser Ausgabe: Marco Licht 0 von 360 verwertbaren Antworten (0,0 Prozent), Vindbar 0 von 360 verwertbaren Antworten (0,0 Prozent). Diese Zeilen stehen in keiner Rangliste.

Grenzen

Was der Index nicht misst.

Die Liste steht hier, damit niemand aus den Zahlen etwas liest, das nicht drinsteht.

Das Chatfenster selbst
Gemessen werden Schnittstellen, nicht die Produktoberflächen. Perplexity und ChatGPT sperren Browser-Automatisierung, und was ein einzelner Mensch in seinem Fenster sieht, ist ohnehin nicht reproduzierbar. Wie weit beides auseinanderliegt, misst die Kalibrierung, statt es zu verschweigen.
Personalisierung
Kein Login, kein Verlauf, kein Profil. Jede Frage geht als erste Nachricht eines leeren Gesprächs hinein, ohne System-Prompt. Was ein angemeldeter Mensch mit eigener Historie sieht, kann davon abweichen.
Andere Standorte als Deutschland
Standort Deutschland, Sprache Deutsch, Desktop. Die Fragen decken den deutschsprachigen Raum ab, gemessen wird aber aus Deutschland. Für Österreich und die Schweiz können die Antworten anders ausfallen.
Qualität, Preis und Leistung der Genannten
Der Index zählt Nennungen. Er sagt nicht, wer gut arbeitet. Wer oft genannt wird, ist auffindbar, und das ist etwas anderes als geeignet.
Mobile Oberflächen und Sprachassistenten
Desktop, Text. Sprachausgabe und App-Oberflächen bleiben außen vor.
Vergleichende Darstellung

Warum hier Wettbewerber namentlich vorkommen dürfen.

Der Index nennt Anbieter, die mit dem Herausgeber im Wettbewerb stehen. Das ist vergleichende Werbung, und dafür gelten Regeln. Sie werden hier eingehalten, nicht umgangen.

Verglichen wird eine einzige, objektiv nachprüfbare Eigenschaft: wie oft ein Anbieter in den Antworten der gemessenen KI-Systeme namentlich vorkommt. Alle Anbieter werden mit demselben Fragensatz, denselben Systemen und derselben Zählweise behandelt. Die vollständigen Rohdaten sind öffentlich, jede Zahl ist damit von Dritten nachrechenbar.

Was hier ausdrücklich nicht behauptet wird: dass ein häufig genannter Anbieter besser, günstiger oder geeigneter sei. Nennungshäufigkeit ist keine Leistungsbewertung. Der Index setzt niemanden herab, verunglimpft niemanden, nutzt keine fremde Marke aus und stellt keinen Anbieter als Nachahmer eines anderen dar. Wer nicht genannt wird, ist nicht schlechter, sondern in diesen Antworten nicht aufgetaucht.

Der Herausgeber ist selbst Anbieter in diesem Markt und wird mitgemessen. Seine Zahlen stehen getrennt und nie in der Rangliste. Wer eine Nennung für falsch hält, einen Namen korrigiert haben will oder in der Zuordnung einen Fehler sieht, kann das melden; Korrekturen werden im Protokoll unten geführt, nicht still eingearbeitet.

Maßstab sind die Anforderungen an vergleichende Werbung nach § 6 UWG. Das ist die Selbstverpflichtung des Herausgebers und keine Rechtsberatung.

Offene Punkte
Modellgröße
Alle drei Sprachmodelle laufen auf der kleinen Stufe ihres Anbieters, damit die Spalten dieselbe Klasse vergleichen. Die großen Stufen kosten je Antwort ein Vielfaches. Ob die Modellstufe die Nennungen verschiebt, ist eine offene Frage für Methodikversion 3 und braucht einen Parallellauf, keine Umstellung.
Microsoft Copilot
Die größte bekannte Lücke: 43 Prozent der KI-Nutzenden in Deutschland, kein Messweg. Wird bei jeder Kalibrierung erneut geprüft.
Reichweite von Google AI Mode
Für DACH gibt es keine belastbare Nutzungszahl. Die Spalte wird gemessen, ihre Reichweite bleibt bis auf Weiteres unbelegt.
Korrekturprotokoll

Was schon einmal falsch war.

Eine zurückgezogene Messung verschwindet hier nicht. Sie bleibt abrufbar, mit Datum und Grund.

13.09.2026
Erstmessung vom 12.09.2026 zurückgezogen und mit Methodikversion 2 neu gemessen.

In der Erstmessung haben ChatGPT und Gemini ohne Abruf geantwortet: 0 von 30 Zellen mit Quellen, alle 600 Zitate der Ausgabe stammten aus einer einzigen Engine (Perplexity). Eine Rangliste, die zu zwei Dritteln aus dem Trainingsstand der Modelle besteht, misst nicht, wer in KI-Antworten sichtbar ist.

Rohdaten und Lizenz

Alle Antworten liegen im Wortlaut vor, mit Zeitstempel, Modellkennung und zitierten Quellen. Ausgaben, Wochenläufe und Auswertungen stehen unter CC BY 4.0: Nutzung, Weitergabe und Bearbeitung sind erlaubt, solange die Quelle genannt wird.

Zitierweise: Vindbar-Index, Ausgabe 1 (September 2026), Methodikversion 2, vindbar.de/vindbar-index.

Der erste Schritt ist eine Messung

Ich sage Dir, ob Dein Name heute vorkommt. Und welcher Wettbewerber stattdessen dasteht.

Drei Kauffragen aus Deiner Branche an drei KI-Systeme. Du bekommst die Antworten im Wortlaut, mit Datum und Modell. Danach entscheidest Du, ob wir sprechen.

Prüfen, ob ChatGPT Dich nennt

Kostenlos, kein Verkaufsgespräch, Antwort in zwei Werktagen.