GEO-Tools: was sie wirklich messen

Dominik Breitbach ist Gründer der taismo GmbH und als Lead SEO Stratege auf SEO-Betreuung und Sichtbarkeit in KI-Antworten (GEO) spezialisiert. Die beiden Messwerkzeuge in diesem Artikel betreibt er seit Monaten selbst, samt der Kontingentrechnung, die niemand auf die Produktseite schreibt.
🔄 Zuletzt aktualisiert: 18.09.2026
GEO-Tools messen nicht, wie gut deine Website für KI-Systeme gebaut ist. Sie stellen Sprachmodellen Fragen und schreiben mit, was in den Antworten steht. Das klingt nach einer Kleinigkeit, entscheidet aber alles: Es gibt zwei Sorten dieser Werkzeuge, und sie beantworten zwei verschiedene Fragen. Die eine misst deine eigene Sichtbarkeit gegen die Keywords, die du ohnehin verfolgst. Die andere misst den Markt, also wen die Modelle bei deinen Themen nennen und aus welchen Quellen sie ihre Antwort bauen. Wer die falsche Sorte kauft, misst sehr sauber das Falsche. Wir haben beide seit Monaten im Echtbetrieb und schreiben hier auf, was sie liefern, was sie kosten und wo sie aufhören.
👉 Du willst wissen, wo deine Seite in KI-Antworten heute steht, bevor du ein Werkzeug kaufst? Unser GEO-Audit misst genau das.
GEO-Tools: die kurze Antwort
Ein GEO-Tool tut im Kern drei Dinge. Es schickt eine Liste von Fragen an ein oder mehrere Sprachmodelle, es speichert die Antworten, und es wertet aus, ob deine Marke darin vorkommt, ob sie verlinkt ist und welche Quellen das Modell genannt hat. Mehr ist es nicht. Genau deshalb ist die Auswahl der Fragen wichtiger als die Oberfläche des Werkzeugs.
Zur Einordnung des Begriffs, weil er doppelt belegt ist: GEO steht hier für Generative Engine Optimization, also für Sichtbarkeit in KI-Antworten, nicht für Geodaten. Die deutsche Ergebnisseite ist bei „geo tools“ eindeutig: zehn von zehn Treffern sind Vergleichslisten für KI-Sichtbarkeit. Beim Nachbarbegriff „geo tracking“ dagegen stehen zehn von zehn GPS-Apps und Fuhrpark-Anbieter. Zwei Begriffe, ein Wortstamm, zwei völlig verschiedene Märkte.
Die Nachfrage ist neu, und sie wächst schnell. „geo tools“ steht in Deutschland bei 210 Anfragen im Monat und lag im Oktober 2025 noch bei null. „geo audit“ liegt bei 170, ebenfalls von null kommend, „ki sichtbarkeit messen“ bei 70. Auffällig ist der englische Begriff: „ai visibility tools“ hat mit 70 Anfragen kaum mehr Volumen, aber eine Difficulty von 58 und einen Klickpreis von 6,10 Euro. Im Englischen ist das Feld längst teuer umkämpft, im Deutschen noch nicht.
Falls dir beim Lesen Begriffe begegnen, die du sortieren willst: Wir führen LLMO und KI-Suche als eigene Einträge im Glossar.
Zwei Fragen, zwei Werkzeugklassen
Die Vergleichslisten im Netz sortieren GEO-Tools nach Funktionsumfang und Preis. Das ist die falsche erste Sortierung. Die richtige ist die Frage, die du beantwortet haben willst, denn danach zerfällt der Markt in zwei Klassen.
Frage 1: Wirst du genannt, wenn es um deine Themen geht?
Das ist die Innensicht. Sie läuft gegen die Keywords, die du ohnehin verfolgst, und beantwortet eine schmale, aber sehr konkrete Frage: Taucht deine Domain in den KI-Antworten zu diesen Begriffen auf, und deckt sich das mit deinem organischen Ranking?
Frage 2: Wer wird stattdessen genannt?
Das ist die Außensicht. Sie läuft gegen eine Menge von Fragen, die du selbst formulierst, und beantwortet: Welche Marken nennt das Modell bei diesem Thema, in welchem Verhältnis, in welchem Ton, und aus welchen Quellen baut es die Antwort?
Beide Fragen sind berechtigt. Sie führen nur zu verschiedenen Rechnungen, verschiedenen Tarifen und verschiedenen Schlussfolgerungen. Wer die Innensicht kauft und eine Marktanalyse erwartet, bekommt eine saubere Messung, die seine Frage nicht beantwortet. Wie sich das im Alltag anfühlt, haben wir im Beitrag zur Sichtbarkeit in KI-Suchmaschinen beschrieben.
Klasse 1: die eigene Sichtbarkeit gegen getrackte Keywords
Werkzeuge dieser Klasse hängen an deinem bestehenden Ranking-Projekt. Sie nehmen die Keywords, die dort schon liegen, prüfen für jedes, ob eine KI-Antwort ausgespielt wird, und protokollieren, ob deine Domain darin erwähnt oder verlinkt ist. Der Einrichtungsaufwand ist klein, weil die Keywordliste bereits existiert.
Die Überschneidung ist der eigentliche Befund
Die interessante Zahl dieser Klasse ist nicht die Erwähnungsquote. Es ist die Überschneidung mit dem organischen Ranking, und die zerfällt in vier Felder:
- Du rankst und wirst zitiert. Der Normalfall bei funktionierenden Seiten. Nichts zu tun.
- Du rankst gut, wirst aber nicht zitiert. Der teuerste Befund. Die Seite ist auffindbar, aber nicht zitierfähig: keine klare Antwort dort, wo die Frage steht, keine sauber abgegrenzte Aussage, zu viel Anlauf. Hier liegt die Arbeit.
- Du wirst zitiert, rankst aber nicht. Kommt häufiger vor, als man denkt. Die Seite trägt in der Antwort mehr Gewicht als in der Ergebnisliste, oft weil sie eine Definition sauber liefert.
- Weder noch. Kein GEO-Problem, sondern ein SEO-Problem.
Nur das zweite und das dritte Feld erzeugen Handlung, alles andere ist Bestätigung. Wer stattdessen einen einzigen aggregierten Sichtbarkeitswert bekommt, hat dieselbe Kompression vor sich, die auch ein klassischer Sichtbarkeitsindex vornimmt: bequem für den Verlauf, unbrauchbar für die Entscheidung, was du morgen anfasst.
Klasse 2: der Markt
Werkzeuge dieser Klasse hängen nicht an Keywords, sondern an Fragen, die du selbst schreibst. Sie laufen gegen mehrere Modelle und liefern vier Dinge:
- Anteil an der Nennung. Wie oft deine Marke über die gesamte Fragenmenge genannt wird, gemessen an allen genannten Marken.
- Wettbewerbsmarken. Welche Anbieter bei denselben Fragen auftauchen. Oft die ernüchterndste Spalte, weil dort regelmäßig Namen stehen, die im organischen Wettbewerb keine Rolle spielen.
- Tonalität. In welchem Ton über die Marke gesprochen wird.
- Zitierte Quellen auf Domain- und URL-Ebene. Welche Seiten das Modell tatsächlich herangezogen hat.
Zitierte Quellen sind die praktischste Zahl
Von diesen vier ist die letzte die einzige, aus der unmittelbar Arbeit folgt. Du siehst nicht nur, dass ein Wettbewerber genannt wird, sondern über welche einzelne Adresse. Und du siehst, dass häufig gar nicht die Anbieterseiten zitiert werden, sondern Vergleichsportale, Fachartikel und Verzeichnisse. Wer das einmal gesehen hat, versteht, warum Markenerwähnungen auch ohne Link zählen und warum ein Platz in einer fremden Liste manchmal mehr bringt als eine weitere eigene Seite. Die Mechanik dahinter, also woraus Modelle ihre Empfehlung bauen, haben wir im GEO-Ranking auseinandergenommen.
Was die Messung wirklich kostet
Hier wird es unangenehm, und hier hört jede Vergleichsliste auf. Der Preis eines GEO-Tools steht nicht in der Tarifzeile, sondern in zwei Kontingenten.
Erstens: Ein Prompt kostet bei jedem Messzyklus, nicht einmalig. Wer 100 Fragen wöchentlich messen lässt, verbraucht in vier Wochen das Vierfache. Das ist keine Anschaffung, sondern ein Abonnement mit Mengenbegrenzung.
Zweitens: Ein Prompt zählt einmal, unabhängig davon, gegen wie viele Modelle er läuft. Das haben wir nachgerechnet, weil es in keiner Beschreibung stand: Ein Projekt mit 20 Fragen gegen fünf Modelle hat exakt 20 von 200 Prompts verbraucht, nicht 100. Für die Planung heißt das, dass mehr Modelle nichts kosten und mehr Fragen alles.
Der Engpass ist die Projektzahl, nicht die Prompt-Zahl
Bei uns laufen beide Klassen über denselben Anbieter, SE Ranking, und selbst dort sind es zwei getrennte Produkte mit zwei getrennten Kontingenten: der AI Results Tracker für die Innensicht mit 450 Prompts, SE Visible für die Außensicht mit 200 Prompts und drei Projekten. Das sind die Zahlen unseres Tarifs, keine allgemeingültigen Grenzen; prüfe sie für deinen. Die 200 klingen nach der harten Grenze. Sind sie nicht. Ein Projekt ist eine Marke, und drei Projekte heißt: Du kannst drei Kunden gleichzeitig messen. Den vierten nicht, egal wie viele Prompts noch frei sind.
Für eine Agentur ist das die eigentliche Kaufentscheidung, und sie dreht die Reihenfolge der Prüfung um. Prompts lassen sich zuteilen, Projekte nicht. Bei uns bekommen Kunden mit GEO-Auftrag 25 bis 40 Prompts, Kunden mit laufender SEO-Betreuung 12 bis 15, alle übrigen keine. Wer eine solche Staffel nicht vorher aufschreibt, verbraucht das Kontingent in der ersten Woche an dem Kunden, der zufällig als Erster gefragt hat.
Welche Fragen einen Messplatz verdienen
Wenn Prompts das knappe Gut sind, ist die Auswahl der Fragen die eigentliche Arbeit. Dafür braucht es eine Abgrenzung, die im Alltag ständig durcheinandergeht.
Eine FAQ ist kein Prompt. Eine FAQ ist eine Frage, die du stellst, damit deine eigene Seite sie beantwortet. Ein Prompt ist eine Frage, die ein Mensch einem Modell stellt. Das eine ist Inhalt, das andere ist Messung. Wer die FAQ-Sammlung seiner Website in ein Messwerkzeug kippt, verbrennt das Kontingent an Fragen, die so niemand stellt. Zur Größenordnung: Unser eigener Bestand trägt je nach Zählweise zwischen 2.400 und 6.100 FAQs bei 2.445 erfassten Adressen. Das bildet kein Tarif ab, auch die große Stufe mit 1.000 Prompts nicht.
Die Regel, nach der wir zuteilen, hat zwei Bedingungen, und beide müssen erfüllt sein: Ein Prompt verdient einen Messplatz, wenn die Antwort eine Anbieter- oder Kaufentscheidung trägt und wenn sie zwischen Anbietern unterscheidet.
Das trifft auf Auswahlfragen zu („welches X ist das beste“), auf Vergleichsfragen („X oder Y“), auf Markenfragen (wird die eigene Marke genannt oder stattdessen der Wettbewerb) und bei lokalen Anbietern auf Ortsfragen. Es trifft nicht zu auf reine Definitionsfragen ohne Anbieterbezug, auf Servicefragen zum eigenen Betrieb („wie lange dauert die Lieferung bei euch“) und auf Fragen mit trivialer Faktenantwort. Dort nennt das Modell keine Marke, und der Messplatz ist verbrannt.
Betriebsbefund: der 403, der keiner ist
Ein Punkt, der in keinem Testbericht steht, weil er erst auftaucht, wenn man die Daten automatisiert weiterverarbeiten will: Zwei Werkzeuge desselben Anbieters können getrennte Zugänge verlangen. In unserem Fall gilt der Schlüssel des Ranking-Zugangs in SE Visible nicht, und die Antwort darauf ist ein 401, das man sofort versteht.
Weniger offensichtlich ist der zweite Fall. Mit dem richtigen Schlüssel, aber ohne Browser-Kennung im Anfragekopf, antwortet nicht die Schnittstelle, sondern die Schutzschicht davor: 403 mit einer eigenen Fehlernummer. Dieser 403 sieht aus wie ein Rechteproblem und ist keines. Wer ihn als fehlende Berechtigung deutet, sucht im Konto statt im Anfragekopf, und das kostet einen halben Tag.
Die verallgemeinerbare Lehre: Wenn du planst, aus einem Messwerkzeug einen wiederkehrenden Bericht zu bauen, prüfe den Abrufweg, bevor du den Bericht baust. Eine Oberfläche, die im Browser funktioniert, sagt nichts darüber, ob die Schnittstelle auf demselben Weg erreichbar ist.
Was kein GEO-Tool messen kann
Diesen Abschnitt schreiben Anbieter ungern, deshalb steht er hier. Google selbst formuliert die Grenze in seinem Leitfaden zur Optimierung für generative KI-Funktionen in einem Satz: „No third-party tool has access to our internal ranking or AI systems.“ Kein Werkzeug eines Drittanbieters hat Zugriff auf Googles Ranking- oder KI-Systeme.
Daraus folgt alles Weitere. Jedes GEO-Tool arbeitet durch Befragung, es erzeugt eine Stichprobe und keine Vollerhebung. Drei Dinge liegen damit außerhalb seiner Reichweite.
Erstens die echten Häufigkeiten. Ein Werkzeug weiß, was ein Modell auf deine 200 Fragen geantwortet hat. Es weiß nicht, wie oft Menschen diese Fragen wirklich stellen. Der einzige Ort mit echten Google-Daten ist der Bericht zur generativen KI-Leistung in der Search Console: kostenlos, seit dem 31. August 2026 weltweit für alle Websites verfügbar, und er deckt Übersichten mit KI sowie den KI-Modus ab. Er zeigt allerdings bewusst nur Impressionen. Keine Klicks, keine Position, keine Suchanfragen.
Zweitens die Beständigkeit einer einzelnen Antwort. Dasselbe Modell beantwortet dieselbe Frage zu verschiedenen Zeitpunkten verschieden. Eine Einzelmessung ist eine Anekdote. Erst eine Reihe über Wochen ist eine Messung, und genau dafür kostet ein Prompt bei jedem Zyklus.
Drittens der Umsatz. Kein Werkzeug sagt dir, was eine Nennung eingebracht hat. Es gibt keine durchgehende Spur von der KI-Antwort bis in dein Anfrageformular, die dem Werkzeug zur Verfügung stünde.
Wir richten die Messung ein, wählen die Fragen aus und liefern dir den Verlauf, statt dir ein Werkzeug zu empfehlen, das du danach allein bedienst. Die Auswahl der Fragen ist der Teil, an dem es hängt.
Fünf Fragen vor dem Kauf
- Welche der beiden Fragen willst du beantworten? Innensicht oder Markt. Wer beides braucht, braucht zwei Werkzeuge und sollte das vorher wissen statt hinterher.
- Wie viele Projekte enthält der Tarif? Nicht wie viele Prompts. Die Projektzahl begrenzt, wie viele Marken du gleichzeitig messen kannst, und sie lässt sich nicht durch Sparsamkeit umgehen.
- Zeigt das Werkzeug zitierte Quellen auf URL-Ebene? Auf Domain-Ebene ist die Information hübsch. Auf URL-Ebene ist sie eine Arbeitsanweisung.
- Wie oft wird gemessen, und was kostet ein Zyklus? Rechne den Monat, nicht den Einzelabruf.
- Kommst du an die Rohdaten? Export oder Schnittstelle. Sonst hängt dein Bericht an einer Oberfläche, die der Anbieter jederzeit umbaut.
Wenn du erst einmal eine Standortbestimmung willst, ohne Tarif und ohne Zugang: Unser kostenloser SEO- und GEO-Check prüft deine Seite auf die Punkte, die überhaupt erst dafür sorgen, dass ein Modell dich zitieren kann.
Ein Werkzeug erzeugt keine Sichtbarkeit
Zum Schluss die unbequeme Einordnung: Messen ist nicht arbeiten. Ein GEO-Tool sagt dir, wo du stehst, und es sagt dir nach zwei Monaten, ob sich etwas bewegt hat. Es bewegt nichts.
Bewegt wird durch das, was ein Modell überhaupt erst zitierfähig findet: klar formulierte Antworten an der Stelle, an der die Frage steht, saubere Entitäten, die über Seiten und Domains hinweg dieselbe Aussage machen, strukturierte Daten, die diese Aussage maschinenlesbar wiederholen, und eine Website, die für KI-Systeme abrufbar ist, wozu auch eine gepflegte llms.txt gehören kann. Google schreibt im selben Leitfaden einen Satz, der die Aufregung um die Begriffe ganz gut sortiert: „optimizing for generative AI search is optimizing for the search experience, and thus still SEO.“
Wer die Grundlagen nicht hat, kauft sich mit einem GEO-Tool eine sehr genaue Beschreibung seines Problems.
Du bekommst von uns keine Tarifempfehlung, bevor wir wissen, welche Fragen dein Thema überhaupt trägt. Das Erstgespräch kostet nichts und endet oft mit der Einschätzung, dass du zuerst an der Seite arbeiten solltest und erst danach an der Messung.
Häufige Fragen zu GEO-Tools
Was ist ein GEO-Tool?
Ein GEO-Tool stellt Sprachmodellen wie ChatGPT, Gemini oder Perplexity eine feste Menge an Fragen und wertet die Antworten aus: ob eine Marke genannt wird, ob sie verlinkt ist und welche Quellen das Modell herangezogen hat. GEO steht dabei für Generative Engine Optimization, also für Sichtbarkeit in KI-Antworten, nicht für Geodaten.
Was kostet ein GEO-Tool?
Der Tarifpreis ist nur die halbe Antwort. Entscheidend sind zwei Kontingente: die Zahl der Prompts, die bei jedem Messzyklus erneut verbraucht wird, und die Zahl der Projekte, also der Marken, die gleichzeitig gemessen werden können. Bei wöchentlicher Messung ist ein Kontingent von 200 Prompts bereits nach 50 Fragen aufgebraucht.
Reicht die Google Search Console zum Messen der KI-Sichtbarkeit?
Für einen Teil der Frage ja. Der Bericht zur generativen KI-Leistung zeigt seit dem 31. August 2026 weltweit, wie oft Links zu einer Website in Übersichten mit KI und im KI-Modus erschienen sind. Er liefert aber ausschließlich Impressionen, keine Klicks, keine Positionen und keine Suchanfragen, und er deckt nur Google ab, nicht ChatGPT oder Perplexity.
Wie viele Prompts braucht man für eine belastbare Messung?
Weniger, als die meisten annehmen, aber regelmäßiger. Eine einzelne Messung ist eine Momentaufnahme, weil dasselbe Modell dieselbe Frage zu verschiedenen Zeitpunkten verschieden beantwortet. Belastbar wird es durch die Reihe: lieber 20 gut ausgewählte Fragen über drei Monate als 200 Fragen ein einziges Mal.
Warum liefern zwei GEO-Tools unterschiedliche Ergebnisse?
Weil sie unterschiedlich fragen. Ergebnisse hängen an der Fragenmenge, am abgefragten Modell, am Zeitpunkt und am Standort. Kein Werkzeug hat Zugriff auf die internen Systeme der Anbieter, jedes arbeitet mit Stichproben. Zwei Werkzeuge sind deshalb nur vergleichbar, wenn sie dieselben Fragen zur selben Zeit stellen. Welche Anbieter im deutschen Markt überhaupt damit arbeiten, haben wir in unserer Übersicht der GEO-Agenturen in Deutschland zusammengetragen.
Quellen
- Google Search Central: „Google’s guide to optimizing for generative AI features“, developers.google.com, Stand 10.07.2026, abgerufen am 18.09.2026.
- Google Search Console-Hilfe: „Bericht ‚Generative KI-Leistung‘“, support.google.com, abgerufen am 18.09.2026.
- Google Search Central Blog: „Introducing Search Generative AI performance reports in Search Console“, developers.google.com, Juni 2026.
- SE Ranking: „AI Visibility Tracker“, seranking.com, abgerufen am 18.09.2026.
- SE Ranking: Keyword-Datenbank Deutschland (Suchvolumen und Difficulty zu „geo tools“, „geo audit“, „ki sichtbarkeit messen“ und „ai visibility tools“), Stand September 2026, seranking.com.