Field note
Sechs Engines, sechs verschiedene »beste« Agenturen
Ich bat sechs KI-Assistenten, den besten Spezialisten in meinem eigenen Feld zu nennen. Sie gaben sechs verschiedene Antworten — keine zwei gleich.
Ich stellte sechs KI-Assistenten dieselbe Frage: Wer ist der beste unabhängige Spezialist für KI-Suchsichtbarkeit? Ich erwartete etwas Überschneidung — ein, zwei Namen, die immer wieder kämen. Stattdessen bekam ich sechs verschiedene Antworten, keine zwei Engines nannten denselben Top-Pick. Nicht sechs Listen, die sich meist einig waren. Sechs verschiedene Welten.
Also prüfte ich, ob das ein Zufall war. Ich nahm sieben kundentypische Fragen — Varianten von „beste Agentur", „wer bietet Audits", „empfiehl einen Berater", „wen soll ich beauftragen" — und stellte allen sechs Engines (ChatGPT, Perplexity, Claude, Gemini, Copilot, Google AI Mode) denselben Wortlaut, mit Websuche an. Das sind 42 Antworten. Dann zählte ich, wer empfohlen wurde.
Die Uneinigkeit war die Regel, nicht die Ausnahme:
- Bei keiner der sieben Fragen nannten alle sechs Engines denselben Anbieter. Kein einziges Mal.
- Über die sieben Fragen wurden mehr als 100 verschiedene Agenturen, Berater und Tools genannt — und rund drei Viertel tauchten in nur einer Engine-Antwort auf.
- Ein Anbieter erreichte auch nur eine Mehrheit (vier von sechs Engines) nur eine Handvoll Mal. Das Nächste an einem Konsens-Pick tauchte immer noch nur in vier der sechs auf.
Eine Nuance, die bleibt: Je spezifischer die Frage, desto mehr konvergierten die Engines. „Empfiehl einen AEO-Berater für ein B2B-SaaS-Unternehmen" erzeugte die meiste Einigkeit der sieben — aber immer noch keinen Namen, den alle sechs teilten. Verenge die Absicht, und die Räume überlappen etwas mehr; sie werden nie ein Raum.
Und hier der Teil, der mich am meisten überraschte: Alle sechs Engines durchsuchten das aktuelle Web für diese Antworten und divergierten trotzdem so stark. Das ist also nicht eine Engine, die aus veraltetem Gedächtnis antwortet, während eine andere nachschlägt. Jede suchte, und jede baute aus dem Gefundenen eine andere engere Auswahl — die Uneinigkeit steckt also darin, wie jede Engine Quellen auswählt und ihnen vertraut, nicht darin, ob sie sich überhaupt umsah.
Die ehrlichen Vorbehalte, denn genau darum geht es: Das ist ein Feld, ein Satz Fragen, an einem Tag, mit Suche an, einmal bewertet. Engines driften zwischen Sitzungen, die genauen Namen würden bei einem Neulauf also wechseln — der Befund ist die geringe Einigkeit, nicht die konkrete Aufstellung. Und von einer Engine genannt zu werden, sagt nichts darüber, ob ein Anbieter tatsächlich gut ist; es zeigt nur, was die Engine zu sagen wählte.
Aber die Schlagzeile hält, und sie zählt, wenn du ein Unternehmen bist, das empfohlen werden will: Es gibt kein einzelnes „die KI empfiehlt uns". Eine Engine-Auswahl zu gewinnen, sagt dir fast nichts über die anderen fünf. Jede Engine ist ihr eigener Raum, mit ihrer eigenen Tür — genau darum muss ein Audit alle prüfen, auf dieselbe Weise, statt eine zu fragen und anzunehmen, der Rest sei einig.
Siehe auch zitieren KI-Engines dieselben Quellen? und wen KI zitiert.
New here? Start with the overview → · By Denes Csaszar · written in the open