Googles KI-Suche scheitert nach Ansicht des KI-Beraters Hitesh Sarda nicht am Sprachmodell, sondern an der Oberfläche. Die KI-Übersichten erscheinen in derselben Schrift und klingen so sicher wie die klassischen Treffer, obwohl sie oft nur eine Vermutung liefern. Shops mit eigenem KI-Assistenten können in dieselbe Falle laufen.
drweb.de als bevorzugte Quelle auf Google hinzufügenQualitätsgeprüfte Inhalte direkt in Google News & DiscoverJetzt hinzufügenAm 27. September schilderte ein Blogger, wie Googles KI-Suche auf seine Frage nach alten Fan-Witzen über den Basketballprofi Dario Šarić reagierte. Auf „hes never coming over dario“ antwortete die KI-Übersicht mit Trostworten, als hätte ein Mann namens Dario den Suchenden zurückgewiesen.[2] Sarda analysiert solche Fälle in einem Essay vom 28. September.[1]
Das Wichtigste in Kürze
- Hitesh Sarda verortet Googles Schwäche bei Platzierung und Kennzeichnung der KI-Antworten.
- KI-Übersichten sehen aus wie klassische Suchtreffer.
- Neben einer KI-Zusammenfassung klicken Nutzer laut Pew Research nur bei 8 % der Besuche auf einen Treffer, sonst bei 15 %.
- Der AI Act verlangt seit August 2026, dass Nutzer KI-Dialogsysteme erkennen.
Warum wirkt Googles KI-Suche trotz starkem Modell kaputt?

Hitesh Sarda sieht den Fehler oberhalb des Modells: in Entscheidungen darüber, wo die KI erscheint und wie offen Google Vermutungen als solche kennzeichnet.[1]
Eine Suchmaske gab lange ein stilles Versprechen: Dieselbe Anfrage liefert dieselben, überprüfbaren Treffer, mit Anführungszeichen sogar Treffer mit exakt diesem Wortlaut.[3] Mit den KI-Übersichten schob Google eine Wahrscheinlichkeitsebene in genau diese Oberfläche, gestaltet wie die Trefferliste darunter. Welche Zeile nachgeschlagen und welche geraten ist, zeigt die Seite laut Sarda nirgends.[1]
Den zweiten Grund sucht Sarda in der Organisation: Nach dem Gesetz von Conway spiegelt Software das Organigramm ihres Herstellers. Teams, die Funktionen nach eigenen Zielvorgaben ausliefern, bauen ein Produkt, das niemand zusammenführt. Die Folgen ungeprüft ausgelieferter KI-Funktionen beschreibt die Nielsen Norman Group als Aufräum-Ära der UX.
Wie teuer wird der Vertrauensverlust?
Der Schaden zeigt sich laut Sarda in einer Gewohnheit: Nutzer prüfen jede KI-Antwort nach, bevor sie handeln. In Dashboards fällt diese Prüfarbeit kaum auf, weil die Kontrolle oft eine weitere Google-Suche bedeutet.[1]
Im Mai 2024 standen in KI-Übersichten Ratschläge, Kleber an die Pizza zu geben oder Steine zu essen. Google-Managerin Elizabeth Reid erklärte die Ausrutscher mit missverstandenen Anfragen sowie Satireseiten und nannte mehr als ein Dutzend Verbesserungen, vor allem Filter.[4] Eine sichtbare Kennzeichnung unsicherer Aussagen nannte Reid nicht.
Pew Research maß im März 2025 an 68.879 Google-Suchen das Klickverhalten. Neben einer KI-Zusammenfassung klickten Nutzer bei 8 % der Besuche auf einen Treffer, ohne Zusammenfassung bei 15 %.[5] Junge Nutzer wandern von Google zu Chatbots ab, was die Generative Engine Optimization wichtiger macht.
Google-Suchen mit und ohne KI-Zusammenfassung
Verspricht die Funktion eine Tatsache oder einen Vorschlag?
Eine Vermutung im Layout eines Suchtreffers verspricht mehr, als das Modell halten kann.
Michael Dobler, Herausgeber Dr. Web
Was bedeutet das für KI-Funktionen auf Ihrer Website?
Prüfen Sie jede Fläche einzeln: Verspricht die Funktion eine Tatsache oder einen Vorschlag? Autovervollständigung und Entwürfe dürfen danebenliegen, Preise und Rechtsauskünfte nicht.[1]
Microsoft empfiehlt in seinen 18 Leitlinien für KI-Produkte, Nutzern zu zeigen, wie zuverlässig das System arbeitet.[6] Eine eigene Fläche für generierte Antworten und Quellenlinks je Aussage machen den Unterschied sichtbar. Luke Wroblewski rät ohnehin, Ergebnisse statt Werkzeuge zu gestalten.
In der EU kommt eine Pflicht hinzu: Seit dem 2. August 2026 müssen Anbieter KI-Systeme, die direkt mit Menschen interagieren, nach Artikel 50 des AI Act so gestalten, dass Nutzer die KI erkennen.[7] Den Unterschied zwischen Fakt und Vermutung muss trotzdem das Design leisten. Dass Betreiber für falsche Antworten haften, zeigt der Fall Baidu: Ein Gericht in Nanjing wertete ein erfundenes Strafurteil in der KI-Suche als Rufschädigung.
Gehen Sie vor dem nächsten KI-Feature gerne alle Seiten mit Sardas Frage durch. Bei Preisen, Verträgen oder Gesundheit verlinken Sie besser auf die geprüfte Quelle, statt eine KI zusammenfassen zu lassen.
Quellen
[1] Hitesh Sarda: „Google has the best AI money can buy. Its products still feel broken.“
[2] sancho, Bear Blog: „When did Google get so f-ing weird?“
[3] Google Suche-Hilfe: „Google-Suchanfragen optimieren“
[4] Google, Elizabeth Reid: „AI Overviews: About last week“
[5] Pew Research Center: „Google users are less likely to click on links when an AI summary appears in the results“
[6] Microsoft HAX Toolkit: „Make clear how well the system can do what it can do“
[7] EUR-Lex: „Verordnung (EU) 2024/1689 (KI-Verordnung)“, Artikel 50
Mehr Newshunger?
- KI-Slop erkennen: So befreien Sie vibecodierte Entwürfe vom Einheitslook
- Ladezustand im Ladezustand: Warum Marcin Wichary bei Figma Tipps im Ladebildschirm ablehnte
- KI-Inhalte: Google fordert den Faktencheck von Hand bis zum Alt-Text
- Stripe-Designchefin Katie Dill: Wie sich mit KI Anspruch, Qualität und Kunstfertigkeit skalieren lassen
- Die Voreinstellung ist keine Designentscheidung: Warum SaaS-Oberflächen immer gleicher aussehen
- Kontext schlägt Prompt: Die drei Rollen, mit denen Profis KI-Agenten steuern
- Das KI-Interface-Museum zeigt 15 Jahre Bedienoberflächen
