Vor Kurzem gab ich eine einfache Frage in die Google-Suche ein: Wie viel Bildschirmzeit ist zu viel für Teenager? Anstatt wie bisher Links anzuzeigen, lieferte Google eine KI-generierte Antwort. Der KI-Assistent nannte eine Zahl, relativierte diese dann aber und merkte an, dass Qualität und Ausgewogenheit der Bildschirmzeit wichtiger sein könnten als die reine Stundenzahl und dass „zu viel“ Zeit vom Schlaf, der Bewegung, den schulischen Anforderungen und der Stimmung des Teenagers abhängen könne.
Ich habe eine weitere Suche versucht: Sollte ich täglich Aspirin einnehmen? Diesmal lieferte mir die KI medizinische Informationen, warnte vor Risiken und bot mir eine individuellere Beratung an, wenn ich mein Alter und meine Krankengeschichte angab.
Das waren gute Antworten. Mich interessierte vor allem, dass es unterschiedliche Arten von Antworten waren.
Die Debatte um KI-Antworten konzentrierte sich bisher auf die Genauigkeit: Hat das System die richtige Antwort gegeben? Das ist wichtig, aber Genauigkeit ist nur ein Kriterium. Jede Antwortart erfordert vom Nutzer eine andere Beurteilung.
Ich finde es hilfreich, KI-Antworten in eine „Antworttypografie“ mit vier Haupttypen einzuteilen: faktisch, interpretativ, konstruktiv und strategisch. Eine faktische Behauptung lässt sich oft anhand einer Quelle überprüfen. Eine Interpretation kann korrekt sein und dennoch die subjektive Einschätzung widerspiegeln, welche Beweise relevant sind. Eine Konstruktion kann gut begründet sein und dennoch für den Empfänger falsch. Ein elegant formuliertes strategisches Dokument kann falsch sein. Dennoch präsentiert die KI alle vier Antworttypen in einer ähnlich flüssigen und autoritären Form; die Unterschiede sind leicht zu übersehen.
Ich bin Universitätsbibliothekarin und Bibliotheksdirektorin an der University of Virginia und leite landesweite Initiativen zur Entwicklung von KI-Kompetenzen für Bibliothekare. Zudem berate ich umfassend zum Thema KI-Kompetenz. Den Typografie-Vorschlag veröffentlichte ich erstmals im Journal of Academic Librarianship.
Die vier Kategorien sind nicht strikt voneinander abgegrenzt. Eine Antwort eines KI-Systems kann verschiedene Typen aufweisen. Dennoch beschreibe ich im Folgenden jeden Antworttyp und gebe Hinweise, wie Sie entscheiden können, ob eine Antwort direkt verwendbar ist oder weiterer Prüfung bedarf.
Welche Antwort gibt Google Ihnen?
Eine faktische Antwort stellt eine Behauptung auf, die prinzipiell anhand von Beweisen überprüft werden kann. Wann wurde die University of Virginia gegründet? Was ist das chemische Symbol für Gold?
Um festzustellen, ob eine faktische Antwort ausreichend belegt ist, überprüfen Sie die Aussage anhand einer geeigneten Quelle. Wenn die Antwort eine Quelle zitiert, folgen Sie diesem Link, anstatt die Antwort selbst als Beweis zu betrachten.
Eine interpretative Antwort stützt sich auf Belege, doch es gibt keine allgemeingültige Schlussfolgerung. Wie viel Bildschirmzeit ist zu viel für einen Teenager? Steigert Telearbeit die Produktivität? Die Antwort hängt davon ab, welche Belege einbezogen, welche außer Acht gelassen und wie Meinungsverschiedenheiten interpretiert werden.
Googles erste Antwort auf meine Frage zur Bildschirmzeit deutete auf ein Limit von zwei Stunden für Teenager hin. Anschließend wurde darauf hingewiesen, dass kinderärztliche Empfehlungen der Qualität und dem Kontext der Bildschirmnutzung mehr Gewicht beimessen als der reinen Stundenzahl. Die Amerikanische Akademie für Kinderheilkunde gibt an, dass es keine exakte Empfehlung für Teenager und betont die Art der Bildschirmnutzung sowie die Aktivitäten, die dadurch möglicherweise verdrängt werden. Eine Frage, die zunächst wie eine reine Zahlenfrage aussah, erwies sich somit als interpretationsbedürftig.
Um Interpretationsantworten zu bewerten, reicht es nicht aus, nur Fakten zu prüfen. Fragen Sie sich, welche Beweise das System hervorgehoben, welche es ausgelassen hat und ob eine andere, vertretbare Interpretation existiert. Eine hilfreiche Anschlussfrage an die Suchmaschine lautet: „Was ist der stärkste Beweis für eine andere Schlussfolgerung?“

Konstruktive Antworten werden erarbeitet, nicht gefunden. Wenn man KI bittet, ein Anschreiben zu verfassen, eine Trauerrede zu schreiben, einen Unterrichtsentwurf vorzuschlagen oder einen Absatz umzustrukturieren, gibt es kein eindeutig richtiges Ergebnis.
Die Wirkung einer Trauerrede lässt sich anhand von Zweck, Zuhörern und dem gewählten Stil einschätzen. Eine grammatikalisch einwandfreie Rede kann dennoch völlig anders klingen als die Person, die sie vorträgt, oder sie wirkt auf die Angehörigen leblos. Möglicherweise wird der Verstorbene auch nicht angemessen dargestellt. Berücksichtigen Sie diese Effekte beim Lesen.
Strategische Fragen zielen darauf ab, Handlungsempfehlungen zu geben. Soll ich täglich eine Aspirin nehmen? Soll ich das Haus kaufen? Die Antworten verbinden Informationen mit einer Beurteilung von Zielen, Risiken, Abwägungen und persönlichen Umständen.
Meine Suche nach Aspirin zeigt, warum der Kontext so wichtig ist. Google warnte vor Risiken, empfahl mir, einen Arzt zu konsultieren, und bot mir individuellere Informationen an, wenn ich mein Alter, meine Herz-Kreislauf-Vorgeschichte und mein Blutungsrisiko angab. Diese Vorsicht deckt sich mit den Empfehlungen der US Preventive Services Task Force. Diese besagt, dass die Entscheidung für eine niedrig dosierte Aspirin-Therapie zur Vorbeugung von Herzinfarkten und Schlaganfällen individuell getroffen werden sollte und der Nutzen für das Herz-Kreislauf-System gegen das Blutungsrisiko abgewogen werden muss.
Um strategische Antworten zu erhalten, fragen Sie sich, welche Informationen das System benötigt, damit seine Empfehlung sinnvoll auf Sie persönlich anwendbar ist. Wägen Sie die Konsequenzen, die Alternativen und die Frage ab, ob eine qualifizierte Person hinzugezogen werden sollte. Im Fall von Aspirin wäre eine hilfreiche Anschlussfrage: „Welche Details zu meinem Alter, meiner Krankengeschichte oder meinem Blutungsrisiko könnten diese Empfehlung beeinflussen? Was sollte ich mit meinem Arzt besprechen, bevor ich eine Entscheidung treffe?“ Die endgültige Entscheidung liegt jedoch bei Ihnen, da Sie diejenige sind, die mit den Folgen leben muss.
Die erste Frage nach einer Antwort
Meine Fragen begannen mit gewöhnlichen Google-Suchanfragen. Ich habe keinen Chatbot geöffnet. Die KI-generierten Antworten kamen einfach an, und Links wurden hinzugefügt.
Die Antworten waren hilfreich. Google lieferte Kontext, ging auf Komplikationen ein und bot individuelle Hilfestellung, wenn ich zusätzliche Informationen bereitstellte. Innerhalb jeder Antwort konnte sich die Art der Antwort jedoch ändern. Die Wiedergabe einer medizinischen Leitlinie ist etwas anderes, als zu entscheiden, wie sie auf eine bestimmte Person anzuwenden ist. Eine flüssige Antwort kann zwischen diesen Antworttypen wechseln, ohne dass sich der Tonfall merklich verändert.
Versuchen Sie als Nutzer zu erkennen, welche Art von intellektueller Arbeit der KI-Agent für eine gegebene Antwort geleistet hat. Überlegen Sie, ob die Interpretation überzeugend ist und ob der Rat zu Ihren Umständen passt.
Bevor man fragt, ob eine KI-Antwort richtig ist, sollte man sich eine grundlegendere Frage stellen: Um welche Art von Antwort handelt es sich? Der Antworttyp gibt Aufschluss darüber, was als Nächstes zu tun ist.
Leo S. Lo, Dekan der Universität von Virginia.
Dieser Artikel wurde mit freundlicher Genehmigung von The Conversation unter einer Creative-Commons-Lizenz erneut veröffentlicht. Lesen Sie den Originalartikel.





