KI-generierte Texte gibt es inzwischen wie Sand am Meer. Klar, dass deshalb passende Detektoren her mussten. Die funktionieren aber â Wunder oh Wunder â auch auf Basis von KI. SpĂ€testens, als eines dieser Tools persönlich von mir geschriebene Texte als «von KI» bewertet hat, wurde ich stutzig. Wenn sauber recherchierte und stilistisch hochwertige Texte plötzlich als «verdĂ€chtig» gelten, lĂ€uft offenbar irgendwas schief. Noch absurder: ebenjene Kriterien, die einen guten Text ausmachen, gelten gleichzeitig als Hinweis auf KI-Beteiligung. Erkennen wir kĂŒnstliche Intelligenz in Texten einfach nicht mehr â oder bestrafen wir ab sofort echtes, gutes Schreiben?
Warum liegen sogar KI-Detektoren bei der Texterkennung daneben?
Um KI-generierte Texte als solche zu entlarven, gibt es mittlerweile verschiedenste Anbieter und Tools. Originality.ai etwa gibt es direkt als WordPress-Plugin, es scannt nach Belieben einzelne BeitrÀge bis zur gesamten Webseite und ermittelt einen «KI-Wahrscheinlichkeits-Score». Sprich, es analysiert, ob die Texte von KI oder von Menschenhand geschrieben wurden. Weitere Beispiele sind Uncertify AI (eine Kombi aus Erkennung & Textoptimierung) oder Copyleaks AI Detector.
Ich habe mehrere davon parallel getestet. Die Ergebnisse haben mich nicht nur ĂŒberrascht, sondern regelrecht amĂŒsiert. Denn bei einigen von mir schon vor Jahren â bevor es ĂŒberhaupt KI-Textgeneratoren wie ChatGPT, Grok, Gemini gab â selbst verfassten Texten waren diese Tools einstimmig der Meinung: «mit hoher Wahrscheinlichkeit KI». Autsch. Das hat mir einen DĂ€mpfer verpasst und dazu gefĂŒhrt, dass ich meinen Schreibstil in Frage stelle.
Nach passenden Recherchen und dem Hinterfragen der Analysemethoden war ich aber erleichtert. Vielleicht hatte ich kurz vergessen: Das ist kein Mensch, der meine Texte «bewertet». Es sind KIs. Und die bewerten nicht «Ist das menschlich?» â weil sie es nicht können â, sie bewerten «Wie sehr Ă€hnelt dieser Text einem statistischen Sprachmuster?»
Was sind Indizien fĂŒr KI-generierte Texte?
KI-Texte sind meistens auffĂ€llig «sauber». Keine GedankensprĂŒnge, keine echte Persönlichkeit. Dazu typische Formulierungen, die wie aus einem Baukasten wirken. Immer prĂ€sent: «Sicherheitsformulierungen», weil KI sich ungern festlegt. Wiederkehrende Sprachmuster hĂ€ufen sich innerhalb eines Textes. Die Struktur ist lehrbuchhaft, Bullet Points allgegenwĂ€rtig â selbst wenn sie unpassend sind â und jeder Absatz erfĂŒllt einen klaren Zweck. Wo die KI thematisch schwimmt, tauchen inhaltliche AuffĂ€lligkeiten auf: gleiche Aussagen, nur dezent umformuliert.
Aber ganz nebenbei: Ich liebe Bullet Points auch. Wenn ich viele Informationen bĂŒndig vermitteln will, gibt es nichts Besseres. Deshalb hier eine Liste mit typischen Erkennungsmerkmalen fĂŒr KI-generierte Texte:
- Gedankenstriche: Die meisten KI-Systeme nutzen Gedankenstriche statt anderer Satzzeichen, um SĂ€tze zu verbinden â weil sie auf englischsprachigen Daten trainiert wurden, wo das ĂŒblicher ist.
- Sicherheitsformulierungen und AbschwĂ€chungen: «oft», «viele», «kann» â KI vermeidet klare Aussagen, weil sie nicht falsch liegen will.
- Wiederkehrende Satzmuster: «nicht⊠sondern», «eine entscheidende Rolle».
- Lehrbuchhafte Struktur: Einleitung â ErklĂ€rung â Beispiele â Fazit. Funktioniert fĂŒr viele Themen, wirkt aber trotzdem generisch.
- Bullet Points: Besonders bei Fakten, Guides oder Ratgebern fÀllt KI zuverlÀssig in Listenform.
- Redundanz bei langen Texten: Gleiche Aussagen, immer wieder, nur anders formuliert.
- OberflÀchliche Tiefe: Klingt kompetent, bleibt aber allgemein.
- Ausweichende Beispiele: Statt konkreter FĂ€lle kommen generische Szenarien («Unternehmen könntenâŠÂ», «Mögliche Szenarien wĂ€renâŠÂ»). Keine greifbaren Details aus der Praxis.
- NeutralitĂ€t und SterilitĂ€t: Selbst bei Meinungen bleibt KI ausgewogen und zeigt keine klare Haltung â ausser jemand hat besonders gut gepromptet.
- Pseudo-IndividualitĂ€t: SĂ€tze wie «Hast du dich auch schon gefragt, obâŠÂ» oder «Stell dir vor, dassâŠÂ» sollen persönlich wirken, sind aber generisch.
Wird ein professioneller Schreibstil mit KI verwechselt?
Scheinbar schon. Vor allem bei sachlichen Themenschwerpunkten â Medizin, Studienanalysen, Darstellung von Fakten â lag mein Score teilweise bei hoher KI-Wahrscheinlichkeit.
Das liegt in der Natur der Sache: Wer sachlich berichtet oder nĂŒchterne Fakten wissensorientiert vermitteln will, greift nun mal nicht zum saloppen Stil. Das wĂ€re schlicht unpassend.
Ich sehe mich durch diese Tools vor einem echten Widerspruch. Ich habe mir ĂŒber Jahre einen konsistenten, sauberen Schreibstil aufgebaut â und genau der gilt jetzt als «verdĂ€chtig».
Warum wirkt „sauberes Schreiben“ verdĂ€chtig?
Was ich damals gelernt habe â und was ich nach wie vor fĂŒr richtig halte â: klare Satzstrukturen, logischer Aufbau, saubere Grammatik, konsistente und zum Thema passende TonalitĂ€t.
KI-Erkennungs-Tools machen daraus: Keine Varianz. Vorhersehbar. Wenig Ăberraschung. Zu glatt. Das Ergebnis: «mit hoher Wahrscheinlichkeit KI-generiert».
Mit anderen Worten: Einige meiner Texte werden abgestraft, weil ich sie handwerklich sauber geschrieben habe.
LÀsst sich das Problem lösen?
Meiner Meinung nach nicht â das System ist in sich widersprĂŒchlich. Eine KI soll bewerten, ob ein Text von einer KI geschrieben wurde. DafĂŒr wurde sie auf «guten» Texten trainiert. Und gute Texte sehen in vielen Punkten «KI-Ă€hnlich» aus.
Wo ist die Trennlinie? Die Schnittmenge zwischen «von Hand sauber geschrieben» (siehe dazu auch Ratgeber fĂŒr menschliche Texte: Menschlich schreiben in Zeiten von KI) und «typisch KI» ist riesig. Die Tools messen eher, wie generisch ein Text aufgebaut ist â nicht, wer ihn geschrieben hat. Das ist ein fundamentaler Unterschied.
In einem Kontext wie unserem â Content, Blog, SEO â ist ein strukturierter, sauberer Stil durchaus gewollt. Genauso der Wiedererkennungswert, denn sonst brĂ€uchte es keine menschlichen Autoren. Aber genau das triggert die Erkennungstools. FĂŒr eine rein redaktionelle Bewertung sind sie damit nahezu unbrauchbar.
Ironischerweise zwingt uns dieses Dilemma dazu, wieder mehr ĂŒber Stil nachzudenken. Vielleicht ist es sinnvoll, auch bei seriösen Texten eine persönliche TonalitĂ€t reinzubringen. Nicht, um hĂ€nderingend «menschlicher» zu wirken. Aber um wieder unterscheidbar zu sein.
Die eigentliche Frage ist fĂŒr mich nicht «Stammt das von KI oder einem Menschen», sondern «Ist dieser Text austauschbar oder hat er Substanz?»