Eine Hand hält einen roten Stift über einem leeren Notizbuch auf einem hölzernen Tisch. Die Spiralbindung des Notizbuchs ist gut sichtbar.
Der Rotstift ist einsatzbereit. Jetzt brauchen wir nur noch etwas Text, den wir damit traktieren können (Kelly Sikkema, Unsplash-Lizenz).

Ein Prompt, der eure Texte tatsächlich verbessert

Statt Texte von der KI schreiben zu lassen, benutzen wir sie zur Ver­bes­se­rung. Hier eine An­lei­tung und ein aus­ge­klü­gel­ter Prompt, der für an­ge­wand­te Sprach­kri­tik taugt und Wort­wahl, Stil und Sprach­bil­der per­fek­tio­niert.

Die KI als Ghostwriter zu benutzen, ist dumm. Höchst sinnvoll ist hingegen, mit ihrer Hilfe die eigenen Texte zu verbessern. Ich verwende ChatGPT und Mistral gern auf der rein sprachlichen Ebene – ohne Einwirkung auf den Inhalt, meine Argumentation oder die Auswahl und Präsentation der Fakten. Ich benutze die LLMs auf zwei Ebenen: ad hoc während des Schreibens als Helfer für prägnante und exakte Formulierungen und am Ende für eine Sprachkritik.

1) Wortwahl und Vokabular während des Schreibens perfektionieren

Seit jeher hat die Textverarbeitung ein Synonymenwörterbuch (auch Thesaurus genannt). Das sorgt für Abwechslung, erfüllt jedoch längst nicht alle Bedürfnisse im Bereich der Wortfindung.

Ein simples Beispiel: Für meinen Blogpost über einen Sport-Bauchgürtel fehlte mir der Begriff für den Schliessmechanismus. Anhand der Beschreibung lieferte Gemini mir das fehlende Wort: Steckschnalle.

Das funktioniert gleichermassen für Fachbezeichnungen, Oberbegriffe und Spezialvokabular. Falls wir eine Tonalität treffen möchten, die uns nicht geläufig ist, fragen wir, wie ein bestimmter Satz in einem gewissen Jargon formuliert würde, etwa wissenschaftlich oder jugendsprachlich. Oder wir weisen die wortgewandte Wundermaschine an, einen Satz sauber stabreimend zu schreiben. (Dabei achten wir tunlichst darauf, dass wir es nicht übertreiben.)

Wir können uns helfen lassen, originelle Komposita oder Neologismen zu kreieren, wenn das zum Thema passt und für einen kreativen Extrakick sorgt (dazu im einen späteren Beitrag mehr). Für diese Hilfestellung verwenden wir die KI während des Schreibens nach Bedarf.

2) Den fertigen Text anhand einer Sprachkritik verbessern.

Der zweite Hebel ist ein ausführlicher Prompt, mit dem wir unseren Text nach Vollendung einer Prüfung allein auf Ebene der Sprache und der Wortwahl unterziehen. Das ist ein Prompt, den ich seit einiger Zeit als ChatGPT-Projekt verwende und kontinuierlich weiter ausbaue. Er kann und darf natürlich nach Belieben adaptiert werden:

Ausgangslage

Du bist mein gestrenger Lektor und prüfst den folgenden Text allein auf das verwendete Vokabular – ohne inhaltliche Beurteilung oder Veränderung. Der Text richtet sich an [Zielgruppe, z.B. Blog- oder Zeitungsleser und -leserinnen]. Die Textsorte ist [Analyse, Kommentar, Bericht, Newsmeldung, Blogpost, Glosse …]

Wortebene
  • Markiere Worte, die nicht zum Stil bzw. zur Sprachebene passen¹,
  • bezüglich Kollokationen verbessert werden könnten oder eine potenziell unerwünschte Konnotation² aufweisen.
  • Weise mich auf unnötige Anglizismen, Modewörter und Fremd- oder Fachwörter hin, für die leichter verständliche Synonyme existieren. Helvetismen sind okay, so lange sie das Verständnis nicht erschweren. Teutonismen passen nicht zu meinen Texten (Stulle würde seltsam wirken).
  • Markiere Nominalisierungen (vor allem Substantive auf -ung und -heit), für die es handlichere Ausweichformen gäbe oder die sich mittels Verb aktivieren lassen.
  • Zeige Füllwörter und Begriffe auf, die ich im Übermass brauche (auch, nun, etwa, zum Beispiel, noch, tatsächlich, dafür, eigentlich, natürlich, quasi, spannend, Thema, Bereich, etc.) und markiere ebenfalls unnötige Adjektive und Adverben. Teile mit, wenn ich überflüssigerweise Modalverben benutze.
  • Melde Wortwiederholungen, und Häufungen bei Wendungen oder Konstruktionen vor und schlage mir Alternativen vor – aber nur, wenn die eine echte Verbesserung darstellen.
  • Falls gesuchte und bemühte Synonyme vorhanden sind, die das Verständnis eher erschweren, verwende stattdessen das gängigste Wort.
Metaphern und Sprachbilder
  • Prüfe Sprachbilder auf ihre Stimmigkeit: Die einzelne Metapher soll in sich schlüssig sein und mit den anderen Vergleichen harmonieren.
  • Kennzeichne abgelutschte, banale, gestelzte und hinterwäldlerische Redewendungen wie «Herr und Frau Schweizer».

[Text]

Ausgabe

Liefere mir den Ursprungstext mit unveränderter Markdown-Formatierung zurück. Markiere die geprüften Stellen im Text farblich: Rot für Fehler, Orange für Stilbruch und Gelb für Geschmacksfragen. Setze in eckigen Klammern deinen Verbesserungsvorschlag hinzu (Rot: <span style="color:red; background-color:gray">Fehler: Vorschlag</span>; orange: <span style="color:orange; background-color:gray">Stilbruch: Vorschlag</span>; gelb: <span style="color:yellow; background-color:gray">Geschmacksfrage: Vorschlag</span>).

Hänge an deine überarbeitete Fassung einen Bericht an, der

  • detaillierteren Erläuterungen zu den einzelnen Vorschlägen enthält, falls nötig.
  • eine allgemeine stilistische und sprachliche Kritik zu den überprüften Punkten liefert.

Und so urteilen Gemini, ChatGPT und Claude

Ich habe den Prompt bei Gemini, ChatGPT und Claude eingespeist und den KIs jeweils meinen Blogpost Ist das KI oder kann das weg? vorgesetzt  (bei Gemini könnt ihr ihn als Gem hier ausprobieren, bei ChatGPT hier als Projekt).

Die Erkenntnisse:

Gemini prangert zu Recht an, dass ich das Adverb «hier» inflationär verwende

Diese KI findet ein überzähliges L im Wort «Listlicle» und einen Fallfehler beim «Funke» (inzwischen korrigiert). Sie prangert die umständliche Formulierung «für das Thema, um das es hier geht» an. Und sie trifft ins Schwarze, wenn sie meine Marotte, Sätze mit «und» zu beginnen, ins Fadenkreuz nimmt. Aber Gemini halluziniert einen Fehler herbei, den es nicht gibt («Man can [Fehler: kann] und darf ein falsches Dilemma vermuten.»).

Bei der Sprachkritik ist Gemini zu überschwänglich:

Der Text hat eine wunderbare, dynamische Energie. Er liest sich frisch, die Tonalität passt perfekt zu einem modernen Blog oder einer journalistischen Glosse.

Immerhin kann Google sich zu ein bisschen Kritik durchringen. Die ist etwas vage und kritisiert ein bewusst eingesetztes Stilmittel. Aber berechtigt ist sie trotzdem:

Der Text leidet unter einer leichten «Verschlammung» durch mündliche Gewohnheiten. Phrasen wie «Ihr wisst schon», «Und siehe da», «quasi» oder das bereits erwähnte «hier»blähen den Text auf, ohne echten Mehrwert zu liefern.

ChatGPT entdeckt einen Fehler im Lead

Dort schrieb ich «den letzten Resten» statt «Rest» und auch der Tippfehler im Wort «Listicle» fällt OpenAIs KI auf

Das Sprachmodell kritisiert «Anglizismen wie ‹Slop›, ‹«Deepfake›, ‹Threads› oder ‹Account›»:

Nicht alle müssen eingedeutscht werden. Problematisch werden sie dort, wo sie ohne Mehrwert nach LinkedIn-/Plattformjargon riechen: «Social-Media-Kanäle», «integraler Bestandteil», «trollen», «Slop-Durchsetzung». Da reichen oft einfachere Wörter.

Und ja, die App heisst Threads, da kann ich nichts machen. Die vielen «Hiers» bleiben unentdeckt, aber der Lektor entdeckt Verbesserungspotenzial bei den Füllwörtern und Adverbien: «‹vermutlich› kommt gehäuft vor, ebenso relativierende Wendungen wie ‹quasi›, ‹offensichtlich›, ‹zumindest›, ‹vielleicht sogar›. Das passt zwar zum tastenden, essayistischen Ton, könnte aber an ein, zwei Stellen gestrafft werden.»

Textausschnitt aus einem Artikel über gefälschte KI-Bilder, der die Diskussion um deren Auswirkungen auf Popkultur und Kreativität thematisiert. Beinhaltet kritische Anmerkungen und Meinungen.
Die von ChatGPT farblich markierten Verbesserungsvorschläge im Markdown-Editor, wo sie direkt umgesetzt werden können.

Auch ChatGPT halluziniert einen Fehler herbei, der im Text nicht vorhanden ist (ein angeblich fehlender Artikel bei «die Flut»). Die Sprachkritik am Ende ist nicht falsch, aber nicht sonderlich prägnant:

Sprachlich lebendig, pointiert und blogtypisch locker. Die grösste Gefahr ist nicht Slang, sondern die Mischung aus sehr saloppen Eigenprägungen («versloppen», «Läääängen», «µ optimistischer») und abstrakterem Feuilleton-/Sachtextvokabular. Meist trägt diese Reibung den Text; an ein paar Stellen wirkt sie gesucht.

Claude liefert die beste Sprachkritik

Claude findet wie seine beiden Mitstreiter einen Genus-Fehler («eine Autorin … seine Einsicht»): Das ist der einzige der Grammatik- und Orthografiefehler, der allen drei Sprachmodellen aufgefallen ist. Das ist ein Trost für uns alle, die wir unsere eigenen Vertipper und Verschreiber übersehen. Die stilistische Kritik von Anthropics Modell trifft voll ins Schwarze:

Der Text hat einen klaren, wiedererkennbaren Sound: pointiert, ironisch, mit Lust an Wortspielen («versloppen», «Läääängen», «µ optimistischer») und alltagssprachlichen Einsprengseln («kriegen», «toll», «den Braten riechen»). Die Reibung entsteht dort, wo bildungssprachliche oder bürokratische Wörter («entrinnen», «überdies», «integraler Bestandteil», «deretwegen», «exquisit») unvermittelt in diesen lockeren Fluss hineinragen. Sie sind alle für sich genommen korrektes Deutsch, aber sie kollidieren mit dem sonstigen, bewusst unprätentiösen Register.

Abschliessendes Fazit

Abschliessend fällt auf, wie breit gestreut die Urteile sind. Nicht einmal die Grammatikfehler werden von allen Sprachmodellen zuverlässig identifiziert. Bei den offensichtlichen stilistischen Problemen wie meiner inflationären Verwendung von Worten wie «hier» und «und» gibt es ebenso wenig einen Konsens. Das finde ich überraschend und es beweist einmal mehr, dass Sprachmodelle keine Wahrheitsmaschinen sind, sondern durch ihr Trainingsmaterial geprägt werden. Man darf dieses Resultat so interpretieren, dass es bei Stilfragen keine absolute Wahrheit gibt. Unterschiedliche Gewichtungen und Sichtweisen sind unvermeidlich.

Das erschwert es, die KI für solche Sprachverbesserungen einzusetzen, aber es entwertet sie nicht. Wir kommen jedoch nicht umhin, die LLMs zu vergleichen und unseren persönlichen Liebling zu küren – wie in diesem Fall Claude.

Bei der formalen Kritik fällt Gemini durch: Googles Sprachmodell ist nicht in der Lage, die geforderte farbliche Auszeichnung per <span>-Tag vorzunehmen. Bei ChatGPT und Claude ist sie vorhanden, wird im Browser leider nicht angezeigt. Sie ist erst sichtbar, wenn der Text in einen Markdown-Editor kopiert wird. Tipps dazu gibt es  in einem kommenden Blogbeitrag.

Fussnoten

1) Man nennt das manchmal auch Register-Shifting, d. h. eine unangemessene Wortwahl, die zu salopp, umgangssprachlich oder zu akademisch für die Zielgruppe ist, die wir an dieser Stelle spezifizieren.

2) Ein Wort ist negativ besetzt, aber im Kontext neutral gemeint oder vielleicht auch zu euphorisch oder werberisch.

Kommentar verfassen