Stilprüfung

Markiert Textstellen, die formal an typische Muster maschinell oder routiniert erzeugter Prosa erinnern. Das Werkzeug urteilt nicht, es zeigt. Jede Markierung ist eine Einladung zum zweiten Blick, kein Fehler.

Dieselben Muster kennzeichnen oft auch gute akademische oder rhetorisch dichte Texte. Wer jede Markierung tilgt, optimiert nicht auf „menschlich", sondern auf Blässe. Es gibt bewusst keinen Score und keine KI-Wahrscheinlichkeit, weil eine solche Zahl bei einem einzelnen Text Scheingenauigkeit wäre.
Datenschutz. Der eingegebene Text verlässt diesen Browser nicht. Es gibt keinen Server-Aufruf, keine Cookies, keine Reichweiten- oder Tracking-Skripte und keine Drittanbieter-Einbettungen. Alle Berechnungen laufen lokal in Ihrem Browser. Beim Schließen des Tabs ist nichts gespeichert.

Haftung. Das Werkzeug zeigt rein heuristische Mustertreffer. Es gibt keine Gewähr für Richtigkeit, Vollständigkeit oder Eignung der Befunde für irgendeinen Zweck. Die Nutzung erfolgt auf eigenes Risiko.
Welche Stilmittel markiert werden und warum

Markiert werden Formmerkmale, die in maschinell oder routiniert erzeugter Prosa gehäuft auftreten. Keines davon ist für sich genommen ein Fehler. Dieselben Mittel kennzeichnen auch gute rhetorische und akademische Texte. Auffällig wird erst die Häufung.

Antithese »nicht X, sondern Y«
Kontrastfigur, die eine Einsicht durch Verneinung zuspitzt. Einmal pointiert wirkungsvoll, als Dauermuster ein verbreiteter Reflex. Beispiel: Deutschland denkt in Projekten, nicht in Produkten.
Übergangs- und Eröffnungsfloskel
Vorgefertigte Anschlüsse, die Struktur eher behaupten als herstellen. Beispiele: Darüber hinaus, Letztlich, In einer Welt, in der.
Verstärker und Bedeutsamkeits-Adjektiv
Aufwertung ohne Beleg. Das Wort behauptet Wichtigkeit, statt sie zu zeigen. Beispiele: entscheidend, zentral, von grundlegender Bedeutung.
Hohlfloskel
Feste Wendung mit geringem eigenen Informationswert, oft Füllmaterial. Beispiele: spielt eine wichtige Rolle, vor dem Hintergrund, der Schlüssel zu.
Leere Bedeutungszuweisung
Verweist auf eine Bedeutung, ohne sie zu belegen. Beispiele: Dies unterstreicht, einmal mehr, umso wichtiger.
Möglicher Dreiklang
Dreiergruppe, wo zwei oder fünf Glieder oft natürlicher wären. Die unzuverlässigste Kategorie, da ein Regex eine rhetorische Figur nicht von einer banalen Aufzählung unterscheiden kann. Beispiel: einen Server, eine Datenbank oder eine KI-Anwendung.
Rhetorische Frage
Frage als Stilmittel im Fließtext, häufig zur Absatzeröffnung. Beispiel: Was bedeutet das konkret?
Abschwächung / Hedging
Vorsichts-Floskel, die im Dauergebrauch jede Aussage abfedert. Beispiele: kann durchaus, in vielen Fällen, unter Umständen.
Gedankenstrich
Gehäufte Halbgeviertstriche gelten als verbreiteter Marker, weil viele Modelle sie auffällig oft setzen.
Warum dieses Werkzeug keine KI-Wahrscheinlichkeit angibt

Eine Angabe wie „zu 80 Prozent KI-generiert" wäre Scheingenauigkeit. Dieses Werkzeug zählt Oberflächenmuster. Eine belastbare Wahrscheinlichkeit setzt etwas anderes voraus: ein statistisches Modell, trainiert auf großen, sauber zugeordneten Mengen menschlicher und maschineller Texte, sowie die bekannte Häufigkeit von KI-Texten in der geprüften Menge. Beides fehlt hier, und das zweite fehlt in der Praxis fast immer.

Auch eigens trainierte Detektoren leisten es nicht. OpenAI nahm den eigenen Klassifikator 2023 wegen geringer Treffsicherheit wieder vom Netz. Unabhängige Untersuchungen aus 2025 und 2026 berichten Gesamtgenauigkeiten von rund 60 bis 70 Prozent, wobei die Erkennung bei gemischten Mensch-KI-Texten gegen null fällt. Schon leichtes Umschreiben kippt das Ergebnis, sodass ein niedriger Wert nichts beweist.

Hinzu kommt das Grundproblem der Basisrate. Selbst ein sehr treffsicherer Detektor erzeugt überwiegend Fehlalarme, wenn KI-Texte in der geprüften Menge selten sind. Ohne Kenntnis dieser Häufigkeit ist eine Prozentzahl mathematisch bedeutungslos. Dichte Fachprosa und Texte von Nicht-Muttersprachlern werden dabei systematisch häufiger falsch markiert, was solche Zahlen gerade in Bildungs- und Prüfkontexten gefährlich macht.

Deshalb gibt dieses Werkzeug bewusst nur Markierungen aus. Die Zahlen im Vergleichsmodus messen die Stilverschiebung zwischen zwei Fassungen mit bekanntem Ursprung, nicht die Herkunft eines einzelnen Textes. Was technisch tatsächlich tragfähig wäre, ist nicht Textanalyse, sondern Herkunftsmarkierung an der Quelle, etwa über Wasserzeichen oder Provenance-Daten, wie sie Art. 50 der KI-Verordnung von den Anbietern verlangt.

Text einfügen

Befund

Fassung A

Üblich: das Original mit bekanntem Ursprung.

Fassung B

Üblich: die überarbeitete Version zum Vergleich.

Dieser Modus vergleicht zwei Fassungen mit Ihnen bekanntem Ursprung. Die Dichte ist die Trefferzahl pro 1000 Wörter, also längenbereinigt. Aussagekräftig ist die Veränderung zwischen A und B, nicht der Absolutwert. Welche Richtung „besser" ist, entscheiden Sie. Mehr Muster bedeutet nicht automatisch schlechter, und der Wert ist keine KI-Wahrscheinlichkeit.

Musterdichte je 1000 Wörter

Fassung A

Fassung B