- Dennis Gumprich
Der Text liegt seit drei Tagen bei der Fachabteilung. Die Rückmeldung kommt in einem Satz: Passt so nicht ganz, bitte nochmal überarbeiten.
Du liest den Text erneut und findest nichts. Also fragst du nach. Zwei Tage später erfährst du, dass eine Formulierung im dritten Absatz so nicht verwendet werden darf. Der Rest war in Ordnung. Fünf Tage für eine Information, die in eine Checkliste gehört hätte.
Eine Prüfliste für KI-Texte ersetzt Geschmacksdiskussionen durch entscheidbare Fragen. Wirksam sind acht Kriterien in drei Gruppen: Fakten, Marke und Recht. Jedes Kriterium hat eine Zuständigkeit und ein eindeutiges Ergebnis, sodass eine Prüfung in unter zehn Minuten machbar ist.
Warum Freigaben so lange dauern
Der häufigste Grund für lange Freigabeschleifen ist nicht mangelnde Sorgfalt, sondern fehlende Klarheit darüber, worauf geprüft wird. Wer einen Text ohne Kriterien bekommt, prüft alles gleichzeitig: Inhalt, Ton, Rechtschreibung, Rechtslage, Strategie.
Das führt zu Rückmeldungen wie passt so nicht ganz. Diese Aussage ist für die prüfende Person völlig ausreichend, weil sie weiß, was sie meint. Für die schreibende Person ist sie wertlos, weil sie nicht sagt, welche Ebene betroffen ist.
Bei KI-erzeugten Texten verschärft sich das Problem, weil ein zusätzlicher Verdacht mitschwingt. Formulierungen werden kritisiert, die in einem selbst geschriebenen Text niemandem aufgefallen wären. Eine Checkliste nimmt dieser Diskussion die Grundlage: Geprüft wird, was auf der Liste steht, unabhängig davon, wie der Text entstanden ist.
Welche Kriterien gehören auf die Prüfliste für KI-Texte?
Acht Kriterien in drei Gruppen: Fakten mit belegten Zahlen, Eigenangaben und Aktualität. Marke mit Anrede und Ton, Ausschlussliste und Eigenständigkeit. Recht mit Werbeaussagen und Personen- oder Kundenfreigaben. Jedes Kriterium hat genau eine Zuständigkeit und ein Ja-Nein-Ergebnis. Bei Umwelt- und Nachhaltigkeitsaussagen kommt seit 2026 eine zusätzliche Prüfung hinzu, die Anforderungen stehen in EmpCo-Richtlinie: was die EU-Vorgaben für Green Claims ab 2026 bedeuten.
| Gruppe | Kriterium | Prüffrage | Zuständig |
|---|---|---|---|
| Fakten | Belegte Zahlen | Steht hinter jeder Zahl eine gesicherte Quelle? | Redaktion |
| Fakten | Eigenangaben | Stimmen alle Aussagen über unser Unternehmen? | Fachabteilung |
| Fakten | Aktualität | Tragen zeitbezogene Aussagen ein Datum? | Redaktion |
| Marke | Anrede und Ton | Durchgehend passend zum Format, ohne Wechsel? | Redaktion |
| Marke | Ausschlussliste | Enthält der Text verbotene Formulierungen? | Redaktion |
| Marke | Eigenständigkeit | Könnte ein Wettbewerber diesen Text genauso veröffentlichen? | Redaktion |
| Recht | Werbeaussagen | Sind Wirkungs- und Vergleichsaussagen zulässig? | Rechtsabteilung |
| Recht | Personenbezug | Sind genannte Personen und Kunden freigegeben? | Rechtsabteilung |
Das sechste Kriterium ist das ungewöhnlichste und das nützlichste. Ein Text, den euer Wettbewerb wortgleich veröffentlichen könnte, ist inhaltlich korrekt und trotzdem wertlos. Diese Frage fängt genau die Beliebigkeit ab, die bei KI-Texten am häufigsten kritisiert wird.
Wie viel Zeit spart eine feste Prüfliste?
Statt drei bis fünf Tagen Freigabedauer mit Rückfragen unter zehn Minuten Prüfzeit je Beitrag, und eine Runde statt zwei bis drei Abstimmungsschleifen. Der Gewinn entsteht nicht durch schnelleres Lesen, sondern dadurch, dass die Rückmeldung eindeutig wird.
Arbeitsmodell zur Veranschaulichung, keine erhobenen Messwerte.
Der Zeitgewinn entsteht nicht durch schnelleres Lesen, sondern dadurch, dass die Rückmeldung eindeutig wird. Statt passt so nicht ganz steht dann: Kriterium 5 nicht erfüllt, Formulierung X ersetzen. Das ist in Minuten behoben.
Wie sollte eine Rückmeldung an den Autor aussehen?
Kriterienbezogen und ohne Zusatz: Kriterien 1 bis 4 erfüllt, Kriterium 5 nicht, Begriff X steht auf der Ausschlussliste. Ein passt so noch nicht erzeugt dagegen eine neue Runde. Wichtig ist die Regel, dass nur gegen die Liste geprüft wird. Wer zusätzlich Stilkorrekturen einbringt, hebelt den Zeitgewinn aus.
Passt so noch nicht, bitte nochmal drüberschauen. Klingt auch etwas generisch.
Kriterien 1 bis 4 erfüllt. Kriterium 5: Begriff marktführend steht auf der Ausschlussliste. Kriterium 8: Kundenname noch nicht freigegeben, bitte anonymisieren oder Freigabe einholen.
Wichtig ist die Regel, dass nur gegen die Liste geprüft wird. Wer zusätzlich Stilkorrekturen einbringt, hebelt den Zeitgewinn wieder aus. Stilfragen gehören in die Markensprache, nicht in die Einzelfallprüfung.
Fünf Fehler bei Prüflisten
- Zu viele KriterienAb etwa zwölf Punkten wird nicht mehr geprüft, sondern überflogen. Acht ist eine belastbare Obergrenze.
- Kriterien ohne eindeutige AntwortIst der Text überzeugend lässt sich nicht mit Ja oder Nein beantworten und führt zurück in die Geschmacksdiskussion.
- Keine ZuständigkeitWenn nicht feststeht, wer welches Kriterium prüft, prüfen alle alles oder niemand etwas.
- Liste nur für KI-TexteEine getrennte Behandlung erzeugt den Eindruck, KI-Texte seien grundsätzlich verdächtig. Die Liste sollte für alle Texte gelten.
- Ergebnisse nicht zurückführenWenn dasselbe Kriterium dreimal scheitert, gehört die Ursache in Markensprache oder Faktenblatt, nicht in die nächste Prüfung.
In fünf Schritten zur eingeführten Prüfliste
- Woche 1Abgelehnte Texte auswertenNehmt die letzten zehn Rückmeldungen und ordnet jede einer Ursache zu. Daraus entstehen eure tatsächlichen Kriterien.
- Woche 2Auf acht Punkte kürzenNur Kriterien behalten, die mit Ja oder Nein beantwortbar sind. Alles andere gehört in die Markensprache.
- Woche 2Zuständigkeiten festlegenJe Kriterium eine Rolle, nicht mehrere. Bei Uneinigkeit entscheidet die Rolle, nicht die Diskussion.
- Woche 3Format der Rückmeldung vereinbarenKriteriumsnummer plus konkrete Stelle. Freitext ohne Bezug wird zurückgewiesen.
- Ab Woche 4Quartalsweise auswertenWelches Kriterium scheitert am häufigsten? Diese Ursache gehört behoben, nicht wiederholt geprüft.
Wie passt ihr die Kriterien je Inhaltstyp an?
Nicht über ein zweites Regelwerk, sondern über eine Auswahl aus derselben Liste. Ihr legt je Inhaltstyp fest, welche der acht Kriterien gelten. Damit bleibt die Liste einheitlich und der Aufwand angemessen, denn ein Social-Beitrag trägt andere Risiken als ein Fachartikel mit Produktbezug.
Acht Kriterien für jeden Text anzuwenden klingt sauber und scheitert im Alltag daran, dass ein Social-Beitrag andere Risiken trägt als ein Fachartikel mit Produktbezug. Wer beides gleich prüft, prüft entweder zu viel oder zu wenig.
Die tragfähige Lösung ist kein zweites Regelwerk, sondern eine Auswahl aus derselben Liste. Ihr legt je Inhaltstyp fest, welche der acht Kriterien gelten. Damit bleibt die Liste einheitlich, der Aufwand aber angemessen.
| Inhaltstyp | Geltende Kriterien | Begründung |
|---|---|---|
| Ableitung aus freigegebenem Kern | 4, 5 | Fakten wurden bereits geprüft, es bleibt die formale Ebene |
| Blogbeitrag ohne Produktbezug | 1, 3, 4, 5, 6 | Keine Eigenangaben, keine Werbeaussagen |
| Fachbeitrag mit Produktbezug | alle acht | Vollständiges Risikoüber alle drei Gruppen |
| Kundenreferenz oder Fallstudie | 2, 7, 8 zwingend | Personenbezug und Freigabe des Kunden entscheidend |
| Interne Unterlage | 1, 2, 3 | Nur die Faktengruppe, Stil ist zweitrangig |
Die erste Zeile ist der größte Hebel im Alltag. Wenn eine Kanalfassung aus einem bereits geprüften Beitrag entsteht, ist eine erneute Faktenprüfung eine Wiederholung. Zwei Kriterien genügen, und der Vorgang dauert Minuten statt Tage. Ob ein Beitrag zusätzlich als KI-gestützt gekennzeichnet werden muss, klärt KI-Kennzeichnung: wie ihr zu einer belastbaren Praxis kommt.
Was passiert, wenn ein Kriterium nicht erfüllt ist?
Das hängt vom vorher festgelegten Schweregrad ab. Drei Stufen reichen. Stopp bedeutet: keine Veröffentlichung, bis die Stelle geklärt ist, und gilt bei falscher Eigenangabe, unzulässiger Werbeaussage oder fehlender Personenfreigabe. Ohne diese Abstufung wird jede Anmerkung zur Vollbremsung.
Eine Prüfliste beantwortet, ob etwas erfüllt ist. Sie beantwortet nicht, was dann geschieht. Genau an dieser Stelle entstehen die Verzögerungen, die eine Liste eigentlich verhindern sollte.
Wirksam ist eine Abstufung in drei Schweregrade, die vorher festgelegt wird. Nicht jede Beanstandung darf eine Veröffentlichung stoppen, und nicht jede darf ignoriert werden.
Diese Abstufung hat einen zweiten Effekt, der oft unterschätzt wird: Sie nimmt der prüfenden Person die Sorge, mit einer Anmerkung einen Termin zu gefährden. Wer weiß, dass ein Vermerk keine Blockade auslöst, meldet auch kleinere Beobachtungen. Ohne Abstufung wird entweder übertrieben blockiert oder aus Rücksicht geschwiegen.
Ein Prüfdurchlauf in der Praxis
Wie das konkret aussieht, lässt sich an einem typischen Fall zeigen. Ein Fachbeitrag mit Produktbezug, rund 1.500 Wörter, geht in die Freigabe.
Die Redaktion prüft zuerst die Kriterien 1, 3, 4, 5 und 6. Sie liest dabei nicht den gesamten Text auf alles gleichzeitig, sondern geht die Liste durch: Zuerst alle Zahlen im Text, dann alle zeitbezogenen Aussagen, dann Anrede und Ansprache, dann Abgleich mit der Ausschlussliste, zuletzt die Frage nach der Eigenständigkeit. Fünf gezielte Durchgänge dauern zusammen weniger als ein gründliches Komplettlesen und finden mehr.
Was übrig bleibt, geht als konkrete Anfrage weiter: an die Fachabteilung die zwei Aussagen über das Produkt, an die Rechtsabteilung die eine Vergleichsaussage. Beide bekommen nicht den Beitrag mit der Bitte um Durchsicht, sondern zwei markierte Sätze mit einer Frage. Der Zeitunterschied zwischen diesen beiden Varianten beträgt in der Praxis Tage.
Zurück kommen zwei Antworten. Die Produktaussage stimmt, die Vergleichsaussage nicht. Kriterium 7 ist damit nicht erfüllt, Schweregrad Stopp. Der Satz wird gestrichen, nicht umformuliert, weil eine abgeschwächte Vergleichsaussage dieselbe Prüfung erneut auslösen würde. Der Beitrag geht am selben Tag online.
Die Auswertung, die eure Liste verbessert
Eine Prüfliste ist kein statisches Dokument. Sie wird nur dann besser, wenn ihr auswertet, welche Kriterien tatsächlich scheitern. Diese Auswertung kostet einmal im Quartal etwa 30 Minuten und verändert die Arbeit spürbar.
Notiert dazu bei jeder Freigabe lediglich die Nummer des beanstandeten Kriteriums, mehr nicht. Nach drei Monaten habt ihr eine Verteilung. Diese Verteilung sagt euch, wo die Ursache liegt, und zwar unabhängig von einzelnen Personen.
Scheitert häufig Kriterium 1, fehlt euch ein Faktenblatt mit gesicherten Zahlen. Scheitert Kriterium 5, gehören die beanstandeten Begriffe in die Ausschlussliste, statt sie jedes Mal erneut zu finden. Scheitert Kriterium 2, ist die Wissensbasis unvollständig. In allen drei Fällen liegt die Lösung vor der Prüfung, nicht in ihr. Welche Fehlertypen hinter Kriterium 1 stecken und wie ihr sie vorher abfangt, steht in Halluzinationen im Marketing-Text systematisch abfangen.
Der wichtigste Befund dieser Auswertung ist meist ein anderer: Ein oder zwei Kriterien scheitern nie. Diese gehören gestrichen. Eine Liste, die von acht auf sechs schrumpft, wird zuverlässiger angewendet, weil sie schneller durchzugehen ist.
Selbstcheck: Wie klar ist eure Freigabe?
Setzt Haken bei allem, was auf euch zutrifft.
Vorschlag, wie wir Textfreigaben kürzer machen:
Wir prüfen künftig gegen acht feste Kriterien in drei Gruppen: Fakten, Marke und Recht. Jedes Kriterium ist mit Ja oder Nein beantwortbar und hat genau eine zuständige Rolle.
Rückmeldungen enthalten die Kriteriumsnummer und die konkrete Textstelle. Damit entfallen Rückfragen, was genau gemeint war, und wir kommen in einer Runde durch statt in zwei bis drei.
Die Liste gilt für alle Texte, unabhängig davon, ob sie mit oder ohne KI entstanden sind. Stilfragen regeln wir über die Markensprache, nicht im Einzelfall.
Kann KI die Prüfung selbst übernehmen?
Teilweise, und genau diese Unterscheidung entscheidet. Zuverlässig maschinell prüfbar ist der Abgleich gegen die Ausschlussliste, das ist eine Suchaufgabe. Gut unterstützbar ist auch das Auffinden zeitbezogener Aussagen ohne Datum. Nicht übertragbar sind Eigenangaben und Werbeaussagen: Ob eine Aussage über euer Unternehmen zutrifft, weiß nur euer Unternehmen.
Die Frage liegt nahe, wenn ohnehin mit KI gearbeitet wird. Die Antwort fällt je Kriterium unterschiedlich aus, und genau diese Unterscheidung entscheidet darüber, ob die Prüfung schneller oder unzuverlässiger wird.
Zuverlässig maschinell prüfbar ist Kriterium 5, die Ausschlussliste. Ein Abgleich gegen eine feste Wortliste ist eine Suchaufgabe und braucht kein Sprachmodell. Ebenfalls gut unterstützbar ist Kriterium 3: Ein Modell findet zuverlässig zeitbezogene Aussagen ohne Datumsangabe und markiert sie.
Nicht übertragbar sind die Kriterien 2 und 7. Ob eine Aussage über euer Unternehmen zutrifft und ob eine Werbeaussage zulässig ist, kann ein Modell nicht wissen, sondern nur plausibel raten. Genau hier entstehen die teuersten Fehler, und genau hier braucht es die zuständige Rolle.
Ein Sonderfall ist Kriterium 6, die Eigenständigkeit. Ein Modell kann durchaus einschätzen, ob ein Text generisch klingt, und ist darin oft strenger als der Mensch, der ihn geschrieben hat. Als Hinweisgeber ist das nützlich, als Entscheidung nicht, weil die Bewertung ohne Kenntnis eures Wettbewerbs erfolgt.
Praktisch heißt das: KI übernimmt die mechanischen Kriterien und markiert Kandidaten für die übrigen. Die Entscheidung bleibt bei den benannten Rollen. Wer die Prüfung vollständig automatisiert, hat sie faktisch abgeschafft, ohne es zu merken.
Wie führt ihr die Prüfliste ein, ohne Widerstand zu erzeugen?
Über die Herleitung aus den eigenen Ablehnungen, nicht über eine Ankündigung. Wenn die Liste sichtbar aus den letzten zehn Rückmeldungen des Teams entstanden ist, beschreibt sie das vorhandene Urteil, statt es zu ersetzen. Genau so solltet ihr sie auch vorstellen.
Eine Prüfliste verändert, wie Menschen über ihre eigene Arbeit sprechen. Wer bisher nach Gefühl bewertet hat, bekommt plötzlich ein Raster vorgelegt. Das kann als Misstrauen gelesen werden, besonders bei erfahrenen Personen, deren Urteil bisher gereicht hat.
Die Einführung gelingt deshalb selten über eine Ankündigung. Sie gelingt über die Herleitung aus den eigenen Ablehnungen. Wenn die Liste sichtbar aus den letzten zehn Rückmeldungen des Teams entstanden ist, beschreibt sie das vorhandene Urteil, statt es zu ersetzen. Genau so solltet ihr sie auch vorstellen.
Der zweite Punkt betrifft die Reihenfolge der Argumente. Wer mit Qualitätssicherung beginnt, erzeugt den Eindruck, die Qualität sei bisher unzureichend gewesen. Wer mit der Freigabedauer beginnt, spricht ein Problem an, unter dem alle Beteiligten leiden. Die Liste ist dann eine Entlastung und keine Kontrolle.
Rechnet in den ersten Wochen mit einer Übergangsphase. Anfangs werden mehr Beanstandungen auftauchen als vorher, weil gezielt gesucht wird, wo vorher überflogen wurde. Das ist kein Rückschritt, sondern der Grund für die Liste. Nach etwa zwei Monaten sinkt die Zahl spürbar, weil die häufigsten Ursachen bis dahin in Faktenblatt und Ausschlussliste gewandert sind.
Ein letzter Hinweis zur Autorität: Die Liste muss von der Rolle getragen werden, die auch die Freigabe verantwortet. Wird sie vom Marketing verordnet und von der Fachabteilung als zusätzliche Anforderung erlebt, wird sie umgangen. Wird sie gemeinsam beschlossen, ersetzt sie Diskussionen, die beide Seiten ohnehin als anstrengend empfinden.
Fazit: Kriterien schlagen Sorgfalt
Freigaben werden nicht schneller, wenn Beteiligte sich mehr Mühe geben. Sie werden schneller, wenn klar ist, worauf geprüft wird und wer entscheidet. Eine Liste mit acht entscheidbaren Fragen leistet dafür mehr als jede Aufforderung zur Gründlichkeit.
Häufige Fragen
Sollten KI-Texte strenger geprüft werden als andere?
Bei Fakten ja, weil Falschangaben dort systematisch entstehen können. Bei Stil und Marke nein. Eine generell strengere Behandlung führt dazu, dass Teams die Nutzung verschweigen, statt sie transparent zu machen.
Wer entscheidet bei Uneinigkeit?
Die für das Kriterium zuständige Rolle, ohne Diskussion. Genau dafür wird die Zuständigkeit vorher festgelegt. Wenn eine Entscheidung wiederholt als falsch empfunden wird, gehört das Kriterium überarbeitet, nicht der Einzelfall verhandelt.
Wie halten wir die Liste kurz?
Indem wiederkehrende Beanstandungen nicht als neues Kriterium aufgenommen, sondern an der Ursache behoben werden. Ein Begriff, der ständig beanstandet wird, gehört auf die Ausschlussliste der Markensprache und nicht in die Prüfung.
Funktioniert das auch mit externen Agenturen?
Besonders gut, weil eine Agentur eure ungeschriebenen Erwartungen nicht kennen kann. Die Kriterienliste gehört in das Briefing, nicht erst in die Abnahme.
Wie halten wir die Prüfung bei hohem Volumen durch?
Indem ihr die Kriterien je Inhaltstyp reduziert. Bei Ableitungen aus einem geprüften Kern genügen zwei Kriterien. Wer stattdessen versucht, alle acht auf jeden Social-Beitrag anzuwenden, gibt die Prüfung nach wenigen Wochen ganz auf.
Sollten wir die Prüfergebnisse dokumentieren?
Nur die Nummer des beanstandeten Kriteriums, nicht den Vorgang im Detail. Diese eine Angabe reicht für die quartalsweise Auswertung und kostet Sekunden. Eine ausführliche Dokumentation wird nach kurzer Zeit nicht mehr gepflegt und liefert dann gar keine Daten.
Was, wenn eine Beanstandung strittig bleibt?
Dann entscheidet die für das Kriterium zuständige Rolle, und zwar sofort. Wichtig ist die zeitliche Grenze: Eine strittige Frage darf einen Vorgang nicht mehrere Tage aufhalten. Wenn dieselbe Frage wiederholt strittig ist, gehört das Kriterium präzisiert, nicht der Einzelfall verhandelt.
Wie lässt sich euer Marketingalltag einfacher machen?
In 30 Minuten schauen wir gemeinsam darauf, wo euch heute unnötige Abstimmungen, manuelle Aufgaben, Toolwechsel oder wiederkehrende Content-Arbeit Zeit kosten.
Du bekommst eine konkrete Einordnung, welche Aufgaben ihr vereinfachen, automatisieren oder besser organisieren könnt und wo KI und Tools tatsächlich helfen, statt zusätzliche Komplexität zu schaffen.
Alles an eurem tatsächlichen Marketingalltag.
30 Minuten, um deinen Marketingalltag zu vereinfachen Kostenfrei. Du nimmst konkrete Ansatzpunkte mit, die ihr intern direkt weiterverwenden könnt.
Dennis Gumprich
Dennis begleitet Marketing- und Kommunikationsteams bei der Frage, wie generative KI in bestehende Content-Prozesse passt, ohne Qualität, Markensprache und Freigaben zu untergraben. Schwerpunkte: Content Operations, AI Governance und Toolauswahl in Mittelstand und Konzern.
Transparenzhinweis: Dennis arbeitet für contentbird, einen Anbieter von KI-gestützter Content-Software. Produkterwähnungen sind im Beitrag gekennzeichnet. Mehr über Dennis · LinkedIn
Weiterlesen
Entstehung dieses Beitrags
Dieser Beitrag ist unter Einsatz von KI entstanden. Struktur, Recherche und Formulierungsentwürfe wurden KI-gestützt erarbeitet. Fachliche Einordnung, Prüfung der Aussagen und die finale Fassung liegen bei Dennis Gumprich.
Zur Belastbarkeit der Zahlen
Die genannten Freigabedauern und Prüfzeiten sind ausdrücklich als Arbeitsmodelle gekennzeichnet und keine erhobenen Messwerte.
Rechtlicher Hinweis
Dieser Beitrag ersetzt keine Rechtsberatung. Welche Werbeaussagen in eurer Branche zulässig sind, klärt eure Rechtsabteilung.
Teile den Beitrag, wenn er dir weitergeholfen hat.


