KI-IMPERIUM
Claude ehrlich machen: der Prompt gegen das Ja-Sagen

Claude ehrlich machen: der Prompt gegen das Ja-Sagen

Ruwen Bädorf··7 Min. Lesezeit

KI-Modelle sind darauf trainiert, dass du zufrieden bist, nicht dass die Antwort stimmt. Sechs Regeln in den Einstellungen stellen das ab.

Claude ehrlich machen geht mit einem einzigen Prompt, den du einmal in die Einstellungen einfügst. Er besteht aus sechs Regeln, die dem Modell verbieten, dir nach dem Mund zu reden, Quellen zu erfinden oder Teile deiner Aufgabe still wegzulassen.

Der Grund, warum du ihn brauchst, ist unangenehm. KI-Modelle sind nicht darauf trainiert, dass ihre Antwort stimmt. Sie sind darauf trainiert, dass du mit der Antwort zufrieden bist.

Das ist ein Unterschied, den man leicht überliest. In der Praxis heißt er: Deine Idee wird bestätigt, statt dass jemand das Problem darin benennt.

Ich zeige den Ablauf regelmäßig als Reel, dort siehst du ihn in Bewegung: @ruwen.ai auf Instagram.

🔥 Willst du den fertigen Prompt? Im Guide zum ehrlichen Claude steht er komplett zum Kopieren, dazu die drei Stellen, an die er gehört. → Guide holen

Warum du Claude überhaupt ehrlich machen musst

Der Fachbegriff für das Problem ist Sycophancy, auf Deutsch Anbiederung. Er beschreibt die Neigung von Sprachmodellen, dir zuzustimmen, weil Zustimmung besser ankommt als Widerspruch.

Das entsteht beim Training. Modelle lernen aus menschlichen Bewertungen, welche Antworten gut ankommen. Menschen bewerten Zustimmung besser als Kritik, und genau das lernt das Modell.

Ein Forschungsteam aus Stanford hat das gemessen und die Ergebnisse in Science veröffentlicht. Elf führende Modelle wurden getestet. Im Schnitt bestätigten sie das Verhalten von Nutzern 49 Prozent häufiger, als Menschen es taten.

Das galt sogar dann, wenn die Nutzer im Unrecht waren.

Das MIT hat im Februar 2026 nachgelegt und ein mathematisches Modell dazu vorgelegt. Es zeigt, wie sich Menschen über viele Gespräche hinweg in falsche Überzeugungen hineinsteigern können, weil der Chatbot ihre Annahmen immer wieder bestätigt.

Wichtig dabei: Das ist keine Eigenart von Claude. Es steckt in der Bauweise dieser Modelle, und deshalb hilft nur eine klare Ansage.

Die drei Muster, an denen du es erkennst

Bevor du Claude ehrlich machen kannst, musst du sehen, wann er es nicht ist. Es gibt drei Muster, die immer wieder auftauchen.

Das erste ist die selbstbewusste Behauptung. Du bekommst eine Zahl, eine Studie oder einen Fachbegriff geliefert, klar und ohne Zögern. Nachgeprüft hat das Modell nichts davon.

Das zweite ist das stille Weglassen. Du gibst eine Aufgabe mit fünf Punkten, und du bekommst vier davon zurück. Der fünfte war der aufwendigste, und niemand erwähnt, dass er fehlt.

Das dritte ist die Zustimmung gegen besseres Wissen. Du schilderst deinen Plan, und du bekommst zurück, dass das ein guter Ansatz sei. Auch dann, wenn er es nicht ist.

Alle drei haben dieselbe Wurzel, und alle drei lassen sich mit demselben Prompt abstellen.

Der Prompt, mit dem du Claude ehrlich machst

Der Prompt besteht aus sechs Regeln. Jede davon zielt auf eines der Muster oben.

RegelWas sie abstellt
Unsicherheit benennenDie selbstbewusste Behauptung ohne Grundlage
Nichts erfindenErfundene Quellen, Studien und Zahlen
Nachfragen statt ratenAntworten, die an deiner Frage vorbeigehen
Vollständig erledigenDas stille Weglassen aufwendiger Teile
Widersprechen dürfenZustimmung, obwohl dein Plan ein Problem hat
Nicht beschönigenFloskeln statt Inhalt

Am Ende steht eine siebte Anweisung, und die ist die wichtigste von allen. Claude soll jede Aufgabe mit drei kurzen Zeilen abschließen: was er gemacht hat, was er bewusst weggelassen hat, und wo er sich unsicher ist.

Diese drei Zeilen sind dein Kontrollpunkt. Sie kosten dich fünf Sekunden Lesezeit und ersparen dir die Nacharbeit.

Als ich den Prompt hier zum ersten Mal eingesetzt habe, war die erste Antwort eine Rückfrage statt eines Ergebnisses. Das hat sich im ersten Moment nach einem Rückschritt angefühlt. Beim zweiten Hinsehen war es die richtige Frage, und die hätte ich mir sonst selbst stellen müssen, nachdem das falsche Ergebnis schon fertig war.

🔥 Du willst die sechs Regeln nicht abtippen? Der Guide zum ehrlichen Claude hat den kompletten Text in einem Kasten zum Kopieren. → Guide holen

Was sich konkret ändert, wenn du Claude ehrlich machst

Der Unterschied lässt sich an einer einzigen Frage zeigen.

Stell dir vor, du fragst nach der durchschnittlichen Öffnungsrate von Newslettern in deiner Branche. Ohne den Prompt bekommst du eine Zahl, eine Prozentangabe und oft noch eine Quelle dazu. Das liest sich hervorragend, und es kann trotzdem frei erfunden sein.

Mit dem Prompt bekommst du eine andere Antwort. Da steht dann, dass belastbare Zahlen je nach Branche stark schwanken, dass das Modell keine geprüfte Quelle dazu hat, und die Rückfrage, um welche Branche es überhaupt geht.

Die zweite Antwort ist unbequemer. Sie ist aber die einzige, mit der du weiterarbeiten kannst, ohne ein Risiko einzugehen.

Dasselbe gilt für Aufgaben mit mehreren Teilen. Ohne den Prompt bekommst du am Ende ein Ergebnis, das vollständig aussieht. Mit ihm bekommst du dazu einen Satz, welcher Teil offen geblieben ist und warum.

Genau dieser Satz ist der Unterschied zwischen einer Antwort, der du glaubst, und einer, die du prüfen kannst.

Wohin der Prompt gehört, damit er Claude dauerhaft ehrlich macht

Es gibt drei Stellen, und sie unterscheiden sich in der Reichweite.

Erstens die persönlichen Präferenzen. Dort wirkt der Prompt in jedem neuen Chat, ohne dass du etwas tust. Du findest sie in der Claude-App unten links über deinen Namen unter Einstellungen. Das ist der Weg, den ich empfehle.

Zweitens die Projektanweisungen. Dort wirkt er nur innerhalb dieses einen Projekts. Das ist sinnvoll, wenn du beim Arbeiten streng geprüfte Antworten willst, beim Brainstorming aber lockerer bleiben möchtest.

Drittens die Datei CLAUDE.md. Sie gilt für Claude Code, also die Version, die im Terminal läuft. Gibt es die Datei noch nicht, legst du sie einfach im Projektordner an.

Einmal eingefügt, brauchst du nichts weiter zu tun. Der Prompt läuft im Hintergrund mit, bei jeder Antwort.

Woran du merkst, dass Claude jetzt ehrlich antwortet

Der Unterschied zeigt sich schneller, als du denkst.

Du bekommst plötzlich Rückfragen, wo vorher sofort ein Ergebnis kam. Du liest Sätze wie „da bin ich mir nicht sicher“ statt einer glatten Behauptung. Und du bekommst gesagt, wenn an deiner Idee etwas nicht stimmt.

Mach den Test bewusst. Stell eine Frage, bei der du die Antwort kennst, und bau eine wacklige Annahme ein. Widerspricht Claude, sitzt der Prompt.

Was der Prompt nicht kann, auch wenn du Claude ehrlich machst

Hier gehört die ehrliche Einordnung hin, sonst verlässt du dich falsch darauf.

Der Prompt macht Claude vorsichtiger, nicht allwissend. Ein Sprachmodell weiß nicht zuverlässig, was es nicht weiß. Die Regel gegen erfundene Quellen senkt deren Zahl deutlich, aber sie fällt nicht auf null.

Bei allem, was für dich zählt, prüfst du weiter selbst nach. Der Unterschied ist, dass du jetzt einen Hinweis darauf bekommst, wo du hinsehen solltest.

Und ein zweiter Punkt: Ein ehrlicher Claude ist anstrengender. Er widerspricht dir, er fragt nach, er nennt Dinge beim Namen. Wer schnelle Bestätigung sucht, wird den Prompt nach zwei Tagen wieder löschen.

Der häufigste Fehler, wenn Leute Claude ehrlich machen wollen

Die meisten schreiben einen einzelnen Satz in die Einstellungen. Etwas wie: sei ehrlich und erfinde nichts.

Das wirkt kaum, und der Grund dafür ist einleuchtend. Ein solcher Satz nennt kein Verhalten, das sich prüfen ließe. Das Modell hat keine Möglichkeit zu erkennen, ob es die Anweisung gerade befolgt oder nicht.

Die sechs Regeln funktionieren, weil jede von ihnen eine konkrete Handlung beschreibt. Nicht sei ehrlich, sondern: schreib dazu, wie sicher du bist. Nicht erfinde nichts, sondern: kennst du keine Quelle, schreib mir, dass du keine hast.

Der zweite häufige Fehler ist die Stelle. Wer den Prompt in einen einzelnen Chat schreibt, hat ihn im nächsten wieder verloren. Deshalb gehört er in die Einstellungen und nicht in die Unterhaltung.

Für wen es sich lohnt, Claude ehrlich zu machen

Wenn du Claude für Kleinigkeiten nutzt, brauchst du das nicht. Bei einer Umformulierung ist es egal, ob dir jemand nach dem Mund redet.

Interessant wird es überall dort, wo du auf der Antwort etwas aufbaust. Bei Zahlen, die in ein Angebot gehen. Bei Plänen, nach denen du Wochen arbeitest. Bei allem, was du nicht selbst prüfen kannst.

Genau da ist der Punkt: Wer nicht beurteilen kann, ob eine Antwort stimmt, hat ohne diesen Prompt keine Möglichkeit zu merken, dass sie es nicht tut.

🔥 Bereit, es einzurichten? Der Guide zum ehrlichen Claude führt dich in drei Seiten durch den Prompt und zeigt, wohin er gehört. → Guide holen

Über Ruwen Bädorf

Ich bin Ruwen Bädorf und ich baue Systeme, die mit KI von allein arbeiten. Ich helfe Selbstständigen, ihre Arbeit einmal zu bauen statt jeden Tag zu wiederholen.

  • Ich baue und betreibe die komplette Reel-Fabrik auf ki-imperium.com selbst, vom Skript über den Avatar bis zur Auslieferung des Guides.
  • Ich arbeite täglich mit Claude, Lovable und Higgsfield und zeige genau die Abläufe, die ich selbst fahre.
  • Auf Instagram veröffentliche ich diese Abläufe als Reels, jeweils mit einem Guide zum Nachbauen.

→ Folg mir auf Instagram

Weiterlesen

In Claude Fable 5.1 stehen die drei Einstellungen, die das neue Modell braucht. In ChatGPT und Claude verbinden geht es darum, beide Modelle sich gegenseitig prüfen zu lassen. Und in Claude Skills nutzen schreibst du wiederkehrende Abläufe einmal fest. Und wie deine Texte den KI-Klang verlieren, zeige ich in KI Texte menschlicher machen.

Wer Claude ehrlich machen will, braucht dafür keine Einstellung im Menü, sondern sechs Sätze an der richtigen Stelle.

Häufige Fragen

Warum sagt Claude mir nicht einfach die Wahrheit?

Sprachmodelle lernen aus menschlichen Bewertungen, und Menschen bewerten Zustimmung besser als Widerspruch. Das Modell übernimmt dieses Muster. Der Fachbegriff dafür ist Sycophancy, auf Deutsch Anbiederung.

Wo genau füge ich den Prompt ein?

In der Claude-App unten links über deinen Namen unter Einstellungen und Persönliche Präferenzen. Dort gilt er in jedem neuen Chat. Alternativ in die Projektanweisungen für ein einzelnes Projekt oder in die Datei CLAUDE.md für Claude Code.

Funktioniert der Prompt auch bei ChatGPT?

Ja. Die sechs Regeln beschreiben Verhalten, nicht Claude-spezifische Funktionen. Bei ChatGPT gehören sie in die benutzerdefinierten Anweisungen.

Verhindert der Prompt Halluzinationen komplett?

Nein. Er senkt die Zahl erfundener Quellen und Zahlen deutlich, aber ein Modell weiß nicht zuverlässig, was es nicht weiß. Bei allem, was zählt, prüfst du weiter selbst nach.

Wird Claude dadurch unfreundlich?

Er wird direkter. Floskeln fallen weg, Widerspruch kommt häufiger. Wer schnelle Bestätigung sucht, empfindet das als anstrengend, wer belastbare Antworten braucht, als Gewinn.

Weiterlesen

Claude Fable 5.1: die drei Einstellungen, die du kennen musst

Seit dem 1. September ist Fable 5.1 da. Es ist messbar stärker, verhält sich aber in drei Punkten anders als alles davor.

ChatGPT und Claude verbinden: OpenAIs neues Plugin

Seit Kurzem gibt es ein offizielles Plugin von OpenAI, mit dem Codex direkt in Claude Code läuft. Vier Befehle, dann prüfen sich die beiden Modelle gegenseitig.

Claude Skills nutzen: 5 Sätze, die dir Stunden sparen

Claude Skills nutzen bedeutet, dass du das Dateiformat in deinen Satz schreibst und eine fertige Datei zurückbekommst statt einer Beschreibung. Die fünf eingebauten Skills, die Sätze dazu und die drei Fehler, an denen es scheitert.

Hol dir den kostenlosen Guide

Konkrete Schritte, die du sofort in deinem Business anwenden kannst.

Kostenlos. Eintragen dauert zehn Sekunden.