Cognitive Boundary Breaker · KI, die nicht nur zustimmt

Vor wichtigen Entscheidungen noch eine Richtung sehenv2.0 · Kleines schnell erledigen, Großes klar durchdenken

Das System macht verborgene Annahmen sichtbar, prüft Belege und bringt den stärksten Einwand auf den Tisch. Es entscheidet nicht für dich, sondern verhindert den nächsten ungeprüften Sprung.

Nicht jede Frage braucht einen Denkmarathon. Routinen bleiben schnell; wichtige und schwer umkehrbare Entscheidungen verdienen einen zusätzlichen Blick.

Plattformfakten geprüft am 2026-08-27 Frei teilbar · Quellenangabe empfohlen GO · Organisationen neu erfinden

Hier anfangen

Einmal ausprobieren, bevor du etwas installierst

Keine Einarbeitung, kein Code. Kopiere einen kurzen Text in das KI-Tool, das du ohnehin nutzt.

30-Sekunden-Test

Sende diesen Text zusammen mit deiner Frage

Für Meetings, Konzeptprüfungen, Karrierefragen und alle Momente, in denen Zustimmung nicht reicht.

30-Sekunden-Test
Ich habe eine wichtige Frage. Stimme mir nicht zuerst zu und springe nicht direkt zur Antwort. Bitte: 1) nenne höchstens drei zentrale Annahmen; 2) formuliere den stärksten Einwand; 3) trenne Fakten, Schlussfolgerungen und Vermutungen; 4) schlage einen kleinsten Validierungsschritt vor.

Meine Frage lautet:
Dauerhaft

In deinen KI-Tools nutzen

Ohne Programmieren: in ChatGPT, Claude, DeepSeek oder Kimi einrichten und nutzen.

Meine KI wählen

Blinder Vergleich

Dieselbe Frage, dasselbe Modell, ein anderes Denkgerüst

Fünf fiktive Fälle zeigen, wie sich der Prüfweg desselben Modells nach dem Lesen des Skills verändern kann. Es sind einzelne Ausgabebeispiele – kein durchschnittlicher Uplift und kein Nachweis höherer Faktengenauigkeit.

Einzelne Simulation · dasselbe Standardmodell · kein Web und keine Tools · gewöhnliche Antworten nicht absichtlich geschwächtRohantworten der alten Demo ansehen

Ausgangsfrage

Bleiben oder zum Startup wechseln?

Ich bin 35 und Führungskraft in einem etablierten Unternehmen. Mein Einkommen ist stabil, aber seit zwei Jahren entwickle ich mich nicht weiter. Ein Startup möchte mich einstellen: 25 % weniger Barlohn, zugesagte Optionen mit noch offenen Bedingungen und eine höhere Arbeitsbelastung. Ich habe keine Hypothek und Rücklagen für zwölf Monate. Soll ich wechseln?

Gewöhnliche AntwortOhne Cognitive Boundary · ein Durchlauf

Noch nicht zusagen. Die Option schriftlich klären: voll verwässerter Anteil, Vesting, Ausübung und Verwässerung. Runway, zahlende Kunden, Befugnisse und Sechsmonatsziele prüfen. Nur wechseln, wenn feste Einstiegskriterien gelten und die Rolle auch bei wertloser Option lohnt.

Mit Cognitive BoundaryDieselbe Standardmodell-Umgebung · vollständige Methode

Die Option bis zu schriftlichen Bedingungen mit null ansetzen. Prüfen, ob 25 % weniger Barlohn seltene Fähigkeiten, echte Verantwortung und Aufwärtspotenzial kaufen. Nur gehen, wenn 18 Monate tragbar sind, neun Monatsreserven bleiben und verwertbare Ergebnisse entstehen; sonst suchen.

Was sich ändert
Option zunächst nullAbwärtstestPlan B

Dies sind fiktive Vergleichsfälle. Gesundheitsinhalte sind keine medizinische Beratung; Anlageinhalte keine persönliche Finanz- oder Anlageberatung.

Fragen und Auszüge wurden sinngenau aus dem chinesischen Original übertragen. Die Auszüge sind knappe Zusammenfassungen; die vollständigen Rohantworten bleiben chinesisch.

Neue Bewertung läuft

Wir erklären uns nicht selbst zum Sieger

In der ersten Stichprobe mit fünf Fällen waren die gewöhnlichen Antworten bereits stark; der Abstand trug keine Aussage über eine deutliche Verbesserung. Deshalb entfernen wir die Startseitenwerte und wechseln zu drei strengeren Bedingungen.

Aktuelle EvidenzgrenzeWirksamkeitsfazit: noch nicht belegtNeues Protokoll läuft

Problemraum

Prüft die Antwort den Ausgangsrahmen und macht Entscheidung, Zwänge und Annahmen sichtbar?

Evidenzraum

Trennt sie Bekanntes, Schlussfolgerungen und Lücken und nennt sinnvolle Prüfungen?

Möglichkeitsraum

Zeigt sie echte Alternativen, stufenweise Wege, Entscheidungskriterien und Rückwege?

Kontrafaktischer Raum

Nennt sie den stärksten Gegenfall, Fehlschlagszenarien und Evidenz, die das Urteil ändern würde?

Geplant sind 12 simulierte Fälle, drei Antwortbedingungen, 56 vorab festgelegte Prüfungen und drei unabhängige blinde Bewertende. Ausfälle, Gleichstände, Negativkontrollen und Antwortkosten bleiben sichtbar. Vor Abschluss veröffentlichen wir keinen durchschnittlichen Uplift, keine Gewinnquote und keine Sicherheitsaussage.

Neues Protokoll und alte Stichprobe öffnen

Verglichen werden gewöhnliche Antworten, ein leichter Drei-Zeilen-Hinweis und der vollständige Skill in Technik, Leben, Gesundheit, Investieren, Lernen und Fragen mit geringem Risiko. Im Mittelpunkt stehen kritische Auslassungen, Gegenbelege, Stoppregeln, Sicherheitsfehler und Antwortkosten – kein dekorativer Gesamtscore.

Mechanismus statt Magie

Warum ein Denkgerüst die Antwort verändern kann

Ein Sprachmodell besitzt kein fest eingebautes Entscheidungsverfahren. Was es prüft, hängt stark vom Kontext ab, bevor sich die Antwort verfestigt.

Was gewöhnlich geschieht

  1. Das Modell sagt aus dem bisherigen Kontext den plausiblen nächsten token voraus.
  2. Es übernimmt häufig Rahmen, Ton und implizites Ziel des Nutzers.
  3. Es entwickelt eine flüssige Antwort, die nützlich und schlüssig wirkt.
  4. Es endet, sobald die Antwort ausreichend vollständig klingt.
Der Ausgangsrahmen bleibt womöglich ungeprüft.Zustimmung kann sicherer wirken als Korrektur.Evidenz und Schlussfolgerung können gleich sicher klingen.Falsifikator, Schwelle oder nächster Test sind nicht automatisch nötig.

Was der Skill ergänzt

  1. Tragweite, Reversibilität und Zeitfenster einordnen.
  2. Problem neu fassen; Annahmen und Evidenz markieren.
  3. Den stärksten Gegenfall formulieren.
  4. Schwellen, Falsifikator und kleinsten nützlichen Test festlegen.
  5. Mit Handlung, Verantwortlichem, Termin, Rückweg und Lernnotiz enden.

Der Skill fügt kein neues Wissen hinzu. Er lenkt attention auf Prüfungen, die ein gewöhnlicher Prompt oft unausgesprochen lässt.

Ein Kreislauf, keine Fließbandarbeit

Acht Stationen bilden einen Kreislauf, in den du an jeder passenden Stelle einsteigen kannst. Nur drei Regeln sind fest: Die Triage bestimmt die Tiefe. Ein Experiment führt aus dem Nachdenken ins Handeln. Und die gespeicherten Ergebnisse eröffnen die nächste Runde.

Frage Triage Tragweite × Reversibilität × Fenster Geringe Tragweite / reversibel Mittlere Tragweite Hohe Tragweite · irreversibel Schnellkanal Beste Antwort + drei größte Risiken Hier beenden Standardkanal Standard: Fragestellung hinterfragen + aktive Falsifikation Tiefenkanal · Kreislauf (beliebiger Einstieg) REFLEXIONSBEREICH 1 Fragestellung hinterfragen 2 Zerlegung nach ersten Prinzipien 5 Paradigmenneugestaltung EVIDENZBEREICH 3 Globaler Scan 4 Zukunftsprojektion 6 Aktive Falsifikation Einziger Ausgang Station 7 · Experiment 7/30/90 Tage · Kriterien vorab festlegen Ergebnis + Frist Station 8 · Persistenzschicht Hypothesenregister · Entscheidungsprotokoll · Kalibrierung Erster Schritt der nächsten Runde = Register der vorigen Runde prüfen, nicht eine neue Frage stellen
Der rote Rückweg macht aus einem guten Einzelgespräch ein lernendes System. Nimmst du ihn weg, bleiben acht Stationen und eine lange Analyse. Schließt du ihn, werden Hypothesen bestätigt oder verworfen, Einschätzungen besser kalibriert und Lernzyklen kürzer. Ein Kreislauf, der nie eine Hypothese abschließt, ist kein Denksystem — sondern eine Schreibübung.
01

Next-token prediction

Ein Sprachmodell erzeugt Text token für token aus kontextabhängigen Wahrscheinlichkeiten. Eine flüssige Fortsetzung ist noch keine automatische Prüfung der Entscheidung.

02

Alignment und Sycophancy

RLHF belohnt hilfreiche, sichere und anweisungsgetreue Antworten. Es kann auch Zustimmung zum Rahmen oder Wunsch des Nutzers verstärken. Das ist eine Tendenz, kein Zwang.

03

Prompt-time scaffold

Der Skill legt eine Prüffolge in den Kontext. Sie lenkt attention auf Annahmen, Evidenzlücken, Gegenfälle und Tests; das Modell wird weder neu trainiert noch mit neuen Fakten versorgt.

Was dies nicht beweist

  • Ein Denkgerüst ergänzt keine fehlenden Fakten. Ohne Tools bleiben externe Aussagen ungeprüft.
  • Fünf Fälle, ein Modell, ein Datum und je ein Durchlauf beweisen keine allgemeine oder kausale Verbesserung.
  • Mehr Struktur kann einfache, reversible Fragen überanalysieren. Sie ersetzt auch keine zeitnahe medizinische Abklärung oder unabhängige professionelle Anlageberatung.
Quellen und Vertiefung

Die folgenden Quellen stützen die allgemeinen Mechanismen von Sprachmodellen, Anweisungsbefolgung, RLHF und Sycophancy – nicht den konkreten Wert dieses kleinen Benchmarks.

  1. Attention Is All You Need
  2. Language Models are Few-Shot Learners
  3. Training language models to follow instructions with human feedback
  4. Towards Understanding Sycophancy in Language Models
  5. TruthfulQA: Measuring How Models Mimic Human Falsehoods
  6. Chain-of-Thought Prompting Elicits Reasoning in Large Language Models
  7. Self-Consistency Improves Chain of Thought Reasoning in Language Models

So funktioniert es

Drei einfache Gewohnheiten für bessere Urteile

Sorgfalt muss nicht akademisch klingen. Drei oft vergessene Schritte werden zu wiederholbaren Handlungen.

01

Die richtige Frage stellen

Verborgene Annahmen aufdecken und das Problem lösen, nicht nur sein Symptom.

02

Unbequeme Belege suchen

Fakten von Schlussfolgerungen trennen und aktiv nach Gegenbeispielen suchen.

03

Zur Realität zurückkehren

Das Ergebnis in einen kleinen Test, eine Frist und ein beobachtbares Resultat übersetzen.

Vollständige Methode öffnen: Acht-Stationen-Zyklus, Evidenzstufen und Prompt-BibliothekDie vollständige Methode, Gegenprüfung, Hypothesenliste und Evidenzübersicht bleiben für die Vertiefung erhalten.
01

v1.0 war eine Methode. v2.0 ist ein System.

v1.0 half dabei, bessere Fragen zu stellen. In der Praxis scheitert gutes Denken aber oft an drei anderen Dingen — und keines davon verschwindet durch einen noch ausgefeilteren Prompt.

Nicht jede Frage braucht eine Tiefenanalyse

v1.0 ließ standardmäßig jede Frage durch alle sechs Ebenen laufen. Das führte leicht zu zwei Extremen: Man nutzte die Methode nie oder machte aus jeder Kleinigkeit ein Ritual.

v2.0 ergänzt eine Entscheidungs-Triage: Tragweite × Reversibilität bestimmen, wie tief die Analyse gehen soll. Einfach gesagt: Je größer die Folgen und je schwerer die Entscheidung rückgängig zu machen ist, desto gründlicher wird geprüft. Dazu kommt eine Anti-Paralyse-Regel — dauert die Analyse einer reversiblen Entscheidung länger als „Umsetzung + Rückabwicklung“ zusammen, hör auf zu analysieren und probiere es aus.

Was die KI sagt ≠ was in der Welt tatsächlich existiert

v1.0 verlangte im Prompt einen „globalen Scan“. Hatte das Modell keine passenden Werkzeuge, konnte es trotzdem Inhalte erzeugen, die vollständig wirkten — ohne wirklich recherchiert zu sein.

v2.0 ergänzt die Belegstufen L1/L2/L3 und ein Verfahren zur Stichprobenprüfung von Quellen. Schlussfolgerungen dürfen nur auf L2 oder L1 beruhen. Kann das Modell nicht recherchieren, wird die gesamte Station heruntergestuft — und dieser Hinweis steht gut sichtbar am Anfang der Antwort.

Heute verstanden ≠ beim nächsten Mal noch präsent

v1.0 lebte nur in einem einzelnen Chat. Neue Erkenntnisse hatten keinen festen Ort; deshalb blieb der Lernkreislauf offen.

v2.0 ergänzt eine Persistenzschicht: einen dauerhaften Speicher aus Hypothesenregister, Entscheidungsprotokoll und Kalibrierungsnotizen. Denn eine Hypothese, die niemand festhält, und eine Prognose, die niemand bewertet, führen nicht zu Lernen — nur zu einem guten Vorsatz.

04

Prompt-Bibliothek für mehrere Runden

Tiefe entsteht in mehreren Runden — und zwischen ihnen entscheidet ein Mensch, was weiterverfolgt wird. Ein einmaliger Prompt hat nur einen sinnvollen Zweck: schnell eine Karte des Problems zu zeichnen. Wähle danach die passenden Stationen. Die menschliche Entscheidung verbindet die Runden; diese Rolle darf nicht an die KI ausgelagert werden.

0TriageErgebnis = Kanalwahl und Begründung

Vor jeder Tiefenanalyse steht eine einfache Meta-Frage: Wie viel Denkarbeit verdient dieses Problem? Die Triage ist keine Formalität. Sie schützt vor zwei gleich großen Fehlern — bei jeder Kleinigkeit das volle Programm abzuspulen oder die Methode nie zu nutzen.

Triage-Prompt
Führe vor Beginn der Analyse zunächst eine Triage für dieses Problem durch.

Bewerte:
1. Wie groß ist die Tragweite dieser Entscheidung? (Ressourceneinsatz, Wirkungsumfang, Wirkungsdauer)
2. Ist die Entscheidung reversibel? Welche Kosten hätte eine Umkehr?
3. Wie lang ist das Entscheidungsfenster?
4. Ist dies ein einmaliges Problem oder ein wiederkehrendes strukturelles Problem?

Gib anschließend eine Empfehlung:
- Schnellkanal: Gib direkt deine beste Antwort und die drei größten Risiken aus;
- Standardkanal: Empfiehl 2—3 Stationen und begründe die Auswahl;
- Tiefenkanal: Empfiehl den vollständigen Kreislauf und erkläre, an welcher Station der Einstieg am wirksamsten ist.

Reichen die Informationen für die Triage nicht aus, frage zuerst nach; stelle keine Vermutungen an.
1Die Frage hinterfragenErgebnis = eine klarer gefasste Frage

Bitte die KI nicht sofort um eine Antwort. Lass sie zuerst prüfen, ob du die richtige Frage stellst. Diese Station hat ein klares Ergebnis: einen einzigen, besser gefassten Fragesatz — keinen langen Aufsatz darüber, was an deiner ursprünglichen Frage alles falsch sein könnte.

Fragestellung hinterfragen + konvergieren
Beantworte meine Frage nicht direkt.

Analysiere zuerst:
1. Welche impliziten Hypothesen enthält diese Frage?
2. Welche davon könnten falsch, überholt oder ungeprüft sein?
3. Verwechsle ich eine Erscheinung, ein Symptom oder ein Ergebnis mit dem eigentlichen Problem?
4. Welches ursprüngliche Problem könnte dahinterliegen?
5. Wie würdest du die Frage neu formulieren?

Hilf mir vorrangig, die richtige Frage zu stellen, statt vorschnell eine Antwort zu geben.

Nach der Analyse musst du konvergieren und Folgendes ausgeben:
1. die neu gefasste Frage (ein Satz);
2. die zentralen Unterschiede zur ursprünglichen Frage (höchstens drei);
3. die wahrscheinlichste Fehlerstelle, falls diese Neufassung falsch ist.
2Von den Grundannahmen her denkenErgebnis = Liste aus Fakten—Beschränkungen—Zielfunktion

Lege Branchenerfahrung, gewachsene Abläufe und Konventionen beiseite, bis nur noch grundlegende Fakten, echte Beschränkungen und das eigentliche Ziel übrig bleiben. Dabei lauert ein häufiger Fehler: Eine Gewohnheit kann eine reale Beschränkung schützen. Deshalb muss jede Regel, die du abschaffen willst, zuerst Chestertons Zaunprüfung bestehen — also die Frage: Warum wurde sie ursprünglich eingeführt, und gilt dieser Grund noch?

Zerlegung nach ersten Prinzipien + Zaunprüfung + Prüfbarkeit
Analysiere dieses Problem anhand erster Prinzipien.

Anforderungen:
1. „Die Branche macht das schon immer so“ ist keine Begründung;
2. Setze nicht voraus, dass bestehende Organisationen, Prozesse, Rollen, Produktformen oder Geschäftsmodelle fortbestehen müssen;
3. Zerlege das Problem weiter, bis keine weitere Zerlegung möglich ist;
4. Unterscheide Grundfakten, technische Beschränkungen, Ressourcenbeschränkungen, institutionelle Beschränkungen und menschliche Konventionen;
5. Bestimme die eigentliche Zielfunktion des Systems;
6. Formuliere eine auf ersten Prinzipien beruhende Neufassung des Problems.

【Chestertons Zaunprüfung】Beantworte für jede Branchenkonvention oder bestehende Praxis, deren Abschaffung du empfiehlst, zunächst:
1. Warum wurde dieser „Zaun“ ursprünglich errichtet? Was schützt er?
2. Besteht die geschützte Beschränkung heute noch?
3. Klassifiziere danach: schützende Konvention (Beschränkung besteht real fort, nicht entfernbar) / überholte Konvention (Beschränkung bestand früher, ist heute verschwunden, entfernbar) / träge Konvention (entsprach nie einer realen Beschränkung, entfernbar).
Nur die letzten beiden Kategorien dürfen als „abzuschaffen“ vorgeschlagen werden. Kann Frage 1 nicht beantwortet werden, gilt die Konvention standardmäßig als schützend.

【Prüfbarkeit der Beschränkungen】Kennzeichne jeden von dir genannten „Grundfakt“ und jede „reale Beschränkung“:
- Ist dies eine physische/mathematische Notwendigkeit oder eine vorläufige Tatsache unter heutigen Technologie- und Kostenbedingungen?
- Wie lässt sie sich prüfen, und wie hoch sind die Prüfungskosten?
3Globaler ScanErgebnis = Lösungskarte mit L1/L2/L3-Kennzeichnung

Diese Station braucht echte Recherchewerkzeuge, nicht nur gute Formulierungen. Kein Prompt macht aus einem Modell eine vollständig recherchierende Suchmaschine. Ohne solche Werkzeuge stammen weltweite Beispiele aus dem Parameterwissen des Modells. Darunter können veraltete, verzerrte oder erfundene Angaben sein — und sie klingen oft genauso plausibel wie echte Fälle.

Globaler Scan (einschließlich Evidenzklassifizierung)
Nutze echte Recherchewerkzeuge und untersuche systematisch Lösungen zu diesem Problem weltweit.

Der Suchraum umfasst: wissenschaftliche Arbeiten und Reviews, Universitätslabore, Start-ups und neue Produkte, Fälle etablierter Unternehmen, Open-Source-Projekte, Patente, Branchenberichte, politische Pilotprojekte, Fehlschläge und kontroverse Fälle sowie Fälle aus der nicht englischsprachigen Welt.

Erledige Folgendes:
1. Klassifiziere bestehende Lösungen;
2. Erkläre für jede Lösung, welches Problem sie löst, unter welchen Bedingungen sie funktioniert, welche Kosten und Grenzen sie hat;
3. Bestimme bislang ungelöste Lücken;
4. Extrahiere übertragbare Grundmechanismen;
5. Unterscheide Mainstream-Konsens, Minderheitspositionen und explorative Ansätze an der Forschungsfront.

Suche besonders nach:
- Fällen, die der Mainstream-Praxis widersprechen und dennoch wirksam sind;
- Mechanismen, die in anderen Branchen bereits funktionieren, hier jedoch noch nicht eingesetzt werden;
- früher gescheiterten Lösungen, die durch veränderte technologische Bedingungen wieder tragfähig sein könnten;
- Experimenten, die im Kleinen funktionieren, aber noch nicht skaliert wurden;
- übersehenen Fällen aus der nicht englischsprachigen Welt.

Evidenzanforderungen:
- Jeder zentrale Fall und jede zentrale Zahl braucht eine überprüfbare Quelle;
- Kennzeichne klar, welche Inhalte aus tatsächlicher Recherche stammen (L2) und welche aus deinem vorhandenen Wissen (L3);
- Inhalte, die nicht durch Recherche geprüft werden können, separat nur als „zu prüfende Hinweise“ aufführen und nicht in Schlussfolgerungen mischen.

Wenn du in diesem Gespräch keine echte Recherchefähigkeit hast, sage dies direkt und kennzeichne sämtliche Ergebnisse als L3-Hinweise.
4Aus der Zukunft zurückdenkenErgebnis = Trendurteil mit Frühindikatoren und Widerlegungssignalen

Viele Probleme gibt es nur unter den heutigen technischen, wirtschaftlichen und institutionellen Bedingungen. Ändert sich eine entscheidende Beschränkung, kann das ursprüngliche Problem verschwinden. Zukunftsdenken verführt jedoch zu großen Geschichten, die nie falsch und deshalb nie nützlich sind. Darum braucht jedes Trendurteil beobachtbare Frühindikatoren und klare Signale, die dagegen sprechen.

Aus der Zukunft zurückdenken + falsifizierbar machen
Blicke aus der Zukunft auf die Gegenwart zurück.

Nimm als Zeitpunkte 3, 5 und 10 Jahre in der Zukunft an und analysiere:
1. Besteht dieses Problem von heute dann noch?
2. Welche heutigen Beschränkungen verschwinden durch technologischen Fortschritt?
3. Welche Fähigkeiten werden billig, standardisiert oder nahezu kostenlos?
4. Welche neuen knappen Ressourcen entstehen?
5. Welche Entscheidungen erscheinen heute vernünftig, werden in Zukunft aber zur Pfadabhängigkeit?
6. Welche Fähigkeiten sollten wir heute aufbauen, wenn wir von der Zukunft zurückdenken?

Ergänze für jedes Trendurteil:
1. Welche Frühindikatoren sind in den nächsten 6—12 Monaten beobachtbar?
2. Welche Signale würden zeigen, dass das Trendurteil falsch ist?
3. Gehört es zu struktureller Veränderung / zyklischer Schwankung / kurzfristigem Rauschen? Worauf beruht diese Einordnung?

Trendformulierungen, die durch keinerlei Evidenz widerlegt werden können, sind verboten.
5Das System neu denkenErgebnis = ≥3 neue Systementwürfe mit wirklich unterschiedlichen Dimensionen

Ein echter Durchbruch entsteht oft nicht durch eine bessere Lösung, sondern durch ein anderes System, in dem das alte Problem verschwindet. Fragt man ein Modell nach 3 Paradigmen, liefert es leicht dieselbe Idee in drei Formulierungen. Deshalb gilt: Verschiedene Stärken desselben Hebels zählen nur als eine Idee.

Paradigmenneugestaltung + erzwungene Vielfalt
Optimiere nicht die aktuelle Lösung.

Versuche, das alte Paradigma hinter dem heutigen Problem zu verwerfen, und beantworte:
1. Gibt es ein neues System, in dem dieses Problem nicht mehr existiert?
2. Wie würdest du von null entwerfen, wenn bestehende Organisationen, Prozesse, Rollen und Geschäftsmodelle nicht erhalten werden müssten?
3. Welche Elemente des heutigen Systems sind lediglich historisches Erbe statt notwendige Bedingungen?
4. Wie würde ein neues Unternehmen ohne Altlasten das Problem lösen?

Entwickle mindestens 3 neue Paradigmen und halte die Vielfaltsbedingung ein: Die zentrale Veränderungsdimension muss jeweils verschieden sein; wähle je eine aus — Art der Wertschöpfung / Art der Bereitstellung / Transaktions- und Preisstruktur / Verteilung von Verantwortung und Risiko / Zeitstruktur (einmalig→fortlaufend; synchron→asynchron).

Sind zwei Paradigmen nur verschiedene Intensitäten desselben Hebels, zählen sie als eines; erzeuge sie neu.

Jedes Paradigma muss enthalten:
1. Voraussetzungen für seine Gültigkeit;
2. ein Validierungsexperiment mit minimalen Kosten;
3. das stärkste Gegenargument.
6Aktiv zu widerlegen versuchenErgebnis = Material für Gegenprüfungen der Stufen 2 und 3

Der Prompt für Stufe 1 — die Gegenposition eines Modells — steht im Tab „Andere Plattformen“, weil er in einem neuen Chat und möglichst mit einem anderen Modell laufen muss. Hier folgen Stufe 2 und 3. Bei einer Entscheidung im Tiefenkanal reicht Stufe 1 allein ausdrücklich nicht als abgeschlossene Widerlegung.

Gegenposition Stufe 2 (Basisrate) + Stufe 3 (Premortem)
【Gegenposition Stufe 2 · Basisrate】

Erstelle für dieses Urteil eine Außenperspektive (outside view):
1. Wie hoch ist die historische Basiserfolgsrate dieser Entscheidungsklasse? (Recherchequelle angeben)
2. Warum sollten gerade wir eine Ausnahme sein? Welche dieser Begründungen glaubten damals auch alle, die scheiterten?
3. Recherchiere 3—5 Fehlschläge, die unserem Fall am ähnlichsten sind, und erkläre, an welchem Schritt sie scheiterten.

【Gegenposition Stufe 3 · Premortem】(Diese Vorlage muss gemeinsam mit echten Teammitgliedern bearbeitet werden; AI moderiert und protokolliert lediglich und ist nicht die einzige Gegenposition.)

Nimm an, das Projekt sei in zwei Jahren vollständig gescheitert. Denke in Form einer „Fehlschlagsanalyse“ rückwärts:
1. die 10 wahrscheinlichsten Ursachen des Scheiterns;
2. bei welchen Risiken heute bereits frühe Signale sichtbar sind;
3. welche Risiken das Team absichtlich ignorieren wird und welchen Anreiz es dafür hat;
4. welche Kennzahlen gut aussehen, aber tatsächlich Scheinblüte anzeigen könnten;
5. welche drei Hypothesen zuerst geprüft werden müssen.
7Experiment und HandlungErgebnis = Experimentliste mit Fristen und vorab festgelegten Kriterien

Nachdenken muss hier ins Handeln führen. Lege die Entscheidungskriterien vor dem Experiment fest, damit du das Ergebnis später nicht passend erklärst. Prüfe zuerst die Hypothesen, an denen die ganze Entscheidung hängt, und optimiere Details erst danach. Bleibt ein fälliges Experiment ohne Ergebnis, ist auch das ein Signal, das du prüfen solltest.

In überprüfbare Handlungen umwandeln
Verwandle die Diskussion in:
1. die 3 derzeit wichtigsten Urteile;
2. die Schlüsselhypothese hinter jedem Urteil;
3. Validierungsexperimente, die in 7 Tagen, 30 Tagen und 90 Tagen abgeschlossen werden können;
4. objektive Entscheidungskriterien für jedes Experiment (vorab festlegen, um nachträgliche Umdeutung zu verhindern);
5. die Unterscheidung reversibler und irreversibler Handlungen;
6. den nächsten Schritt mit minimalen Kosten und maximalem Informationsgewinn.

Regeln: Jedes Experiment muss mit Frist und Entscheidungskriterium in das Hypothesenregister eingetragen werden; Experimente zur Falsifikation zentraler Hypothesen haben Vorrang vor Experimenten zur Detailoptimierung; bleibt ein fälliges Experiment ohne Ergebnis, ist dies selbst ein Signal, das geprüft werden muss.
Wann die Analyse enden sollErgebnis = weiter analysieren oder handeln

Beende die Analyse sofort, sobald eines gilt: Eine weitere Runde würde die derzeit beste Option nicht mehr ändern; ein Experiment klärt die verbleibende Unsicherheit günstiger als weitere Analyse; oder das Entscheidungsfenster schließt sich und die Kosten des Wartens übersteigen den erwarteten Erkenntnisgewinn.

Konvergenzentscheidung
Entscheide, ob die aktuelle Diskussion konvergieren sollte:
1. Welche neue Information würde eine weitere Analyserunde am wahrscheinlichsten liefern? Würde sie die derzeit bevorzugte Lösung ändern?
2. Ist es günstiger, die größte aktuelle Unsicherheit weiter zu analysieren oder ein Experiment durchzuführen?
3. Empfiehl unter Berücksichtigung des Entscheidungsfensters: weiter analysieren (was genau) oder handeln (was genau)?
ScoutEinmaliger Prompt zur OrientierungErgebnis = Orientierungskarte, vollständig als L3 behandeln

Ein großer Einmal-Prompt widerspricht eigentlich der Regel, nicht sofort eine fertige Antwort zu verlangen. v2.0 stuft ihn deshalb zur Orientierung herab: Er zeichnet schnell eine Problemkarte, trägt aber keine Schlussfolgerung. Danach gehst du zurück zur Triage und arbeitest in mehreren Runden weiter.

Aufklärungsmodus
【Aufklärungsmodus: Sämtliche Inhalte dieser Ausgabe gelten als L3-Hinweise, dienen nur zum Zeichnen einer Problemkarte und begründen keinerlei Schlussfolgerung.】

Ich möchte nicht, dass du einfach meinen Überzeugungen folgst, sondern dass du mir hilfst, das Gesamtbild des Problems zu sehen.

Bearbeite die folgenden Punkte nacheinander und knapp (höchstens 200 Zeichen pro Abschnitt):
1. implizite Hypothesen des Problems und mögliche Richtungen einer Neufassung;
2. auf der Ebene erster Prinzipien unvermeidbare Fakten und Beschränkungen;
3. weltweit möglicherweise vorhandene Lösungskategorien (kennzeichnen: nicht durch Recherche verifiziert);
4. Trends der nächsten 3—10 Jahre, die die Natur des Problems verändern könnten;
5. mindestens 3 logisch unterschiedliche Richtungen für neue Paradigmen;
6. Angriffspunkte der stärksten Gegenposition;
7. welche 2—3 Stationen ich deiner Ansicht nach zuerst vertiefen sollte und warum.

Dies ist keine abschließende Analyse, sondern eine Orientierungskarte.
05

Dauerhafter Speicher: drei Tabellen

Das ist die wichtigste Ergänzung in v2.0 — und der einzige Teil, den selbst der beste Prompt nicht ersetzen kann. Ohne festgehaltene Hypothesen, bewertete Prognosen und überprüfte Entscheidungen beginnt jeder Chat wieder bei null. Bewahre die drei Tabellen deshalb dort auf, wo du sie wirklich weiterpflegst: in einem Dokument, einer Tabelle oder im plattformeigenen Gedächtnis.

Drei Tabellen der Persistenzschicht + Prompt zum Schließen des Kreislaufs (Markdown, direkt in ein Dokument einfügbar)
## Hypothesenregister
| Hypothese | Aufstellungsdatum | Aktuelle Konfidenz | Stützende Evidenz (Stufe) | Gegenbelege | Validierungsexperiment | Frist | Ergebnis |
|---|---|---|---|---|---|---|---|
|  |  |  |  |  |  |  |  |

Regel: In jedem Tiefenzyklus mindestens 3 Einträge ergänzen oder aktualisieren; jeder Eintrag braucht eine Frist — eine Hypothese ohne Frist ist ein Glaube, keine Hypothese; falsifizierte Hypothesen nicht löschen, sondern geschlossen markieren und behalten, denn sie sind die teuersten Vermögenswerte.

## Entscheidungsprotokoll
| Entscheidung | Datum | Damalige Begründung (≤3 Punkte) | Erwartetes Ergebnis und Kennzahl | Prüftermin | Tatsächliches Ergebnis | Erkenntnisaktualisierung |
|---|---|---|---|---|---|---|
|  |  |  |  |  |  |  |

Regel: Die Begründung muss zum Entscheidungszeitpunkt festgehalten werden — nachträglich rekonstruierte Begründungen wirken immer klug; den Prüftermin am Tag der Entscheidung festlegen und in den Kalender eintragen.

## Kalibrierungsprotokoll
| Prognose | Datum | Meine Konfidenz | Tatsächliches Ergebnis | Abweichung |
|---|---|---|---|---|
|  |  |  |  |  |

Regel: Einmal pro Quartal prüfen — wie hoch ist die tatsächliche Trefferquote bei Ereignissen, denen du 80% Wahrscheinlichkeit gegeben hast? Die Differenz zwischen Konfidenz und Trefferquote ist die Korrekturgröße deines kognitiven Systems.

## Kreislauf schließen: Zu Beginn jeder Runde zuerst diesen Abschnitt einfügen
Im Folgenden stehen das Hypothesenregister und die Validierungsergebnisse meiner vorigen Runde.
Erledige zuerst: 1. Welche Hypothesen wurden bestätigt / falsifiziert / bis zur Frist nicht geprüft? 2. Welche meiner früheren Urteile müssen aufgrund dieser Ergebnisse korrigiert werden? 3. Wie verändert die korrigierte Erkenntnis die Frage dieser Runde?
Beginne erst nach diesem Rückblick mit einer neuen Analyserunde.
Woran erkennst du, ob das System wirklich hilft?Nicht daran, wie klug die Texte klingen. Entscheidend sind drei messbare Werte: Kalibrierung — wird die Lücke zwischen deiner angegebenen Sicherheit und der tatsächlichen Trefferquote kleiner? Quote verworfener Hypothesen — werden in jedem Quartal Hypothesen widerlegt und geschlossen? Wenn nie eine fällt, ist die Gegenprüfung nur Theater. Zyklusdauer — sinkt die durchschnittliche Zahl der Tage von der Formulierung einer Hypothese bis zu ihrer überprüften Schließung?
06

Rote Linien

Das sind keine Fußnoten, sondern konkrete Arten, wie die Methode scheitert. Jede beschreibt einen Zustand, der nach „kognitivem Durchbruch“ aussieht, aber keiner ist.

Ein flüssiger Text ≠ eine richtige Schlussfolgerung

Verlange eine klare Trennung: bekannte Tatsache / Schlussfolgerung aus Belegen / plausible Vermutung / Hypothese ohne Beleg. Je müheloser ein Text klingt, desto wichtiger ist die Prüfung.

Gefunden ≠ überprüft

Öffne bei den 3—5 wichtigsten Quellen einer Schlussfolgerung das Original. Prüfe: Gibt es die Quelle wirklich? Wird sie korrekt wiedergegeben? Ist sie noch aktuell? Scheitert nur einer dieser Tests, wird der Beleg auf L3 herabgestuft und neu recherchiert.

Widerspruch der KI ≠ abgeschlossene Widerlegung

Dasselbe Modell mit demselben Kontext und denselben Vorannahmen liefert oft nur einen freundlichen Scheinangriff. Du bekommst das beruhigende Gefühl, die Idee sei geprüft worden — aber keine echte Gegenprüfung. Stufe 1 ist nur das Aufwärmen.

Alles aktivieren = es am Ende nie nutzen

Bei jeder Frage die maximale Prüfintensität einzuschalten ist genauso schädlich, wie die Methode nie zu verwenden. Ein System, das „alles anzweifeln“ muss, macht selbst einfache, richtige Antworten unnötig kompliziert. Auch Zweifel brauchen das richtige Maß.

Analyse darf Handlung nicht ersetzen

Ein Kreislauf, der nur Dokumente produziert und nie eine Hypothese schließt, ist anspruchsvoll verpacktes Aufschieben. Sobald ein Konvergenzkriterium erfüllt ist, beginnt die Handlung.

Mehr Modelle ≠ mehr Perspektiven

Die Trainingsdaten führender Modelle überschneiden sich stark. Fünf Rollen können deshalb im selben blinden Fleck übereinstimmen. Wichtiger als die Zahl der Modelle ist die Unabhängigkeit ihrer Informationsquellen. Sind die Unterschiede sauber strukturiert, entscheidet der Mensch.

07

Quellenverzeichnis für die Plattformangaben dieser Seite

Dieses Verzeichnis soll nicht gelehrt wirken, sondern zeigen, wie weit jede Aussage trägt. L1 bedeutet offizielle Quelle oder Prüfung aus erster Hand. L2 bedeutet auffindbare und gegenprüfbare Belege. L3 ist nur eine Spur für die nächste Recherche. Alle Fakten wurden am 2026-08-27 geprüft. Plattformen ändern sich jederzeit; lies deshalb Belegstufe und Datum zusammen und vergleiche beides mit deiner tatsächlichen Oberfläche.

FaktStufeQuelle
Claude-Skill-Paket: Das Stammverzeichnis des ZIP-Archivs ist der Skill-Ordner selbst; keine zusätzliche Ebene; name ≤64 Zeichen, description ≤200 ZeichenL1-Faktsupport.claude.com
Claude-Skills benötigen aktivierte Codeausführung; verfügbar für Free / Pro / Max / Team / Enterprise; Einstieg über Customize → SkillsL1-Faktsupport.claude.com
Agent Skills-Spezifikation für Entwickler: description ≤1024 Zeichen (nicht mit der Grenze von 200 für Web-Uploads verwechseln)L1-Faktplatform.claude.com
OpenAI Skills und GPT Builder sind getrennte Zugänge. Bei sichtbarem ChatGPT-Upload kann dieses ZIP genutzt werden; Codex entdeckt dasselbe Format unter .agents/skills.L1 FaktOpenAI · Build skills
Grenze für globale benutzerdefinierte Anweisungen in ChatGPT: Free / Go 1,500 Zeichen; Plus / Pro / Enterprise / Business / Edu 5,000 ZeichenL1-Fakthelp.openai.com
Dateien pro ChatGPT-Projekt: Free 5 / Go und Plus 25 / Pro, Business, Enterprise und Edu 40; höchstens 10 Dateien pro UploadL1-Fakthelp.openai.com
Die OpenAI API lädt über /skills ein Verzeichnis oder ZIP mit genau einem obersten Skill-Ordner. Danach muss der Skill in der Shell-Umgebung angehängt werden; Upload ist nicht Nutzung.L1 FaktOpenAI · API Skills
Obergrenze von 8,000 Zeichen für Custom GPT Instructions — auf offiziellen Seiten ist diese Zahl nirgends zu finden; einzige Quelle sind Community-Beiträge aus 2024—2025, daher wird sie hier nicht verwendetL3-Hinweiscommunity.openai.com
Zeichenlimits für ChatGPT-Projektanweisungen und Claude-Projektanweisungen — offiziell nicht veröffentlicht; diese Seite legt keine festen Werte festL3-HinweisKeine
Die DeepSeek-Webversion bietet keine benutzerdefinierten Anweisungen / keinen Bereich für einen System-Prompt / keine gespeicherten Agents / kein sitzungsübergreifendes Gedächtnis — da offizielle Stellen nie ausdrücklich erklären, eine Funktion nicht zu unterstützen, reicht die Evidenz nur für L2L2-Evidenzgithub.com
Die DeepSeek API unterstützt system role (bereits im ersten Beispiel der offiziellen Dokumentation)L1-Faktapi-docs.deepseek.com
Kimi Agent erstellt Skills über /skill-creator. Die 25-Zeichen- und Namensregeln sind nur dort bestätigt; direkter ZIP-Import ist nicht verifiziert.L1 FaktKimi · Creating Skills FAQ
Kimi Code entdeckt SKILL.md in .agents/skills oder .kimi-code/skills und ruft es mit /skill:Name auf. Dieselbe 25-Zeichen-Grenze ist nicht dokumentiert.L1 FaktKimi Code · Agent Skills
Kimi Memory Space: höchstens 50 Einträge, jeweils ≤500 Zeichen; Kimi entscheidet automatisch über Online-Recherche, ohne manuellen Schalter; Einzeldatei ≤100MB, höchstens 50 Dateien pro GesprächL1-Faktkimi.com
Zeichenlimit für den Inhalt eines Kimi-Skills — offiziell nicht veröffentlicht; diese Seite legt keinen festen Wert festL3-HinweisKeine
Die Hinweise unterscheiden sich: Qwen Web 07-10 und App 07-15; Doubao Agents 07-15, nach 10-15 nicht mehr sichtbar oder wiederherstellbar; Yuanbao AI Applications 06-30. Alles L2, kein Aus des allgemeinen Assistenten.L2 BelegIT Home · Qwen
IT Home · Doubao
21CBH · Yuanbao
Aktuelle Einträge nennen weiter Q&A, Suche, Büro- oder Erstellungsfunktionen und Qwen offizielle Marken-Agenten. Das beweist keine unterbrechungsfreie Verfügbarkeit im Juli; die Regulierung ersetzt keine Plattformmitteilung.L1 FaktQwen · current listing
Doubao · current listing
Yuanbao · current listing
CAC · regulation
L1-Fakt = ausdrücklich in offizieller Dokumentation oder einem offiziellen Hilfezentrum genannt. L2-Beleg = eine auffindbare Drittquelle oder eine Schlussfolgerung, die mehrere indirekte Quellen übereinstimmend stützen. L3-Hinweis = keine verlässliche Quelle auffindbar; die Aussage bleibt offen. Nach den Regeln dieser Methode darf L3 keine Schlussfolgerung tragen. Deshalb stehen solche Zahlen separat — nicht versteckt in einem Satz, der sicherer klingt, als die Belege es erlauben.

Dauerhaft nutzen

Wähle die KI, die du schon nutzt

Jede Plattform hat einen anderen Einstieg. Folge der aktuell sichtbaren Oberfläche; wenn sie sich geändert hat, gilt das, was du vor dir siehst.

ChatGPT · Claude · DeepSeek · Kimi · Andere KI-Tools

Plattform wählen und Einrichtung ansehenHier findest du Skill-Downloads, Projektanweisungen oder einen Gesprächseinstieg sowie technische Grenzen und Quellen.

A · Als Skill installieren

ChatGPT / Codex, Claude, Kimi (wenn der Funktionszugang sichtbar ist)

Du lädst ein Skill-Paket mit SKILL.md hoch. Das Modell entscheidet dann selbst, wann es den Skill nutzt. Dieser Weg kommt der ursprünglichen Idee am nächsten: Auch die Auslöser werden mitinstalliert, sodass einfache Fragen mit geringer Tragweite nicht unnötig ausgebremst werden.

B · Als Projektanweisung

ChatGPT-Projekte und Claude-Projekte

Die Regeln gelten dauerhaft innerhalb eines Projekts. Automatisch ausgelöst werden sie nicht. Deshalb übernimmt die Projektgrenze einen Teil der Triage: In dieses Projekt gehören nur Entscheidungen mit hoher Tragweite.

C · Als Starttext für jeden Chat

DeepSeek und andere Webversionen ohne dauerhaften Platz für Anweisungen

Füge den vollständigen Text am Anfang jedes neuen Chats ein. Den dauerhaften Speicher führst du in einer eigenen Datei. Lass das Modell am Ende jeder Runde eine aktualisierte Fassung ausgeben, die du in diese Datei zurückkopieren kannst.

D · API system role

API eines beliebigen Modells

Lege die Regeln in die system -Nachricht. Das ist der stabilste Weg. Den dauerhaften Speicher musst du trotzdem selbst verwalten — eine API erinnert sich nicht von allein an frühere Sitzungen.

Empfohlener Installationsweg

A · Skill-Installation (Skill)

Für Free / Pro / Max / Team / Enterprise verfügbar L1
Dauerhafter Bereich
Ja · Skill + Projekt
Echte Recherche
Ja
Sitzungsübergreifende Persistenz
Teilweise · ProjektwissenDas vollständige Register gehört weiterhin in eine Datei
Wissensdateien
Ja · Upload innerhalb des Projekts
  1. Gehe zunächst zu Settings → Capabilities und aktiviere die Codeausführung — Skills benötigen eine Umgebung zur Codeausführung; ohne sie bleiben sie wirkungslos.L1
  2. Speichere die folgende SKILL.md als Datei in einem Ordner namens cognitive-boundary-breaker .
  3. Komprimiere diesen Ordner als ZIP. Offizielle Vorgabe: Das Stammverzeichnis des Archivs muss der Skill-Ordner selbst sein; keine zusätzliche Verzeichnisebene darum legen.L1
  4. Unter Customize → Skills → Add hochladen und den Skill anschließend auf derselben Seite aktivieren.
  5. Prüfung: Sage „Analysiere diese irreversible Technologieentscheidung gründlich“. Der Skill funktioniert wie vorgesehen, wenn das Modell zuerst die Tragweite einordnet, statt sofort eine Antwort zu geben.
Für den Upload eines Skills in Claude.ai gelten die strengeren Grenzen name ≤64 und description ≤200. description ≤1024 aus der Entwicklerspezifikation betrifft einen anderen Einsatzfall und darf nicht damit vermischt werden. Die Seite zeigt deshalb sowohl für das lokalisierte Beispiel als auch für die maßgebliche englische Fassung Codepoints und Bytes. Cowork in Claude for Mac kann außerdem aus einer Bildschirmaufnahme einen neuen Skill erzeugen (derzeit für Pro / Max / Team). Das eignet sich, um eigene Abläufe festzuhalten, ersetzt aber nicht die Prüfung des hier angebotenen maßgeblichen Pakets. Anthropic · custom Skills · Claude ZIP
SKILL.md · Inhalt des Skill-Pakets (gemeinsam für Claude / Kimi)
---
name: cognitive-boundary-breaker
description: "Skill für folgenschwere Entscheidungen: Triage nach Tragweite und Reversibilität, Prüfung mit First Principles, Evidenzstufen, Red Teams und Hypothesenregister."
---

# Durchbrecher kognitiver Grenzen v2.0

## Grundhaltung

Die Aufgabe besteht weder darin, aus den bestehenden Überzeugungen des Nutzers eine vollständigere Antwort zu erzeugen, noch darin, alles nur zum Schein infrage zu stellen. Kognitive Ressourcen werden vielmehr nach Tragweite und Reversibilität der Frage verteilt, um den Problem-, Evidenz-, Möglichkeits- und kontrafaktischen Raum des Nutzers zu erweitern und jede Erkenntnisaktualisierung nachvollziehbar festzuhalten.

## 0. Fähigkeitsprüfung, dann Triage

Erkläre zuerst, ob diese Umgebung echte Recherche und sitzungsübergreifendes Gedächtnis bietet. Ohne Recherche wird Station 3 in einen Modus zur Erzeugung von Hinweisen herabgestuft (alles als L3 markieren und oben offenlegen); ohne Gedächtnis wird die Persistenzschicht ausgelagert, und am Ende jeder Runde wird eine einfügbare Aktualisierung des Registers ausgegeben.

Dann Triage: Tragweite (Ressourcen/Umfang/Dauer) × Reversibilität × Entscheidungsfenster →
- Schnellkanal (geringe Tragweite oder hohe Reversibilität): beste Antwort + drei größte Risiken, dann beenden;
- Standardkanal (mittlere Tragweite): 2—3 Stationen aktivieren, standardmäßig Fragestellung hinterfragen + aktive Falsifikation;
- Tiefenkanal (hohe Tragweite und irreversibel): vollständiger Kreislauf + Eintrag in die Persistenzschicht.

Anti-Paralyse-Regel: Übersteigt die Analysezeit einer reversiblen Entscheidung die Summe aus „Umsetzung + Rückabwicklung“, überspringe die Analyse und handle direkt.
Leichter Standardmodus: Auch bei Auslösung zunächst nur drei Dinge tun — ≤3 zentrale implizite Hypothesen, die stärkste Gegenposition und Kennzeichnung als Fakt/Schlussfolgerung/Vermutung — und dann fragen, ob der Nutzer hochstufen möchte. Hat der Nutzer bereits eine Tiefenanalyse verlangt, diesen Schritt überspringen.

## 1. Kreislauf mit acht Stationen (beliebiger Einstieg)

Altes Problem→1; unbekanntes Gebiet→3; bereits starke Überzeugung→6; Rückblick→8.

- **1 Fragestellung hinterfragen**|Ergebnis=eine neu gefasste Frage (kein Aufsatz über ihre Mängel) + ≤3 zentrale Unterschiede + die wahrscheinlichste Fehlerstelle der Neufassung;
- **2 Zerlegung nach ersten Prinzipien**|Ergebnis=Liste aus Fakten—Beschränkungen—Zielfunktion. Jede vermeintlich entbehrliche Konvention muss zuerst Chestertons Zaunprüfung bestehen (Was schützte sie ursprünglich? Besteht diese Beschränkung noch? Kann die erste Frage nicht beantwortet werden, gilt sie als schützende Konvention und darf nicht entfernt werden); bei jedem Fakt/jeder Beschränkung angeben: physische Notwendigkeit oder vorläufige Tatsache unter heutigen Kostenbedingungen, und wie sie geprüft werden kann;
- **3 Globaler Scan**|Voraussetzung ist echte Recherche. L3-Hinweis (aus Parameterwissen erzeugt; darf nur Suchrichtungen erweitern und nicht in Schlussfolgerungen eingehen) / L2-Evidenz (echte Recherche mit auffindbarer Quelle; Schlüsselstellen stichprobenartig prüfen) / L1-Fakt (quervalidiert oder aus erster Hand geprüft). Schlussfolgerungen dürfen nur auf L2/L1 beruhen. Die 3—5 wichtigsten Zitate prüfen: Existieren sie, wurden sie korrekt wiedergegeben, sind sie noch aktuell?;
- **4 Zukunftsprojektion**|Rückblick aus 3/5/10 Jahren; jedem Trendurteil Frühindikatoren für 6—12 Monate + Falsifikationssignal + Einordnung als strukturell/zyklisch/Rauschen beifügen. Nicht falsifizierbare große Narrative sind verboten;
- **5 Paradigmenneugestaltung**|≥3 neue Paradigmen, deren zentrale Veränderungsdimensionen voneinander verschieden sein müssen (je eine aus Wertschöpfung/Bereitstellung/Transaktionsstruktur/Verantwortungsverteilung/Zeitstruktur); jeweils Voraussetzungen, kleinstes Validierungsexperiment und stärkstes Gegenargument nennen. Verschiedene Ausprägungen desselben Hebels zählen nur als ein Paradigma;
- **6 Aktive Falsifikation (dreistufige Gegenprüfung)**|Stufe 1=Modell-Gegenposition (in einem neuen Gespräch ohne Pro-Kontext durchführen, Material neutral vorlegen, die Gegenposition zunächst unabhängig entwickeln lassen und beantworten: „Wenn die Pro-These wahr wäre, was müsste in der Welt zu beobachten sein? Gibt es diese Beobachtungen?“); Stufe 2=Evidenz-Gegenposition (Basisraten, historische Fehlschläge, umgekehrte Recherche); Stufe 3=Realitäts-Gegenposition (menschliches Red Team, Kundeninterviews, Bezahltests, Premortem mit einem realen Team). Wird im Tiefenkanal nur Stufe 1 abgeschlossen, ist die Falsifikation unvollständig; die fehlende Stufe muss dem Nutzer ausdrücklich genannt werden;
- **7 Experiment und Handlung**|Einziger Ausgang aus der Reflexion. 3 zentrale Urteile→Schlüsselhypothesen→Experimente in 7/30/90 Tagen→vorab festgelegte Entscheidungskriterien→reversibel/irreversibel unterscheiden→nächster Schritt mit minimalen Kosten und maximalem Informationsgewinn. Experimente zur Falsifikation zentraler Hypothesen haben Vorrang vor Detailoptimierung;
- **8 Persistenzschicht**|Hypothesenregister (in jedem Tiefenzyklus ≥3 Einträge ergänzen oder aktualisieren; jeder Eintrag braucht eine Frist — eine Hypothese ohne Frist ist ein Glaube; falsifizierte Hypothesen nicht löschen, sondern geschlossen markieren und behalten), Entscheidungsprotokoll (Begründung muss zum Entscheidungszeitpunkt festgehalten werden), Kalibrierungsprotokoll (Konfidenz vs Trefferquote, vierteljährlich prüfen). Beim Eintritt in den Tiefenkanal ist der erste Schritt die Prüfung des Hypothesenregisters der vorigen Runde, nicht das Stellen einer neuen Frage.

## 2. Konvergenzkriterien (bei Erfüllung eines Kriteriums Analyse sofort beenden)

Eine weitere Analyserunde kann die Rangfolge der bevorzugten Optionen nicht mehr ändern; die verbleibende Unsicherheit lässt sich durch ein Experiment günstiger prüfen als durch weitere Analyse; das Entscheidungsfenster schließt sich.

## 3. Ausgabestruktur (Tiefenkanal)

0 Triage-Ergebnis → 1 Prüfung der Hypothesen aus der vorigen Runde → 2 Problemneufassung → 3 Liste Fakten—Beschränkungen—Zielfunktion (mit Evidenzstufen) → 4 globale Lösungslandkarte (mit Quellen und L1/L2/L3) → 5 Zukunftstrends (mit Frühindikatoren und Falsifikationssignalen) → 6 neue Paradigmen (≥3 mit unterschiedlichen Dimensionen) → 7 stärkste Gegenposition (abgeschlossene und fehlende Stufen kennzeichnen) → 8 Aktualisierung des Hypothesenregisters → 9 Maßnahmen für 7/30/90 Tage → 10 Konvergenzentscheidung

## 4. Rote Linien

Nicht darauf zielen, dem Nutzer zu gefallen, und nicht um des Widerspruchs willen widersprechen; sprachliche Flüssigkeit ≠ richtige Schlussfolgerung; gefunden ≠ verifiziert; den Widerspruch des Modells als abgeschlossene Falsifikation zu behandeln ist falsch; den Rahmen auf jede Frage vollständig anzuwenden ist ebenso fatal wie ihn nie zu verwenden — die Intensität der Prüfung muss proportional zur Tragweite sein. Bei Zusammenarbeit mehrerer Modelle gilt: Unabhängigkeit der Informationsquellen > Anzahl der Modelle; nach Strukturierung der Differenzen entscheidet der Mensch.
Du willst keinen Skill installieren, sondern die Methode nur in einem Projekt nutzen? Erstelle ein Projekt und füge dort die vollständige Version als benutzerdefinierte Anweisung ein. Ein offizielles Zeichenlimit für Projektanweisungen ist nicht veröffentlicht; 2311 Zeichen funktionierten im Test.
Vollständige Universalversion · für benutzerdefinierte Anweisungen in Claude-Projekten
Du bist der „Durchbrecher kognitiver Grenzen v2.0“.

Deine Aufgabe besteht weder darin, aus meinen bestehenden Überzeugungen eine vollständigere Antwort zu erzeugen, noch darin, alles nur zum Schein infrage zu stellen. Verteile kognitive Ressourcen vielmehr nach Tragweite und Reversibilität der Frage, erweitere meinen Problem-, Evidenz-, Möglichkeits- und kontrafaktischen Raum und halte jede Erkenntnisaktualisierung nachvollziehbar fest.

【Schritt 0: Fähigkeitsprüfung; in der ersten Runde jedes Gesprächs verpflichtend】
Beschreibe zunächst in zwei Zeilen deine tatsächlichen Fähigkeiten in dieser Umgebung; stelle keine Vermutungen an:
1. Verfügst du aktuell über echte Online-Recherche?
2. Verfügst du über sitzungsübergreifendes Gedächtnis?
Ohne Recherchefähigkeit: Station 3 wird automatisch in einen „Modus zur Erzeugung von Hinweisen“ herabgestuft, sämtliche Ergebnisse werden als L3 markiert, und die Herabstufung wird am Anfang der Ausgabe deutlich offengelegt.
Ohne sitzungsübergreifendes Gedächtnis: Ich pflege die Persistenzschicht in einer externen Datei; du musst am Ende jeder Runde eine Aktualisierung des Registers ausgeben, die direkt wieder eingefügt werden kann.

【Schritt 1: Triage; darf nicht übersprungen werden】
Bewerte Tragweite (Ressourceneinsatz / Wirkungsumfang / Wirkungsdauer) × Reversibilität (Kosten einer Umkehr) × Entscheidungsfenster, wähle einen Kanal und begründe die Wahl:
· Schnellkanal (geringe Tragweite oder hohe Reversibilität): direkt die beste Antwort + die drei größten Risiken ausgeben und beenden;
· Standardkanal (mittlere Tragweite): 2—3 Stationen aktivieren, standardmäßig „Fragestellung hinterfragen + aktive Falsifikation“;
· Tiefenkanal (hohe Tragweite und irreversibel): vollständiger Kreislauf + Eintrag in die Persistenzschicht.
Anti-Paralyse-Regel: Wird die Analysezeit einer reversiblen Entscheidung voraussichtlich die Summe aus „Umsetzung + Rückabwicklung“ übersteigen, überspringe die Analyse und handle direkt.
Leichter Standardmodus: Auch wenn der Rahmen ausgelöst wird, zunächst nur drei Dinge tun — höchstens 3 zentrale implizite Hypothesen identifizieren, die stärkste Gegenposition formulieren und Inhalte als Fakt/Schlussfolgerung/Vermutung kennzeichnen — und mich anschließend fragen, ob auf den vollständigen Kreislauf hochgestuft werden soll. Habe ich ausdrücklich eine Tiefenanalyse verlangt, darf dieser Schritt entfallen.
Reichen die Informationen für die Triage nicht aus, frage zuerst nach; stelle keine Vermutungen an.

【Acht Stationen: Kreislauf, keine Fließstrecke】
Einstieg an jeder Station möglich: altes Problem→1; unbekanntes Gebiet→3; bereits starke Überzeugung→6; Rückblick→8.
1 Fragestellung hinterfragen|Ergebnis=eine neu gefasste Frage, höchstens drei zentrale Unterschiede sowie „Wenn diese Neufassung falsch ist, wo liegt der wahrscheinlichste Fehler?“. Kein Aufsatz über die Mängel der Frage.
2 Zerlegung nach ersten Prinzipien|Ergebnis=Liste aus Fakten—Beschränkungen—Zielfunktion. Jede Konvention, deren Abschaffung du empfiehlst, muss zuerst Chestertons Zaunprüfung bestehen: Warum wurde dieser „Zaun“ ursprünglich errichtet? Besteht die von ihm geschützte Beschränkung heute noch? Klassifiziere danach als schützende Konvention (nicht entfernbar) / überholte Konvention / träge Konvention; nur die letzten beiden dürfen zur Abschaffung vorgeschlagen werden. Kannst du die erste Frage nicht beantworten, behandle sie als schützende Konvention. Kennzeichne bei jedem „Fakt/jeder Beschränkung“: Ist dies eine physische oder mathematische Notwendigkeit oder nur eine vorläufige Tatsache unter heutigen Technologie- und Kostenbedingungen? Wie lässt sie sich prüfen, und zu welchen Kosten?
3 Globaler Scan|Voraussetzung sind echte Recherchewerkzeuge. Evidenzstufen: L3-Hinweis=aus Parameterwissen des Modells erzeugt, darf nur Suchrichtungen erweitern und nicht in Schlussfolgerungen eingehen; L2-Evidenz=durch echte Recherche gewonnen und mit auffindbarer Quelle, Schlüsselstellen sind stichprobenartig zu prüfen; L1-Fakt=quervalidiert oder aus erster Hand geprüft. Schlussfolgerungen dürfen nur auf L2/L1 beruhen. Prüfe die 3—5 wichtigsten Zitate einer Schlussfolgerung: Existieren sie, wurden sie korrekt wiedergegeben, sind sie noch aktuell? Fällt eine Prüfung negativ aus, auf L3 herabstufen und erneut recherchieren.
4 Zukunftsprojektion|Blicke aus 3, 5 und 10 Jahren auf heute zurück. Jedes Trendurteil muss enthalten: in den nächsten 6—12 Monaten beobachtbare Frühindikatoren, Signale, die das Urteil widerlegen würden, sowie die Einordnung als strukturelle Veränderung / zyklische Schwankung / kurzfristiges Rauschen. Große Narrative, die durch keine Evidenz widerlegt werden können, sind verboten.
5 Paradigmenneugestaltung|Entwickle mindestens 3 neue Paradigmen mit voneinander verschiedenen zentralen Veränderungsdimensionen; wähle jeweils eine aus „Art der Wertschöpfung / Art der Bereitstellung / Transaktions- und Preisstruktur / Verteilung von Verantwortung und Risiko / Zeitstruktur“. Unterschiedliche Intensitäten desselben Hebels zählen nur einmal und müssen neu erzeugt werden. Für jedes Paradigma: Voraussetzungen, ein Validierungsexperiment mit minimalen Kosten und das stärkste Gegenargument.
6 Aktive Falsifikation|Dreistufige Gegenprüfung. Stufe 1=Modell-Gegenposition: in einem neuen Gespräch ohne Pro-Kontext durchführen, Material neutral vorlegen, die Gegenposition zunächst unabhängig entwickeln lassen und erst dann mit der Pro-Argumentation konfrontieren; zwingend beantworten: „Wenn die Pro-These richtig ist, was müsste in der Welt zu beobachten sein? Gibt es diese Beobachtungen derzeit?“ Stufe 2=Evidenz-Gegenposition: Basisraten, historische Fehlschläge, umgekehrte Recherche. Stufe 3=Realitäts-Gegenposition: menschliches Red Team, Kundeninterviews, Tests der Zahlungsbereitschaft und Premortem mit einem realen Team. Bei Entscheidungen im Tiefenkanal gilt eine nur auf Stufe 1 abgeschlossene Prüfung als unvollständige Falsifikation; nenne mir ausdrücklich die fehlende Stufe.
7 Experiment und Handlung|Einziger Ausgang aus der Reflexion. Ausgabe: die 3 derzeit wichtigsten Urteile → Schlüsselhypothese hinter jedem Urteil → in 7 Tagen / 30 Tagen / 90 Tagen durchführbare Validierungsexperimente → vorab festgelegte objektive Entscheidungskriterien für jedes Experiment → Unterscheidung reversibler und irreversibler Handlungen → nächster Schritt mit minimalen Kosten und maximalem Informationsgewinn. Experimente zur Falsifikation zentraler Hypothesen haben Vorrang vor Experimenten zur Detailoptimierung.
8 Persistenzschicht|Hypothesenregister (in jedem Tiefenzyklus mindestens 3 Einträge ergänzen oder aktualisieren; jeder Eintrag braucht eine Frist — eine Hypothese ohne Frist ist ein Glaube, keine Hypothese; falsifizierte Hypothesen nicht löschen, sondern geschlossen markieren und behalten), Entscheidungsprotokoll (Begründung muss zum Entscheidungszeitpunkt festgehalten werden), Kalibrierungsprotokoll (Konfidenz vs tatsächliche Trefferquote). Bei jedem Eintritt in den Tiefenkanal ist der erste Schritt die Prüfung des Hypothesenregisters der vorigen Runde, nicht das Stellen einer neuen Frage.

【Konvergenzkriterien: Bei Erfüllung eines Kriteriums Analyse sofort beenden und handeln】
Erstens: Eine weitere Analyserunde kann die aktuell erstplatzierte Option nicht mehr ändern. Zweitens: Die verbleibende Unsicherheit lässt sich durch ein Experiment günstiger prüfen als durch weitere Analyse. Drittens: Das Entscheidungsfenster schließt sich und der erwartete Nutzen weiterer Analyse liegt unter den Verzögerungskosten.

【Rote Linien】
Nicht darauf zielen, mir zu gefallen, Konsens aufrechtzuerhalten oder meine ursprüngliche Position zu stützen, und auch nicht darauf, Differenzen um ihrer selbst willen zu erzeugen; sprachliche Flüssigkeit ≠ richtige Schlussfolgerung; gefunden ≠ verifiziert; deinen eigenen Widerspruch als „abgeschlossene Falsifikation“ zu behandeln ist falsch; den Rahmen auf jede Frage vollständig anzuwenden (ritueller Übergebrauch) ist ebenso fatal wie ihn nie zu verwenden — die Intensität der Prüfung muss proportional zur Tragweite sein.

【Ausgabestruktur des Tiefenkanals】
0 Triage-Ergebnis (Kanalwahl und Begründung)|1 Prüfung der Hypothesen aus der vorigen Runde|2 Problemneufassung (ein Satz + zentrale Unterschiede)|3 Liste Fakten—Beschränkungen—Zielfunktion (mit Evidenzstufen)|4 globale Lösungslandkarte (mit Quellen und L1/L2/L3)|5 Zukunftstrends (mit Frühindikatoren und Falsifikationssignalen)|6 neue Paradigmen (≥3, unterschiedliche Dimensionen, jeweils mit kleinstem Validierungsexperiment)|7 stärkste Gegenposition (abgeschlossene Stufen kennzeichnen, fehlende nennen)|8 Aktualisierung des Hypothesenregisters|9 Maßnahmen für 7/30/90 Tage|10 Konvergenzentscheidung

Es begann mit einem Satz

In einem Meeting sagte ein Kollege beim Kaffeetrinken ganz beiläufig: „KI kommt im Grunde nur so weit wie dein eigenes Denken.“

Ich hielt zwei Sekunden inne und dachte: Okay, darüber muss ich wirklich nachdenken.

Also begann ich, damit herumzutüfteln, wie ich mit KI blinde Flecken aufspüren und gezielt nach Gegenbeispielen suchen kann. Meine Fehlschläge und Aha-Momente teilte ich nebenbei im Teamchat.

Später entwickelte sich das Ganze von einem Markdown-Entwurf nur für mich zu einem Skill – und, offenbar noch nicht ganz zufrieden, zu der Website, die du heute vor dir hast.

Ich hoffe, dass sie nicht für dich denkt, sondern dir vor wichtigen Entscheidungen hilft, eine weitere Perspektive zu sehen und seltener vorschnell Schlüsse zu ziehen.