Kein Prompt macht eine Antwort wahr
Nur eine Prüfung ausserhalb des Modells kann das. Hier stehen die Fehler, die dabei auffliegen, an Dokumenten wie an Code, jeder belegt mit seiner Quelle.
Was Sie hier finden: Beiträge über Dokumente und über Code, jeder mit einem echten Fehler und der Prüfung, die ihn abgefangen hat. Jede Zahl steht mit ihrer Quelle da.

Woran Sie sehen, was die KI wirklich gemacht hat
Eine Zusammenfassung ohne die beiden entscheidenden Punkte, alles erledigt bei einer von fünf Dateien, zwölf Prozent ohne Quelle. Drei kostenlose Skills, die die Arbeit zusammen mit dem Ergebnis zurückgeben.
09.09.2026 · 5 Min.
Spec CodingNeun verbreitete Annahmen über KI-Codebasen, einzeln geprüft
Neun Behauptungen zur Kontrolle einer KI-gebauten Codebasis, geprüft gegen unser eigenes Prüfregister und externe Quellen. Fünf hielten stand, zwei mit Korrektur, eine übersteht die Prüfung nicht.
27.08.2026 · 16 Min.
KI allgemeinIhre KI-Prüfung hat noch nie einen echten Fehler gesehen
Ein zweiter KI-Schritt prüft die Arbeit des ersten. Keines der großen Projekte misst, ob diese Prüfung überhaupt anschlägt. Die Antwort aus der Fertigung und die drei Schritte dorthin.
25.08.2026 · 7 Min.
KI allgemeinDas Manifest der schlanken Software-Fabrik
Elf Mechanismen aus Lean Production und dem Toyota-Produktionssystem, von 5S über Jidoka, Poka-Yoke, Kanban bis Kaizen, übertragen auf das Abfangen von Goodhart-Tricks bei KI-Coding-Agenten.
20.08.2026 · 8 Min.
KI allgemeinWarum auch Ergebnisse von Reasoning-Modellen überprüft werden müssen
Der Denkprozess hebt die Trefferquote und bleibt stochastisch. Drei Befunde aus der Forschung und die drei Orte, an denen die Prüfung sitzen kann.
19.08.2026 · 9 Min.
KI allgemeinSkills, Prompts, Hacks: ohne automatische Prüfung nützt das alles nichts
Prompt-Formeln, Skill-Listen, KI-Hacks: fast jeder Tipp verbessert die Eingabe. Ob dem Ergebnis zu trauen ist, entscheidet die Prüfung der Ausgabe. Hier stehen die Filterfrage und der erste Schritt zur eigenen Prüfung.
18.08.2026 · 4 Min.
KI allgemeinDer Lauf ist echt: beim Kartenspiel, im Sport und bei der KI
Ein Lauf am Kartentisch ist mehr als eine Geschichte des Gehirns. Dieselbe Rückkopplung zieht ein KI-Modell nach oben oder nach unten.
17.08.2026 · 10 Min.
Spec CodingGeringste Rechte: der Käfig um den Agenten
Saltzer und Schroeders Prinzip der geringsten Rechte auf KI-Code-Agenten angewendet, mit Forschung von 2023 bis 2026 zu indirekter Prompt Injection und gemessener Rechte-Überschreitung bei Agenten-Fertigkeiten.
16.08.2026 · 5 Min.
KI allgemeinSpezifikations-getriebene Entwicklung mit KI: die ehrliche Fassung
Vier gemessene Befunde, vier Werkzeugkästen und die Schwierigkeiten aus der Praxis. Was die Belege tragen und was nicht.
16.08.2026 · 19 Min.
Spec CodingSpielregeln ändern, nicht den Prompt
Was die abgeschnittenen Ecken eines Bundesliga-Trainingsfelds mit geringsten Rechten gemeinsam haben: der Constraints-Led Approach aus der Sportwissenschaft und was Spec Coding daraus zieht.
16.08.2026 · 9 Min.
Spec CodingSpieltheorie für KI Agenten
Die sechsunddreißig Strategeme als Diagnosewortschatz für die Ausgabe eines Agenten, drei gemessene Stellschrauben für den Regelbauer und warum der Rest der Lücke strukturell ist.
16.08.2026 · 21 Min.
KI-PrüfungWas ein Paket mit 500 Prompts wirklich kostet
Der Preis ist der kleinste Teil der Rechnung. Drei Kosten, die auf keiner Rechnung stehen.
16.08.2026 · 4 Min.
Spec CodingZwei Jahre Vertrauen, eine Hintertür: Sicherheitschecks von Bibliotheken
Eine zweiphasige Prüfung für die Aufnahme offener Bibliotheken: ein signiertes Protokoll beim Hereinkommen, ein Offline-Gate danach, fünf harte Ausschlusskriterien und eine Punktzahl, die nie allein entscheidet.
16.08.2026 · 10 Min.
Spec CodingDie Gesetze des Spec-Codings: fünfundzwanzig alte Regeln und ein neuer Spieler
Fünfundzwanzig etablierte Ingenieurs-, System- und Vertrauens-Gesetze für KI-Spec-Coding in sechs Gruppen, dazu die sechs Paare, in denen sich die Gesetze widersprechen, plus der Schluss Miller gegen Goodhart.
15.08.2026 · 21 Min.
KI allgemeinDie Ironien der Automatisierung: warum der Mensch über dem Agenten wichtiger wird
Bainbridges Ironien der Automatisierung auf Code-Agenten angewendet, mit Forschung von 2023 bis 2025 und vier Konsequenzen für Spec Coding.
15.08.2026 · 5 Min.
Spec CodingGoodharts Gesetz: warum Kennzahlen kippen und was Spec Coding dagegen braucht
Goodhart, Campbell und Specification Gaming auf KI-erzeugten Code angewendet, dazu die sechs Techniken von Spec Coding gegen kippende Kennzahlen.
15.08.2026 · 8 Min.
KI allgemeinDas Maulwurf-Spiel im Prompt Engineering: warum Reparieren nicht hält
Ein Fehler weg, der nächste an anderer Stelle da. Vier Arbeiten dazu, warum Ausbessern nie endet.
14.08.2026 · 3 Min.
KI allgemeinDie 15 grössten Prompting-Mythen und warum Ihr System-Prompt Ihr Produkt nicht rettet
Fünfzehn Überzeugungen über Prompts, jede gegen die Forschung gehalten. Siebzehn Quellen, ein Ergebnis.
14.08.2026 · 14 Min.
KI allgemeinFertigungsdisziplin statt Prompt Engineering: Poka-Yoke, MSA, FMEA für KI-Code
Poka-Yoke, MSA und FMEA auf KI-erzeugten Code angewendet. Qualitätstechnik statt Prompt Engineering.
07.08.2026 · 13 Min.
KI allgemeinKritische Dokumenten-Reviews mit KI: Wie Hardware-Ingenieure falsche Zahlen im Keim ersticken
Im Datenblatt stehen 2,7 Volt, in der KI-Zusammenfassung 3,3. Wie Sie eine erfundene Zahl vor dem Design-Review abfangen.
07.08.2026 · 4 Min.
KI allgemeinDie sieben Versagensdimensionen der KI-Prüfung: Mechanismus und Kontrolle
Sieben Dimensionen, in denen die KI-Prüfung versagt, jede mit ihrem Mechanismus und der Kontrolle, die ihn hält.
06.08.2026 · 18 Min.
KI allgemeinSchluss mit Halluzinationen und halbfertiger Arbeit: ein Weg, der die Qualität Ihrer KI massiv steigert
Eine einzige Prüfdatei zwingt jede Aussage zu einem Beleg und deckt beides auf: Erfundenes und halb gelesene Dokumente.
06.08.2026 · 10 Min.
