Die Fabrik · Vorgeschmack
Unten steht kein Werbetext, sondern ein realer Bau-Durchlauf aus der Governance-Datenbank der Fabrik: eine Story, ihr Advocatus Diaboli, ihr Aufräum-Audit, fünf Prüf-Linsen — mit den unbequemen Funden, so wie sie registriert wurden. Prüfer schreiben sich selbst in die Datenbank; eine Prüfung ohne Zeile hat nicht stattgefunden.
Auszüge aus echten Prüf-Verdikten — gekürzt und ohne Shell-Kommando-Passagen, nicht geschönt. Die Decke der Aussage ist die Datenbank-Zeile.
1 · Die Story
EIN public_surface_gate: build.py --audit (banned+R5) + public_pii_scan (Namen) + honesty_layer (positive Marker) zusammenfuehren, Glob-Abdeckung … (Titel gekürzt) — Status heute: DONE
Jede Arbeit ist eine Zeile in der Datenbank: mit Akzeptanzkriterien, Messgröße und den Prüf-Pflichten, die vor dem Commit erzwungen werden.
2 · Advocatus Diaboli — 6 Funde
Ein Agent mit dem Auftrag, den Erfolg zu widerlegen
VERDIKT: Gate ist ECHT (34 Surfaces, rc=0, Ratchet greift) — aber 2 CRITICAL Fail-open-Loecher. (1) CRITICAL Auditor-Crash=gruen…
3 · Aufräum-Audit — 2 Funde
Ein zweiter Agent sucht Reste, Doppel, tote Zweige
KEEP + sauber, nichts-zu-entfernen im Worktree; 1 redundantes Doppel-Wissen benannt. (a) Worktree exakt beabsichtigt…
4 · Linse: aqal — 3 Funde
Eigene Frage, eigene Registrierung
VERDIKT: OR/LL/OL gefuellt, LR ist der ehrliche Riss — die Regel ist UR/OR-stark, aber nicht un-umgehbar. (1) Befund Deploy-Hook umgehbar…
4 · Linse: architekt — 4 Funde
Eigene Frage, eigene Registrierung
Schnitt traegt fuer v1: build.py-subprocess statt Wortlisten-Fork ist richtig (EINE Refusal-SSoT, Devil-Haertung 196719e wirkt sofort auf 43 Surfaces), Repo-Grenze read-only sauber. ABER nicht 3-Jahre/Multi-Produkt-faehig: Produkt-Kopplung hart verdrahtet,…
4 · Linse: code-audit — 4 Funde
Eigene Frage, eigene Registrierung
VERDIKT CONCERNS: Randfaelle mehrheitlich fail-closed, ein echter Fail-Open-Befund. (1) leere dist/ ist GRUEN…
4 · Linse: inspect — 3 Funde
Eigene Frage, eigene Registrierung
VERDIKT CONCERNS (v1 vertretbar, aber blind nach dem Lauf): (1) Befund kein Ledger…
4 · Linse: security — 3 Funde
Eigene Frage, eigene Registrierung
VERDIKT weitgehend CLEAN — der Austrick-Verdacht ist empirisch WIDERLEGT. (1) Output-Parsing-Injektion scheitert: build.py echot Seitentext nur im R5-Excerpt, und der wird whitespace-normalisiert.…
Gezählt in der Werkstatt-Datenbank (backlog_stories, devil_runs, build_panel_runs, cleanup_audit_runs) — gemessen 11.09.2026. Was hier nicht steht, wird nicht behauptet.
Die kritischen Funde oben wurden vor dem Merge behoben — und genau das ist der Punkt: nicht behauptete Fehlerfreiheit, sondern registrierte Prüfung. Nichts hier ist ein Versprechen; es ist ein Protokoll.
Die Story oben ist ein Ausschnitt. Daneben arbeitet ein Bestand von 263 Hintergrund-Jobs (Timer-Inventur, gemessen 11.09.2026), gut die Hälfte davon dauerhaft aktiv. Welche das sind und was sie tun, bleibt bewusst intern — öffentlich ist hier die Art, wie sie geführt werden:
Welche KI wo läuft
Doppelt ausgewiesen, nie geraten
Jeder Job zeigt seine KI zweifach: deklariert (das Modell-Flag in der Dienst-Datei) und beobachtet (die echten Aufrufe im Kosten-Register). Weichen beide voneinander ab, sieht man es — das ist der Zweck.
Wenn ein KI-Budget endet
Läuft ein Guthaben-Topf leer, stoppt der betroffene Job laut: roter Hinweis am Job, betroffene Nachbar-Jobs markiert — kein stilles Weiterdrehen, kein stilles Verschwinden. Zuletzt so geschehen am 11.09.
Eingreifen mit Spur
Jobs lassen sich im Steuer-Cockpit abschalten — aber nur mit Begründung, die danach sichtbar am Job steht. Die Inventur überwacht sich selbst: ist sie älter als ein Tag, meldet der Bildschirm das rot, statt Vollständigkeit zu behaupten.