Zum Hauptinhalt springen
Gemessene Zuverlässigkeit · K-15 Health Score

Der Code wird nicht halluziniert, sondern erzeugt – und wir beweisen es fortlaufend.

Jede von Blueprint Maker generierte Anwendung durchläuft K-15, eine automatisierte Laufzeitprüfung: Die App baut, startet, liefert ihre Daten und lässt sich navigieren – oder sie geht nicht live. Hier steht, offen und datiert, der Anteil der Apps, die alle 5 Tore in den letzten 7 Tagen bestehen. Kein anderer KI-App-Generator veröffentlicht diese Zahl, weil keiner ein deterministisches Tor besitzt.

100%
der Apps bestehen K-15 mit 5/5
bei 33 in den letzten 7 Tagen generierten und getesteten Apps
100%
erfolgreiche Builds
bei 33 getesteten Apps

Zahl beim Laden aus der Datenbank gelesen.

Die 5 Tore von K-15

01Build

Die App kompiliert für die Produktion (next build), fehlerfrei.

02Design / CSS

Das CSS ist vorhanden und trägt die Design-Tokens (var(--bpm-*)).

03Visuell

Die visuelle Darstellung besteht die Prüfung (Screenshot, kein kaputter Bildschirm).

04Daten

Der Seed läuft und die App liefert echte Daten, keinen leeren Bildschirm.

05Navigation

Die Bereiche laden und navigieren ohne Laufzeitfehler.

Warum diese Zahl existiert (und warum sie einzigartig ist)

Blueprint Maker trennt das Verständnis der Fachdomäne (das LLM erzeugt eine AppSpec) von der Erzeugung des Codes (deterministische Builder). Das LLM schreibt nicht das Grundgerüst der Anwendung: Es wird kompiliert, nicht halluziniert. Die Bildschirmblöcke, die ein Modell schreibt – Dashboard, Zusammenfassungsbereiche –, sind abgegrenzt und müssen Kompilierung und Laufzeitvalidierung bestehen.

Dadurch ist die technische Korrektheit von Grund auf garantiert, nicht nachträglich geflickt. K-15 ist der automatisierte Richter dieses Versprechens.

Die jüngsten Sicherheitsvorfälle der Branche (offengelegte Datenbanken, nicht authentifizierte Endpunkte, ein Agent, der eine Produktionsdatenbank löscht) haben alle dieselbe Ursache: ein probabilistisches Modell die gesamte Anwendung schreiben zu lassen, Datenbankschema und Routen inbegriffen. Wir haben uns anders entschieden.

Methodik

Health Score = Anteil der Apps, die alle 5 K-15-Tore bestehen (Build, Design, Visuell, Daten, Navigation), berechnet über die in den letzten gleitenden 7 Tagen generierten und getesteten Apps. Entwürfe und Apps vom Typ Note (synthetische Prüfung) werden ausgeschlossen. Dieselbe Wahrheitsquelle wie unser internes Qualitäts-Dashboard.