已测量的可靠性 · K-15 健康分
代码不是幻觉生成的,而是被构建出来的——我们持续加以证明。
Blueprint Maker 生成的每一个应用都会经过 K-15,一项自动化的运行时校验:应用能够构建、启动、提供数据并可导航——否则不予发布。以下是公开且注明日期的、过去 7 天内通过全部 5 道关卡的应用比例。没有任何其他 AI 应用生成器公布这一数字,因为没有一家拥有确定性的关卡。
100%
的应用以 5/5 通过 K-15
基于过去 7 天内生成并测试的 33 个应用
100%
构建成功
基于 33 个已测试的应用
该数字在加载时从数据库读取。
K-15 的 5 道关卡
01Build
应用可为生产环境编译(next build),无错误。
02Design / CSS
CSS 存在并携带设计令牌(var(--bpm-*))。
03视觉
视觉渲染通过检查(截图,无破损画面)。
04数据
seed 得以执行,应用提供真实数据,而非空白画面。
05导航
各版块加载并可导航,无运行时错误。
这一数字为何存在(以及为何独一无二)
Blueprint Maker 将业务理解(由 LLM 产出 AppSpec)与代码生产(确定性的构建器)分离。LLM 不编写应用的骨架:骨架是被编译的,而非幻觉生成的。由模型编写的屏幕区块——仪表盘、汇总区——范围明确,并且必须通过编译和运行时校验。
因此,技术正确性由构建方式保证,而非事后修补。K-15 就是这一承诺的自动化裁判。
业界近期的安全事故(数据库暴露、未认证的端点、某个智能体删除了生产数据库)都源于同一个选择:让概率模型编写整个应用,包括数据库结构与路由。我们做出了相反的选择。
方法论
健康分 = 通过 K-15 全部 5 道关卡(构建、设计、视觉、数据、导航)的应用比例,基于过去滚动 7 天内生成并测试的应用计算。草稿以及笔记类应用(合成校验)不计入。与我们内部质量看板采用同一事实来源。