Perslis 外壳 · Kist

Kist:循环外壳。

目标进去,出来的是经过检查的结果。Kist 计划、通过真实工具行动、验证结果,然后再来一轮,直到工作被证明或触及上限。

摘要

Kist 是 Perslis 所构建于其上的引擎。它不是语言模型,而是围绕语言模型的循环:语言模型提供推理,Kist 提供工具、记忆、检查,以及什么才算完成的规则。它可以使用你指向的任何模型——用你自己密钥的云端模型,或你自己硬件上的本地模型。外壳、安全关卡和验证机制作为一个经过校验和验证的二进制文件一起发布。

它遵循的规则

Kist 是外壳,不是模型:它让语言模型遵守一组固定规则,规定一个结果必须经受什么才能算数。一共四条:

循环,一轮一轮

  1. 估计目标。Kist 在投入之前先估计目标需要多少工作量。
  2. 计划。目标被拆成有序的步骤,每步只做一件事,步骤之间的依赖是明确的。互不依赖的步骤并行运行。
  3. 行动。每个步骤都通过真实工具运行:文件、命令行、服务和遗留系统。
  4. 验证。对照目标检查结果,能运行的地方就实际运行。
  5. 重新计划。任何失败或与预期不同的地方都回到计划中。
  6. 学习。Kist 读取自己的运行历史,因此下一份计划从上一份的发现出发。
  7. 停止。当工作被验证,或触及预算、时间或轮次上限时,循环结束。触及上限会如实报告为上限,而不是成功。
一次提示加一次回应只是一次猜测。循环让它以证据收尾。

从产品角度看同一个循环

从外面看,循环有八个阶段:研究、计划、分析、决策、构建、测试、部署和连接。你做架构师该做的决定;Kist 负责研究、构建和证明,未经验证的东西不会被称为完成。

循环,逐个阶段 →

模型评审会

在 Kist 信任一个重要结果之前,它会把结果交给不止一个模型。构建者起草;来自不同实验室的评审者提出批评,使它们的盲点不相重叠;一个对手试图击破结果;最强的可用模型最终签署。模型之间的分歧被当作信号,因为真正的错误正是在那里浮现。

谁在评审会上,以及为什么 →

它在哪里运行

Kist 可以用云端前沿模型运行同一个循环,也可以完全离线运行。敏感工作会进入 AirTight 模式,构建、评审和记录都留在本地。受监管的工作则采用法律循环的引用与验证纪律。Kist 从不转售推理:你把它指向你已有的账户,或你自己硬件上的模型。

它不是什么

Kist 不会让模型变得更聪明,而是让模型的工作可以被检查。它的保证只延伸到它的检查所及之处:一个结果只能对照测试、运行或评审者实际能观察到的东西来验证。没有检查的地方,诚实的输出就是“未验证”,Kist 会如实说明。

延伸阅读