Perslis 国防
PERSLIS 国防 · 时间线

从玩具的大脑,到受人指挥的自主作战人形机器人。

在仿真中学习。把教训向前传递。在物理世界中验证。目前只完成了第一步。

它从哪里来

它最初是一个必须离线工作的玩具里的小型大脑。这条规矩至今不变:它在机器本身上思考,而不是在数据中心里。此后的每一步都在更大尺度上追问同一个问题:怎样打造一个你真正拥有的大脑——一个你能打开、读懂、修好的大脑?

  1. 第一天大脑工厂
  2. 2026 年 2–3 月TinkyBrains
  3. 2026 年 3–5 月SML——最小的语言模型
  4. 2026 年 3 月起结构化知识
  5. 2026 年 3 月起追踪——Peel
  6. 2026 年 9 月失败优先
  7. 2026 年 9 月Peel——一个自我演化的符号大脑
  8. 2026 年 9 月一个大脑,许多世界
  9. 下一步具身的大脑

大脑工厂:每个阶段的完整内容 →

前面的路

7 步中 1 步运行中
  1. 01运行中

    游戏与仿真

    Doom、Wolfenstein、Fallout、GoldenEye、坦克、软件中的无人机飞控、照片级驾驶。本页的每一个数字都来自这里。

    拿走的拐杖尚未移除:完美重置、游戏直接告诉它真相、早已熟悉的对手。

    作战计划 ↻

    01作战计划

    游戏与仿真

    这一步
    在 DOOM、Wolfenstein、Fallout、GoldenEye、坦克游戏、模拟无人机航线和照片级驾驶中运行同一个大脑。每一次尝试、每一次失败都被记录。
    改变什么
    尚无改变:游戏能完美重置、如实告诉它真相,对手都是已知的。
    过关标准
    在留出测试上显示出学习,而不只是在训练过的运行上:无人机从未见过的起点 10 圈全部无碰;坦克大脑带到另一款游戏 +17%。失败一并公开。
    证明什么
    循环有效:失败、解释、改一处、证明、写下规则。

    ↺ 返回

  2. 02下一步

    真实控制器,仿真世界

    同一个大脑运行在真实的飞控与电机驱动上;世界仍是仿真的。

    拿走的拐杖完美时序:真实延迟、真实总线、真实时钟。

    作战计划 ↻

    02作战计划

    真实控制器,仿真世界

    这一步
    把同一个密封的大脑装到真实的飞控和电机驱动上,世界仍然是仿真的。
    改变什么
    时序变成真的:真实延迟、真实总线、真实时钟。
    过关标准
    无人机航线的结果在真实硬件时序下依然成立,每一次地板否决依然有记录。
    证明什么
    在碰上真实地形之前,大脑先经受住真实的电子系统。

    ↺ 返回

  3. 03有门槛

    泥地里的廉价机器人

    小型地面与空中机器人,一次坠毁损失的是一个零件,而不是一个项目。

    拿走的拐杖游戏直接告诉它真相:眼睛只剩下它自己的摄像头。

    作战计划 ↻

    03作战计划

    泥地里的廉价机器人

    这一步
    小型地面与空中机器人,在泥地里跑,一次坠毁损失的是一个零件,而不是一个项目。
    改变什么
    游戏不再告诉它真相:眼睛只剩下它自己的摄像头。
    过关标准
    只靠自己的传感器完成航线,并在机器人本身上把失败变成规则。
    证明什么
    没有引擎真值,也能在廉价硬件上学习。

    ↺ 返回

  4. 04有门槛

    我们自己实验室里的人形机器人

    一台商用人形机器人,在我们自己的工作台上。它从不与人对练。

    拿走的拐杖低代价的后果:平衡、摔倒与磨损都是真实的。

    作战计划 ↻

    04作战计划

    我们自己实验室里的人形机器人

    这一步
    在我们自己的工作台上使用一台商用人形机器人。它从不与人对练。
    改变什么
    后果不再廉价:平衡、摔倒与磨损都是真实的。
    过关标准
    在人掌握停止按钮的前提下完成稳定的自主动作,失败变规则的循环在硬件上运行。
    证明什么
    同一个大脑能驱动一副会摔倒的身体。

    ↺ 返回

  5. 05有门槛

    擂台:机器人对机器人

    经认可的机器人对机器人比赛,由大脑取代远程操控者。我们在这里融资,也在这里弄清楚:对方还手时什么会坏。

    拿走的拐杖已知对手:现在对方掌控了一半的实验。

    作战计划 ↻

    05作战计划

    擂台:机器人对机器人

    这一步
    经认可的机器人对机器人比赛,由大脑取代远程操控者。我们在这里融资。
    改变什么
    已知对手没了:对方掌控一半的实验。
    过关标准
    计分项:每小时人工干预、恢复、新的失败类型、地板否决、保留与否决的规则、重复失败的减少,以及带到从未交手对手身上的教训。失败公开留档。
    证明什么
    它在一场场比赛之间、面对不是我们造的对手时学习。

    ↺ 返回

  6. 06有门槛

    由别人来测试

    由别人执行这套协议,用他们的机器人,对阵他们的对手。

    拿走的拐杖我们:写下这个实验的人。

    作战计划 ↻

    06作战计划

    由别人来测试

    这一步
    由别人执行这套协议,用他们的机器人,对阵他们的对手。
    改变什么
    我们被拿掉了:写实验的人不再主持实验。
    过关标准
    没有我们在场,结果依然能复现。
    证明什么
    这不再是我们自己讲的故事,而是一个结果。

    ↺ 返回

  7. 07有门槛

    受人指挥、具备作战能力的人形机器人

    这是目标。一台在人的指挥下运行、具备作战能力的人形机器人:使用武力的权限在人手里,地板让机器守住交给它的约束,每个决定都有记录。尚未建成,受上面每一步的门槛约束。

    拿走的拐杖擂台:规则、裁判,以及由别人掌控的停止按钮。

    作战计划 ↻

    07作战计划

    受人指挥、具备作战能力的人形机器人

    这一步
    一台受人指挥、具备作战能力的人形机器人,建立在上面每一步之上。
    改变什么
    擂台的规则、裁判和停止按钮,让位于指挥官的命令和交战规则。
    过关标准
    对武力的使用由人行使判断,正如美国国防部第 3000.09 号指令所要求;地板让机器守住人设定的机器可读约束;每个决定都有记录。
    证明什么
    学习可以改变它的战术,但永远不能扩大它的权限。

    ↺ 返回

联系我们 ↗

Perslis 全站