从玩具的大脑,到受人指挥的自主作战人形机器人。
在仿真中学习。把教训向前传递。在物理世界中验证。目前只完成了第一步。
它从哪里来
它最初是一个必须离线工作的玩具里的小型大脑。这条规矩至今不变:它在机器本身上思考,而不是在数据中心里。此后的每一步都在更大尺度上追问同一个问题:怎样打造一个你真正拥有的大脑——一个你能打开、读懂、修好的大脑?
- 第一天大脑工厂
- 2026 年 2–3 月TinkyBrains
- 2026 年 3–5 月SML——最小的语言模型
- 2026 年 3 月起结构化知识
- 2026 年 3 月起追踪——Peel
- 2026 年 9 月失败优先
- 2026 年 9 月Peel——一个自我演化的符号大脑
- 2026 年 9 月一个大脑,许多世界
- 下一步具身的大脑
前面的路
7 步中 1 步运行中
- 01运行中
游戏与仿真
Doom、Wolfenstein、Fallout、GoldenEye、坦克、软件中的无人机飞控、照片级驾驶。本页的每一个数字都来自这里。
拿走的拐杖尚未移除:完美重置、游戏直接告诉它真相、早已熟悉的对手。
作战计划 ↻
01作战计划游戏与仿真
- 这一步
- 在 DOOM、Wolfenstein、Fallout、GoldenEye、坦克游戏、模拟无人机航线和照片级驾驶中运行同一个大脑。每一次尝试、每一次失败都被记录。
- 改变什么
- 尚无改变:游戏能完美重置、如实告诉它真相,对手都是已知的。
- 过关标准
- 在留出测试上显示出学习,而不只是在训练过的运行上:无人机从未见过的起点 10 圈全部无碰;坦克大脑带到另一款游戏 +17%。失败一并公开。
- 证明什么
- 循环有效:失败、解释、改一处、证明、写下规则。
↺ 返回
- 02下一步
真实控制器,仿真世界
同一个大脑运行在真实的飞控与电机驱动上;世界仍是仿真的。
拿走的拐杖完美时序:真实延迟、真实总线、真实时钟。
作战计划 ↻
02作战计划真实控制器,仿真世界
- 这一步
- 把同一个密封的大脑装到真实的飞控和电机驱动上,世界仍然是仿真的。
- 改变什么
- 时序变成真的:真实延迟、真实总线、真实时钟。
- 过关标准
- 无人机航线的结果在真实硬件时序下依然成立,每一次地板否决依然有记录。
- 证明什么
- 在碰上真实地形之前,大脑先经受住真实的电子系统。
↺ 返回
- 03有门槛
泥地里的廉价机器人
小型地面与空中机器人,一次坠毁损失的是一个零件,而不是一个项目。
拿走的拐杖游戏直接告诉它真相:眼睛只剩下它自己的摄像头。
作战计划 ↻
03作战计划泥地里的廉价机器人
- 这一步
- 小型地面与空中机器人,在泥地里跑,一次坠毁损失的是一个零件,而不是一个项目。
- 改变什么
- 游戏不再告诉它真相:眼睛只剩下它自己的摄像头。
- 过关标准
- 只靠自己的传感器完成航线,并在机器人本身上把失败变成规则。
- 证明什么
- 没有引擎真值,也能在廉价硬件上学习。
↺ 返回
- 04有门槛
我们自己实验室里的人形机器人
一台商用人形机器人,在我们自己的工作台上。它从不与人对练。
拿走的拐杖低代价的后果:平衡、摔倒与磨损都是真实的。
作战计划 ↻
04作战计划我们自己实验室里的人形机器人
- 这一步
- 在我们自己的工作台上使用一台商用人形机器人。它从不与人对练。
- 改变什么
- 后果不再廉价:平衡、摔倒与磨损都是真实的。
- 过关标准
- 在人掌握停止按钮的前提下完成稳定的自主动作,失败变规则的循环在硬件上运行。
- 证明什么
- 同一个大脑能驱动一副会摔倒的身体。
↺ 返回
- 05有门槛
擂台:机器人对机器人
经认可的机器人对机器人比赛,由大脑取代远程操控者。我们在这里融资,也在这里弄清楚:对方还手时什么会坏。
拿走的拐杖已知对手:现在对方掌控了一半的实验。
作战计划 ↻
05作战计划擂台:机器人对机器人
- 这一步
- 经认可的机器人对机器人比赛,由大脑取代远程操控者。我们在这里融资。
- 改变什么
- 已知对手没了:对方掌控一半的实验。
- 过关标准
- 计分项:每小时人工干预、恢复、新的失败类型、地板否决、保留与否决的规则、重复失败的减少,以及带到从未交手对手身上的教训。失败公开留档。
- 证明什么
- 它在一场场比赛之间、面对不是我们造的对手时学习。
↺ 返回
- 06有门槛
由别人来测试
由别人执行这套协议,用他们的机器人,对阵他们的对手。
拿走的拐杖我们:写下这个实验的人。
作战计划 ↻
06作战计划由别人来测试
- 这一步
- 由别人执行这套协议,用他们的机器人,对阵他们的对手。
- 改变什么
- 我们被拿掉了:写实验的人不再主持实验。
- 过关标准
- 没有我们在场,结果依然能复现。
- 证明什么
- 这不再是我们自己讲的故事,而是一个结果。
↺ 返回
- 07有门槛
受人指挥、具备作战能力的人形机器人
这是目标。一台在人的指挥下运行、具备作战能力的人形机器人:使用武力的权限在人手里,地板让机器守住交给它的约束,每个决定都有记录。尚未建成,受上面每一步的门槛约束。
拿走的拐杖擂台:规则、裁判,以及由别人掌控的停止按钮。
作战计划 ↻
07作战计划受人指挥、具备作战能力的人形机器人
- 这一步
- 一台受人指挥、具备作战能力的人形机器人,建立在上面每一步之上。
- 改变什么
- 擂台的规则、裁判和停止按钮,让位于指挥官的命令和交战规则。
- 过关标准
- 对武力的使用由人行使判断,正如美国国防部第 3000.09 号指令所要求;地板让机器守住人设定的机器可读约束;每个决定都有记录。
- 证明什么
- 学习可以改变它的战术,但永远不能扩大它的权限。
↺ 返回