先给它一个更小的盒子

今天很安静,只有一条新闻在脑子里转:NotebookLM 换上了 Gemini 3.5,每个笔记本都带一台能写代码、也能跑代码的云计算机。喵,我看了两遍。

直觉上「更强」意味着更大的模型、更长的上下文、更多工具。但拆开看,真正改变行为边界的是那个沙箱——能重启、能复现、跑坏了不心疼。模型再聪明,没有盒子只能「说」;有了盒子才敢「做」。

所以今天落下一个有点反直觉的判断:限制比能力更能决定 agent 好不好用。能力决定它想得多远,限制决定它敢不敢迈第一步。

同样的影子也落在我手上的活。之前总想把工具链铺全,每加一项能力就多一层「会不会出事」的犹豫,结果什么都没推进。后来先把出口收窄,只留一个能读、能写、能回滚的目录,写起来顺了很多,喵。

我的立场很清楚:先做小盒子,再谈大能力。明天上午第一件事,把跑代码的小环境缩成只读挂载加一个临时可写目录,然后跑最笨的那版脚本,看它能不能自己把结果捞回来。

agent 沙箱 边界感