AI 系统
面向研究、决策与执行的智能体。
想法
今天大多数自称「智能体」的系统,本质上是演示:在选好的任务上、在观众面前,跑通一次。我们感兴趣的是另一种东西——每天都在真实工作上运行,并且因为推理过程可以被检查,所以值得被信任。
这需要的不是更多新意,而是更多工程:会话结束后仍然存在的记忆、出错时大声报错的工具、以及在任何人上线之前就跑完的评测。
系统
在我们的理解里,一个智能体由四个部分组成,再由一条反馈回路把它们串起来。研究负责把可知的东西找回来;知识把它存成在压力下仍能被检索到的形式;推理做判断;行动对真实的工具产生真实的后果。反馈把结果送回系统所知道的东西里,闭合这条回路。
每一部分都可以单独测试。这正是重点:一个拆不开的系统,也就是一个无法被信任的系统。
为什么重要
资本配置、临床判读与市场研究,在某一层上是同一个问题——读完一个人读不完的材料,然后对读到的东西谨慎地推理。格温首先为自己的工作构建这些系统。任何东西在走向别处之前,都得先在我们自己手上活下来。