展示你的推理过程
单元格里写着 78.4%——可为什么是这个数?当生成它的对话早已消失,.deepcell 如何留住每个数字背后的推理。
“我能相信智能体给出的这个数字吗?”
每位分析师迟早都会问出这个问题,而且往往就在交付物即将发出的那一刻。单元格里写着
78.4%。生成它的那个智能体已经不在了——上下文窗口被清空,对话被归档,提示词
也被遗忘。模型只是一张快照。当标签页一关,推理就蒸发殆尽。
一个没有审计追踪、却信心满满的数字,比没有数字还要糟糕。只要会议上有人问一句 为什么,信任就在那一刻开始流失。
诊断#
电子表格里的 ChatGPT 就像一个坐在你旁边、口若悬河的陌生人。你指向哪个单元格, 它就能把哪个填满。它做不到的——也是任何聊天形态的工具都做不到的——是留下一份 结构化的记录,说明它是怎么走到这一步的。单元格批注只是一段散文。你没法对它做结构化 检索,没法把两个版本拿来比对,也没法向它提问——比如"哪些假设一旦崩塌,就会让这个 数字变动?"。一条批注做不到这些,一张彼此相连的推理网络却可以。
即便没有智能体,同样的问题也存在。一位分析师离开团队,他的模型就变成了考古现场。
公式还在;但为什么没了。我们都曾接手过这样的工作簿:标签页被命名为
final_v3_USE_THIS,然后花上整整一个周二,从单元格引用里逆向推断出某人的整套
世界观。
解决之道不是一套更好的批注系统,而是赋予推理与公式同等的一等公民待遇。
设计上的关键一步#
一个 .deepcell 在承载数字的同时,还紧挨着数字携带一张结构化的推理地图——包括那些 主张、假设、证据,以及它们彼此如何相连。 一个 .deepcell 的解剖 一文涵盖了完整的 section 列表;这里我们关心的是 Reasoning。它由四类构件组成:
- 主张(Claims)——关于模型的承重性陈述。共七种:投资论点、风险、催化剂、 反方观点、待解问题、市场共识,以及一条既有的常识判断。
- 假设(Assumptions)——你选择去相信的某个输入。每一项都会被标注为:成立、 存疑、已崩塌,或已被取代。
- 证据(Evidence)——指向模型之外某物的锚点:一条通往来源的链接(一份财报、 一个网页、一份文档,或另一个模型)、一个可选的截止日期,以及一段摘录。
- 论证(Arguments)——连接上述任意两者之间的一条带标签的链接:其中一方支持、 反驳、依赖、推导自、是其变体、取代、抵触,或引用了另一方。
主张会链接到它所支撑的单元格。这张推理地图不是装饰。它是文件中负责解释文件其余 部分的那一部分。
下面是一个投资论点在实际使用中的样子,取自一个真实的在用模型,略作虚构处理:
论点: 毛利率在 2027 年年中达到 78%,已由三季度电话会议确认。它所依赖的 假设: 单位推理成本每年下降 30%。两者的关联: 该论点依赖于这项假设。
这个论点指向毛利率的两个预测季度。它依赖于一项关于推理成本衰减的假设。如果那项 假设崩塌,这个论点就是第一个应当被重新审视的对象。
这就是那份契约:模型中每一个承重性数字,都有一条通往产生它的那些假设的回溯路径。
你能用它做什么#
你可以向这个文件提问。问它:如果这项假设崩塌了,会连带崩掉什么?——它就会列出 每一个倚赖这项假设的主张,连同那些间接的连锁影响也一并算上。
当季报落地、而你想赶在午饭前弄清这个新数据点会触及模型的哪些部分时,这就很有用。
更有意思的一问,是在你保存版本的那一刻提出的。把那项推理成本假设从成立翻转为 已崩塌——比如某家供应商宣布了价格下限——文件就会顺着推理一路走下去,把这项假设 下游的每一个主张都标记为漂移候选项。它不会自动判定为伪。它只做标记。是否要让这个 论点在新的现实中存活下来、还是需要用一个 v3 来取代它,仍由分析师来决定。
把这一步设为每次保存版本时自动运行,你的模型就再也无法在无人知晓的情况下,悄悄从 它自己的论点之下漂移出去。
历史同样可以问。问这个文件:把这个论点的每一个版本、以及分别被什么取代,都给我 列出来。
这套推理能在分析师离职后存续下来。下一个打开这个文件的人,得到的是整套世界观,而 不只是一张工作表。
共存,而非替代#
一个 xlsx 可以承载单元格批注。它无法承载一张彼此相连的推理地图。这并不是 Excel 的 缺陷——批注本就是为随手翻阅的读者、为顺手浏览标签页的同事而设计的。这件事它做得 很好。
推理地图则是为审计追踪而生。两者可以并肩共存:批注留在工作簿里,供随手翻阅的读者 查看;推理留在 .deepcell 里,供审计人员、接任的分析师,以及运行自动检查的智能体 使用。把你的 Excel 模型导入进来,在其之上叠加推理,需要时再导出回去。
一点补充#
Reasoning section 是该格式中最新加入的部分——其规范在上一个迭代中才落地,也是 .deepcell 中正在最积极演进的部分。上文中的构件与关系已经稳定;预计会有更多 提问方式在此之上陆续登场。
谁为这份工作署名#
一张彼此相连的推理地图不等于免责。智能体可以大规模地填充主张与证据,但一个被标注 为高强度的主张,仍然是某个人正在做出的主张。这张地图让主张变得可读——对审阅者、 对监管者、对那个将在十八个月后接手模型的分析师而言皆是如此。它并不会让主张变得 正确。关于我们如何看待这种分工,参见 分析师与 Claude:智能体起草,分析师署名。
页面上的那个数字,依然属于你。只是现在,它背后多了一份可以随时调阅的底稿。
亲眼看看——到在线演练场打开一份示例 .deepcell。编辑一个值,看着依赖项重新计算,检视任何一个数字背后的推理。