知道一份化学样品的组成,也拿到了质谱图,为什么程序还需要化学家的判断?本期《原代码》从 Edward Feigenbaum 与合作者的 DENDRAL 研究出发,追踪专家经验怎样成为可输入、可修改、也可以由程序学习的知识,再沿着 MYCIN 与 R1 的实践,讨论这套架构怎样扩展,以及它与大语言模型的不同路径。
从一张留下多个答案的谱图,到一条可以重新检查的判断:机器保留了哪个候选,我们又能不能找到它所依据的条件?
你可在官方网站 yuandaima.xyz 中查看本期逐字稿、证据引用关系和证据快照。
时间轴
数据没有直接给出答案
程序还不知道什么
把一个判断写进去
规则也成为要寻找的答案
那个还没有被排除的结构
换知识,还要不要换方法
知识进入了另一种地方
留下可以检查的判断
本期资料
- [Robert K. Lindsay、Bruce G. Buchanan、Edward A. Feigenbaum、Joshua Lederberg:DENDRAL: a Case Study of the First Expert System for Scientific Hypothesis Formation(1993)](digirepo.nlm.nih.gov)
- [Bruce Buchanan、Georgia Sutherland、Edward Feigenbaum:Heuristic DENDRAL(1969)](stacks.stanford.edu)
- [Bruce G. Buchanan 等:Automatic Rule Formation in Mass Spectrometry by Means of the Meta-DENDRAL Program(1976)](stacks.stanford.edu)
- [Bruce G. Buchanan、Edward A. Feigenbaum:DENDRAL and Meta-DENDRAL: Their Applications Dimension(1978 年技术报告)](ftpmirror.your.org)
- [Bruce G. Buchanan、Edward H. Shortliffe 编:Rule-Based Expert Systems,第 36 章 Major Lessons from This Work(1984)](shortliffe.net)
- [Judith Bachant、John McDermott:R1 Revisited: Four Years in the Trenches(1984)](ojs.aaai.org)
- [Qwen Team:Qwen3 Technical Report(2025,v1)](arxiv.org)
- [Patrick Lewis 等:Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks(2020)](papers.nips.cc)
源码与工程记录
- [Qwen3.5-397B-A17B:模型说明(本期核对的固定版本)](huggingface.co)
- [同版本 config.json:模型结构与层配置](huggingface.co)
访谈与历史原声来源
- [Computer History Museum:Edward Feigenbaum 接受 Nils Nilsson 采访,Session 1(2007-06-20)](www.computerhistory.org)——本期两段历史原声均来自这场访谈,分别谈向化学家求取知识,以及从数据中学习规则的设想与范围。[馆方整理文本](archive.computerhistory.org)。
- [Carl Djerassi:Using Artificial Intelligence in Chemistry(2005 年录制,Web of Stories)](www.webofstories.com)——用于核对他对结构推断与课堂应用的回忆,本期未剪入这场访谈的声音。
说明与延伸阅读
- DENDRAL 是多方合作的结果。Joshua Lederberg 提出科学任务并研究结构枚举,Georgia Sutherland、Bruce Buchanan 与化学专家等共同推动程序实现和知识获取;MYCIN、R1 各有自己的团队,不能都归到 Feigenbaum 一人名下。
- Heuristic DENDRAL 与 Meta-DENDRAL 的任务不同:前者利用知识约束、提出并比较结构,后者研究从已知结构及质谱中形成规则。程序学习规则仍依赖既定表示和评价办法,不等于从零自行发现全部知识。
- CONGEN 找到另一个符合现有条件的结构,说明这些条件还没有唯一确定答案,不直接证明原论文的结构错误。节目使用的样品与排障例子是机制说明,不是历史实验现场的复原。
- 1978 年材料采用的是二月技术报告版,不能与同名期刊版本混用页码。2007 年原声是 Feigenbaum 的后见回忆;其中转述 Carl Djerassi 的话,并不是 Djerassi 本人的录音。
- 本期对显式知识库与推理机的讨论主要以 MYCIN / EMYCIN 为例,不代表所有专家系统都只有一种结构;规则系统也并非天然不能处理不确定性或因果知识。对语言模型的结构比较限于所引用的公开实例,RAG 的文档检索也不等于经典规则推理。
- 第七章简要回看了不同研究起点:[Cyc 的显式常识](arxiv.org)、[Soar 的统一认知架构](soar.eecs.umich.edu)、[Rodney Brooks 的感知与行动](people.csail.mit.edu),以及 [Marcus Hutter 的通用智能理论](arxiv.org)。这些路线没有整体成为本期所述语言模型的底座,不等于它们没有影响,也不意味着各自已经完成通用智能。

