本期要点
· AI 已经能读写生命的底层代码:从 HyenaDNA 的超长上下文,到 EVO 第一次生成 DNA,再到用模型从零造出一个有功能的噬菌体基因组。
· 为什么同一批人既做设计又做防御:会「生成」的模型天然也会「判别」,判别致病性靠的正是同一套概率分布。
· 现在这道防线建错了地方:语言层的护栏只能管住「嘴」,真正需要的是序列层的护栏——不管怎么绕,危险的 DNA 就该被识别出来。
· Omni 的意义不只是分数:把中期训练与后训练(对齐)引入基因组学,模型从「基座模型」变成开箱即用的工具,中间那步微调不用再自己做。
· 真正的富矿在 98% 的非编码区:传统工具只能处理约 1.5%-2% 的编码区,而大量疾病恰恰藏在需要超长上下文才能捕捉的长程调控区域里。
· 一个绕不过去的两难:筛查系统漏掉真坏人和错杀好人,乘上每年数十亿条序列的基数,都会变成大问题——但嘉宾的判断是,有工具胜过没工具。
