TIMELINE · 1990 → 2026

四条线,
各自走到今天

两个引擎(SOTA 模型、RSI)与两条前沿(AI4S、世界模型)的关键节点排在同一根轴上。先看颜色:同一年里,哪条线在动、哪条线在等。

SOTA 模型RSIAI4S世界模型
1990s
1990《Making the world differentiable》路线0
Schmidhuber 让「世界模型」术语进入机器学习:一个可微 RNN 预测器 M,配一个利用它规划的控制器 C。
1991好奇心与内在动机路线0
《Curious model-building control systems》:让智能体主动寻找预测误差大的地方——学习的动力来自「惊讶」。
2018–22
2018Ha & Schmidhuber《World Models》路线1
VAE 压缩 + MDN-RNN 预测 + 梦境中训练控制器。交互式论文网页让这个词重回聚光灯下。
2017–22Transformer → 指令模型 → ChatGPTSOTA 模型
基础模型主线从语言建模走向指令遵循与通用交互,成为今天 LLM 与智能体浪潮的认知底座。
2019–25PlaNet → Dreamer V1/V2/V3 → V4路线1
Hafner 的十年长跑:RSSM、离散隐变量,DreamerV3 登上 Nature(2025),从零采到 Minecraft 钻石。
2020/23NeRF 与 3D Gaussian Splatting路线5
神经辐射场与高斯泼溅:路线 5 空间智能的两块技术地基。
2022LeCun 蓝图与 JEPA 登场路线2
《A Path Towards Autonomous Machine Intelligence》:六大模块架构,押注隐空间预测而非像素生成。
2020–21AlphaFold 2:蛋白质结构预测被「解决」AI4S
CASP14 上精度接近实验解析,2021 年论文登上《自然》并开放结构数据库——AI4S 的起点事件。
2023
5月Voyager:把技能写成代码存起来RSI 阶段1
Minecraft 智能体把学会的技能存成可调用的代码库——「经验自进化」最早被广泛引用的样本。
7月RFdiffusion 登上《自然》AI4S
扩散模型从噪声里「长」出蛋白质骨架,蛋白设计从手艺变成可规模化的流程。
11月GNoME 与 A-Lab 同期发表AI4S
DeepMind 预测 38 万种稳定晶体,伯克利自动实验室宣称 17 天合成 41 种新材料;后者的「新材料」判定随即引发争议。
2024
2月Sora 与 Genie 1 同月发布路线3
OpenAI 称 Sora 为「世界模拟器」引发大争论;DeepMind Genie 从无标注视频学出可玩 2D 世界。
8月GameNGen:神经网络跑 DOOM路线3
Stable Diffusion 实时模拟 DOOM,20fps——游戏引擎第一次被纯神经网络替代。
9–12月World Labs 成立 · Oasis · Genie 2路线3/5
李飞飞创立 World Labs(9月);Oasis 成为首个公开可玩的 AI 生成游戏(10月);Genie 2 走向 3D(12月)。
5月AlphaFold 3:从单个蛋白到复合物AI4S
预测蛋白质与 DNA、RNA、小分子配体的复合物结构,成为药物研发的日常工具。
8月The AI ScientistRSI 阶段3
Sakana AI 让大模型自己提想法、写代码、跑实验、写论文,全流程只花十几美元——第一批「AI 做机器学习研究」的样本。
10月诺贝尔化学奖颁给蛋白质设计与结构预测AI4S
一半授予大卫·贝克(计算蛋白质设计),一半授予哈萨比斯与江珀(AlphaFold)。
2025
1月NVIDIA Cosmos 发布(CES)路线4
面向机器人与自动驾驶的「世界基础模型」平台,与 GR00T 人形机器人栈配套。
6–8月V-JEPA 2 · Genie 3路线2/3
V-JEPA 2-AC 用 62 小时机器人视频后训练实现零样本控制;Genie 3 达到 720p/24fps 可交互世界。
11月Marble 发布 · LeCun 离开 Meta路线5/2
World Labs 的 Marble 从文本/图像生成可探索持久 3D 世界;LeCun 出走创立 AMI Labs。
1–2月MatterGen 登上《自然》· Evo 2 发布AI4S
微软用扩散模型按目标性质直接生成晶体;Arc 研究所的 Evo 2 在全生命之树的 DNA 上训练。材料与细胞两个方向同时进入「设计」层。
5月AlphaEvolve · 达尔文-哥德尔机RSI 阶段2/3
DeepMind 让大模型进化算法并用在自家训练栈上;Sakana 等让智能体改写自己的代码并靠基准分数筛选——自我改进开始有可核对的数字。
6月Rentosertib 二期结果登上《自然·医学》AI4S
英矽智能的 AI 发现靶点 + AI 设计分子,在特发性肺纤维化患者中完成 IIa 期试验。
2026
9月Rentosertib 三期首例患者给药AI4S
第一款由 AI 同时发现靶点与设计分子的药物进入三期临床(以 clinicaltrials.gov 登记为准)。
5月Robin 的发现登上《自然》AI4S
FutureHouse 的多智能体系统提出假设并分析实验,找到干性黄斑变性的候选疗法——湿实验仍由人完成。
9月World Labs 发布 Atlas路线5
相机位姿成为世界模型的原生输入:1–6 张参考图生成 1 分钟 1440p 视频,稀疏视图重建反超专用模型。空间智能这条线第一次同时打赢生成与重建两侧——但全篇没有一个物理准确度数字。
9月GPT-6 Astra,与 ARC-AGI-3 的两个分数SOTA 模型
官方宣称 99.9%,ARC Prize 用中立 harness 复测 62.7%。差的不是分数是口径——世界模型那一大片「官方口径」面对的是同一个问题。
6–8月Fable 5 · GPT-5.6 · Opus 5SOTA 模型
闭源前沿模型把长程知识工作、编程、视觉与智能体能力继续推高,同时更强调推理强度与成本效率。
7–8月Kimi K3 开放 · GLM-5.3 发布国产开源
开放路线继续扩大模型规模、原生多模态、百万上下文和长程后训练环境;GLM-5.3 权重截至 8 月 21 日仍待发布。
1月/7月LingBot 开源周路线3/4
蚂蚁灵波开源 LingBot-World / VA / VLA 系列,对标 Genie 3(720p/60fps 为官方口径,缺独立复现)。
3月AMI Labs 10.3 亿美元种子轮路线2
LeCun 的新公司拿下巨额种子轮:市场愿意为「反主流赌注」下注。
8月开放阵营分叉:DeepSeek-V4-Pro / Qwen3.8 开放,Wan3.0 收紧国产开源
同一个月,DeepSeek 以 MIT 协议放出 1.7T 模型、Qwen 首次开放 Max 级模型;而万相 Wan3.0 公测却不再放权重。开源从立场退化成逐次决策。
6月李飞飞《A Functional Taxonomy of World Models》路线5
渲染器 / 模拟器 / 规划器三分法:给混乱的「世界模型」命名体系立了一把尺子(2026-06-03 发表于个人 Substack drfeifei.substack.com)。
下一步:读第一条路线的起源故事 →关于与方法 →术语表 →最后更新 2026-09