模型编年史 / MODEL CHRONICLE
VOL. 01   /   2012—2026
2012—2026A SHORT HISTORY OF AI MODELS

模型编年史

从看见,到行动。

十四年,几次转折。从图像识别,走到推理与工作流。

AN ARCHIVE OF POSSIBILITIES
更新至 2026.10.06 · 精选里程碑 · 非完整模型名录
201201 / VISION

AlexNet

机器开始看清世界。

深度卷积网络在 ImageNet 比赛中取得突破。图像识别,成为深度学习的重要转折点。

IMAGECNNCAT像素 → 特征 → 类别
来源:Krizhevsky et al. · NeurIPS 2012 / 图像流程为示意
201702 / ATTENTION

Transformer

词语之间,有了连线。

以注意力机制构建序列模型。后来许多语言模型,由此发展。

词语不再独自站立ATTENTION IS ALL YOU NEED让词语看见彼此的关系关系连线为概念示意,不代表真实注意力权重
来源:Attention Is All You Need · 2017.06
201803 / CONTEXT

BERT

读一句话,也读上下文。

从左右两侧的语境学习语言表示。预训练,再微调:让模型适应不同任务。

我在[MASK]看星星左侧语境右侧语境夜里双向语境 · 掩码语言建模
来源:BERT · Devlin et al. · 2018.10 / 填词为示意
202004 / SCALE

GPT-3

给几个例子,就能接着写。

1750 亿参数,探索少样本任务学习。同一个语言模型,通过文本接收不同任务。

175BILLION PARAMETERS海 → sea 星 → star月 → moon用几个例子,在上下文中学习任务
来源:Language Models are Few-Shot Learners · 2020.05 / 示例为示意
2022.0805 / IMAGINATION

Stable Diffusion

文字,开始长出画面。

文生图模型公开发布。一句描述,成为视觉创作的新入口。

“群山之间,一轮橘色太阳。”噪声 → 去噪 → 图像 / 概念示意
来源:Stability AI · Public Release · 2022.08.22
2022.1106 / CONVERSATION

ChatGPT

能力,被装进了对话框。

基于 GPT-3.5 系列的对话产品登场。追问、修改、再来一次:交互方式变了。

A NEW INTERFACE用一句话,解释什么是 AI。让机器从数据中学习,再用学到的规律完成任务。从提示框,走向一场对话。
来源:OpenAI · Introducing ChatGPT · 2022.11.30 / 对话为创作示例
202307 / TWO DIRECTIONS

LLaMA / GPT-4

一边更强,一边更开放。

LLaMA 向研究社区提供模型。GPT-4 推进能力与图像输入,生态继续展开。

LLaMA研究社区GPT-4更强的通用模型能力扩展,生态也在分岔。
来源:LLaMA 论文 · 2023.02 / OpenAI · GPT-4 · 2023.03
2024.0508 / MULTIMODAL

GPT-4o

文字、视觉、声音汇流。

将多种模态纳入同一模型。更自然的实时交互,成为新的方向。

文字视觉声音GPT-4o多模态交互,进一步走向实时。
来源:OpenAI · Hello GPT-4o · 2024.05.13
2024.0909 / REASONING

o1-preview

回答之前,多想一会儿。

通过训练,把更多计算用于作答前的推理。数学、代码、复杂问题,成为重点。

提问尝试检查修正回答推理路径为抽象示意,并非模型内部过程的实录
来源:OpenAI · Introducing o1-preview · 2024.09.12
2025.0110 / OPEN REASONING

DeepSeek-R1

推理,走向更广的社区。

公开推理模型权重与技术报告。同时提供蒸馏模型,扩展研究与应用的入口。

R1推理能力,也可以被分享。开放权重 · 技术报告 · 蒸馏模型
来源:DeepSeek · R1 Release · 2025.01.20
2025.03—0811 / REASONING CONVERGES

2025 / 新一轮

推理与编码,成为共同焦点。

Gemini 2.5、Claude 4 与 GPT-5 相继登场。工具调用和长任务,进入主流模型的设计。

03.25Gemini 2.505.22Claude 408.07GPT-5推理 · 编码 · 长任务
来源:Google · 2025.03.25 / Anthropic · 2025.05.22 / OpenAI · 2025.08.07
2026.0412 / LONG CONTEXT

DeepSeek-V4

把更长的材料,放进上下文。

V4 预览版公开,提供 Pro 与 Flash 两条线。百万 token 上下文,支持更长的任务材料。

1M CONTEXT百万 token 上下文 · 开放权重
来源:DeepSeek · V4 Preview Release · 2026.04.24
2026.05—0713 / INTELLIGENCE TO ACTION

Gemini 3.5 / 3.6

智能,进一步走向行动。

3.5 Flash 聚焦工具与编码工作流。7 月,3.6 Flash 继续更新推理与速度。

目标TASK计划PLAN工具TOOLS交付RESULT从给出答案,到执行一段工作流。
来源:Google · Gemini 3.5 · 2026.05.19 / July Gemini Drop · 2026.07.31
2026.09.0114 / LONG-HORIZON WORK

Claude Fable 5.1

长任务,要能持续做下去。

继 7 月 Opus 5 后,Fable 5.1 于 9 月登场。聚焦编码、知识工作和长时间的问题求解。

PROJECT / LONG-HORIZON WORK✓理解代码与需求✓编写实现与测试✓检查结果并修正✓交付供人审阅长任务与工具调用 · 流程为概念示意
来源:Anthropic · Opus 5 · 2026.07.24 / Fable 5.1 · 2026.09.01
2026.09.1015 / CONTINUOUS RELEASES

DeepSeek-V4.1-Flash

模型家族,仍在继续生长。

8 月,V4-Pro 正式发布。9 月 10 日,V4.1-Flash 发布,继续版本迭代。

V4-Pro08.13 / GAV4.1-Flash09.10 / RELEASEDEEPSEEK / 2026正式发布之后,模型仍在持续更新。
来源:DeepSeek 官方发布记录 · 2026.08.13 / 2026.09.10
2026.0916 / A NEW MODEL FAMILY

GPT-6 / 6.1 Sol

一组模型,面对不同的工作。

Astra、Sol、Luna,组成 GPT-6 模型家族。9 月 29 日,6.1 Sol 继续更新编码与专业能力。

09.03Astra新一代旗舰09.22Sol / Luna不同工作负载09.296.1 Sol继续迭代编码 · 计算机使用 · 专业工作
来源:OpenAI · GPT-6 Astra / Sol & Luna / GPT-6.1 Sol · 2026.09
2026.09.3017 / FRONTIER & ACCESS

Gemini 4 Argon

新一代能力,分阶段开放。

面向复杂专业工作与网络安全防御。目前向可信网络安全防御者分阶段开放。

ARGONGEMINI 4编码 / 知识工作 / 防御分阶段开放 · 可信网络安全防御者
来源:Google · Introducing Gemini 4 Argon · 2026.09.30 / 非普遍可用
2026.10.06THE PRESENT / VERIFIED TODAY

截至 2026.10.06

我们已经走到这里。

从识别与生成,到推理、工具和交付。今天的代表模型,仍在不断更新。

GPT-6.1 Sol2026.09.29Claude Fable 5.12026.09.01Gemini 4 Argon2026.09.30 / 分阶段开放DeepSeek-V4.1-Flash2026.09.10截至 2026 年 10 月 6 日 · 已核实的代表版本
核实截止:2026 年 10 月 6 日 · 右侧为已核实的代表版本,并非完整榜单
TO BE CONTINUEDTHE NEXT CHAPTER

下一章,

也属于使用模型的人。

从看见,到行动。你会用这些能力,创造什么?

AN ARCHIVE OF POSSIBILITIES
模型编年史 / 2012—2026 · 更新至 2026.10.06 · MADE WITH HYPERFRAMES