这不是补丁流水账。本页只保留会改变能力、工作方式、价格、安全边界或行业影响的重大节点,并把官方术语翻译成普通人能理解的话。
日期按官方公布时间倒序。预览、逐步开放与正式可用并不相同,实际入口仍以你的地区、套餐和账户为准。
2026:重大产品变化
DeepSeek V4-Flash-Vision-Exp 发布
在 V4-Flash 的智能体路线之外加入视觉理解实验能力,让模型可以围绕屏幕、图片和工具完成更完整任务。
为什么重要:DeepSeek 从纯文字推理继续走向能看、能调用工具的多模态智能体。
打个比方:以前像只听电话的工程师,现在开始能看你发来的现场照片。
DeepSeek V4-Pro 正式可用
V4-Pro 从预览进入 App、网页和 API,成为更复杂推理、编码与长任务的主力型号。
为什么重要:“正式可用”比“预览”更适合评测和生产规划,但仍要核对价格、限额与数据政策。
打个比方:预览像样板房,正式版才像开始交付入住。
DeepSeek V4-Flash 公测并强化 Agent
V4-Flash API 提升代码代理、终端操作和多步骤工具任务,并原生支持 Responses API 风格。
为什么重要:低延迟型号开始承担真正的软件执行工作,而不仅是回答代码问题。
打个比方:它从“给程序员提建议”变成“在受控工位上动手干活”。
DeepSeek V4 预览发布
API 增加 V4-Pro 与 V4-Flash,并同时兼容 OpenAI Chat Completions 与 Anthropic 风格接口。
为什么重要:迁移成本降低,开发者可以更容易在已有应用中测试新一代模型。
打个比方:像新发动机同时配好了两种常见接口,不必重造整辆车。
2025:重大产品变化
DeepSeek V3.2 与 Speciale 发布
V3.2 把思考直接放进工具调用流程;Speciale 追求更强推理,但发布期为临时 API 且不支持工具。
为什么重要:模型开始在“想”和“做”之间连续工作,代理路线更加明确。
打个比方:不是先写完计划再交给别人,而是边判断边使用工具。
DeepSeek V3.2-Exp 引入稀疏注意力
实验版通过 DeepSeek Sparse Attention 降低长上下文计算成本,并同步大幅下调 API 价格。
为什么重要:长资料处理不只比能力,也比速度和费用。
打个比方:像读长书时只重点翻相关页,而不是每次把全书逐字重读。
DeepSeek V3.1 合并思考与非思考模式
同一个模型支持 Think 与 Non-Think,强化工具使用、多步骤搜索和 Agent 任务,并提供 128K 上下文。
为什么重要:用户不必在两个完全不同的模型间频繁切换。
打个比方:像同一个人既能快速答复,也能在难题前打开草稿本。
DeepSeek R1-0528 升级推理与函数调用
更新改善推理、前端代码和幻觉表现,并支持 JSON 输出与函数调用。
为什么重要:推理模型开始更适合被软件系统稳定调用。
打个比方:不只是会解题,还开始学会按表格格式交作业、按按钮调用工具。
DeepSeek R1 正式发布并开放权重
R1 以强化学习提升数学、代码和推理能力,主模型、技术报告与多个蒸馏模型以开放许可发布。
为什么重要:高水平推理模型第一次以低价格和开放权重形成全球影响。
打个比方:像把优秀解题老师的方法、教材和可训练的小班版本一起开放。
2024:重大产品变化
DeepSeek V3 发布
V3 使用混合专家架构,在较低激活参数下提升通用能力、速度和价格竞争力,并公开模型与论文。
为什么重要:它奠定了此后 R1 与 V3.x 产品线的通用底座。
打个比方:像建成一所大医院,但每位病人只调度最相关的科室。
怎样使用这条时间线
专题页回答“这个产品是什么、适合谁”;本页回答“它什么时候发生了哪些重大变化”;每个节点的详细报道继续解释能力、适用人群、使用边界和官方来源。三层页面相互连接,便于从概览一路读到细节。
收录与复核规则
新一代模型、核心入口、代理执行、重要创作能力、显著价格变化和安全边界调整进入主线;按钮移动、少量修复和短期活动不单独占一条。本站会继续检查官方更新日志,并在出现重大节点时更新。