DeepSeek-V4 Preview 是什么

DeepSeek 在官方更新日志中宣布,DeepSeek-V4 Preview 正式上线并开源。它由 DeepSeek 开发,是一个包含两个版本的大语言模型系列:DeepSeek-V4-Pro 和 DeepSeek-V4-Flash。这次发布采用开放权重方式,模型权重发布在 Hugging Face 上,任何人都可以下载和研究。它能做推理、编程、智能体任务,还能处理长达 100 万字的上下文。打个比方,就像给电脑换了一个能记住一整本长篇小说内容、还会自己分步骤解题的超级大脑,而且这个大脑的图纸还公开出来让大家一起研究改进。

两个版本有什么不同

DeepSeek-V4-Pro 是系列中的旗舰版本,总参数量 1.6 万亿,每次推理激活 490 亿参数。官方称它的性能可以媲美世界顶级闭源模型,在智能体编程基准上达到开源最优,在世界知识上领先所有当前开源模型,仅次于 Gemini-3.1-Pro。DeepSeek-V4-Flash 则更轻量,总参数 2840 亿,激活 130 亿参数,推理能力接近 V4-Pro,在简单智能体任务上表现相当,但参数更小、响应更快、API 价格更经济。就像同一个家族里,一个是大块头全能选手,一个是轻便快速的经济型选手。

1M 上下文意味着什么

官方表示,1M 上下文现在已成为所有 DeepSeek 官方服务的默认标准。这意味着模型一次可以处理大约 100 万个 token 的内容,相当于好几本长篇小说或者大量代码文件。为了实现这一点,DeepSeek-V4 采用了新的注意力机制:Token-wise 压缩加上 DSA(DeepSeek 稀疏注意力)。官方称这种结构创新在长上下文场景下大幅降低了计算和内存成本,达到世界领先的效率。简单说,就像给大脑装了一个聪明的过滤器,只关注真正重要的信息,而不是把所有细节都硬记下来。

智能体能力有哪些优化

DeepSeek-V4 针对智能体能力做了专门优化。官方称它已经无缝集成到 Claude Code、OpenClaw 和 OpenCode 等主流 AI 智能体工具中,并且已经在 DeepSeek 内部的智能体编程工作中使用。在智能体编程基准上,V4-Pro 达到开源最优水平。智能体可以理解为能自己使用工具、分步骤完成任务的 AI 助手,比如自动写代码、查资料、操作软件。这次优化让 DeepSeek-V4 在这类任务上更可靠。

API 怎么用,旧模型怎么办

API 在发布当天就已可用。开发者不需要更换 base_url,只需把模型名称改成 deepseek-v4-pro 或 deepseek-v4-flash 即可。新模型支持 OpenAI ChatCompletions 和 Anthropic 两种 API 格式,两个版本都支持 1M 上下文和思考/非思考双模式。同时官方提醒,deepseek-chat 和 deepseek-reasoner 将在 2026 年 7 月 24 日 15:59(UTC)之后完全退役并无法访问,目前这两个旧模型名称会路由到 deepseek-v4-flash 的非思考/思考模式。使用旧模型的开发者需要提前迁移。

开放权重和获取方式

DeepSeek-V4 Preview 采用开放权重方式发布,模型权重和 Tech Report 都可以在 Hugging Face 上找到。官方还提供了技术报告 PDF 供研究参考。开放权重意味着任何人都可以下载模型文件,在自己的硬件上运行或进一步研究,但官方未说明具体的许可证条款和权重文件大小。对于想要本地部署或深入研究模型结构的开发者和研究者来说,这是一个重要的资源。

适用人群和注意事项

DeepSeek-V4 适合需要长上下文处理、智能体编程、复杂推理的开发者和企业用户。V4-Flash 适合对成本和速度敏感的场景,V4-Pro 适合追求最强性能的任务。普通用户可以通过 chat.deepseek.com 的 Expert Mode 和 Instant Mode 体验。需要注意的是,官方强调请只依赖 DeepSeek 官方账号获取消息,其他渠道的声明不代表官方观点。另外,官方未说明训练数据截止日期、完整基准测试分数和 API 具体定价数值,使用前建议查阅官方文档获取最新信息。

官方来源

本文由 AIGCWHY 自动监测系统发现,经结构化处理后发布。重要决策请打开原文核验。

查看原始发布信息 ↗