“不诱于誉,不恐于诽,率道而行,端然正己。”
—— DeepSeek团队
今天一早,朋友圈又被DeepSeek刷屏了。
这次不是什么传闻,是实打实的——DeepSeek-V4预览版,4月24日正式上线,同步开源。
自从去年1月R1爆火出圈,整整15个月,DeepSeek几乎销声匿迹。很多人以为他们躺平了,结果人家憋了个大的。
这一次,他们带来了一个让所有人都没想到的东西:
百万字上下文,直接作为所有官方服务的标配。
不是付费功能,不是企业专属,就是标配。
01 | 百万上下文,到底意味着什么?
先说人话。
之前用AI最头疼的一件事是什么?就是上下文太短,聊着聊着它就"忘了"。你跟它说了半天背景,一旦对话超过一定长度,前面说的全白说。
DeepSeek-V4直接把上下文窗口拉到了 100万Token,大概相当于数十万字的文档。
做个对比:前一代V3是128K,V4直接把它扩大了将近10倍。
这意味着什么?
-
• 你可以把一整个项目的所有文档、需求、会议记录,一股脑全塞进去 -
• 律师可以处理几十万字的合同和卷宗,一句话都不会漏 -
• 研究员可以把一篇长论文加上所有参考文献一起分析 -
• 开发者可以把整个代码库扔进去,让它帮你找bug
更厉害的是,DeepSeek这次发明了一种全新的注意力机制,在处理这么长的内容时,计算量和显存占用不升反降,比老方法还省资源。用一句话概括就是:又长又快还省钱。
02 | 两个版本,总有一款适合你
DeepSeek-V4这次推出了 Pro 和 Flash 两个版本,思路很清晰——一个打性能天花板,一个打性价比极限。
🔵 V4-Pro:总参数1.6万亿,激活49B
说白了,这是给需要打硬仗的场景准备的。
-
• 代码能力:在开源模型里排第一,实际交付质量已经追平顶级闭源模型Opus 4.6 -
• 数学/推理:STEM类、竞赛级编程题,超越所有已公开的开源模型 -
• Agent能力:针对Claude Code、CodeBuddy、OpenCode等主流开发框架做了深度优化
🟡 V4-Flash:总参数2840亿,激活13B
给不需要那么"重"的场景用的,但别小瞧它。
-
• 推理能力跟Pro几乎持平 -
• 普通任务上,跟Pro基本打平 -
• 响应速度更快,价格更便宜
两个版本都支持 思考模式,可以通过参数设置思考强度(high或max),复杂任务建议拉满到max。
03 | 现在就能用,怎么用?
普通用户:
打开 chat.deepseek.com 或者下载官方App,登录就能直接跟V4对话,体验百万上下文。完全免费。
开发者:
API已经同步更新,不用改任何其他东西,只需要把 model_name 改一下:
deepseek-v4-pro ← 高性能版
deepseek-v4-flash ← 经济版
同时支持 OpenAI 格式和 Anthropic 格式两套接口,迁移成本几乎为零。
想自己部署的:
已在 HuggingFace 和 ModelScope 完整开源,自取。
04 | 价格,还是那个DeepSeek的风格
每百万Token的价格:
|
|
|
|
|
|---|---|---|---|
|
|
|
|
|
|
|
|
|
|
官网聊天和App端继续免费。
⚠️ 提醒一下:旧接口
deepseek-chat和deepseek-reasoner将于2026年7月24日停止使用,在此之前请把模型名迁移到新版本。
05 | 说点题外话
每次DeepSeek发布新模型,大家讨论的不只是技术参数。
因为这家公司在做一件很不一样的事情——他们不是在把AI变成一门生意,而是在把AI变成一种基础设施。
从V2把成本打到地板,到V3正面对抗GPT-4,到R1让全世界重新认识开源推理模型,再到今天V4把百万上下文变成标配……
每一步,都是在把原本只有大厂才用得起的能力,变成人人都能用的东西。
这条路不性感,但很重要。
今天就去试试吧。 打开 chat.deepseek.com,把你最复杂的那个需求扔进去,看看百万上下文能帮你解决什么问题。
内容来源:DeepSeek官方公告 · 2026年4月24日

