DeepSeek 最新动态 · 六大看点
V4.1 Flash 发布
快科技 9 月 13 日消息,本周 DeepSeek 发布了 V4.1 Flash,这个大模型架构变化之大,完全可以称得上是 V5 了,但 DeepSeek 很低调地没换大版本号。从 V4.1 Flash 换用新结构使得参数量翻倍来看,这个 Code 2.0 从当前 1.6万亿提升到 3万亿参数的可信度是有的。
V4.1 Pro 确定
Pro 系列的新品确定了是 V4.1 Pro,具体升级还没公布。如果是 V4 到 V4.1 这样的提升幅度,那 V4.1 Pro 性能上限也会很高,但考虑到之前 V4 Pro-0813 正式版的不及预期,大家期待值不要拉太高。预计 V4.1 Pro 面向通用 Agent 任务。
Code 2.0 即将发布
后续还有一波大模型,爆料者称它叫做 DeepSeek Code 2.0,即将发布,时间窗口是 9 月份,预计性能会击败 Mythos 5.1 和 GPT-6 Astra,这是当前最强大的两个前沿级大模型。设计重点是 Computer Use,也就是电脑控制,AI 替代你操作电脑完成很多工作。
3万亿以上参数量
Code 2.0 拥有高达 3万亿以上的参数量,显然这也是它提高性能的关键。这方面国内目前最强的是 K3 大模型的 2.8万亿,千问的 Qwen 3.8 Max 是 2.4万亿参数量,DeepSeek V4 Pro 是 1.6万亿参数。想跟 Mythos 5.1 及 Astra 这样的大模型竞争就需要这个级别的参数量。
参数翻倍的可信度
从 V4.1 Flash 换用新结构使得参数量翻倍来看,这个 Code 2.0 从当前 1.6万亿提升到 3万亿参数的可信度是有的。不然性能上限是很难提升的。这方面也能看出 DeepSeek 在架构层面的持续突破,为下一波大模型奠定基础。
开源开放与产品定位
DeepSeek Code 2.0 预计会继续保持开源开放。DeepSeek 过去在 23-24 年推出过三款名字带 Code 的大模型,表现平平。这次要是重推偏向代码/逻辑的 Code 大模型,作为旗舰级产品倒也不失为一个方向,就让 V4.1 Pro 及 Flash 面向通用 Agent 任务即可。