DeepSeek 新模型上线：6850亿参数的 DeepSeek-V3 再进化！

DeepSeek 终于发布新模型了！

3 月 24 日晚，DeepSeek 在官方 Hugging Face 社区上传了一个名为 DeepSeek-V3-0324 的新模型。

顾名思义，DeepSeek 的这个新模型是上一代 DeepSeek-V3 的升级版本。

点击进入 DeepSeek-V3-0324 的模型页面，虽然 DeepSeek 官方还没有来得及上传详细的 README 文档，但从右边的模型参数信息也能够推断出蛛丝马迹。

新模型的参数量为 685B，即 6850 亿个参数。这个参数量与上一代 DeepSeek-V3 是一样的。

而新模型所支持的张量数据类型也和前代模型保持一致：支持 BF16、F8_E4M3 和 F32 三种不同精度的浮点数格式进行推理和训练计算。

毫无疑问，将开源进行到底的 DeepSeek 这次推出的 DeepSeek-V3-0324 也是完全开源的模型。

虽然 DeepSeek 官方还没有介绍，但不难推测，这次的 DeepSeek-V3-0324 主要会在两方面提升。

一个是性能。前一代的 DeepSeek-V3 说实话就挺强的，我微信公众号目前接入的就是 DeepSeek-V3 模型。

并且我也在 DeepSeek-V3 刚发布时就做了测试：测试完DeepSeek V3和GPT-4o，我不想再开ChatGPT会员了！这个测评文章发布于 DeepSeek 爆火之前，当时还有不少小可爱质疑 DeepSeek-V3 的能力。

其二是修 bug。是的，你没有看错，模型也是有 bug 的。之前的 DeepSeek-V3 有一个很“致命”的问题：function call 循环调用和空回复。

这是 DeepSeek 官方之前在其开放平台发的公告。而现在，这句话已经没有了。

至于在哪里使用 DeepSeek-V3-0324，DeepSeek 官方还没有明确说。但 Hugging Face 已经有小伙伴表示官网 “非深度思考” 模式下的底层模型已经换成了 DeepSeek-V3-0324。

其实也不用急，DeepSeek-V3-0324 一旦正式发布，DeepSeek 官网和 API 都会同步更新。

我是木易，一个专注AI领域的技术产品经理，国内Top2本科+美国Top10 CS硕士。

相信AI是普通人的“外挂”，致力于分享AI全维度知识。这里有最新的AI科普、工具测评、效率秘籍与行业洞察。

欢迎关注“AI信息Gap”，用AI为你的未来加速。

（文：AI信息Gap）