DeepSeek开源新基础模型，但不是V4，而是V3.1-Base

原创于 2025-08-20 15:27:59 发布 · 372 阅读

CC 4.0 BY-SA版权

文章标签：

该模型一发布就吸引了 AI 社区的广泛关注，短短几个小时就已经冲上了 Hugging Face 热门模型榜第 4 位！

昨晚，深度求索在用户群里宣布「DeepSeek 线上模型版本已升级至 V3.1，上下文长度拓展至 128k」并更新了 UI （去掉了 DeepThink 旁的 R1 标示）之后，在 Hugging Face 发布了一款新模型 DeepSeek-V3.1-Base。

模型地址：https://huggingface.co/deepseek-ai/DeepSeek-V3.1-Base

从名字也能看出来，该模型是 DeepSeek-V3 系列最新的基础模型。至于为什么命名为 V3.1，而不是像之前以前命名为 V3 带四位日期数字的形式（如 V3-0324），尽管社区有诸多猜测，但深度求索官方尚未给出明确说明 —— 和该公司之前的操作一样，这一次同样是模型先行，说明和宣传还在后面。

该模型一发布就吸引了 AI 社区的广泛关注，短短几个小时就已经冲上了 Hugging Face 热门模型榜第 4 位！

具体技术指标上，DeepSeek-V3.1-Base 与 DeepSeek-V3 差别不大，同样的参数量，采用了混合专家（MoE）架构，拥有 128k 上下文长度。

整体来看，社交网络上对深度求索的这次更新看法不一。有人表示非常振奋，认为这是深度求索在为接下来的 DeepSeek-V4 和 DeepSeek-R2 做铺垫，但也有人认为这次更新不够亮眼，没有达到该公司之前的一贯水准。

对此，你怎么看？

作为一名热心肠的互联网老兵，我决定把宝贵的AI知识分享给大家。至于能学习到多少就看你的学习毅力和能力了。我已将重要的AI大模型资料包括AI大模型入门学习思维导图、精品AI大模型学习书籍手册、视频教程、实战学习等录播视频免费分享出来。

AI大模型时代的学习之旅：从基础到前沿，掌握人工智能的核心技能！

因篇幅有限，仅展示部分资料，需要点击文章最下方名片即可前往获取

这套包含640份报告的合集，涵盖了AI大模型的理论研究、技术实现、行业应用等多个方面。无论您是科研人员、工程师，还是对AI大模型感兴趣的爱好者，这套报告合集都将为您提供宝贵的信息和启示。

因篇幅有限，仅展示部分资料，需要点击文章最下方名片即可前往获

随着人工智能技术的飞速发展，AI大模型已经成为了当今科技领域的一大热点。这些大型预训练模型，如GPT-3、BERT、XLNet等，以其强大的语言理解和生成能力，正在改变我们对人工智能的认识。那以下这些PDF籍就是非常不错的学习资源。

因篇幅有限，仅展示部分资料，需要点击文章最下方名片即可前往获

因篇幅有限，仅展示部分资料，需要点击文章最下方名片即可前往获

作为普通人，入局大模型时代需要持续学习和实践，不断提高自己的技能和认知水平，同时也需要有责任感和伦理意识，为人工智能的健康发展贡献力量