AIGC宇宙 AIGC宇宙

突发!DeepSeek刚刚开源V3.1-Base

今天凌晨,全球著名大模型开源平台DeepSeek开源了Deepseek V3.1-Base版本。 非常低调没有任何介绍,只是把模型放上去了。 但在Hugging Face的趋势榜单中已经上升到第4名,还是相当受欢迎的。

今天凌晨,全球著名大模型开源平台DeepSeek开源了Deepseek V3.1-Base版本。

非常低调没有任何介绍,只是把模型放上去了。但在Hugging Face的趋势榜单中已经上升到第4名,还是相当受欢迎的。

突发!DeepSeek刚刚开源V3.1-Base

开源地址:https://huggingface.co/deepseek-ai/DeepSeek-V3.1-Base/tree/main

Hugging Face联合创始人Clement Delangue特意发了推文祝贺,他表示,Deepseek V3.1 已经悄无声息地发布,没有附带模型卡片,却已登上 Hugging Face 趋势榜第四位,太有意思了。

这就是在 Hugging Face 上拥有 8 万名关注者的力量。

突发!DeepSeek刚刚开源V3.1-Base

根据网友的推测,新升级版本,速度更快、智能程度更高,可与GPT级模型媲美。该模型拥有 6850 亿参数,支持 BF16、F8_E4M3、F32三种张量类型,以Safetensors格式发布,便于高效推理,还具备扩展的上下文窗口。

同时非常欣赏DeepSeek这种 “先放权重,后补说明”的风格,能让社区能够优先开展模型探索。

突发!DeepSeek刚刚开源V3.1-Base

很高兴看到仍有公司在发布基础模型。

突发!DeepSeek刚刚开源V3.1-Base

它应该是一个结合了 v3 和 r1 的模型。其对话模板包含一个思考参数,用于控制思考过程。

突发!DeepSeek刚刚开源V3.1-Base

我试着在我的 4GB 显卡上加载新的 DeepSeek-V3.1-Base 685B 模型,结果它崩溃了,不知道为啥?

突发!DeepSeek刚刚开源V3.1-Base

那近期R2还会有希望吗?

突发!DeepSeek刚刚开源V3.1-Base

相关资讯

OpenAI首席研究官:DeepSeek独立发现了o1的一些核心思路,奥特曼、LeCun纷纷置评

成本打下来了,需求更多才对? 春节这几天,国内外 AI 圈都被 DeepSeek 刷了屏。 英伟达的股市震荡更是让全世界看得目瞪口呆(参见《英伟达市值蒸发近 6000 亿美元,而 DeepSeek 刚刚又开源新模型》)。
1/29/2025 6:43:00 PM
机器之心

“新神登场”,消息称 DeepSeek R2 模型有望 5 月前发布

据路透社报道,三位知情人士透露,DeepSeek 正在加速推出其 R2 人工智能模型,该公司最初计划在五月推出,但目前正在努力尽快推出。
2/25/2025 8:18:29 PM
归泷(实习)

DeepSeek-R1详细解读!

DeepSeek-R1爆火,今天来详细看下。 论文地址::::现有LLMs在推理任务上的改进主要依赖监督微调(SFT)和后训练(Post-Training)方法,但这些方法需要大量人工标注数据且成本高昂。 OpenAI的o1系列模型虽通过扩展推理链(Chain-of-Thought, CoT)提升了性能,但其测试时扩展仍存在挑战。
2/19/2025 8:00:00 AM
GoldMa
  • 1