今天凌晨,全球著名大模型开源平台DeepSeek开源了Deepseek V3.1-Base版本。
非常低调没有任何介绍,只是把模型放上去了。但在Hugging Face的趋势榜单中已经上升到第4名,还是相当受欢迎的。
开源地址:https://huggingface.co/deepseek-ai/DeepSeek-V3.1-Base/tree/main
Hugging Face联合创始人Clement Delangue特意发了推文祝贺,他表示,Deepseek V3.1已经悄无声息地发布,没有附带模型卡片,却已登上Hugging Face趋势榜第四位,太有意思了。
这就是在Hugging Face上拥有8万名关注者的力量。
根据网友的推测,新升级版本,速度更快、智能程度更高,可与GPT级模型媲美。该模型拥有6850亿参数,支持BF16、F8_E4M3、F32三种张量类型,以Safetensors格式发布,便于高效推理,还具备扩展的上下文窗口。
同时非常欣赏DeepSeek这种“先放权重,后补说明”的风格,能让社区能够优先开展模型探索。
很高兴看到仍有公司在发布基础模型。
它应该是一个结合了v3和r1的模型。其对话模板包含一个思考参数,用于控制思考过程。
我试着在我的4GB显卡上加载新的DeepSeek-V3.1-Base 685B模型,结果它崩溃了,不知道为啥?
那近期R2还会有希望吗?
未经允许不得转载:RPA中国 | RPA全球生态 | 数字化劳动力 | RPA新闻 | 推动中国RPA生态发展 | 流 > 突发!DeepSeek刚刚开源V3.1-Base
热门信息
阅读 (15865)
1 2023第三届中国RPA+AI开发者大赛圆满收官&获奖名单公示阅读 (15279)
2 《Market Insight:中国RPA市场发展洞察(2022)》报告正式发布 | RPA中国阅读 (13387)
3 「RPA中国杯 · 第五届RPA极客挑战赛」成功举办及获奖名单公示阅读 (13208)
4 与科技共赢,与产业共进,第四届ISIG中国产业智能大会成功召开阅读 (12713)
5 财务机器人 —— RPA的财务应用