DeepSeek V3 和 R1 模型完成海光 DCU 国产化适配并正式上线-网络资讯-红帽SEO工作室

当前位置：红帽SEO工作室网络资讯 DeepSeek V3 和 R1 模型完成海光 DCU 国产化适配并正式上线

→ 源码教程下载地址见 →右侧下载链接 →点“登录购买”→注册登录购买后可见→
→ 这里没有广告，只有干货！给力项目更多教程，点此加入VIP会员,即可免费下载！
→ 每日分享你意想不到的网络思维！加入红帽VIP会员，感受一下网络赚钱的快感，点击进入了解。

2 月 4 日消息，中科曙光国家先进计算产业创新中心有限公司昨日发文宣布，海光信息技术团队成功完成 DeepSeek V3 和 R1 模型与海光 DCU（深度计算单元）国产化适配，并正式上线。

用户在“光合开发者社区”中的“光源”板块访问并下载相关模型，或登录光源官网搜索“DeepSeek”，即可基于 DCU 平台部署和使用相关模型。

据介绍，DeepSeek V3 和 R1 模型基于 Transformer 架构，采用了 Multi-Head Latent Attention（MLA）和 DeepSeek MoE 两大核心技术。MLA 通过减少 KV 缓存显著降低了内存占用，提升了推理效率；DeepSeek MoE 则通过辅助损失（auxiliary loss）实现了专家负载的智能平衡，进一步优化了模型性能。

IT之家查询获悉，DCU 是海光信息推出的高性能 GPGPU 架构 AI 加速卡，致力于为行业客户提供自主可控的全精度通用 AI 加速计算解决方案。目前，DCU 已在科教、金融、医疗、政务、智算中心等多个领域实现规模化应用。

温馨提示：
1、如非特别声明，本内容转载于网络，版权归原作者所有！
2、本站仅提供信息存储空间服务，不拥有所有权，不承担相关法律责任。
3、本内容若侵犯到你的版权利益，请联系我们，会尽快给予删除处理！
我要投诉
红帽SEO工作室 » DeepSeek V3 和 R1 模型完成海光 DCU 国产化适配并正式上线

红帽seo

分享到：

红帽seo

咨询在线客服