您的当前位置:首页>科技咨询>资讯详情

DeepSeek,最新发布!

发表于:2025-02-27 14:00:03 浏览:36次 发布者: 网易互联网


【导读】DeepSeek宣布开源Optimized Parallelism Strategies

中国基金报记者 忆山

2月27日,在“开源周”第四日,DeepSeek宣布开源Optimized Parallelism Strategies。

Optimized Parallelism Strategies主要针对大规模模型训练中的效率问题。其特点包括:混合并行策略,在减少通信开销的同时最大化GPU利用率;通过梯度压缩、异步通信、通信-计算重叠等技术降低节点间通信延迟;根据硬件拓扑和模型结构自动推荐并行策略,减少手动调参成本等。


2月21日,DeepSeek宣布,从2月24日起将开源5个代码库,以完全透明的方式与全球开发者社区分享他们的研究进展。并将这一计划命名为“开源周”。

DeepSeek称,即将开源的代码库是其在线服务中的基础组件,且都经过了详细记录、部署和实战测试。

2月24日,DeepSeek首个开源的项目是FlashMLA。FlashMLA是DeepSeek用于Hopper GPU的高效MLA解码内核,并针对可变长度序列进行了优化,现已投入生产。

2月25日,DeepSeek宣布开源DeepEP,即首个用于MoE模型训练和推理的开源EP通信库。其特点包括:高效且优化的全对全通信,通过NVLink和RDMA支持节点内和节点间的通信,用于训练和推理预填充的高吞吐量内核,用于推理解码的低延迟内核,原生FP8调度支持,灵活的GPU资源控制,用于计算通信重叠。

2月26日,DeepSeek宣布开源DeepGEMM。其特点包括:同时支持密集布局和两种MoE布局,完全即时编译,可为V3/R1模型的训练和推理提供强大支持等。

此外,在2月6日宣布暂停API服务充值后,2月25日,DeepSeek宣布重新开放API充值。2月26日晚间,DeepSeek又宣布推出错峰优惠活动,北京时间每日00:30至08:30的夜间空闲时段,DeepSeek-V3降至原价的50%,DeepSeek-R1降至原价的25%。

DeepSeek称,鼓励用户充分利用这一时段,享受更经济、更流畅的服务体验。

QuestMobile数据显示,上线以来至2月9日,DeepSeek App的累计下载量已超1.1亿次,周活跃用户规模最高近9700万个。

编辑:赵新亮

校对: 王玥

制作: 黄梅

审核:许闻

版权声明

《中国基金报》对本平台所刊载的原创内容享有著作权,未经授权禁止转载,否则将追究法律责任。

授权转载合作联系人:于先生(电话:0755-82468670)

猜你喜欢

更名虎鲸文娱 阿里大文娱锚定娱乐新生态
更名虎鲸文娱 阿里大文娱锚定娱乐新生态
发表于:2025-05-22 浏览:31 发布者: 网易互联网
水产品牌如何建设?业内:平衡好变与不变,标准化是发展关键
水产品牌如何建设?业内:平衡好变与不变,标准化是发展关键
发表于:2024-11-18 浏览:72 发布者: 新京报
欧盟AI规则引爆硅谷裂痕:谷歌官宣准备签署,Me
欧盟AI规则引爆硅谷裂痕:谷歌官宣准备签署,Me
发表于:2025-07-30 浏览:20 发布者: 网易科技
微信小店送礼物功能将在春节前全量开放?微信回
微信小店送礼物功能将在春节前全量开放?微信回
发表于:2024-12-24 浏览:52 发布者: 网易互联网
京东0佣金高调进攻外卖,意在解即时零售困局
京东0佣金高调进攻外卖,意在解即时零售困局
发表于:2025-02-11 浏览:40 发布者: 网易互联网
B站曾经顶流UP主现在欠账几百万
B站曾经顶流UP主现在欠账几百万
发表于:2025-03-24 浏览:59 发布者: 网易互联网
谷歌电话会:AI Overviews用户超15亿,评估关税
谷歌电话会:AI Overviews用户超15亿,评估关税
发表于:2025-04-25 浏览:28 发布者: 网易互联网
谷歌测试纯AI版搜索引擎,彻底取消传统展示形式
谷歌测试纯AI版搜索引擎,彻底取消传统展示形式
发表于:2025-03-06 浏览:38 发布者: 网易IT
“派送时效受影响”,五家快递回应快件泡水咋理
“派送时效受影响”,五家快递回应快件泡水咋理
发表于:2025-07-29 浏览:18 发布者: 网易互联网
曝苹果正与OpenAI、Anthropic洽谈,为Siri急寻
曝苹果正与OpenAI、Anthropic洽谈,为Siri急寻
发表于:2025-07-03 浏览:26 发布者: 网易IT