来源:中国基金报
媒体
2025-02-27 12:07:26
(原标题:DeepSeek,最新发布!)
中国基金报记者 忆山
2月27日,在“开源周”第四日,DeepSeek宣布开源Optimized Parallelism Strategies。
Optimized Parallelism Strategies主要针对大规模模型训练中的效率问题。其特点包括:混合并行策略,在减少通信开销的同时最大化GPU利用率;通过梯度压缩、异步通信、通信-计算重叠等技术降低节点间通信延迟;根据硬件拓扑和模型结构自动推荐并行策略,减少手动调参成本等。
2月21日,DeepSeek宣布,从2月24日起将开源5个代码库,以完全透明的方式与全球开发者社区分享他们的研究进展。并将这一计划命名为“开源周”。
DeepSeek称,即将开源的代码库是其在线服务中的基础组件,且都经过了详细记录、部署和实战测试。
2月24日,DeepSeek首个开源的项目是FlashMLA。FlashMLA是DeepSeek用于Hopper GPU的高效MLA解码内核,并针对可变长度序列进行了优化,现已投入生产。
2月25日,DeepSeek宣布开源DeepEP,即首个用于MoE模型训练和推理的开源EP通信库。其特点包括:高效且优化的全对全通信,通过NVLink和RDMA支持节点内和节点间的通信,用于训练和推理预填充的高量内核,用于推理解码的低延迟内核,原生FP8调度支持,灵活的GPU资源控制,用于计算通信重叠。
2月26日,DeepSeek宣布开源DeepGEMM。其特点包括:同时支持密集布局和两种MoE布局,完全即时编译,可为V3/R1模型的训练和推理提供强大支持等。
此外,在2月6日宣布暂停API服务充值后,2月25日,DeepSeek宣布重新开放API充值。2月26日晚间,DeepSeek又宣布推出错峰优惠活动,北京时间每日00:30至08:30的夜间空闲时段,DeepSeek-V3降至原价的50%,DeepSeek-R1降至原价的25%。
DeepSeek称,鼓励用户充分利用这一时段,享受更经济、更流畅的服务体验。
QuestMobile数据显示,上线以来至2月9日,DeepSeek App的累计下载量已超1.1亿次,周活跃用户规模最高近9700万个。
编辑:赵新亮 校对:王玥 制作:黄梅 审核:许闻版权声明
《中国基金报》对本平台所刊载的原创内容享有著作权,未经授权禁止转载,否则将追究法律责任。
授权转载合作联系人:于先生(电话:0755-82468670)
小米大消息!雷军连续发声
中国基金报
2025-02-27
中国基金报
2025-02-27
中国基金报
2025-02-27
中国基金报
2025-02-27
中国基金报
2025-02-27
中国基金报
2025-02-27
证券之星资讯
2025-02-27
证券之星资讯
2025-02-27
证券之星资讯
2025-02-27