当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek“开源周”第二天开源EP通信库

5个月前 (02-25)Deepseek最新资讯298

新京报贝壳财经讯(记者罗亦丹)北京时间2月25日,DeepSeek发布了其“开源周”第二天的成果:DeepEP,第一个用于MoE模型(混合专家模型)训练和推理的开源EP通信库。

据了解,EP为Expert Parallelism(专家并行),是一种在大规模分布式AI模型训练中使用的技术,能用于提升模型并行处理能力和训练效率。

DeepSeek介绍,DeepEP的特点包括:高效且优化的全对全(all-to-all)通信,节点内和节点间支持NVLink和RDMA,用于训练和推理预填充的高吞吐量内核,用于推理解码的低延迟内核,原生FP8调度支持,灵活的GPU资源控制,实现计算与通信重叠。

DeepSeek发布公告截图


“DeepSeek“开源周”第二天开源EP通信库” 的相关文章

郑州交警“无人机+DeepSeek”让出行更智能、更顺畅

郑州交警“无人机+DeepSeek”让出行更智能、更顺畅

当警用无人机遇上人工智能会擦出怎样的火花?在郑州街头一场由"无人机+DeepSeek"引领的交通变革正在悄然上演从空中侦察员、安全宣讲员,到事故调解员再到智能调度师郑州交警正在逐步...

DeepSeek R1模型已完成小版本试升级

DeepSeek R1模型已完成小版本试升级

每经快讯,5月28日,DeepSeek官方宣布DeepSeek R1模型已完成小版本试升级,欢迎前往官方网页、APP、小程序测试(打开深度思考),API 接口和使用方式保持不变。每日经济新闻...

DeepSeek价格下调,API调用错峰时段降幅最高达75%

DeepSeek价格下调,API调用错峰时段降幅最高达75%

经快讯,2月26日,DeepSeek API开放平台宣布,即日起,北京时间每日00:30至08:30的夜间空闲时段,DeepSeek开放平台推出错峰优惠活动。在此期间,API调用价格大幅下调:Deep...

DeepSeek能干什么?搜论文、学代码……多所高校接入的DeepSeek“满血版”有哪些神奇之处?

DeepSeek能干什么?搜论文、学代码……多所高校接入的DeepSeek“满血版”有哪些神奇之处?

新学期,多所高校掀起了智能化革新浪潮。中国人民大学、华东师范大学、北京邮电大学等高校正式接入了DeepSeek“满血版”。这个拥有6710亿参数的“超级大脑”,正在以每周迭代的领域知识和强大的“思维链...

效率狂飙!DeepSeek最强16个王炸组合,打工人必看!(强烈建议收藏)

效率狂飙!DeepSeek最强16个王炸组合,打工人必看!(强烈建议收藏)

01内容创作:1分钟输出爆款(1)DeepSeek + 豆包            爆款文案生成器自媒体人痛点:选题难、灵感枯竭?输入行业关...

搭载国内首个Deep Research功能,元知平台让用户零门槛免费用满血DeepSeek

搭载国内首个Deep Research功能,元知平台让用户零门槛免费用满血DeepSeek

未来式智能今天推出元知:让满血DeepSeek R1触手可及未来式智能作为国内领先的AI智能体构建平台,始终致力于通过前沿的AI技术,为10亿知识工作者提升10倍生产力为愿景。今天,未来式智能推出元知...