当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek“开源周”第二天开源EP通信库

2个月前 (02-25)Deepseek最新资讯147

新京报贝壳财经讯(记者罗亦丹)北京时间2月25日,DeepSeek发布了其“开源周”第二天的成果:DeepEP,第一个用于MoE模型(混合专家模型)训练和推理的开源EP通信库。

据了解,EP为Expert Parallelism(专家并行),是一种在大规模分布式AI模型训练中使用的技术,能用于提升模型并行处理能力和训练效率。

DeepSeek介绍,DeepEP的特点包括:高效且优化的全对全(all-to-all)通信,节点内和节点间支持NVLink和RDMA,用于训练和推理预填充的高吞吐量内核,用于推理解码的低延迟内核,原生FP8调度支持,灵活的GPU资源控制,实现计算与通信重叠。

DeepSeek发布公告截图


“DeepSeek“开源周”第二天开源EP通信库” 的相关文章

人工智能新成员Manus和DeepSeek有何区别

人工智能新成员Manus和DeepSeek有何区别

原标题:人工智能新成员Manus和DeepSeek有何区别?近期,一款既能思考问题又能执行任务的“智能体”AI产品——Manus引发广泛关注,它和其他的AI大模型有什么区别,又能做什么呢?一起来看。记...

DeepSeek API 的返回值格式是什么?

DeepSeek API 的返回值格式是什么?

DeepSeek API 的返回值格式是什么?DeepSeek API的返回值格式通常是JSON格式。这种格式返回的数据包括生成的文本内容、状态码(用于判断请求是否成功)、错误信息(若请求失败时)等。...

DeepSeek赋能潮起

DeepSeek赋能潮起

新华社北京3月21日电 3月21日,《新华每日电讯》发表题为《DeepSeek赋能潮起》的报道。2025年开年,DeepSeek彻底突破技术圈层,直抵社会大众,成为热议高频词。刚刚结束的全国两会上,人...

北京大学 | DeepSeek应用、提示词工程和落地场景(附PPT下载)

北京大学 | DeepSeek应用、提示词工程和落地场景(附PPT下载)

今天和大家分享的资料来自于北京大学DeekSeek内部研讨系列讲座,两份PPT资料“DeepSeek与AIGC应用”“DeepSeek提示词工程和落地场景”均由北京大学AI肖睿团队制作,分享给各位老师...

政通智合·数聚泉城 共创政务AI新场景 山东移动DeepSeek政务场景共创沙龙举办

政通智合·数聚泉城 共创政务AI新场景 山东移动DeepSeek政务场景共创沙龙举办

3月7日,山东移动与华为联合举办DeepSeek政务场景共创沙龙。本次沙龙以“政通智合·数聚泉城 共创政务AI新场景”为主题,邀请省市大数据局等相关政府单位的领导及专家齐聚泉城济南,在DeepSeek...

DeepSeek加持的AlphaGPT,助力高文律师事务所全面拥抱AI

DeepSeek加持的AlphaGPT,助力高文律师事务所全面拥抱AI

2025年初,中国团队精心雕琢的通用大模型DeepSeek凭借其创新的架构优化以及深入的数据挖掘技术,在逻辑推理、多轮对话和知识搜索等关键领域大放异彩,其为诸多垂直领域,特别是法律行业的智能化转型,开...