当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek开源周第三日 发布高性能通用矩阵乘法库

5个月前 (02-26)Deepseek最新资讯316

新京报贝壳财经讯(记者罗亦丹)北京时间2月26日,DeepSeek进行了其开源周第三日的发布——DeepGEMM,一个支持密集和MoE(专家混合模型)GEMM(通用矩阵乘法)的FP8 (8位浮点数)GEMM库,为V3/R1训练和推理提供支持。

据了解,通用矩阵乘法是许多高性能计算任务的核心,所以其性能优化也是大模型降本增效的重点。

DeepSeek表示,DeepGEMM在Hopper GPU(一种英伟达GPU架构)上最高可达到1350+FP8TFLOPS(每秒万亿次浮点运算),并且像教程一样简洁,可完全即时编译,其核心逻辑只有约300行代码,且在大多数矩阵尺寸上均优于专家调优的内核,并支持密集布局和两种MoE布局。


标签: DeepSeek

“DeepSeek开源周第三日 发布高性能通用矩阵乘法库” 的相关文章

DeepSeek红利耗尽后,元宝拿什么和豆包斗?

DeepSeek红利耗尽后,元宝拿什么和豆包斗?

原创 赵晋杰 字母榜短短60天内,中国AI原生应用下载排行榜的位次排名,就三易其主。最新情况是,截至4月15日中午,中国区苹果应用商店免费APP下载排行榜上,豆包再次超越DeepSeek,位列第二,紧...

英伟达新GPU再王炸,也得靠蹭DeepSeek卖卡

英伟达新GPU再王炸,也得靠蹭DeepSeek卖卡

一身皮衣黄仁勋,GTC 2025上意气风发。虽然最近英伟达的股票跌得比较狠,甚至来到了10年来的最低点,但这不影响老黄,对最新的GPU们信心满满。时间回拨到2月初,DeepSeek的发布在AI领域掀起...

DeepSeek-V3模型更新,各项能力全面进阶

DeepSeek-V3模型更新,各项能力全面进阶

人民财讯3月25日电,DeepSeek-V3模型已完成小版本升级,目前版本号DeepSeek-V3-0324,新版V3模型借鉴DeepSeek-R1模型训练过程中所使用的强化学习技术,大幅提高了在推理...

DeepSeek教师教学全流程指南

DeepSeek教师教学全流程指南

01快速了解DeepSeekDeepSeek是一款开源人工智能工具,专注于提供高效易用的AI模型训练与推理能力,它结合自然语言处理(NLP)和机器学习技术,能够理解并生成自然语言,帮助用户从海量数据中...

匆忙接入DeepSeek,你想好怎么收费了么?

匆忙接入DeepSeek,你想好怎么收费了么?

自从ChatGPT在全球范围引爆关注,国内外大模型接连登场,AI技术迅速从研究室走向产业一线。无论是OpenAI的GPT-4,还是国内如DeepSeek、通义千问、文心一言等产品,AI正以前所未有的速...

至顶AI实验室:DeepSeek完全实用手册V1.5,技术原理·使用技巧·部署进展(PDF版)

至顶AI实验室:DeepSeek完全实用手册V1.5,技术原理·使用技巧·部署进展(PDF版)

好的产品一定是能久经市场考验的,DeepSeek 无疑就是今年最好的产品之一。距离DeepSeek R1发布已经快3个月了,通过微信指数我们可以看到,DeepSeek的热度依然很高。但我们相信,过去的...