当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek发布开源周首个成果 可优化英伟达GPU效率

2个月前 (02-24)Deepseek最新资讯119

新京报贝壳财经讯(记者罗亦丹)北京时间2月24日上午,DeepSeek发布了其“开源周”的第一项成果:FlashMLA(直译为快速多头潜在注意力机制)的代码。


据了解,MLA(多头潜在注意力机制)正是DeepSeek降低大模型成本使用的关键技术之一,其可以显著减少大模型训练和推理过程中的内存占用,而FlashMLA则是针对Hopper GPU(一种英伟达GPU架构)开发的高效MLA解码内核,其针对可变长度序列进行了优化,目前已投入了生产,其可以使得H800达到3000GB/s内存,实现580TFLOPS(每秒浮点运算次数)计算性能。


贝壳财经记者注意到,根据此前DeepSeek发布V3大模型时公开的技术文档,该大模型正是使用英伟达的H800芯片训练而成。


上海骊翰科技咨询有限公司发文称,FlashMLA能在不损失模型性能的前提下,将缓存体积压缩至原来的1/4,从而大幅降低显存需求。例如,原始需要存储的100GB中间结果,压缩后仅需25GB,通过开源让企业可以直接使用FlashMLA来优化自家模型。随着FlashMLA的普及,AI推理有望进入千元级硬件跑百亿模型的时代。


“DeepSeek发布开源周首个成果 可优化英伟达GPU效率” 的相关文章

约20家车企官宣与DeepSeek深度合作

约20家车企官宣与DeepSeek深度合作

约20家车企官宣与DeepSeek深度合作截至2月14日,已有包括比亚迪、广汽、长安、吉利、奇瑞在内的约20家车企官宣与DeepSeek的深度融合,智能座舱中的人机交互,成为DeepSeek上车后聚焦...

DeepSeek助力数禾科技,探索金融服务新边界

DeepSeek助力数禾科技,探索金融服务新边界

在当今科技飞速发展的时代,人工智能技术正以前所未有的态势重塑着各个行业,金融领域也不例外。从传统的柜台服务到线上便捷的金融交易,从人工审核信贷到智能风控体系,金融服务的模式与效率在AI科技的驱动下不断...

DeepSeek在各行各业“上岗”,对你的“饭碗”有影响吗?

DeepSeek在各行各业“上岗”,对你的“饭碗”有影响吗?

这里谈谈我所在的行业: 2025年伊始,deepseek这只黑天鹅横空出世,带来一场深度产业革命,引发全民关注。各行各业争先接入,以推动产业升级,房产中介与贷款中介也面临着新的局面。 与房...

从Deepseek谈东方数理哲学与AI新文明

从Deepseek谈东方数理哲学与AI新文明

2月28日下午,由北京市社会组织党建联合会与中关村超互联新基建产业创新联盟联合主办的 “从Deepseek谈东方数理哲学与AI新文明范式” 交流会在北京成功举办。此次活动汇聚了人工智能、传统文化、社会...

在微信小程序里使用DeepSeek的6种方法

在微信小程序里使用DeepSeek的6种方法

大家好,我是沐颜,专注私域流量变现。我的陪跑项目👉🏻 《超级个体合伙人》我的网创资源站👉🏻《搞钱项目资源》每天分享靠谱的副业项目,感兴趣的朋友,可以点个关注。设定清晰的目标是成功的第一步。当你知道自己...

美商务部禁止在政府设备上用DeepSeek?

美商务部禁止在政府设备上用DeepSeek?

本报记者 李 萌路透社17日报道称,根据该媒体及知情人士了解,美国商务部下属一些部门最近几周通知员工,禁止在政府设备上使用中国的人工智能(AI)模型DeepSeek。路透社称,美商务部在发给工作人员的...