当前位置:首页 > Deepseek最新资讯 > 正文内容

报道:DeepSeek决定使用华为人工智能芯片训练部分模型

  观点网讯:8月29日,据媒体报道,DeepSeek已决定使用华为的人工智能芯片来训练其部分模型,反映其正在减少对英伟达芯片的依赖。

  DeepSeek方面称,本次升级包含以下主要变化:混合推理架构让一个模型同时支持思考模式与非思考模式;相比DeepSeek-R1-0528,DeepSeek-V3.1-Think能在更短时间内给出答案,让模型拥有更高的思考效率;通过Post-Training优化,让新模型有更强的Agent能力,在工具使用与智能体任务中的表现有较大提升。

  据悉,DeepSeek-V3.1采用了UE8MO FP8 Scale参数精度,该模型与UE8M0FP8动态范围大,提升稳定性与效率,适配华为昇腾等芯片deepseek。原文出处:报道:DeepSeek决定使用华为人工智能芯片训练部分模型,感谢原作者,侵权必删!

标签: deepseek

“报道:DeepSeek决定使用华为人工智能芯片训练部分模型” 的相关文章

【新思想引领新征程】文化的力量——习近平文化思想在浙江的溯源与实践

【新思想引领新征程】文化的力量——习近平文化思想在浙江的溯源与实践

  习近平总书记高度重视文化建设,早在二十多年前,他在浙江工作时对文化就有着深刻的思考与实践,他将“加快建设文化大省”列为“八八战略”重要内容,部署实施了文化大省建设“八项工程”,为浙江文...

美的空调新品发布:以科技之力,打造理想的全屋空气

美的空调新品发布:以科技之力,打造理想的全屋空气

  盛夏酷暑,高温天气持续,当人们回到家中,迎接他们的往往是如同蒸笼般的闷热环境。传统制冷方式在应对现代家庭对舒适度日益增长的需求时,已显得力不从心。如何让夏天更舒适,成为了亟待解决的难题...

华为、DeepSeek接连放大招,大模型与国产半导体融合加速,半导体设备ETF基

华为、DeepSeek接连放大招,大模型与国产半导体融合加速,半导体设备ETF基

  8月27日,市场继续上扬,半导体板块领涨两市,截至午间收盘,半导体设备ETF基金(159327)涨3.28%。   8月27日,华为将召开新品发布会,目标直指AI存储...

库里是不是现役最擅长得分的控卫

库里是不是现役最擅长得分的控卫

  你要搞清楚,总冠军不是你库里一个人的功劳,是球队天时地利人和的结果。简单来说,就是队友实力足够强,肖华要力捧,核心球员要健康,缺一不可。你当真你家哥哥是天神下凡,篮球神人啊!上个赛季前...

DeepSeek“极你太美”bug,官方回应了

DeepSeek“极你太美”bug,官方回应了

  这个问题最初是在火山引擎、chutes等平台上被发现,但随着事件的发酵,更多平台也被卷入了进来,包括腾讯的CodeBuddy,甚至是   事件之火,在国外Reddit...

DeepSeek在全过程造价管理中实战应用

DeepSeek在全过程造价管理中实战应用

  2024年12月30日住建部正式发布《建设工程工程量清单计价标准》GB/T50500-2024,新版《清单计价标准》的出台将为工程造价精细化管理带来一场新的革命,同时也给各单位相关管理...