当前位置:首页 > Deepseek最新资讯 > 正文内容

叫板OpenAI,DeepSeek-V3.1正式发布

3小时前Deepseek最新资讯12

  8月21日,DeepSeek 正式发布 V3.1版本,并将其称为“迈向 Agent 时代的*步”。与以往的大模型迭代不同,它*的特征是混合推理架构,一个模型同时支持思考模式与非思考模式。这意味着模型在保持性能稳定的同时,能够根据需求选择是快速给出答案,还是展开更长链路的推理。

  更重要的是,经过思维链压缩训练,新版模型在生成结果时的token数量减少了20%至50%(同前代模型DeepSeek-R1-0528相比),这不仅带来响应速度的提升,也直接降低了使用成本。

  配合128K的上下文扩展和FP8精度推理,V3.1在工程层面强化了吞吐效率与能耗表现,为大规模应用打下基础。

  除了推理效率上的改进,V3.1在智能体能力上的进化尤为关键。官方测试显示,在代码修复和命令行任务等编程智能体场景中,新模型展现出更强的执行力和稳定性,能够在真实环境中完成多轮迭代修正,避免“越改越乱”的问题。

  在复杂搜索任务上,V3.1则展现了更成熟的检索与整合能力,它可以规划搜索步骤、筛选证据并综合多源信息,在高难度的多学科题目测试中,性能已经远超前代模型。

  在商业与生态层面,DeepSeek 选择了“双轨”策略deepseek,一方面继续提供 API 服务,但将于9月6日起调整价格并取消夜间优惠;另一方面,V3.1的Base模型与后训练版本已在Hugging Face和魔搭同步开源。

  值得一提的是,在这一次的官方发布说明中,DeepSeek提到“V3.1使用了 UE8M0 FP8 Scale的参数精度”,更为通俗的说,它设置了一个适配于即将发布的新一代国产芯片的技术规范与设计标准。“建议有部署需求的用户仔细阅读新版说明文档。”而在此之前,国产芯片部署DeepSeek通常会有一定性能减弱,除非再做专门的软件适配。

  本次DeepSeek-V3.1的发布也似有与GPT5对垒的意味,都支持超长上下文,都有更强的复杂任务处理能力,基础模型调用更为灵活,成本更为弹性。原文出处:叫板OpenAI,DeepSeek-V3.1正式发布,感谢原作者,侵权必删!

标签: deepseek

“叫板OpenAI,DeepSeek-V3.1正式发布” 的相关文章

又是梅西粉丝集体沉默的一天

又是梅西粉丝集体沉默的一天

  这都发到乒乓球区了,是不是怕人知道今天梅西助攻梅开二度,补时助攻队友绝杀,罗密还不得哭天喊地?   这都发到乒乓球区了,是不是怕人知道今天梅西助攻梅开二度,补时助攻队...

Deepseek-R2要来了?AI板块集体爆发,科创芯片ETF涨超4%

Deepseek-R2要来了?AI板块集体爆发,科创芯片ETF涨超4%

  8月12日,市场震荡回暖,芯片板块领跑全市,$科创芯片ETF富国(588810)涨超4%,成分股上海合晶、寒武纪-U20cm涨停,盛科通信-U、源杰科技涨超15%。...

两岸共研人工智能布局 盼展开务实交流

两岸共研人工智能布局 盼展开务实交流

  中新社上海7月28日电(记者 朱贺)2025世界人工智能大会期间,台企英业达集团(北京)电子技术有限公司总经理邱全成在接受中新社等媒体采访时指出,技术需经充分交流才能实现应用落地,进而...

大厂“AI”智能体,等待 DeepSeek 时刻

大厂“AI”智能体,等待 DeepSeek 时刻

  热度高涨,人群汹涌。WAIC今年全网超23.6亿的流量,比去年增长了21.6%;但是悬念未解:Open AI即将发布的新一代GPT-5,以及DeepSeek延期已久的新一代模型V4或R...

道曼想效仿赖斯用屁股停球,结果阿尔特塔一拳将球拍走

道曼想效仿赖斯用屁股停球,结果阿尔特塔一拳将球拍走

  主要是虎扑前一个推送王楚琪那个说道曼的帖子,就有人招黑了,这里立马又来一个道曼的帖子,所以才这么说。   主要是虎扑前一个推送王楚琪那个说道曼的帖子,就有人招黑了,这...

南京片仔癀博物馆祝贺DeepSeek赋能财务知识培训会成功召开

南京片仔癀博物馆祝贺DeepSeek赋能财务知识培训会成功召开

  近日,常州航天信息分公司在常瑞宾馆举办DeepSeek赋能财务:解锁财务工作自动化线下课,来自常州各地区企业财务总监,财务经理,税务会计,会计人员110余人参加此次培训,带大家探索智能...