当前位置:首页 > DeepSeek技术交流 > 正文内容

新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练

3个月前 (03-26)DeepSeek技术交流199

明敏 发自 凹非寺

量子位 | 公众号 QbitAI

刚刚,DeepSeek官方发布DeepSeek-V3模型更新技术报告。

V3新版本在数学、代码类相关评测集成绩超过GPT-4.5!

而且这只是通过改进后训练方法实现。

DeepSeek-V3-0324和之前的DeepSeek-V3使用同样的base模型。

打破了之前传言该版本base模型是R2的传言。

新版本参数量约为660B,与此前网传的685B有所出入。

开源版本上下文长度为128K(网页端、App和API提供 64K 上下文)。

私有化部署时只需要更新checkpoint和tokenizer_config.json(tool calls相关变动)。

目前,想要体验这一版本模型,只需用户登录官方网页、APP、小程序进入对话界面后,关闭深度思考即可体验。API 接口和使用方式保持不变。

官方建议,此后非复杂推理任务使用V3新版本更好。

此外,官方还进一步展示了新版本在各个维度的能力。

前端开发

生成代码可用性更高,视觉效果也更好。

中文写作

相较于R1版有进一步优化,特别提升了中长篇的内容质量。

比如写一篇关于苏轼生平的散文:

中文搜索

联网情况下,V3新版本的搜索输出内容也更详实准确、排版更清晰美观。

现在写一份3000字的市场报告也是so easy(上下滑动查看完整内容):

此外,V3新版本在工具调用、角色扮演、问答闲聊等方面也进一步提升。

今天白天不少网友也上手实测了诸多能力,比如做个小游戏:

该版本模型采用宽松的MIT开源协议。

且可直接部署在M3 Ultra的Mac Studio上。

这意味着大模型开发应用的门槛更进一步降低。

话不多说,趁着深夜,还没睡的赶紧去体验最新版吧~


原标题:《新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练》


“新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练” 的相关文章

欧阳明高谈DeepSeek:助力全民智驾加速落地

欧阳明高谈DeepSeek:助力全民智驾加速落地

本报记者张硕北京报道2月25日,在中国电动汽车百人会论坛(2025)专家媒体交流会上,中国科学院院士、中国电动汽车百人会副理事长欧阳明高表示,2025年中国汽车市场将迎来结构性变局,插电混动车型将增长...

OpenAI打小报告,要求禁用DeepSeek

OpenAI打小报告,要求禁用DeepSeek

OpenAI又双叒叕对DeepSeek下黑手了!就在上周,3月13日,OpenAI向美国政府提交了一份长达15页的“举报信”,称DeepSeek R1会带来“重大风险”,并要求美国政府采取行动。不仅偷...

中信消金基于自主研发的“信智”一站式大模型服务平台接入DeepSeek大模型

中信消金基于自主研发的“信智”一站式大模型服务平台接入DeepSeek大模型

近日,中信消金基于自主研发的“信智”一站式大模型服务平台接入DeepSeek大模型,并率先应用于智能质检与知识库检索两大业务场景,成为首批接入前沿领先AI大模型的消费金融公司。  在智能质检方面,借助...

西工大满血版DeepSeek,上线了!

西工大满血版DeepSeek,上线了!

智慧校园再添利器我校AI服务平台—“翱翔挚友”搭载满血版DeepSeek正式上线啦!01 平台有哪些模型?本地化部署DeepSeek R1资源专享、隐私保护公有云接入DeepSeek R1数据共享、智...

TCL实业接入DeepSeek后在哪些方面有帮助?

TCL实业接入DeepSeek后在哪些方面有帮助?

TCL实业接入DeepSeek后,将在多个方面获得显著帮助,具体如下:提升产品智能化水平:DeepSeek的人工智能技术将使TCL的智能家居、移动通讯等产品能够更好地理解和处理自然语言,实现精准的语音...

DeepSeek-V3模型更新,各项能力全面进阶

DeepSeek-V3模型更新,各项能力全面进阶

人民财讯3月25日电,DeepSeek-V3模型已完成小版本升级,目前版本号DeepSeek-V3-0324,新版V3模型借鉴DeepSeek-R1模型训练过程中所使用的强化学习技术,大幅提高了在推理...