DeepSeek ,V4系列迎重猛晋级

时尚 · 2026-08-15 16:07:21

DeepSeek-V4系列模型迎来重猛晋级 。列迎抢在7月末尾一天(31日) ,重猛DeepSeek-V4-Flash正式版上线 。晋级

屈就官方消息,列迎DeepSeek-V4-Flash正式版的重猛模型架构 、大年夜小与预览版不异  ,晋级即MoE(同化专家)架构、列迎2840亿总参数、重猛130亿激活参数 、晋级1M凹凸文,列迎在此根本上,重猛正式版仅从头举办了后操练,晋级Agent身手便除夜幅加强,列迎基准测试得分远超V4-Pro-Preview。重猛

官方功用比照的晋级是国产编程代表GLM-5.2及美国的Opus 4.8 。DeepSeek-V4-Flash正式版的集团功用超出了GLM-5.2 ,切近亲近Opus 4.8。比照对标模型,V4 Flash只是个小参数模型 ,GLM-5.2总参数高达7440亿 ,激活参数为400亿 ,均远高于V4 Flash 。

具体来看官方给出的9项Agent基准测试得分,在审核终端独霸身手的Terminal Bench2.1上,DeepSeek-V4-Flash正式版的得分从61.8涨到了82.7;在代码仓库邃晓与改削义务NL2Repo 、DeepSWE上 ,分袂得分54.2和54.4 ,而其前身Flash Preview在DeepSWE项目上的得分仅为7.3 。

此外,其指向群集安然义务的Cybergym得分为76.7 ,回响对象调用身手的Toolathlon-Verified抵达70.3 。

在更综合的智能体评测中 ,DeepSeek-V4-Flash正式版在Agent Last Exam和 Automation Bench Public上的得分分袂为25.2和25.1,这两个项目都是2026年新推出 、面向AI智能体的理论义务评测基准,用来考验除夜模型Agent能不克不及真正完成真实工作,分辨于MMLU 、Humanity's Last Exam这类纯问答测试。

在内部全栈斥地测试DSBench-FullStack与高难度编码测试DSBench-Hard上 ,得分则抵达68.7和59.6 。多项方针远超本年4月上线的V4-Pro预览版 。

新版本上线后 ,Artificial Analysis和Arena.ai两除夜AI评测平台同步更新了该模型的基准测试下场。

Artificial Analysis智能指数展示  ,DeepSeek-V4-Flash掉落踪掉落踪50分 ,比4月宣布的Flash版本超出超出10分  ,仅比OpenAI的GPT-5.6 Luna(51分)低1分 。该平台发文称 ,即便OpenAI将GPT-5.6 Luna的价值下调了80%,DeepSeek-V4-Flash正式版在其自有API上的单义务成本还是比GPT-5.6 Luna低约60%。

Arena.ai的陈述称 ,DeepSeek-V4-Flash正式版以1586分的下场重塑了Frontend Code Arena跑分榜单 。每MToken的价值为0.14美元/0.28美元,是同类产品中性价比最高的。

申万宏源证券最新研报称 ,DeepSeek-V4-Flash延续揭穿国产模型超高性价比;国联平易近生证券称,DeepSeek-V4-Flash轻量模型追平旗舰功用 ,利好AI独霸财富链。

文章推荐:

以“保险客户旅游”名义伤害消费者权益 ,两部分宣布提示

光遇4.21复刻先祖职位图解

模仿古代经商兑换码礼包码2022除夜全最新

整站优化与关键词优化有什么区别  ?

全国始创“***沙盘党课”珠海开讲  ,把党史机警变成企业包抄的“独霸手册”

SEO优化大概要多少钱呢 ?

如何将SEO与内容营销细致结合?

诺亚之心奇遇还乡义务触发完成攻略

险!珠海一车辆侧翻冒浓烟,正好碰着他们经由……

天谕手游捏脸数据最新分享2022

泰拉瑞亚法师设备流程图1.4

花亦山心之月古谷鼓蛊狸奴戏鼓弄法攻略