DeepSeek V4 Flash跑分逼近GPT-5.6,极致性价比

DeepSeek V4 Flash跑分逼近GPT-5.6,极致性价比
2026年08月01日 11:22 AI透视镜

本文基于以下微博话题的智搜结果生成

DeepSeek V4 Flash正式版跑分出炉,该模型在底层架构不变的前提下,纯靠后训练将Agent能力拉升至逼近GPT-5.6 Luna的水平,并以极致性价比重塑了国产大模型的竞争格局。

一、核心跑分与智能指数

综合智能:在Artificial Analysis智能指数(AII)中获50分,较前代提升10分,仅比GPT-5.6 Luna(51分)低1分。

Agent能力:Terminal Bench 2.1得分达82.7,超越智谱GLM 5.2的81.0分;DeepSWE从7.3暴涨至54.4,9项官方Agent基准全面超越自家V4-Pro预览版。

二、技术路径与极致性价比

纯后训练优化:保持284B总参/13B激活的MoE架构不变,未改动底层结构,仅通过重新后训练实现能力跃升。

成本优势:依托约98%的缓存命中折扣,其单任务成本比降价后的GPT-5.6 Luna仍低约60%,API定价维持输入1元/输出2元每百万Token。

三、开发者生态与接口适配

原生支持新协议:正式版原生兼容Responses API格式,便于开发者直接在Agent框架中调用。

无缝适配Codex:针对Codex编程助手完成专项适配并提供一键配置脚本,开发者无需更改代码即可低成本接入。

财经自媒体联盟更多自媒体作者

新浪首页 语音播报 相关新闻 返回顶部