本文基于以下微博话题的智搜结果生成
DeepSeek V4 Flash正式版跑分出炉,该模型在底层架构不变的前提下,纯靠后训练将Agent能力拉升至逼近GPT-5.6 Luna的水平,并以极致性价比重塑了国产大模型的竞争格局。
一、核心跑分与智能指数
综合智能:在Artificial Analysis智能指数(AII)中获50分,较前代提升10分,仅比GPT-5.6 Luna(51分)低1分。
Agent能力:Terminal Bench 2.1得分达82.7,超越智谱GLM 5.2的81.0分;DeepSWE从7.3暴涨至54.4,9项官方Agent基准全面超越自家V4-Pro预览版。
二、技术路径与极致性价比
纯后训练优化:保持284B总参/13B激活的MoE架构不变,未改动底层结构,仅通过重新后训练实现能力跃升。
成本优势:依托约98%的缓存命中折扣,其单任务成本比降价后的GPT-5.6 Luna仍低约60%,API定价维持输入1元/输出2元每百万Token。
三、开发者生态与接口适配
原生支持新协议:正式版原生兼容Responses API格式,便于开发者直接在Agent框架中调用。
无缝适配Codex:针对Codex编程助手完成专项适配并提供一键配置脚本,开发者无需更改代码即可低成本接入。
4001102288 欢迎批评指正
Copyright © 1996-2019 SINA Corporation
All Rights Reserved 新浪公司 版权所有
All Rights Reserved 新浪公司 版权所有
