DeepSeek-V4-Flash API 开启公测,自动化基准测试达 25.1
DeepSeek 官方 API 文档更新,宣布 DeepSeek-V4-Flash API 正式进入公测阶段。开发者无需更改调用方式,只需将模型名称设置为 deepseek-v4-flash 即可体验最新版本。在自动化基准测试中,该模型取得了 25.1 的评分,展现出强劲的代码与智能体任务处理能力。
DeepSeek 于 7 月 31 日宣布其最新一代模型 DeepSeek-V4-Flash 的 API 正式进入公开测试阶段。此次更新标志着 DeepSeek 的基础模型能力再次实现迭代。开发者可以通过现有的 OpenAI ChatCompletions 接口或 Anthropic 接口进行无缝调用。
在性能表现上,DeepSeek-V4-Flash 在公开的 Automation Bench 测试中获得了 25.1 的分数。官方指出,在针对代码智能体的公开基准测试中,该模型使用了即将发布的 DeepSeek Harness 最小模式作为框架,并在最高努力级别下进行评估。
DeepSeek 的 API 体系目前全面支持 V4-Pro 和 V4-Flash 两个版本。为了平滑过渡,此前旧版的 deepseek-chat 和 deepseek-reasoner 接口名称已按计划于 7 月 24 日停用。在过渡期内,这两个旧名称分别指向了 V4-Flash 的非思考模式和思考模式。
此次 V4-Flash 的发布延续了 DeepSeek 在混合推理架构上的技术路线。自 2025 年 8 月推出 V3.1 实现单模型同时支持思考与非思考模式以来,DeepSeek 在工具调用、代码生成以及智能体任务执行方面持续优化,V4-Flash 的公测表明其在自动化和全栈开发领域有了新的突破。
对于开发者而言,DeepSeek-V4-Flash API 的调用方式保持不变,只需将参数 model 设置为“deepseek-v4-flash”即可启用。内部测试集 DSBench-FullStack 和 DSBench-Hard 的引入,也表明该模型在应对复杂全栈开发和硬核编程难题方面进行了专门强化。
为什么值得关注
DeepSeek 持续推进其混合推理架构的迭代,V4-Flash 的公测为开发者在构建高效代码智能体时提供了更具潜力的新选择。