七牛云MaaS平台第一时间上线DeepSeek-V4-Flash-0731版模型。
本次更新保持了DeepSeek-V4-Flash Preview的模型架构和参数规模,主要通过新一轮后训练强化Agent能力。
同时,新版本支持Responses API,并针对Codex完成适配,更适合AI Coding、工具调用和复杂任务执行等场景。
01
Agent能力升级:从生成代码到完成任务
在真实的Agent场景中,模型面对的通常不是一道独立问题,而是一项需要连续执行的复杂任务。
例如,在软件开发(881272)过程中,模型可能需要理解代码仓库、定位问题、修改多个文件、调用终端运行测试,再根据报错持续调整方案。
这要求模型不仅能够生成代码,还要具备任务理解、工具调用、环境反馈分析和长流程执行能力。
据 DeepSeek官方测试,DeepSeek-V4-Flash-0731版在多项Agent和Coding Agent基准中均取得明显提升:
Terminal Bench2.1:82.7;
Toolathlon Verified:70.3;
DSBench-FullStack:68.7;
DSBench-Hard:59.6;
DeepSWE:54.4;
NL2Repo:54.2。
02
支持Responses API,针对Codex完成适配
本次更新的另一个重要变化,是DeepSeek-V4-Flash-0731版原生支持Responses API,并针对Codex完成适配。
完成模型提供方配置后,开发者可以在Codex CLI、ChatGPT桌面端以及VS Code中的Codex扩展中调用DeepSeek-V4-Flash-0731版。多个Codex客户端共享同一套配置,无需分别接入。
在 Codex工作流中,模型可以参与:
读取和理解项目代码;
制定任务实施步骤;
跨文件修改代码;
调用终端执行命令;
运行测试并分析报错;
根据执行结果继续修复。
03
百万上下文,为复杂任务提供更大空间
DeepSeek-V4-Flash-0731版支持1M Token上下文,最大输出长度为384K Token,同时支持思考与非思考模式、Tool Calls、JSON Output和Responses API。
对于代码Agent而言,长上下文不仅意味着能够读取更多代码,也意味着模型可以在同一次任务中容纳需求文档、项目文件、运行日志、工具返回结果以及历史操作记录。
这为代码仓库级开发、企业知识库Agent、数据分析和业务自动化等复杂场景提供了更大的任务空间。
04
七牛云MaaS,让新模型更快进入业务
模型更新速度越来越快。不同模型拥有不同的接口、价格、上下文长度和能力边界。
七牛云MaaS平台通过统一的模型服务入口,为企业和开发者提供主流模型调用服务,降低模型接入与持续迭代的工程成本。
企业无需自行部署和维护底层模型,也不必在每次模型升级时重新搭建一套服务体系,可以根据不同场景选择合适的模型,并对模型调用和Token用量进行统一管理。
大模型正走向真实工作场景,当模型能够理解项目、调用工具、操作系统并根据结果持续修正行动,Agent才真正开始成为可以参与业务执行的生产力。
DeepSeek-V4-Flash-0731版现已上线七牛云MaaS平台。
