七牛云第一时间上线 DeepSeek-V4-Flash-0731 版模型:Agent 能力跃升,原生适配 Codex利好

2026-07-31 18:00:25
来源:七牛云
作者:研究模型的
分享
文章提及标的

七牛云MaaS平台第一时间上线DeepSeek-V4-Flash-0731版模型。

本次更新保持了DeepSeek-V4-Flash Preview的模型架构和参数规模,主要通过新一轮后训练强化Agent能力。

同时,新版本支持Responses API,并针对Codex完成适配,更适合AI Coding、工具调用和复杂任务执行等场景。

01

Agent能力升级:从生成代码到完成任务

在真实的Agent场景中,模型面对的通常不是一道独立问题,而是一项需要连续执行的复杂任务。

例如,在软件开发(881272)过程中,模型可能需要理解代码仓库、定位问题、修改多个文件、调用终端运行测试,再根据报错持续调整方案。

这要求模型不仅能够生成代码,还要具备任务理解、工具调用、环境反馈分析和长流程执行能力。

据 DeepSeek官方测试,DeepSeek-V4-Flash-0731版在多项Agent和Coding Agent基准中均取得明显提升:

  • Terminal Bench2.1:82.7;

  • Toolathlon Verified:70.3;

  • DSBench-FullStack:68.7;

  • DSBench-Hard:59.6;

  • DeepSWE:54.4;

  • NL2Repo:54.2。

02

支持Responses API,针对Codex完成适配

本次更新的另一个重要变化,是DeepSeek-V4-Flash-0731版原生支持Responses API,并针对Codex完成适配。

完成模型提供方配置后,开发者可以在Codex CLI、ChatGPT桌面端以及VS Code中的Codex扩展中调用DeepSeek-V4-Flash-0731版。多个Codex客户端共享同一套配置,无需分别接入。

在 Codex工作流中,模型可以参与:

  • 读取和理解项目代码;

  • 制定任务实施步骤;

  • 跨文件修改代码;

  • 调用终端执行命令;

  • 运行测试并分析报错;

  • 根据执行结果继续修复。

03

百万上下文,为复杂任务提供更大空间

DeepSeek-V4-Flash-0731版支持1M Token上下文,最大输出长度为384K Token,同时支持思考与非思考模式、Tool Calls、JSON Output和Responses API。

对于代码Agent而言,长上下文不仅意味着能够读取更多代码,也意味着模型可以在同一次任务中容纳需求文档、项目文件、运行日志、工具返回结果以及历史操作记录。

这为代码仓库级开发、企业知识库Agent、数据分析和业务自动化等复杂场景提供了更大的任务空间。

04

七牛云MaaS,让新模型更快进入业务

模型更新速度越来越快。不同模型拥有不同的接口、价格、上下文长度和能力边界。

七牛云MaaS平台通过统一的模型服务入口,为企业和开发者提供主流模型调用服务,降低模型接入与持续迭代的工程成本。

企业无需自行部署和维护底层模型,也不必在每次模型升级时重新搭建一套服务体系,可以根据不同场景选择合适的模型,并对模型调用和Token用量进行统一管理。

大模型正走向真实工作场景,当模型能够理解项目、调用工具、操作系统并根据结果持续修正行动,Agent才真正开始成为可以参与业务执行的生产力。

DeepSeek-V4-Flash-0731版现已上线七牛云MaaS平台。

免责声明:风险提示:本文内容仅供参考,不代表同花顺观点。同花顺各类信息服务基于人工智能算法,如有出入请以证监会指定上市公司信息披露平台为准。如有投资者据此操作,风险自担,同花顺对此不承担任何责任。
homeBack返回首页
不良信息举报与个人信息保护咨询专线:10100571违法和不良信息涉企侵权举报涉算法推荐举报专区涉青少年不良信息举报专区

浙江同花顺互联信息技术有限公司版权所有

网站备案号:浙ICP备18032105号
证券投资咨询服务提供:浙江同花顺云软件有限公司 (中国证监会核发证书编号:ZX0050)
AIME