多模态视觉理解模型DeepSeek V4-Flash-Vision-Exp上线

2026-08-21 17:46:22
来源:凤凰网
分享
文章提及标的

凤凰网科技讯 8月21日,DeepSeek官方发文宣布,全新的多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp 上线 DeepSeek API 平台,并将其称为“一个实验性质的模型”。

官方表示,V4-Flash-Vision-Exp在纯文本能力方面,已与DeepSeek-V4-Flash正式版持平;在需要视觉理解的Agent Benchmark(BHE)上,多模态Agent能力已接近 Opus-4.8。

该模型在各类 Agent 框架内展现出了较好的多模态适配能力,能够有效支持大家借助多样化的 Agent 工具解锁更多实用的工作场景。

据官方介绍,用户可以通过设置 model="deepseek-v4-flash-vision-exp" 来访问 V4-Flash-Vision-Exp 模型的 API。在 API 服务中,图片会转换成 token 后按 token 计费,一张图片最多占 384 tokens,计费价格与 V4-Flash 模型一致。

多模态 API 支持 Chat Completions、Messages、Responses 三种格式调用,可以方便接入各类 Agent 工具中使用,支持图文混合输入,支持 base64 内联、外部 URL、Files API 三种图片传入方式。使用说明请参考官方 API 文档:API 指南 - 图像理解。

免责声明:风险提示:本文内容仅供参考,不代表同花顺观点。同花顺各类信息服务基于人工智能算法,如有出入请以证监会指定上市公司信息披露平台为准。如有投资者据此操作,风险自担,同花顺对此不承担任何责任。
homeBack返回首页
不良信息举报与个人信息保护咨询专线:10100571违法和不良信息涉企侵权举报涉算法推荐举报专区涉青少年不良信息举报专区

浙江同花顺互联信息技术有限公司版权所有

网站备案号:浙ICP备18032105号
证券投资咨询服务提供:浙江同花顺云软件有限公司 (中国证监会核发证书编号:ZX0050)
AIME